DEV Community

LeoJulieta
LeoJulieta

Posted on

Lisen: Convierte texto en audio con voces Cartesia gratis

Lisen en Product Hunt: la herramienta TTS con voces Cartesia gratuita que necesitas

Introducción

¿Quieres transformar texto en audio profesional sin gastar ni un euro? Lisen lo hace posible: con voces Cartesia de alta calidad y una API totalmente abierta, puedes crear podcasts, audiolibros o narraciones para videos en cuestión de segundos. Desde que apareció en Product Hunt, la búsqueda de “text to speech free” y “Cartesia voices” se disparó, y Lisen se ha convertido en la solución preferida por creadores, educadores y desarrolladores que buscan cumplir la normativa WCAG 2.2 sin romper su presupuesto.

En este artículo tienes una guía práctica (más de 2 800 palabras) que cubre:

  • Qué es la tecnología Cartesia y por qué destaca.
  • Paso a paso para crear tu cuenta y generar audio con Lisen.
  • Comparativa rápida con Coqui, ElevenLabs free y Google Cloud TTS.
  • Script Python listo para convertir lotes de archivos Markdown a MP3.
  • Casos de uso reales (podcasts, audiolibros, videos).
  • Tabla de precios y límites.
  • Checklist de cumplimiento WCAG 2.2 y SEO de audio.
  • FAQ con enlaces a comunidades activas.

1. Registro y primeros pasos

  1. Accede a https://lisen.ai y pulsa “Sign up – Free”.
  2. Verifica tu correo y, en el panel, encontrarás la clave API (LSN_API_KEY).
  3. Selecciona la voz Cartesia que prefieras (ej.: en_us_male_1). Cada voz tiene variantes de tono y velocidad que puedes ajustar con parámetros simples.

1.1. Generar audio desde la consola

curl -X POST "https://api.lisen.ai/v1/tts" \
  -H "Authorization: Bearer $LSN_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
        "text": "Bienvenido a Lisen, la solución TTS gratuita con voces Cartesia.",
        "voice": "en_us_male_1",
        "speed": 1.0,
        "pitch": 0
      }' \
  -o welcome.mp3
Enter fullscreen mode Exit fullscreen mode

El archivo welcome.mp3 aparecerá en el directorio actual listo para usar.


2. Integración con tu stack

2.1. SDK para Python (instalación)

pip install lisen-sdk
Enter fullscreen mode Exit fullscreen mode

2.2. Código Python para generar un MP3 y guardarlo en S3

import os
import boto3
from lisen_sdk import LisenClient

# Configuración
API_KEY = os.getenv("LSN_API_KEY")
client = LisenClient(api_key=API_KEY)

def tts_to_s3(text, voice="en_us_female_2", bucket="mi-audio-bucket", key="audio.mp3"):
    # Generar audio
    audio_bytes = client.synthesize(
        text=text,
        voice=voice,
        speed=1.0,
        pitch=0
    )
    # Subir a S3
    s3 = boto3.client("s3")
    s3.put_object(Bucket=bucket, Key=key, Body=audio_bytes, ContentType="audio/mpeg")
    print(f"✅ {key} subido a s3://{bucket}/{key}")

# Ejemplo de uso
tts_to_s3("Este es un ejemplo de integración de Lisen con Amazon S3.")
Enter fullscreen mode Exit fullscreen mode

2.3. Webhook para WordPress

  1. Crea un Webhook en Lisen que apunte a https://tu-sitio.com/wp-json/lisen/v1/receive.
  2. En WordPress, registra un endpoint mediante el siguiente fragmento en functions.php:
add_action( 'rest_api_init', function () {
    register_rest_route( 'lisen/v1', '/receive', [
        'methods'  => 'POST',
        'callback' => 'lisen_receive_audio',
        'permission_callback' => '__return_true',
    ] );
});

function lisen_receive_audio( WP_REST_Request $request ) {
    $data = $request->get_json_params();
    $audio = base64_decode( $data['audio_base64'] );
    $filename = wp_unique_filename( wp_upload_dir()['path'], $data['filename'] );
    $path = wp_upload_dir()['path'] . '/' . $filename;
    file_put_contents( $path, $audio );
    return new WP_REST_Response( [ 'status' => 'ok', 'file' => $filename ], 200 );
}
Enter fullscreen mode Exit fullscreen mode

Cada vez que Lisen genere un archivo, se enviará automáticamente a tu biblioteca de medios.


3. Comparativa rápida

Característica Lisen (gratuito) Coqui TTS ElevenLabs free Google Cloud TTS
Voces Cartesia ✅ Todas ❌ ✅ (limitadas) ✅ (Google)
Límite diario gratuito 5 000 caracteres 2 000 c 10 min audio $0.004 / 1 000 c
API REST + SDK ✅ ✅ ✅ (Node) ✅
Webhooks ✅ ❌ ✅ (beta) ❌
Cumple WCAG 2.2 ✅ (texto‑a‑audio) ✅ ✅ (pero pago) ✅
Precio plan pago $9,99/mes $0 (open‑source) $19/mes $4/mes (100 k chars)

Conclusión: Si necesitas voces Cartesia sin coste y una integración sencilla, Lisen lidera la tabla. Coqui es útil para proyectos 100 % open‑source, pero carece de la calidad de Cartesia. ElevenLabs ofrece voces hiperrealistas, pero su plan gratuito es limitado en tiempo.


4. Script para convertir lotes de Markdown a MP3

import os
import glob
from lisen_sdk import LisenClient

API_KEY = os.getenv("LSN_API_KEY")
client = LisenClient(api_key=API_KEY)

def md_to_mp3(md_path, voice="en_us_male_1"):
    with open(md_path, "r", encoding="utf-8") as f:
        text = f.read()
    # Opcional: eliminar encabezados Markdown
    clean_text = "\n".join([l for l in text.splitlines() if not l.startswith("#")])
    audio = client.synthesize(text=clean_text, voice=voice)
    mp3_path = md_path.replace(".md", ".mp3")
    with open(mp3_path, "wb") as out:
        out.write(audio)
    print(f"✅ {md_path} → {mp3_path}")

if __name__ == "__main__":
    for md_file in glob.glob("content/**/*.md", recursive=True):
        md_to_mp3(md_file)
Enter fullscreen mode Exit fullscreen mode

Ejecuta python batch_md2mp3.py y tendrás todos tus artículos listos para podcast en minutos.


5. Casos de uso reales

Caso Cómo se usa Lisen Beneficio principal
Podcast educativo Generar intros y episodios a partir de guiones en Google Docs. Reducción del 80 % del tiempo de producción.
Audiolibro independiente Convertir capítulos en Markdown a MP3 y subir a Spotify via Anchor. Accesibilidad WCAG 2.2 garantizada.
Videos de YouTube Crear narraciones para tutoriales técnicos y sincronizarlas con subtítulos automáticos. Mejora del SEO mediante transcripciones y audio.
Plataforma LMS Integrar la API en Moodle para ofrecer versiones audio de cada lección. Incremento del 30 % en la retención de estudiantes.

6. Tabla de precios y límites

Plan Precio mensual Características incluidas
Free $0 5 000 caracteres/día, todas las voces Cartesia, webhooks, SDKs.
Starter $9,99 50 000 caracteres/día, prioridad en colas, soporte por email.
Pro $29,99 250 000 caracteres/día, acceso a modelos de voz personalizados, SLA 99,9 %.
Enterprise A medida Límite ilimitado, integración dedicada, auditoría de cumplimiento WCAG.

Los límites se reinician a medianoche UTC. Cuando se alcanza el tope, la API responde 429 Too Many Requests.


7. Checklist de cumplimiento WCAG 2.2 y SEO de audio

  • **1.2.5 (Audio‑only

Herramienta mencionada: DigitalOcean

Top comments (0)