Lisen en Product Hunt: la herramienta TTS con voces Cartesia gratuita que necesitas
Introducción
¿Quieres transformar texto en audio profesional sin gastar ni un euro? Lisen lo hace posible: con voces Cartesia de alta calidad y una API totalmente abierta, puedes crear podcasts, audiolibros o narraciones para videos en cuestión de segundos. Desde que apareció en Product Hunt, la búsqueda de “text to speech free” y “Cartesia voices” se disparó, y Lisen se ha convertido en la solución preferida por creadores, educadores y desarrolladores que buscan cumplir la normativa WCAG 2.2 sin romper su presupuesto.
En este artículo tienes una guía práctica (más de 2 800 palabras) que cubre:
- Qué es la tecnología Cartesia y por qué destaca.
- Paso a paso para crear tu cuenta y generar audio con Lisen.
- Comparativa rápida con Coqui, ElevenLabs free y Google Cloud TTS.
- Script Python listo para convertir lotes de archivos Markdown a MP3.
- Casos de uso reales (podcasts, audiolibros, videos).
- Tabla de precios y límites.
- Checklist de cumplimiento WCAG 2.2 y SEO de audio.
- FAQ con enlaces a comunidades activas.
1. Registro y primeros pasos
- Accede a https://lisen.ai y pulsa “Sign up – Free”.
- Verifica tu correo y, en el panel, encontrarás la clave API (
LSN_API_KEY). - Selecciona la voz Cartesia que prefieras (ej.:
en_us_male_1). Cada voz tiene variantes de tono y velocidad que puedes ajustar con parámetros simples.
1.1. Generar audio desde la consola
curl -X POST "https://api.lisen.ai/v1/tts" \
-H "Authorization: Bearer $LSN_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"text": "Bienvenido a Lisen, la solución TTS gratuita con voces Cartesia.",
"voice": "en_us_male_1",
"speed": 1.0,
"pitch": 0
}' \
-o welcome.mp3
El archivo welcome.mp3 aparecerá en el directorio actual listo para usar.
2. Integración con tu stack
2.1. SDK para Python (instalación)
pip install lisen-sdk
2.2. Código Python para generar un MP3 y guardarlo en S3
import os
import boto3
from lisen_sdk import LisenClient
# Configuración
API_KEY = os.getenv("LSN_API_KEY")
client = LisenClient(api_key=API_KEY)
def tts_to_s3(text, voice="en_us_female_2", bucket="mi-audio-bucket", key="audio.mp3"):
# Generar audio
audio_bytes = client.synthesize(
text=text,
voice=voice,
speed=1.0,
pitch=0
)
# Subir a S3
s3 = boto3.client("s3")
s3.put_object(Bucket=bucket, Key=key, Body=audio_bytes, ContentType="audio/mpeg")
print(f"✅ {key} subido a s3://{bucket}/{key}")
# Ejemplo de uso
tts_to_s3("Este es un ejemplo de integración de Lisen con Amazon S3.")
2.3. Webhook para WordPress
- Crea un Webhook en Lisen que apunte a
https://tu-sitio.com/wp-json/lisen/v1/receive. - En WordPress, registra un endpoint mediante el siguiente fragmento en
functions.php:
add_action( 'rest_api_init', function () {
register_rest_route( 'lisen/v1', '/receive', [
'methods' => 'POST',
'callback' => 'lisen_receive_audio',
'permission_callback' => '__return_true',
] );
});
function lisen_receive_audio( WP_REST_Request $request ) {
$data = $request->get_json_params();
$audio = base64_decode( $data['audio_base64'] );
$filename = wp_unique_filename( wp_upload_dir()['path'], $data['filename'] );
$path = wp_upload_dir()['path'] . '/' . $filename;
file_put_contents( $path, $audio );
return new WP_REST_Response( [ 'status' => 'ok', 'file' => $filename ], 200 );
}
Cada vez que Lisen genere un archivo, se enviará automáticamente a tu biblioteca de medios.
3. Comparativa rápida
| Característica | Lisen (gratuito) | Coqui TTS | ElevenLabs free | Google Cloud TTS |
|---|---|---|---|---|
| Voces Cartesia | ✅ Todas | ❌ | ✅ (limitadas) | ✅ (Google) |
| Límite diario gratuito | 5 000 caracteres | 2 000 c | 10 min audio | $0.004 / 1 000 c |
| API REST + SDK | ✅ | ✅ | ✅ (Node) | ✅ |
| Webhooks | ✅ | ❌ | ✅ (beta) | ❌ |
| Cumple WCAG 2.2 | ✅ (texto‑a‑audio) | ✅ | ✅ (pero pago) | ✅ |
| Precio plan pago | $9,99/mes | $0 (open‑source) | $19/mes | $4/mes (100 k chars) |
Conclusión: Si necesitas voces Cartesia sin coste y una integración sencilla, Lisen lidera la tabla. Coqui es útil para proyectos 100 % open‑source, pero carece de la calidad de Cartesia. ElevenLabs ofrece voces hiperrealistas, pero su plan gratuito es limitado en tiempo.
4. Script para convertir lotes de Markdown a MP3
import os
import glob
from lisen_sdk import LisenClient
API_KEY = os.getenv("LSN_API_KEY")
client = LisenClient(api_key=API_KEY)
def md_to_mp3(md_path, voice="en_us_male_1"):
with open(md_path, "r", encoding="utf-8") as f:
text = f.read()
# Opcional: eliminar encabezados Markdown
clean_text = "\n".join([l for l in text.splitlines() if not l.startswith("#")])
audio = client.synthesize(text=clean_text, voice=voice)
mp3_path = md_path.replace(".md", ".mp3")
with open(mp3_path, "wb") as out:
out.write(audio)
print(f"✅ {md_path} → {mp3_path}")
if __name__ == "__main__":
for md_file in glob.glob("content/**/*.md", recursive=True):
md_to_mp3(md_file)
Ejecuta python batch_md2mp3.py y tendrás todos tus artículos listos para podcast en minutos.
5. Casos de uso reales
| Caso | Cómo se usa Lisen | Beneficio principal |
|---|---|---|
| Podcast educativo | Generar intros y episodios a partir de guiones en Google Docs. | Reducción del 80 % del tiempo de producción. |
| Audiolibro independiente | Convertir capítulos en Markdown a MP3 y subir a Spotify via Anchor. | Accesibilidad WCAG 2.2 garantizada. |
| Videos de YouTube | Crear narraciones para tutoriales técnicos y sincronizarlas con subtítulos automáticos. | Mejora del SEO mediante transcripciones y audio. |
| Plataforma LMS | Integrar la API en Moodle para ofrecer versiones audio de cada lección. | Incremento del 30 % en la retención de estudiantes. |
6. Tabla de precios y límites
| Plan | Precio mensual | Características incluidas |
|---|---|---|
| Free | $0 | 5 000 caracteres/día, todas las voces Cartesia, webhooks, SDKs. |
| Starter | $9,99 | 50 000 caracteres/día, prioridad en colas, soporte por email. |
| Pro | $29,99 | 250 000 caracteres/día, acceso a modelos de voz personalizados, SLA 99,9 %. |
| Enterprise | A medida | Límite ilimitado, integración dedicada, auditoría de cumplimiento WCAG. |
Los límites se reinician a medianoche UTC. Cuando se alcanza el tope, la API responde 429 Too Many Requests.
7. Checklist de cumplimiento WCAG 2.2 y SEO de audio
- **1.2.5 (Audio‑only
Herramienta mencionada: DigitalOcean
Top comments (0)