- Generar audio de calidad a partir de texto, en local y en varios idiomas.
- Producir archivos MP3 descargables.
- Elegir la voz y el idioma adecuados.
Conceptos clave
Esto es TTS (texto a voz) puro, sin micrófono ni modelo de lenguaje: solo texto que entra y audio que sale.
Qué herramientas usar (2026)
- Kokoro — ligera, rápida en CPU, buena calidad, multi-idioma. Gran punto de partida.
- MagpieTTS — voces de calidad de producción en 9 idiomas (incluye español); mejor con GPU.
- F5-TTS — si quieres clonar una voz concreta a partir de una muestra.
Paso a paso
cd ~/proyectos-ia mkdir texto-a-audio cd texto-a-audio claude
Ejecutar en tu ordenador
npm install npm run dev
Pega un párrafo, elige idioma y voz, y genera el audio.
texto-a-audio. Cerrar: Ctrl + C. Reabrir: cd ~/proyectos-ia/texto-a-audio y npm run dev. Los MP3 que generes se guardan donde tú los descargues; no dependen de que la app esté abierta.Si algo falla
- Voz en idioma equivocado — selecciona la voz correcta para ese idioma; no todas hablan todos los idiomas.
- Se corta en textos largos — confirma que la app trocea y une; si no, pídeselo a Claude Code.
- Suena metálica — prueba MagpieTTS para más calidad (mejor con GPU).
Reto para practicar
Añade un “modo pódcast”: que dos voces distintas lean un diálogo alternándose. Ideal para material educativo más ameno.
Si has guardado la evidencia de esta lección, continúa con «Simulaciones 3D». Si no, repite la comprobación antes de avanzar.