Casos de uso

Dónde encaja el texto a voz en un producto

El texto a voz rara vez es el producto: casi siempre es el último tramo de otro sistema que ya genera texto. Estas páginas describen los escenarios donde MatuVoice se usa, qué cambia en cada uno y qué hay que tener en cuenta al integrarlo.

Escenarios principales

Agentes de IA

El modelo ya redacta la respuesta. Falta pronunciarla con latencia baja y sin que el usuario tenga que leer.

IVR y contact center

Sustituir audios pregrabados por prompts generados con datos reales del cliente en el momento de la llamada.

Aplicaciones

Lectura en voz alta, accesibilidad y notificaciones habladas dentro de una app web o móvil.

Contenido, video y formación

Hay un cuarto escenario que no necesita integración: generar locuciones para video, cursos o pódcast. Aquí el flujo es manual —escribes el guion en el estudio, eliges el personaje y descargas el MP3— y lo que importa es que la voz aguante textos largos sin cansar y que el acento encaje con la audiencia.

Para este uso conviene revisar primero el catálogo de voces y comparar dos o tres variantes con el mismo párrafo antes de grabar el proyecto completo.

Qué tienen en común

En los cuatro casos el patrón técnico es el mismo: el texto se genera en algún sistema, viaja a POST /v1/speech junto al identificador de una voz, y vuelve un MP3 que se reproduce donde haga falta. Lo que cambia es la latencia aceptable, la longitud del texto y quién escucha el resultado.

Ver el contrato de la API