Un nuevo estándar en texto a voz
Inworld ha presentado su nuevo modelo TTS-1.5, diseñado para ofrecer voz generada por inteligencia artificial en tiempo real con una calidad y velocidad sin precedentes. Esta nueva generación supera ampliamente a su predecesora, TTS-1, al reducir la latencia y mejorar tanto la expresividad como la precisión.
TTS-1.5 llega en dos versiones: Max, pensada para la mayoría de las aplicaciones, y Mini, optimizada para escenarios extremadamente sensibles a la latencia. En pruebas, TTS-1.5-Max ha logrado una latencia P90 inferior a 250 milisegundos, mientras que TTS-1.5-Mini la reduce aún más, a menos de 130 milisegundos. Esto supone una mejora de 4 veces respecto a la generación anterior.
Precisión, expresividad y estabilidad
Los avances de TTS-1.5 no se quedan en la velocidad. El modelo ofrece un 30% más de expresividad en comparación con TTS-1, generando voces más naturales, con matices emocionales y que se acercan al habla humana. Además, ha logrado una reducción del 40% en la tasa de error de palabras, minimizando errores, cortes y artefactos durante la reproducción de audio.
Accesibilidad y precio competitivo
A pesar de estas mejoras, TTS-1.5 mantiene el compromiso de Inworld con el acceso asequible a la tecnología de voz. La versión Mini cuesta apenas medio céntimo por minuto, mientras que la Max se sitúa en un céntimo por minuto, siendo 25 veces más barata que otras alternativas del mercado.
Multilingüe, personalizable y lista para empresas
El modelo incorpora soporte para 15 idiomas —incluyendo ahora el hindi—, una biblioteca de voces ampliada y mejoras en voice cloning. Además, ofrece opciones de implementación local, lo que permite a las empresas desplegar el sistema en sus propios servidores.
Aplicaciones en expansión
Estas características permiten aplicar TTS-1.5 en una amplia variedad de contextos: desde agentes conversacionales y traducción simultánea, hasta experiencias inmersivas en videojuegos, educación o accesibilidad. Plataformas como Bible Chat, Particle, Luvu, Talkpal y Astrobeam ya están utilizando el modelo para desarrollar aplicaciones que responden con fluidez y realismo en tiempo real.
Disponible ya para desarrolladores
TTS-1.5 está disponible para su prueba en el TTS Playground, donde los usuarios pueden escuchar el modelo con su propio texto o clonarlo con una muestra de voz. Además, Inworld ofrece documentación técnica, SDKs, guías de integración y acceso a través de socios como Layercode, LiveKit, NLX, Pipecat, Stream Vision Agents, Ultravox, Vapi y Voximplant.
Una nueva etapa para la voz sintética
Con TTS-1.5, Inworld consolida su liderazgo en el sector de la voz generada por IA. Al combinar latencia ultrabaja, calidad superior y precios competitivos, la compañía abre la puerta a una nueva generación de experiencias interactivas donde la tecnología no solo responde con rapidez, sino también con emoción y naturalidad.
La fotografía de portada de esta noticia pertenece a Pawel Czerwinski y ha sido publicada en Unsplash

