La familia de modelos MARS8 de CAMB.AI ofrece síntesis de voz natural y expresiva en más de 150 idiomas, con modelos especializados para la conversación en tiempo real, la producción de contenido y el despliegue en dispositivo.
Con la tecnología de MARS8 — diseñado para un tono natural, emoción y uso profesional.

CAMB.AI convierte texto escrito en voz natural y humana en más de 150 idiomas, cubriendo el 99% de la población hablante del mundo. MARS8 es la primera familia de modelos de TTS de nivel de producción con modelos diseñados a medida para casos de uso distintos, cada uno optimizado para un equilibrio específico entre latencia, fidelidad y requisitos de despliegue. MARS-Pro alcanza una similitud de locutor WavLM de 0.87 y una similitud CMV de 0.71, una mejora del 38% respecto al competidor más cercano, según el benchmark MAMBA.




Los idiomas de nivel premium (inglés, hindi, francés, español, alemán, japonés, árabe, coreano, chino, italiano, portugués, indonesio, neerlandés) se entrenan con más de 10,000 horas de datos.

Equipos de ingeniería que crean aplicaciones habilitadas por voz, interfaces conversacionales y experiencias de usuario multilingües.

Empresas de hardware que integran la voz en smartphones, sistemas de automoción, auriculares, dispositivos de hogar inteligente y wearables.

Grandes empresas que necesitan voz multilingüe para contenido de formación, sistemas IVR y flujos de soporte de cara al cliente.
Añade salida de voz a hardware con recursos limitados usando el modelo de 50M de parámetros de MARS-Nano.





MARS-Flash para tiempo real (TTFB de 600ms), MARS-Pro para contenido de nivel de producción, MARS-Instruct para salida con control de emociones o MARS-Nano para uso en dispositivo (TTFB de 60ms, 60M de parámetros).
Conéctate a la API de TTS de CAMB.AI, envía el texto, selecciona un idioma de destino (más de 150 disponibles) y, opcionalmente, proporciona una muestra de voz de referencia para la clonación.
Elige de la biblioteca de voces o clona una voz personalizada a partir de una breve muestra de referencia. Usa diccionarios para controlar la pronunciación y la entrega según el acento.
Despliega mediante la API en la nube para aplicaciones web y de servidor, o empaqueta MARS-Nano para la integración en dispositivo. Escala a varios idiomas sin volver a grabar.