SSML (Speech Synthesis Markup Language) es la capa de control del texto a voz. El texto plano dice al motor TTS qué decir; SSML le dice cómo: dónde pausar, qué enfatizar, a qué velocidad hablar y cómo pronunciar las palabras que de otro modo pronunciaría mal.
Para la locución corporativa y de producto, las funciones críticas son la pronunciación y la interpretación. Una etiqueta
Sin SSML, las voces de IA se delatan exactamente ahí: referencias leídas como galimatías, unidades destrozadas, énfasis en la palabra equivocada. Con él —más un léxico de pronunciación personalizado— la narración de IA supera la revisión de hablantes nativos.
SSML es parte central del flujo de doblaje con IA de MediaLocalize: cada guion recibe marcado SSML ajustado por idioma y cada proyecto construye un léxico con tus marcas, referencias y terminología, verificado por nativos antes de la entrega.