SSML(语音合成标记语言)是文字转语音的控制层。纯文本告诉 TTS 引擎说什么,SSML 告诉它怎么说——在哪里停顿、强调什么、语速多快,以及引擎本来会读错的词怎么发音。
对企业和产品配音,最关键的功能是发音和读法控制。
没有 SSML,AI 配音恰恰在这些地方露馅:型号读成一团乱、单位读错、重音落在错误的词上。有了它——加上定制发音词典——AI 旁白能通过母语者审听。
SSML 是 MediaLocalize AI 配音流程的核心环节:每个脚本按语言做 SSML 标注,每个项目建立覆盖品牌名、型号和术语的发音词典,交付前由母语者核验。