ElevenLabs 发布 Dubbing V2,采用端到端 AI 配音模型,直接基于原始表演建模声音,实现音色、情绪和演绎在 90 多种语言中的跨语言保留。
📝 详细摘要
ElevenLabs 发布了 Dubbing V2,这是一款端到端的 AI 配音模型。其核心突破在于,配音不再是传统的「先转写、再翻译、最后合成」三段式拼接,而是模型直接基于原始表演建模声音,将音色、情绪和演绎「穿越」进每一种目标语言。这意味着同一个人开口讲六国语言,听上去还是他本人,连情绪和呼吸节奏都能对上。该模型支持 90 多种语言和口音,支持音频、视频和文字三种输入,具备音色穿越、情绪保真、同步感知翻译、措辞本地化和端到端全自动等能力。推文通过三个视频场景展示了其效果:MrBeast 风格的荒岛求生、财务部门快节奏对白和童话故事。
📊 文章信息
AI 初评:82
来源:小互(@imxiaohu)
作者:小互
分类:人工智能
语言:中文
阅读时间:3 分钟
字数:551
标签: ElevenLabs, Dubbing V2, AI 配音, 端到端模型, 跨语言