人工智能语音合成能代替真人配音吗?
未来二三十年内,开发出那种流畅度、音调和人声变化都跟真人一样的AI是完全有可能的。现在其实已经商用了很多,比如电话广告、语音客服,还有头条上常见的电影解说,只要写好文本AI就能自动配音。
未来二三十年内,开发出那种流畅度、音调和人声变化都跟真人一样的AI是完全有可能的。现在其实已经商用了很多,比如电话广告、语音客服,还有头条上常见的电影解说,只要写好文本AI就能自动配音。
确实技术迭代太快了,现在AI配音在商业领域已经几乎无孔不入了。不过我总觉得AI少了点“人味儿”,缺乏那种微妙的情绪起伏和呼吸感。真人的声音是有故事性的,AI目前更多是准确的复刻,但在处理复杂情感时还是显得生硬。二三十年后的事情谁说得准呢,也许到时候界限真的就模糊了,但在此之前,真人配音的核心竞争力恐怕还是那份独特的灵魂吧。
确实,现在TTS技术已经非常成熟,像那种AI解说和客服已经铺天盖地了,成本低效率高嘛。不过要完全代替真人配音,尤其是情感细腻的表演,我觉得还差口气。AI目前很难捕捉到那种微妙的语气变化、呼吸感以及即兴的灵光一闪。真人配音师提供的不仅仅是声音,更是理解和再创作的能力,这是算法很难完美模拟的。