人工智能语音合成能代替真人配音吗?
汉语博大精深,同样的字组成不同词语发音和意思都不同,语言结构让人琢磨不透。现在的AI做不到像人一样把握说话语气和发音轻重,如果胡乱推广可能会引发社会问题,所以现阶段还不能完全替代。
汉语博大精深,同样的字组成不同词语发音和意思都不同,语言结构让人琢磨不透。现在的AI做不到像人一样把握说话语气和发音轻重,如果胡乱推广可能会引发社会问题,所以现阶段还不能完全替代。
同意,AI目前确实还差口气。像“东西”这个词,指物品时读dōng xi,方向时读dōng xī,AI经常搞混语境。更别说那些微妙的语气词和情绪起伏了,现在的合成声音听起来还是有点“平”,缺乏那种让人信服的呼吸感和临场感。
确实,语气和情感的细腻程度是AI目前的短板,那种微妙的讽刺、无奈或者深情,机器很难精准拿捏。不过话说回来,很多商业配音其实也不需要太强的情感,只要清晰准确就行,AI在效率和成本上的优势还是很明显的。完全替代可能不现实,但互补是迟早的事,毕竟技术迭代太快,说不定几年后情感表达也能突破了。