会说话的机器人存在吗?为什么有人说话像机器人
人机对话总共分四步。第一步是语种识别,机器人先判断你说的是什么语言,包括方言也能识别。第二步是语音识别,把口语转换成文字,这需要强大的语音知识库来支撑。第三步是最有难度的语义识别,机器人要把文字拆分成不同分词,综合理解含义后从知识库中找出最优回答。第四步是语音合成,把文字答案转化成声音让你听到。
人机对话总共分四步。第一步是语种识别,机器人先判断你说的是什么语言,包括方言也能识别。第二步是语音识别,把口语转换成文字,这需要强大的语音知识库来支撑。第三步是最有难度的语义识别,机器人要把文字拆分成不同分词,综合理解含义后从知识库中找出最优回答。第四步是语音合成,把文字答案转化成声音让你听到。
其实第四步的语音合成现在进步飞快,很多AI声音都听不出是人类还是机器了,甚至能模仿语气和情感,这点比前三步的突破更让普通人有感。不过楼主总结得很清晰,特别是“方言识别”和“语义拆分”这两点,确实是技术难点所在。