
一起动脑筋 · 先看一个小故事
女孩说“打开故事”,机器人先接收到声音信号,而不是直接收到汉字。
把过程摊开来看
- 采集声音变数字
- 识别估计说了哪些词
- 理解任务判断请求
- 执行或回答给出结果
语音系统把声音转成可计算的数据,再用模型识别或处理语言。
“听见声音”“认出文字”“理解要做什么”是不同环节。安静时识别正常,嘈杂环境或同音词却可能让结果变化。
有些系统把这些环节结合起来,但仍不能把输出当成直接读懂人的心思。
轮到你来试一试
把“十五”识别成“五十”,后面的计算可能有什么影响?
想好了吗?点开看解释
输入数字变了,即使后续加减完全正确,最终也回答了错误的问题。先核对识别文字。
带走一个发现
语音系统把声音转成可计算的数据,再用模型识别或处理语言。
试着遮住上面的图,把每一步讲给家人听。如果某一步说不清楚,就回到那张卡片再看一遍。