請語音助理Siri或Google Now回訊息、查資料,在安靜家裡不易失敗,但在路旁、電音派對上,這些虛擬助理卻很可能聽不清楚你的指令。除非,你的手機能做到只讀你的唇。 一般語音辨識技術仰賴收音麥克風,其降噪功能仍無法完全區別目標人聲與其他聲源,達不到預期的聲控效果。以色列公司VocalZoom研發一種低功耗的雷射光束,透過感應器打在說話者臉上,可蒐集嘴唇、兩頰、喉嚨發出的振動頻率,結合收音麥克風、消除無用噪音,精準判斷你在說什麼。 根據VocalZoom與中國上市公司科大訊飛合作測試,VocalZoom感應器裝入科大訊飛的耳機麥克風後,自動語音辨識效能提升達五○%,尤其在大開車窗的疾駛車輛中改善效果更好。 《經濟學人》指出,VocalZoom技術未來有望整合在車聯網。或許有一天,美國科幻影集《霹靂遊俠》場景將成現實。
1.精準區隔聲源: 感應器能蒐集說話者臉部皮膚波動,由軟體解讀後轉為清晰獨立人聲,車站、演唱會都OK。 2.提高辨識能力: 搭配收音麥克風,有效改善如語音助理Siri等聲控系統的語音辨識能力。 3.應用範圍多元: 未來可用於車聯網、行動安全支付、智慧家居、穿戴裝置等,任何需要語音識別的設備。