科学家研发人工智能声呐眼镜：可识别唇语，准-圆圆集团

首页 > 国家政策 >

日期：2023-04-13 08:30:59 作者：admin 来源：未知

　　4月10日消息，美国康奈尔大学的研究人员开发了一种新技能，能够经过声呐眼镜进行无声沟通。这种眼镜利用微型扬声器和麦克风来读取佩带者默念的单词，然后能够在不需要物理输入的情况下执行各种任务。

　　这项技能由康奈尔大学的博士生张瑞东（音译）领导开发，是在一个类似的项目的基础上进行的改进，该项目运用了一个无线耳机，而之前的模型则依赖于摄像头。

　　该声呐眼镜运用一种名为EchoSpeech的无声语音辨认接口，利用声呐来感知嘴部运动，同时运用一个深度学习算法实时剖析回波特征。这使得体系能够以约95%的准确率辨认佩带者默念的单词。

　　这项技能最令人兴奋的远景之一是，对于有语言障碍的人来说，能够运用它来无声地将对话输入到语音合成器中，然后将单词大声说出来。眼镜也能够用来在安静的图书馆中控制音乐播放，或者在嘈杂的音乐会上口述信息。

　　该技能既细巧又低功耗，也不会侵犯隐私，因为没有数据脱离用户的手机。这样，就不会有隐私方面的忧虑。眼镜佩带非常方便，比其他可用的无声语音辨认技能更有用、更可行。

　　研究人员表示，该体系只需要几分钟的练习数据来学习用户的语音模式，学习完成后，就能够朝用户的脸上发送和接纳声波，感知嘴部运动，同时运用深度学习算法剖析回波特征。该体系现在能够辨认31个孤立的指令和一串连续的数字，而且错误率低于10%。

　　该体系现在的版别提供了大约10小时的电池续航，而且能够经过蓝牙无线地与用户的智能手机通信。智能手机负责处理和预测所有数据，并将成果传输到一些“动作键”，让它能够播放音乐、与智能设备交互或激活语音助手。

　　康奈尔大学智能计算机接口未来交互（SciFi）实验室正在利用康奈尔大学的一个资助计划来探索将这项技能商业化的可能性。

首页