康奈尔大学研究团队开发无声沟通技术,利用声纳眼镜执行任务
【本站】4月10日消息,美国康奈尔大学的研究人员开发了一种新技术,可以通过声纳眼镜进行无声沟通。这种眼镜利用微型扬声器和麦克风来读取佩戴者默念的单词,从而可以在不需要物理输入的情况下执行各种任务。
该声纳眼镜使用一种名为 EchoSpeech 的无声语音识别接口,利用声纳来感知嘴部运动,同时使用一个深度学习算法实时分析回波特征。这使得系统能够以约 95% 的准确率识别佩戴者默念的单词。该系统目前能够识别 31 个孤立的命令和一串连续的数字,并且错误率低于 10%。据本站了解,该系统只需要几分钟的训练数据来学习用户的语音模式,学习完成后,就可以朝用户的脸上发送和接收声波。
这项技术最令人兴奋的前景之一是,对于有语言障碍的人来说,可以使用它来无声地将对话输入到语音合成器中,然后将单词大声说出来。眼镜也可以用来在安静的图书馆中控制音乐播放,或者在嘈杂的音乐会上口述信息。该技术既小巧又低功耗,也不会侵犯隐私,因为没有数据离开用户的手机。这样,就不会有隐私方面的担忧。眼镜佩戴非常方便,比其他可用的无声语音识别技术更实用、更可行。
该系统目前的版本提供了大约 10 小时的电池续航,并且可以通过蓝牙无线地与用户的智能手机通信。智能手机负责处理和预测所有数据,并将结果传输到一些“动作键”,让它可以播放音乐、与智能设备交互或激活语音助手。康奈尔大学智能计算机接口未来交互(SciFi)实验室正在利用康奈尔大学的一个资助计划来探索将这项技术商业化的可能性。
相关文章
- 人工智能芯片性能与功率效率,高通战胜英伟达成最大赢家
- 网络安全公司警告:超过一半常规密码可在1分钟内被破解
- 映宇宙集团接入GPT3.5 turbo和审核中的GPT4,将进一步提升语言处理能力
- 昇思MindSpore:人工智能的创新之源
- 史玉柱:未来游戏公司应重点布局游戏+AI领域
- 人工智能技术制作“特朗普被捕”照片引发担忧
- 海天瑞声:大模型和AIGC领域带来更多机遇和挑战
- 必应聊天中已有广告出现 用户质疑AI中立性
- AI研究人员呼吁暂停研发更先进的AI技术
- 阿里巴巴推广文案生成方法获专利,将提高文案营销效果
- 减少对单一模型依赖成为AI行业新共识
- 微软必应聊天推出数学解答新格式,用户体验更佳
- 人工智能领域再迎重量级创业者 搜狗前CEO王小川成立新公司
- 前搜狗CEO王小川成立五季智能,进军人工智能领域!
- 钟薛高成为百度文心一言合作伙伴,智能化冰品即将来临
- 百度表示:AI创作时代给创作者带来更多机会与自由
热门教程
系统之家装机大师怎么用?系统之家装机大师使用教程
2Win11正式版怎么安装安卓APK应用?Win11安装安卓APK文件方法
3Win11每次开机会检查tpm吗?Win11每次开机是否会检查tpm详情介绍
4Win11资源管理器的样式如何切换?Win11资源管理器样式切换方法
5Win11电脑下载的文件被自动删除怎么办?
6Win11蓝屏怎么修复?win11蓝屏修复教程
7老电脑怎么装win11系统?老电脑一键升级Win11系统教程
8Win11正式版如何固定“此电脑”到任务栏?
9Win10 21H1更新KB5003637后任务栏不能在底部显示怎么办?
10Win10和Win11哪个好用?Win10和Win11区别介绍
装机必备 更多+
重装教程
大家都在看
电脑教程专题 更多+