AI降噪耳机让你选择想听的声音

- 华盛顿大学研究人员推出了用于降噪耳机的“语义听觉”技术。
- 深度学习算法使用户能够实时选择和过滤声音。
- 该系统在 UIST '23 上展示,允许用户通过语音命令或智能手机应用程序从 20 种声音类别中进行选择。
在一项突破性进展中,华盛顿大学的研究人员推出了一种AI降噪耳机的革命性方法,允许佩戴者实时定制他们的听觉体验。该系统被称为“语义听觉”(semantic hearing),利用深度学习算法,赋予用户前所未有的能力,从各种选项中选择特定的声音,范围从警报声、婴儿哭声到语音和鸟鸣声。
语义听觉的诞生——音频技术的变革者
在追求完善降噪技术的过程中,华盛顿大学团队发布了“语义听觉”的概念。与 indiscriminately(不加区分地)阻挡环境声音的传统降噪耳机不同,这一创新系统赋予用户控制其听觉环境的能力。耳机将捕获的音频无缝流式传输到连接的智能手机,通过高级算法消除所有环境噪音。
这为用户通过语音命令或专用智能手机应用程序,从20个不同类别的声音池中挑选声音奠定了基础。从警报的尖啸到鸟鸣的舒缓嗡嗡声,佩戴者现在可以根据自己的喜好定制他们的听觉景观。只有选定的声音通过耳机传出,提供个性化且身临其境的音频体验。
高级作者Shyam Gollakota,华盛顿大学保罗·G·艾伦计算机科学与工程学系教授,强调了 实时情报在此过程中的重要性。Shyam Gollakota 强调了从环境中辨别特定声音的实时情报挑战,指出当代降噪耳机在实现这一能力方面尚显不足(来源)。挑战在于将声音与视觉刺激同步,这需要神经算法在不到百分之一秒的时间内处理声音。
鉴于时间限制,语义听觉系统在连接的智能手机上处理声音,而不是依赖更强大的云服务器。此外,它必须保留与来自不同方向的声音相关的延迟和空间线索,以确保佩戴者能够有意义地感知其环境。
在办公室、街道和公园等各种环境中进行的测试表明,该系统在提取警报声、鸟鸣声和警报声等目标声音方面表现出色,同时有效消除了所有其他不需要的噪音。参与者的反馈显示,与原始录音相比,音质整体有所改善,标志着降噪技术向前迈出了充满希望的一步。
完善语义听觉体验
虽然语义听觉系统在音频技术方面标志着重大飞跃,但研究人员承认,在区分具有相似属性的声音(如声乐音乐和人类语音)方面存在挑战。系统表现不佳的案例突显了需要利用多样化的真实世界数据进行进一步训练,以增强其能力。
包括华盛顿大学博士生Bandhav Veluri和Malek Itani,以及卡内基梅隆大学的Justin Chan和AssemblyAI的Takuya Yoshioka在内的合著者共同参与了该项目,带来了多样化的专业知识。
随着研究走向商业化发布,团队设想了一个未来,用户可以将语义听觉无缝融入日常生活。微调听觉体验的能力不仅为休闲生活带来希望,也为有特殊听觉需求的人群(如听障人士或感官敏感者)带来希望。
驾驭明天的声音景观,借助AI降噪 brilliance
在一个个性化至关重要的世界里,语义听觉在降噪耳机中的出现引发了令人深思的可能性。这项技术如何在消费者应用之外发展?它能否找到解决特定听觉挑战的应用,或增强有特殊需求人群的听觉体验?随着我们步入音频技术的未来,塑造声音环境的能力预示着一个个性化聆听的新时代。
最聪明的加密领域人士已经在阅读我们的通讯。想加入吗?加入他们。
免责声明。 本文提供的信息不构成交易建议。 Cryptopolitan.com 对于基于本页信息进行的任何投资,我们不承担任何责任。我们强烈建议在进行任何投资决策之前,进行独立研究或咨询合格的专业人士。

Aamir Sheikh
Aamir 是一位科技记者,在加密货币和科技行业拥有近六年的经验。他毕业于 MAJ 大学,获得金融与市场营销 MBA 学位。目前他在 Cryptopolitan 工作,报道加密货币市场的最新发展和价格预测。
















