ÚLTIMAS NOTÍCIAS
SELECIONADO PARA VOCÊ

Fones de Ouvido com Cancelamento de Ruído por IA Permitem que Você Escolha o Que Ouve

PorAamir SheikhAamir Sheikh 3 min de leitura
Cancelamento de Ruído por IA
  • Pesquisadores da Universidade de Washington revelam tecnologia de "audição semântica" para fones de ouvido com cancelamento de ruído.
  • Algoritmos de aprendizado profundo capacitam os usuários a selecionar e filtrar sons em tempo real.
  • O sistema, apresentado no UIST '23, permite que os usuários escolham entre 20 classes de sons por meio de comandos de voz ou de um aplicativo de smartphone.

Em um desenvolvimento revolucionário, pesquisadores da Universidade de Washington introduziram uma abordagem revolucionária para fones de ouvido com cancelamento de ruído por IA, permitindo que os usuários curatem sua experiência auditiva em tempo real. Chamado de “audição semântica”, este sistema utiliza algoritmos de aprendizado profundo para fornecer aos usuários a capacidade sem precedentes de selecionar sons específicos de uma variedade de opções, desde sirenes e choro de bebês até fala e cantos de pássaros.

O nascimento da audição semântica – Um divisor de águas na tecnologia de áudio

Em sua busca por refinar a tecnologia de cancelamento de ruído, a equipe da Universidade de Washington revelou o conceito de “audição semântica”. Diferente dos fones de ouvido convencionais com cancelamento de ruído que bloqueiam indiscriminadamente os sons ambientais, este sistema inovador capacita os usuários a exercer controle sobre seu ambiente auditivo. Os fones transmitem sem problemas o áudio capturado para um smartphone conectado, que, por meio de algoritmos avançados, cancela todos os ruídos ambientes. 

Isso prepara o palco para os usuários, seja por comandos de voz ou por um aplicativo dedicado de smartphone, escolherem sons de um pool de 20 classes distintas. Desde o lamento das sirenes até o zumbido reconfortante dos cantos dos pássaros, os usuários agora podem personalizar sua paisagem auditiva de acordo com suas preferências. Apenas os sons selecionados passam pelos fones de ouvido, oferecendo uma experiência de áudio personalizada e imersiva.

O autor sênior Shyam Gollakota, professor da Escola Paul G. Allen de Ciência da Computação e Engenharia, destaca a importância da inteligência em tempo real neste processo. Shyam Gollakota enfatiza o desafio da inteligência em tempo real em discernir sons específicos do ambiente, afirmando que os fones de ouvido com cancelamento de ruído contemporâneos ficam aquém de alcançar essa capacidade (fonte). O desafio reside em sincronizar os sons com estímulos visuais, exigindo algoritmos neurais que processem sons em menos de um centésimo de segundo.

Dado esse limite de tempo, o sistema de audição semântica processa os sons em um smartphone conectado, em vez de depender de servidores em nuvem mais poderosos. Além disso, deve preservar atrasos e pistas espaciais associadas a sons de diferentes direções para garantir que os usuários possam perceber significativamente seu ambiente. 

Testado em vários ambientes, como escritórios, ruas e parques, o sistema demonstrou sua capacidade de extrair sons-alvo como sirenes, cantos de pássaros e alarmes, enquanto eliminava efetivamente todos os outros ruídos indesejados. O feedback dos participantes revela uma melhoria geral na qualidade do som em comparação com as gravações originais, significando um salto promissor em frente na tecnologia de cancelamento de ruído.

Refinando a experiência auditiva semântica

Embora o sistema de audição semântica marque um salto significativo na tecnologia de áudio, os pesquisadores reconhecem desafios em distinguir entre sons que compartilham propriedades semelhantes, como música vocal e fala humana. Instâncias em que o sistema teve dificuldades destacam a necessidade de treinamento adicional com dados do mundo real diversos para aprimorar suas capacidades. 

Coautores, incluindo os doutorandos da UW Bandhav Veluri e Malek Itani, bem como Justin Chan da Universidade Carnegie Mellon e Takuya Yoshioka da AssemblyAI, colaboraram no projeto, trazendo diversas expertises para a mesa.

À medida que a pesquisa se aproxima de um lançamento comercial, a equipe imagina um futuro em que os usuários possam integrar perfeitamente a audição semântica em suas vidas diárias. A capacidade de ajustar finamente a experiência auditiva promete não apenas para lazer, mas também para indivíduos com necessidades auditivas específicas, como aqueles com deficiências auditivas ou sensibilidades sensoriais.

Navegando pelas paisagens sonoras do amanhã com a brilhante cancelação de ruído por IA

Em um mundo onde a personalização é fundamental, o advento da audição semântica em fones de ouvido com cancelamento de ruído levanta possibilidades intrigantes. Como essa tecnologia pode evoluir além das aplicações para consumidores? Ela poderia encontrar aplicações para abordar desafios auditivos específicos ou aprimorar as experiências auditivas de pessoas com necessidades únicas? À medida que avançamos para o futuro da tecnologia de áudio, a capacidade de esculpir nosso ambiente sonoro anuncia uma nova era na escuta personalizada.

Não apenas leia notícias sobre criptomoedas. Entenda-as. Inscreva-se em nossa newsletter. É grátis.

Compartilhe este artigo

Aviso Legal. As informações fornecidas não constituem aconselhamento de investimento. Cryptopolitan.com não assume responsabilidade por quaisquer investimentos realizados com base nas informações fornecidas nesta página. Recomendamos fortemente a realização de pesquisa independente e/ou consulta com um profissional qualificado antes de tomar quaisquer decisões de investimento.

Aamir Sheikh

Aamir Sheikh

Aamir é um jornalista de tecnologia com quase seis anos de experiência nos setores de criptomoedas e tecnologia. Formou-se na MAJ University com um MBA em Finanças e Marketing. Atualmente trabalha na Cryptopolitan, onde relata os últimos desenvolvimentos nos mercados de criptomoedas e previsões de preços.

MAIS … NOTÍCIAS