Cuffie con cancellazione del rumore AI che ti permettono di scegliere cosa ascoltare

- I ricercatori dell'Università del Washington presentano la tecnologia "semantic hearing" per le cuffie con cancellazione del rumore.
- Gli algoritmi di deep learning permettono agli utenti di selezionare e filtrare i suoni in tempo reale.
- Il sistema, presentato a UIST '23, consente agli utenti di scegliere tra 20 classi sonore tramite comandi vocali o un'app per smartphone.
In uno sviluppo rivoluzionario, i ricercatori dell’Università di Washington hanno introdotto un approccio innovativo alle cuffie con cancellazione del rumore basate sull’AI, consentendo agli utenti di curare la propria esperienza uditiva in tempo reale. Chiamato "ascolto semantico", questo sistema utilizza algoritmi di deep learning per fornire agli utenti la capacità senza precedenti di selezionare suoni specifici da una vasta gamma di opzioni, dalle sirene ai pianti dei bambini, fino alla voce umana e al cinguettio degli uccelli.
La nascita dell’ascolto semantico – Un punto di svolta nella tecnologia audio
Nella loro ricerca di perfezionare la tecnologia di cancellazione del rumore, il team dell’Università di Washington ha presentato il concetto di "ascolto semantico". A differenza delle cuffie convenzionali con cancellazione del rumore che bloccano indiscriminatamente i suoni ambientali, questo sistema innovativo permette agli utenti di esercitare un controllo sul proprio ambiente uditivo. Le cuffie trasmettono in streaming l’audio catturato a uno smartphone connesso, che, attraverso algoritmi avanzati, cancella tutti i rumori ambientali.
Questo prepara il terreno affinché gli utenti, tramite comandi vocali o un’app dedicata per smartphone, possano selezionare con cura i suoni da un pool di 20 classi distinte. Dal lamento delle sirene al ronzio rassicurante del cinguettio degli uccelli, gli utenti possono ora personalizzare il proprio paesaggio uditivo in base alle proprie preferenze. Solo i suoni selezionati passano attraverso le cuffie, offrendo un’esperienza audio personalizzata e immersiva.
L’autore principale Shyam Gollakota, professore presso la Paul G. Allen School of Computer Science & Engineering, sottolinea l’importanza di real-time intelligence in questo processo. Shyam Gollakota evidenzia la sfida dell’intelligenza in tempo reale nel distinguere suoni specifici dall’ambiente, affermando che le cuffie con cancellazione del rumore contemporanee non sono all’altezza di questa capacità (fonte). La sfida risiede nel sincronizzare i suoni con gli stimoli visivi, richiedendo algoritmi neurali che elaborino i suoni in meno di un centesimo di secondo.
Date queste limitazioni temporali, il sistema di ascolto semantico elabora i suoni su uno smartphone connesso piuttosto che fare affidamento su server cloud più potenti. Inoltre, deve preservare i ritardi e le indicazioni spaziali associate ai suoni provenienti da diverse direzioni per garantire che gli utenti percepiscano significativamente il proprio ambiente.
Testato in vari contesti come uffici, strade e parchi, il sistema ha dimostrato la sua capacità di estrarre suoni target come sirene, cinguettio degli uccelli e allarmi, eliminando efficacemente tutti gli altri rumori indesiderati. Il feedback dei partecipanti rivela un miglioramento generale della qualità del suono rispetto alle registrazioni originali, indicando un promettente passo avanti nella tecnologia di cancellazione del rumore.
Raffinare l’esperienza di ascolto semantico
Sebbene il sistema di ascolto semantico rappresenti un salto significativo nella tecnologia audio, i ricercatori riconoscono le sfide nel distinguere tra suoni che condividono proprietà simili, come la musica vocale e il parlato umano. Gli istanti in cui il sistema ha faticato evidenziano la necessità di un ulteriore addestramento su dati reali diversificati per migliorare le sue capacità.
I co-autori, inclusi gli studenti di dottorato dell’UW Bandhav Veluri e Malek Itani, nonché Justin Chan della Carnegie Mellon University e Takuya Yoshioka di AssemblyAI, hanno collaborato al progetto, portando competenze diversificate.
Mentre la ricerca si avvicina a un rilascio commerciale, il team immagina un futuro in cui gli utenti possono integrare perfettamente l’ascolto semantico nelle loro vite quotidiane. La capacità di perfezionare la propria esperienza uditiva promette non solo per il tempo libero, ma anche per le persone con esigenze uditive specifiche, come quelle con disabilità uditive o sensibilità sensoriali.
Navigare i paesaggi sonori di domani con la brillantezza della cancellazione del rumore AI
In un mondo in cui la personalizzazione è fondamentale, l’avvento dell’ascolto semantico nelle cuffie con cancellazione del rumore solleva possibilità intriganti. Come potrebbe evolversi questa tecnologia oltre le applicazioni consumer? Potrebbe trovare applicazioni nell’affrontare sfide uditive specifiche o migliorare le esperienze uditive di coloro con esigenze uniche? Mentre entriamo nel futuro della tecnologia audio, la capacità di scolpire il nostro ambiente sonoro annuncia una nuova era nell’ascolto personalizzato.
Se stai leggendo questo, sei già avanti. Resta così con la nostra newsletter.
Dichiarazione di responsabilità. Le informazioni fornite non costituiscono consigli di trading. Cryptopolitan.com non si assume alcuna responsabilità per eventuali investimenti effettuati sulla base delle informazioni fornite in questa pagina. Si consiglia vivamente di effettuare ricerche indipendenti e/o consultare un professionista qualificato prima di prendere qualsiasi decisione di investimento.

Aamir Sheikh
Aamir è un giornalista tecnologico con quasi sei anni di esperienza nei settori delle criptovalute e della tecnologia. Si è laureato presso l'Università MAJ con un MBA in Finanza e Marketing. Attualmente lavora per Cryptopolitan, dove si occupa delle ultime novità sui mercati delle criptovalute e delle previsioni sui prezzi.
















