AKTUELLE NACHRICHTEN
FÜR SIE AUSGEWÄHLT

KI-Geräuschunterdrückungskopfhörer: Wählen Sie, was Sie hören möchten

VonAamir SheikhAamir Sheikh 3 Min. Lesezeit
KI-Geräuschunterdrückung
  • Forschende der University of Washington stellen die „semantische Hören“-Technologie für Geräuschunterdrückungskopfhörer vor.
  • Deep-Learning-Algorithmen ermöglichen es Nutzern, Sounds in Echtzeit auszuwählen und zu filtern.
  • Das System, das auf der UIST ’23 vorgestellt wurde, erlaubt es Nutzern, über Sprachbefehle oder eine Smartphone-App zwischen 20 Klangklassen zu wählen.

In einer bahnbrechenden Entwicklung haben Forscher der University of Washington einen revolutionären Ansatz für KI-Geräuschunterdrückungskopfhörer vorgestellt, der es Trägern ermöglicht, ihr Hörerlebnis in Echtzeit zu kuratieren. Dieses als „semantisches Hören“ bezeichnete System nutzt Deep-Learning-Algorithmen, um Nutzern die beispiellose Fähigkeit zu geben, bestimmte Sounds aus einer Vielzahl von Optionen auszuwählen, von Sirenen und Babygeschrei bis hin zu Sprache und Vogelgezwitscher.

Die Geburt des semantischen Hörens – Ein Wendepunkt in der Audiotechnologie

Im Streben nach der Verfeinerung der Geräuschunterdrückungstechnologie hat das Team der University of Washington das Konzept des „semantischen Hörens“ vorgestellt. Im Gegensatz zu herkömmlichen Geräuschunterdrückungskopfhörern, die Umgebungsgeräusche wahllos blockieren, ermöglicht dieses innovative System den Nutzern, die Kontrolle über ihre akustische Umgebung auszuüben. Die Kopfhörer streamen den aufgenommenen Ton nahtlos an ein verbundenes Smartphone, das durch fortschrittliche Algorithmen alle Umgebungsgeräusche unterdrückt. 

Dies legt den Grundstein dafür, dass Nutzer entweder per Sprachbefehl oder über eine dedizierte Smartphone-App klangliche Highlights aus einem Pool von 20 verschiedenen Klassen auswählen können. Vom Heulen der Sirenen bis zum beruhigenden Summen des Vogelgezwitschers können Träger ihre akustische Landschaft nun nach ihren Vorlieben anpassen. Nur die ausgewählten Sounds gelangen durch die Kopfhörer und bieten ein personalisiertes und immersives Hörerlebnis.

Der Senior-Autor Shyam Gollakota, Professor an der Paul G. Allen School of Computer Science & Engineering, unterstreicht die Bedeutung von Echtzeit-Intelligenz in diesem Prozess. Shyam Gollakota betont die Herausforderung der Echtzeit-Intelligenz bei der Unterscheidung spezifischer Geräusche aus der Umgebung und stellt fest, dass zeitgenössische Noise-Canceling-Kopfhörer bei der Erreichung dieser Fähigkeit nach wie vor unzureichend sind (Quelle). Die Herausforderung besteht darin, die Geräusche mit visuellen Reizen zu synchronisieren, was neuronale Algorithmen erfordert, die Geräusche in weniger als einem Hundertstel einer Sekunde verarbeiten.

Angesichts dieser zeitlichen Einschränkungen verarbeitet das semantische Hören-System Sounds auf einem verbundenen Smartphone, anstatt sich auf leistungsfähigere Cloud-Server zu verlassen. Außerdem müssen Verzögerungen und räumliche Hinweise, die mit Sounds aus verschiedenen Richtungen verbunden sind, erhalten bleiben, um sicherzustellen, dass Träger ihre Umgebung sinnvoll wahrnehmen können. 

Getestet in verschiedenen Umgebungen wie Büros, Straßen und Parks, hat das System seine Fähigkeit bewiesen, Zieltöne wie Sirenen, Vogelgezwitscher und Alarme herauszufiltern, während es gleichzeitig alle anderen unerwünschten Geräusche effektiv eliminiert. Das Feedback der Teilnehmer zeigt eine insgesamt verbesserte Klangqualität im Vergleich zu den Originalaufnahmen, was einen vielversprechenden Schritt nach vorn in der Geräuschunterdrückungstechnologie bedeutet.

Verfeinerung des semantischen Hörerlebnisses

Obwohl das semantische Hören-System einen bedeutenden Sprung in der Audiotechnologie markiert, erkennen die Forscher Herausforderungen bei der Unterscheidung zwischen Sounds mit ähnlichen Eigenschaften an, wie etwa zwischen vokaler Musik und menschlicher Sprache. Fälle, in denen das System Schwierigkeiten hatte, unterstreichen die Notwendigkeit weiterer Schulungen mit vielfältigen Echtweltdaten, um seine Fähigkeiten zu verbessern. 

Mitautoren, darunter UW-Doktoranden Bandhav Veluri und Malek Itani sowie Justin Chan von der Carnegie Mellon University und Takuya Yoshioka von AssemblyAI, haben an dem Projekt zusammengearbeitet und ihr unterschiedliches Fachwissen eingebracht.

Während die Forschung auf eine kommerzielle Veröffentlichung zusteuert, sieht das Team eine Zukunft vor sich, in der Nutzer das semantische Hören nahtlos in ihren Alltag integrieren können. Die Fähigkeit, das eigene Hörerlebnis fein abzustimmen, verspricht nicht nur im Freizeitbereich, sondern auch für Menschen mit spezifischen Hörbedürfnissen, wie etwa Personen mit Hörbehinderungen oder sensorischen Überempfindlichkeiten.

Die Klanglandschaften von morgen mit KI-Geräuschunterdrückung meistern

In einer Welt, in der Personalisierung im Mittelpunkt steht, wirft das Aufkommen des semantischen Hörens bei Geräuschunterdrückungskopfhörern faszinierende Möglichkeiten auf. Wie könnte sich diese Technologie über den Verbrauchermarkt hinaus entwickeln? Könnte sie Anwendungen finden, um spezifische Hörherausforderungen zu bewältigen oder die Hörerlebnisse von Menschen mit besonderen Bedürfnissen zu verbessern? Während wir in die Zukunft der Audiotechnologie eintreten, lädt die Fähigkeit, unsere akustische Umgebung zu formen, zu einem neuen Zeitalter des personalisierten Hörens ein.

Wenn Sie dies lesen, sind Sie bereits einen Schritt voraus. Bleiben Sie mit unserem Newsletter auf dem Laufenden.

Diesen Artikel teilen

Haftungsausschluss. Die bereitgestellten Informationen stellen keine Anlageberatung dar. Cryptopolitan.com Wir übernehmen keine Haftung für Investitionen, die auf den auf dieser Seite bereitgestellten Informationen basieren. Wir empfehlen dringend, vor jeglichen Anlageentscheidungen eine unabhängige Recherche durchzuführen und/oder einen qualifizierten Fachmann zu konsultieren.

Aamir Sheikh

Aamir Sheikh

Aamir ist Tech-Journalist mit fast sechs Jahren Erfahrung in der Krypto- und Technologiebranche. Er absolvierte sein Studium an der MAJ University mit einem MBA in Finanzen und Marketing. Heute arbeitet er für Cryptopolitan, wo er über die neuesten Entwicklungen in den Kryptowährungsmärkten und Preisprognosen berichtet.

MEHR … NACHRICHTEN