ChatGPT steigert sein Spiel mit erweiterten KI-Funktionen für Stimme, Vision und mehr

- OpenAI führt eine Sprachfunktion für ChatGPT ein, die Audioantworten in verschiedenen Persönlichkeiten ermöglicht.
- Das Unternehmen richtet sich an mobile Nutzer und im Wettbewerb um persönliche Assistenten.
- Nutzer können zudem Bilder und Fragen einreichen, was die Fähigkeiten von ChatGPT erweitert.
In einem bedeutenden Update hat das KI-Startup OpenAI bahnbrechende KI-Funktionen zu seiner ChatGPT-App hinzugefügt, die es dem Chatbot ermöglichen, sowohl zu hören als auch zu sprechen sowie Bilder zu analysieren. In den nächsten zwei Wochen haben Nutzer die Möglichkeit, aus fünf verschiedenen Personas für den Chatbot zu wählen, wie „Juniper“, „Breeze“ und „Ember“, die jeweils eine einzigartige Stimme für Audioantworten bieten. Diese Entwicklung markiert OpenAIs jüngstes Bemühen, Gespräche mit KI-gesteuerten Chatbots noch lebensechter und ansprechender zu gestalten, was Abonnenten seines ChatGPT Plus-Dienstes und Unternehmensnutzern zugutekommt.
KI-Chatbot-Gespräche werden menschlicher
OpenAIs ChatGPT, das ursprünglich im Mai gestartet wurde, ermöglichte bereits Voice-to-Text-Interaktionen mit dem Chatbot. Jetzt können Nutzer eine Sprach-Persona auswählen, was Gespräche dynamischer und natürlicher macht. Diese Audioantwort-Funktion zielt darauf ab, die Lücke zwischen menschlicher und KI-Interaktion zu schließen und ein Gefühl der Authentizität in Gesprächen mit dem Chatbot zu fördern. OpenAI hofft, dass diese Verbesserung Nutzer anzieht, die Unterstützung unterwegs suchen, und setzt ChatGPT in direkten Wettbewerb mit etablierten persönlichen Assistenten-Angeboten wie Googles Assistant, Apples Siri und Amazon.coms Alexa.
Nutzer können diese Funktion für eine Vielzahl von Aufgaben nutzen, wie zum Beispiel die Anfrage nach Informationen über die Geschichte von Disneyland während der Fahrt zum Freizeitpark oder die Bitte um ein Cocktailrezept beim Multitasking in der Küche. Während Tests demonstrierte ChatGPT seine Geschichtenerzählfähigkeiten, indem es eine skurrile Geschichte über einen Seestern und eine Rübe erzählte. Es ist jedoch erwähnenswert, dass ChatGPT zwar Songtexte generieren kann, seine Stimme aber nicht zum Singen einsetzt, was die Grenzen der App im Bereich der Gesangsleistung aufzeigt.
Die von ChatGPT bereitgestellten Stimmen mögen relativ menschlich klingen, albeit mit einer subtilen roboterhaften Unterton. OpenAI hat mit Synchronsprechern zusammengearbeitet, um das Text-zu-Sprache-KI-Modell zu entwickeln, das diese Funktion antreibt, mit dem Ziel, ein ansprechenderes und überzeugenderes conversationelles Erlebnis zu liefern.
Erweiterung der Fähigkeiten mit Bilderkennung
Zusätzlich zum Voice-Update kündigte OpenAI auch kommende Funktionen für GPT-4 an, eines der fortschrittlichen KI-Modelle hinter ChatGPT. In den kommenden Wochen werden zahlende und Unternehmensnutzer Zugang zu einer Bilderkennungsfunktion innerhalb der ChatGPT-App und -Website erhalten. Diese Funktion ermöglicht es Nutzern, ein Bild zusammen mit einer damit verbundenen Frage oder Anfrage einzureichen, wodurch die Fähigkeiten von ChatGPT über textbasierte Interaktionen hinaus erweitert werden.
Zum Beispiel können Nutzer ein Bild von rosa Sonnenbrillen hochladen und den Chatbot um Modeberatung oder Outfit-Vorschläge bitten, die das Accessoire ergänzen. Alternativ können sie ein Bild eines schwierigen Mathematikproblems einreichen und um Hilfe bei der Lösung bitten. Diese Bilderkennungsfunktion fügt ChatGPTs Nutzen eine neue Dimension hinzu und erhöht seine Vielseitigkeit für Nutzer in verschiedenen Bereichen. Diese Verbesserung markiert einen bedeutenden Schritt voran bei der Überbrückung der Lücke zwischen textbasierter KI und visuellen Informationen und eröffnet aufregende Möglichkeiten für eine breite Palette von Nutzerinteraktionen und Anwendungen.
Feiern von ChatGPTs erweiterten KI-Funktionen
Die neuesten Verbesserungen von OpenAI an ChatGPT markieren einen erheblichen Schritt in der fortlaufenden Entwicklung von KI-gesteuerten conversationellen Schnittstellen. Die Integration von Sprachkompetenz, einschließlich unterscheidbarer Personas, gepaart mit der Erweiterung ihrer Fähigkeiten zur Bildanalyse, ist ein Zeugnis für OpenAIs Engagement, den Nutzern eine tiefgreifend ansprechende und vielschichtige conversationelle Umgebung zu bieten. Obwohl es noch nicht bereit sein mag, Nutzer mit melodischen Klängen zu unterhalten, festigt ChatGPTs Fähigkeit, an dynamischen und äußerst lebensechten Dialogen teilzunehmen und gleichzeitig Bildanfragen kompetent zu beantworten, seine Position als äußerst leistungsfähiges und unverzichtbares KI-Tool im ständig wachsenden Bereich virtueller Assistenten und conversationeller künstlicher Intelligenz.
Wenn Sie dies lesen, sind Sie bereits einen Schritt voraus. Bleiben Sie mit unserem Newsletter auf dem Laufenden.
Haftungsausschluss. Die bereitgestellten Informationen stellen keine Anlageberatung dar. Cryptopolitan.com Wir übernehmen keine Haftung für Investitionen, die auf den auf dieser Seite bereitgestellten Informationen basieren. Wir empfehlen dringend, vor jeglichen Anlageentscheidungen eine unabhängige Recherche durchzuführen und/oder einen qualifizierten Fachmann zu konsultieren.

Aamir Sheikh
Aamir ist Tech-Journalist mit fast sechs Jahren Erfahrung in der Krypto- und Technologiebranche. Er absolvierte sein Studium an der MAJ University mit einem MBA in Finanzen und Marketing. Heute arbeitet er für Cryptopolitan, wo er über die neuesten Entwicklungen in den Kryptowährungsmärkten und Preisprognosen berichtet.
















