Alibabas Qwen3 verdrängt DeepSeeks R1, führt nun die Open-Source-KI-Modelle an

- Die Qwen3-Familie von KI-Modellen von Alibaba hat DeepSeek's R1 übertroffen und ist in Bereichen wie Sprachanweisungen, Mathematik, Programmierung und Datenanalyse das weltweit beste Open-Source-Modell.
- Qwen3 ist kostengünstig zu nutzen, da es nur 0,55 US-Dollar pro 1 Million Tokens kostet.
- Amerikanische Chiphersteller Nvidia und Intel haben begonnen, Qwen3 zu unterstützen.
Die neue Qwen3-Familie von KI-Modellen von Alibaba hat DeepSeeks R1 übertroffen und ist nun das weltweit beste Open-Source-Modell. Berichten zufolge schnitt Qwen3 in Tests besser ab als R1, die die Fähigkeiten von Open-Source-KI-Modellen in Bereichen wie Sprachinstruktion, Mathematik, Programmierung und Datenanalyse messen.
Die Qwen3-Familie wurde letzte Woche von Alibabas Cloud-Computing-Einheit gestartet. Sie umfasst acht verbesserte Modelle mit zwischen 600 Millionen und 235 Milliarden Parametern. Im maschinellen Lernen sind Parameter die Variablen in einem KI-System während des Trainings.
Laut LiveBench Plattform, eine unabhängige Plattform, die große Sprachmodelle testet, bevor diese neuen Tests, war DeepSeeks R1 seit seiner Veröffentlichung im Januar das beste Open-Source-KI-Modell der Welt. Aber nicht mehr.
Sowohl US- als auch chinesische Unternehmen eilen, Qwen 3 zu übernehmen
Der Aufstieg von Qwen3 in den LiveBench-Rankings zeigt, wie schnell sich KI in China entwickelt. Die chinesische Tech-Branke ist dank Open-Source-Tools stark gewachsen. Der Open-Source-Ansatz von Alibaba hat anderen Drittanbietern ermöglicht, das Design zu teilen, defekte Links zu beheben oder das Programm leistungsfähiger zu machen.
Allerdings zeigten die gesamten LiveBench-Ergebnisse, dass Qwen3 nicht so gut war wie OpenAIs o3, Googles Gemini Pro 2.5 und Anthropics Claude 3.7, die die besten Closed-Source-KI-Modelle der Welt sind. LiveBench sagt, dass o3-mini, OpenAIs beliebtestes KI-Modell, das weltweit beste insgesamt war. Microsoft unterstützt OpenAI.
Für jede 1 Million Token kostet es 10 USD, o3 auszuführen. Andererseits ist Qwen3 günstiger in der Nutzung, da es nur 0,55 USD pro 1 Million Token kostet, es auszuführen. Da Qwen3 günstiger ist und besser funktioniert, sagten viele Unternehmen, sie würden Alibabas neuestes KI-Modell unterstützen, sobald es veröffentlicht wurde.
Huawei Technologies, Moore Threads, Cambricon Technologies und Hygon Information Technology sind allesamt Chip-Unternehmen, die erklärt haben, dass sie Qwen3 unterstützen werden.
Cambricon sagte am vergangenen Dienstag, dass es Qwen3 erfolgreich optimiert habe, um schnell auf seinen Grafikprozessoren (GPUs) zu laufen. Dies geschah, weil KI-Entwickler auf den Philippinen in China hergestellte Chips wollten.
Qwen3 wird auch auf den Cloud-Computing-Diensten von Hyperbolic und Fireworks.ai, zwei KI-Infrastrukturunternehmen, genutzt. Die amerikanischen Chip-Hersteller Nvidia und Intel haben begonnen, Qwen3 zu unterstützen.
Viele große Rechenzentren in China, wie die in Peking, Shanghai, Hangzhou und den Provinzen Hubei, Jilin und Nordwest-Shaanxi, haben ebenfalls erklärt, dass sie Alibabas dritte Generation von Qwen-KI-Modellen nutzen werden. Das Supercomputing-Netzwerk in China hat ebenfalls Qwen3 übernommen. Dieses Netzwerk verbindet über 20 Rechenzentren in 20 Städten in 14 Provinzen.
Anthropic-CEO sagt, dass DeepSeek „etwas übertrieben“ war
Auf einer Business-Veranstaltung sagte ein Mitbegründer von Anthropic, dem Unternehmen, das die Claude-KI-Modelle entwickelt hat, dass DeepSeek immer noch „sechs bis acht Monate hinter den US-Frontier-Unternehmen zurückliegt“. Er sagte auch, dass der jüngste Hype um den chinesischen Start-up „vielleicht etwas übertrieben“ war.
DeepSeek erregte Ende Dezember 2024 und Anfang Januar 2025 weltweit Aufmerksamkeit, indem er zwei fortschrittliche Open-Source-KI-Modelle, V3 und R1, teilte. Diese Modelle wurden zu einem Bruchteil der Kosten und Rechenleistung erstellt, die große Tech-Unternehmen normalerweise für LLM-Projekte benötigen.
Es ist unklar, wann DeepSeek die nächste Generation seiner Modelle veröffentlichen wird. Das in Hangzhou ansässige Unternehmen veröffentlichte Ende quietly sein Prover-V2 mit 671 Milliarden Parametern April. Dies war ein Update seines spezialisierten Modells für die Bearbeitung mathematischer Beweise. Allerdings hat es nichts über den Fortschritt seines lang erwarteten R2-Reasoning-Modells gesagt.
Lesen Sie nicht nur Krypto-Nachrichten. Verstehen Sie sie. Abonnieren Sie unseren Newsletter. Es ist kostenlos.
Haftungsausschluss. Die bereitgestellten Informationen stellen keine Anlageberatung dar. Cryptopolitan.com Wir übernehmen keine Haftung für Investitionen, die auf den auf dieser Seite bereitgestellten Informationen basieren. Wir empfehlen dringend, vor jeglichen Anlageentscheidungen eine unabhängige Recherche durchzuführen und/oder einen qualifizierten Fachmann zu konsultieren.

Florence Muchai
Florence berichtet seit sechs Jahren über Kryptowährungen, Gaming, Technologie und KI. Ihr Studium der Computerwissenschaften an der Meru University of Science and Technology sowie ihr Studium im Bereich Katastrophenmanagement und internationale Diplomatie an der MMUST haben sie umfassend mit Sprach-, Beobachtungs- und technischen Fähigkeiten ausgestattet. Florence war bei der VAP Group tätig und arbeitete als Redakteurin für mehrere Krypto-Medienhäuser.
















