Qwen3 от Alibaba вытесняет R1 от DeepSeek, теперь лидирует среди моделей с открытым исходным кодом

- Семейство ИИ-моделей Qwen3 от Alibaba обошло модель R1 от DeepSeek и стало лучшей в мире открытой моделью в таких областях, как языковые инструкции, математика, программирование и анализ данных.
- Qwen3 доступна по низкой цене: её запуск стоит всего 0,55 доллара США за 1 миллион токенов.
- Американские производители чипов Nvidia и Intel начали поддерживать Qwen3.
Новая семья моделей ИИ Qwen3 от Alibaba превзошла R1 от DeepSeek, став лучшей в мире моделью с открытым исходным кодом. Согласно отчетам, Qwen3 показал лучшие результаты, чем R1, в тестах, измеряющих способности моделей ИИ с открытым исходным кодом в таких областях, как языковые инструкции, математика, программирование и анализ данных.
Семья Qwen3 была запущена на прошлой неделе облачным вычислительным подразделением Alibaba. Она имеет восемь улучшенных моделей с количеством параметров от 600 миллионов до 235 миллиардов. В машинном обучении параметры — это переменные в системе ИИ во время обучения.
Согласно Платформа LiveBench, независимая платформа, тестирующая большие языковые модели, до этих новых тестов R1 от DeepSeek был лучшей моделью ИИ с открытым исходным кодом в мире с момента его выхода в январе. Но больше нет.
США и Китайские компании спешат принять Qwen 3
Появление Qwen3 в рейтингах LiveBench показывает, как быстро развивается ИИ в Китае. Китайская технологическая индустрия сильно выросла благодаря инструментам с открытым исходным кодом. Метод кода с открытым исходным кодом от Alibaba позволил другим разработчикам стороннего программного обеспечения делиться дизайном, исправлять неработающие ссылки или делать программу более мощной.
Однако общие результаты LiveBench показали, что Qwen3 не так хорош, как o3 от OpenAI, Gemini Pro 2.5 от Google и Claude 3.7 от Anthropic, которые являются лучшими моделями ИИ с закрытым исходным кодом в мире. LiveBench говорит, что o3-mini, самая популярная модель ИИ от OpenAI, была лучшей в мире в целом. Microsoft поддерживает OpenAI.
На каждый 1 миллион токенов требуется $10 для запуска o3. С другой стороны, Qwen3 дешевле в использовании, потому что он стоит всего $0.55 за 1 миллион токенов для запуска. Поскольку Qwen3 дешевле и работает лучше, многие компании заявили, что поддержат новейшую модель ИИ Alibaba, как только она появится.
Huawei Technologies, Moore Threads, Cambricon Technologies и Hygon Information Technology — все это чипные компании, которые заявили, что поддержат Qwen3.
Cambricon заявила в прошлый вторник, что успешно оптимизировала Qwen3 для быстрого запуска на своих графических процессорах. Это было сделано, потому что разработчики ИИ на Филиппинах хотели чипы, произведенные в Китае.
Qwen3 также используется в облачных вычислительных сервисах Hyperbolic и Fireworks.ai, двух компаний ИИ-инфраструктуры. Американские производители чипов Nvidia и Intel начали поддерживать Qwen3.
Многие крупные центры обработки данных в Китае, такие как в Пекине, Шанхае, Ханчжоу и провинциях Хубэй, Цзилинь и Северо-Западный Шэньси, также заявили, что будут использовать третье поколение ИИ-моделей Qwen от Alibaba. Сверхкомпьютерная сеть Китая также приняла Qwen3. Эта сеть связывает более 20 центров обработки данных в 20 городах в 14 провинциях.
Генеральный директор Anthropic говорит, что DeepSeek был «немного преувеличен»
На бизнес-мероприятии соучредитель Anthropic, компании, создавшей модели ИИ Claude, сказал, что DeepSeek все еще «на шесть-восемь месяцев отстает от того, где находятся американские фронтенд-компании». Он также сказал, что недавний ажиотаж вокруг китайского стартапа был «возможно, немного преувеличен».
моделей DeepSeek получил внимание по всему миру в конце декабря 2024 года и начале января 2025 года, поделившись двумя продвинутыми моделями ИИ с открытым исходным кодом, V3 и R1. Эти модели были созданы за небольшую долю стоимости и вычислительной мощности, которую обычно требуют крупные технологические компании для проектов LLM.
Неясно, когда DeepSeek выпустит следующее поколение своих моделей. Компания из Ханчжоу тихо выпустила свою модель Prover-V2 с 671 миллиардом параметров в конце апреля. Это было обновление ее специализированной модели для обработки математических доказательств. Однако она ничего не сказала о прогрессе своей долгожданной модели рассуждений R2.
Не просто читайте новости о криптовалютах. Понимайте их. Подпишитесь на нашу рассылку. Это бесплатно.
Отказ от ответственности. Предоставленная информация не является торговой рекомендацией. Cryptopolitan.com Мы не несем ответственности за любые инвестиции, сделанные на основе информации, представленной на этой странице. Мы настоятельно рекомендуем проводить независимое исследование и/или проконсультироваться с квалифицированным специалистом перед принятием любых инвестиционных решений.

Флоренс Мучай
Флоренс уже 6 лет освещает новости в сферах криптовалют, игр, технологий и искусственного интеллекта. Её образование по специальности «Компьютерные науки» в Университете науки и технологий Меру, а также обучение управлению в чрезвычайных ситуациях и международной дипломатии в MMUST обеспечили ей отличные языковые навыки, наблюдательность и технические компетенции. Флоренс работала в группе VAP Group и была редактором в нескольких крипто-медиа.
















