ПОСЛЕДНИЕ НОВОСТИ
ПОДОБРАНО ДЛЯ ВАС

Meituan выкладывает в открытый исходный код 1,6-триллионной параметрической ИИ-модели LongCat-2.0, обученной на китайских чипах

АвторРанда МоузРанда Моуз 2 мин. чтения
Meituan открыла исходный код 1,6-триллионной модели LongCat-2.0 для ИИ, обученной на китайских чипах.
  • Meituan выпустила модель LongCat-2.0 — 1,6-триллионную open-source модель ИИ, обученную на отечественных китайских чипах.
  • Этот релиз доказывает, что китайские компании могут создавать модели уровня frontiers без зависимости от ограниченного западного оборудования.
  • Это происходит в период, когда экспортные ограничения стимулируют технологический сектор Китая к достижению аппаратной самодостаточности.

Meituan утверждает, что обучила модель с 1,6 триллиона параметров на отечественном китайском оборудовании, полностью избегая использования GPU Nvidia. Компания является крупнейшей платформой в Китае для локальных услуг и доставки еды.

Выход модели происходит на фоне того, как экспортный контроль США продолжает менять подход китайских компаний к созданию крупномасштабных ИИ. Meituan обучила LongCat-2.0 на отечественных ASIC-суперподах. Компания позиционирует модель как доказательство того, что китайские фирмы могут достигать масштаба передовых технологий без использования чипов Nvidia на базе CUDA.

LongCat-2.0 работает на основе разреженной смеси экспертов (sparse mixture-of-experts)

LongCat-2.0 использует архитектуру разреженной смеси экспертов. DeepSeek и Mixtral от Mistral используют тот же общий подход. Вместо одновременного активирования всех 1,6 триллиона параметров внутренний маршрутизатор выбирает подмножество специализированных суб-моделей для каждого токена. По сравнению с плотной моделью того же размера, такая архитектура снижает затраты на инференс.

Модель поставляется с контекстным окном в один миллион токенов. Как DeepSeek-R1-0528, так и GPT-OSS от OpenAI имеют максимальное значение токенов в 128 000. В опубликованных бенчмарках Meituan сравнила LongCat-2.0 с закрытыми моделями от Google, OpenAI и Anthropic. На данный момент эти утверждения не были проверены независимыми третьими сторонами.

Meituan разработала LongCat-2.0 в качестве основного механизма рассуждений для ИИ-агентов и инструментов для кодинга. Компания указала на понимание кода, редактирование в масштабах репозитория и автоматическое выполнение задач в качестве целевых сценариев использования.

Bernstein оценивает долю Nvidia в 40% рынка ИИ-чипов Китая

Оценка от компании по исследованию акций Bernstein на 2025 год поместила долю Nvidia на китайском рынке ИИ-чипов на уровне ~40%. У Huawei аналогичный процент. Bernstein предсказала, что Huawei займет долю рынка в этом году, что приведет к снижению доли Nvidia на 8 процентных пунктов.

Что касается отечественных ASIC-кластеров, Meituan утверждает, что обучила и оптимизировала LongCat-2.0. Это означает, что модели не нужен программный стек Nvidia, и она может работать на оборудовании, которое уже присутствует в Китае. Вместо разрозненных конфигураций от третьих сторон «суперподы» подразумевают полностью интегрированное корпоративное оборудование.

Ни потребительские устройства, ни большинство локальных систем не смогут обработать 1,6 триллиона параметров LongCat-2.0. Она размещена в центрах обработки данных, распределенных по высокоплотным кластерам инференса, использующим параллелизм моделей.

Доставка еды — это то, чем славится Meituan, а не разработка передового ИИ. Приобретя ИИ-стартап Light Year Beyond за $281 миллионов в 2023 году, пекинская компания сделала свой вход в сферу ИИ. Согласно SiliconANGLE, она публично не объявляла о своих планах по внутренней разработке моделей до 2025 года.

MiniMax, еще одна китайская ИИ-стартап, привлекла поддержку от Alibaba и miHoYo. Согласно более ранним отчетам от Cryptopolitan, эти инвесторы обязались не продавать акции до истечения периода блокировки 9 июля.

MiniMax выпустила собственную модель с контекстным окном в миллион токенов, M3, в начале июня 2026 года, согласно Cai Lian She, цитируемой Cryptopolitan. MiniMax установила цены, которые значительно ниже, чем у лидеров рынка в США.

Независимое тестирование определит, насколько серьезно разработчики за пределами Китая будут относиться к LongCat-2.0. Оптимизация для отечественных чипов может ограничить производительность на оборудовании Nvidia, которое все еще доминирует в центрах обработки данных по всему миру. Согласно Meituan, основная архитектура рассуждений остается переносимой.

Самые умные крипто-энтузиасты уже читают нашу рассылку. Хотите присоединиться? Присоединяйтесь.

Часто задаваемые вопросы

Что такое LongCat-2.0?

LongCat-2.0 — это 1,6-триллионная open-source большая языковая модель от Meituan, использующая архитектуру разреженной смеси экспертов (sparse mixture-of-experts) и обеспечивающая контекстное окно в 1 миллион токенов.

Почему обучение на отечественных чипах имеет значение?

По словам Meituan, модель LongCat-2.0 была полностью обучена на кластерах ASIC китайского производства, что демонстрирует возможность создания моделей уровня frontiers без использования GPU Nvidia.

Как LongCat-2.0 сравнивается с другими моделями ИИ?

Опубликованные Meituan бенчмарки помещают её в один ряд с закрытыми моделями от Google, OpenAI и Anthropic, хотя независимая проверка всё ещё ожидается.

Поделиться статьёй
Ранда Моуз

Ранда Моуз

Ранда Мозес — редактор и репортёр Cryptopolitan, освещающая технологии, ИИ, робототехнику, криптовалюты, мошенничество и взломы. Она работает в сфере криптовалют с 2017 года. Ранда занимала должности в Forward Protocol, AmaZix и Cryptosomniac. Ранда имеет степень в области электротехники и электроники, полученную в Университете Брэдфорда.

ЕЩЁ … НОВОСТИ