DERNIÈRES ACTUALITÉS
SÉLECTIONNÉ POUR VOUS

Meituan open-source le modèle IA LongCat-2.0 à 1,6 trillion de paramètres entraîné sur des puces chinoises

ParRanda MosesRanda Moses 2 min de lecture
Meituan open-source le modèle d'IA LongCat-2.0 de 1,6 trillion de paramètres entraîné sur des puces chinoises.
  • Meituan a lancé LongCat-2.0, un modèle d'IA open-source de 1,6 trillion de paramètres entraîné sur des puces chinoises locales.
  • Cette publication prouve que les entreprises chinoises peuvent créer des modèles à l'échelle de pointe sans dépendre de matériel occidental restreint.
  • Cela survient alors que les restrictions à l'exportation encouragent l'autosuffisance matérielle dans le secteur technologique chinois.

Meituan affirme avoir entraîné le modèle de 1,6 trillion de paramètres sur du matériel chinois national, évitant complètement les GPU Nvidia. L'entreprise est la plus grande plateforme en Chine pour les services locaux et la livraison de repas.

Cette sortie intervient alors que les contrôles à l'exportation des États-Unis continuent de remodeler la manière dont les entreprises chinoises construisent l'IA à grande échelle. Meituan a entraîné LongCat-2.0 sur des superpods ASIC nationaux. L'entreprise présente le modèle comme la preuve que les entreprises chinoises peuvent atteindre une échelle de pointe sans les puces basées sur CUDA de Nvidia.

LongCat-2.0 fonctionne sur une conception sparse mixture-of-experts (mélange clairsemé d'experts)

LongCat-2.0 utilise une architecture sparse mixture-of-experts. DeepSeek et le Mixtral de Mistral utilisent cette même approche générale. Au lieu de déclencher simultanément les 1,6 trillion de paramètres, un routeur interne sélectionne un sous-ensemble de sous-modèles spécialisés pour chaque jeton. Par rapport à un modèle dense de même taille, cette conception maintient les coûts d'inférence à la baisse.

Le modèle est livré avec une fenêtre de contexte d'un million de jetons. Tant DeepSeek-R1-0528 que GPT-OSS d'OpenAI ont une valeur maximale de jeton de 128 000. Dans les benchmarks publiés, Meituan a comparé LongCat-2.0 aux modèles à source fermée de Google, OpenAI et Anthropic. Jusqu'à présent, ces affirmations n'ont pas été validées par des évaluations tierces impartiales.

Meituan a développé LongCat-2.0 pour servir de moteur de raisonnement principal pour les agents IA et les outils de codage. L'entreprise a cité la compréhension du code, les modifications à l'échelle du dépôt et l'exécution automatisée de tâches comme cas d'utilisation cibles.

Bernstein évalue Nvidia à 40% du marché des puces IA en Chine

Une estimation du cabinet de recherche boursière Bernstein pour 2025 a placé la part de Nvidia sur le marché chinois des puces d'intelligence artificielle à ~40 %. Huawei a un pourcentage similaire. Bernstein a prédit que Huawei gagnerait du terrain cette année, faisant chuter la part de Nvidia de 8 points de pourcentage.

En ce qui concerne les grappes ASIC nationales, Meituan affirme avoir entraîné et optimisé LongCat-2.0. Cela signifie que le modèle n'a pas besoin de la pile logicielle de Nvidia et peut plutôt fonctionner sur du matériel déjà présent en Chine. Au lieu de configurations tierces disjointes, « superpods » implique un matériel d'entreprise entièrement intégré.

Ni les appareils grand public ni la majorité des systèmes sur site ne pourront gérer les 1,6 trillion de paramètres de LongCat-2.0. Il réside dans des centres de données, répartis sur des grappes d'inférence à haute densité utilisant le parallélisme de modèles.

La livraison de repas est la spécialité de Meituan, et non son développement d'IA de pointe. En achetant la startup d'IA Light Year Beyond pour 281 millions de dollars en 2023, l'entreprise de Pékin a fait son entrée dans le domaine de l'IA. Selon SiliconANGLE, elle n'a pas annoncé publiquement ses plans de développement de modèles internes avant 2025.

MiniMax, une autre startup chinoise d'IA, a attiré le soutien d'Alibaba et de miHoYo. Selon des rapports antérieurs de Cryptopolitan, ces investisseurs se sont engagés à ne pas vendre d'actions avant l'expiration de la période de blocage le 9 juillet.

MiniMax a lancé son propre modèle à contexte d'un million de jetons, M3, début juin 2026, selon Cai Lian She cité par Cryptopolitan. MiniMax a introduit des prix nettement inférieurs aux leaders du marché aux États-Unis.

Des tests indépendants détermineront dans quelle mesure les développeurs en dehors de la Chine prendront LongCat-2.0 au sérieux. L'optimisation pour les puces nationales peut limiter les performances sur le matériel Nvidia, qui domine toujours les centres de données dans le monde entier. Selon Meituan, l'architecture de raisonnement de base reste portable.

Si vous lisez ceci, vous êtes déjà en avance. Restez ainsi grâce à notre newsletter.

FAQ

Qu'est-ce que LongCat-2.0 ?

LongCat-2.0 est un modèle de langage large (LLM) open-source de 1,6 trillion de paramètres développé par Meituan, utilisant une architecture sparse mixture-of-experts et offrant une fenêtre de contexte de 1 million de tokens.

Pourquoi l'entraînement sur des puces locales est-il important ?

Meituan indique avoir entraîné LongCat-2.0 entièrement sur des clusters ASIC fabriqués en Chine, démontrant qu'il est possible de construire des modèles d'IA à l'échelle de pointe sans GPU Nvidia.

Comment LongCat-2.0 se compare-t-il aux autres modèles d'IA ?

Les benchmarks publiés par Meituan le placent au même niveau que des modèles propriétaires de Google, OpenAI et Anthropic, bien que leur vérification indépendante soit en attente.

Partager cet article
Randa Moses

Randa Moses

Randa Moses est rédactrice et journaliste chez Cryptopolitan, couvrant la technologie, l'IA, la robotique, la crypto, les arnaques et les piratages. Elle évolue dans l'espace crypto depuis 2017. Elle a occupé des postes chez Forward Protocol, AmaZix et Cryptosomniac. Randa détient un diplôme en génie électrique et électronique de l'Université de Bradford.

PLUS D'ACTUALITÉS…