DERNIÈRES NOUVELLES
SÉLECTIONNÉ POUR VOUS

OpenAI restreint l'accès à son niveau Sol GPT-5.6 le plus rapide en avant-première

ParRanda MosesRanda Moses 2 minutes de lecture
OpenAI restreint l'accès à son niveau GPT-5.6 Sol le plus rapide en avant-première.
  • OpenAI a ouvert un aperçu limité d'Ultrafast, un niveau d'API basé sur Cerebras et exécutant GPT-5.6 Sol.
  • Cerebras a déclaré qu'Ultrafast fonctionne 5 fois plus vite que Claude Opus 4.8 en mode rapide et 11 fois plus vite que Claude Fable 5.
  • L'accès est limité à un groupe restreint de clients API.

OpenAI a lancé jeudi une préversion limitée d'Ultrafast. GPT-5.6 Sol fonctionne au niveau de l'API, avec un taux de sortie pouvant atteindre 750 jetons par seconde.

Le fabricant de ChatGPT affirme que ce niveau de traitement est jusqu'à 14 fois plus rapide que le traitement standard. L'entreprise le teste actuellement auprès d'un nombre limité de clients API afin d'évaluer la demande et les capacités disponibles.

Le silicium de Cerebras fait le gros du travail

La vitesse provient de Cerebras (NASDAQ : CBRS), le fabricant de puces qui a conclu un accord de calcul avec OpenAI en janvier.

Cerebras a annoncé jeudi que sa puce équipe le système GPT-5.6 Sol. Cette puce, de la taille d'une plaquette de silicium, intègre 44 Go de SRAM.

En janvier, OpenAI a conclu un accord pour l'acquisition de 750 mégawatts de de Cerebras sur une période de trois ans. Les livraisons devraient s'échelonner jusqu'en 2028. Sam Altman figure parmi les investisseurs de Cerebras.

Cerebras affirme qu'Ultrafast est 5 fois plus rapide que Claude Opus 4.8 en mode Rapide et 11 fois plus rapide que Claude Fable 5 en termes de vitesse de traitement. Anthropic propose son propre mode Rapide accéléré pour Claude, mais ses performances ne correspondent pas aux chiffres annoncés par OpenAI

Cerebras a annoncé que son supercalculateur GPT-5.6 Sol Ultrafast a réussi le test « Humanity's Last Exam », un examen de 2 500 questions portant sur la chimie, l'économie et la littérature de niveau universitaire, en un peu plus de 11 heures. La précision obtenue est comparable à celle de Claude Fable 5, dont la résolution a nécessité plus de trois jours de calcul continu.

Cerebras revendique une accélération globale de 5,6x sans perte de qualité sur GDP-Val, un benchmark basé sur des tâches intellectuelles rémunérées telles que la rédaction de mémoires juridiques et l'élaboration de modèles financiers. Un token est un fragment de texte produit par un modèle de langage lors de son écriture.

Ultrafast est conçu pour les tâches qui ne peuvent pas attendre

OpenAI déploie Ultrafast pour les tâches qui ne peuvent pas attendre un modèle plus lent.

Dans son communiqué, l'entreprise a cité la réponse auxdent , la lutte contre la fraude et l'analyse de marché, l'assistance client en direct, le commerce électronique et la recherche interactive comme des candidats potentiels.

Lors des pannes, ses ingénieurs utilisent ce niveau pour lire les journaux, analyser tracet aider à valider une solution pendant que le système est encore en panne, la décision de déploiement restant du ressort des humains.

« GPT-5.6 Sol sur Ultrafast prouve que vitesse et intelligence ne sont plus incompatibles », a déclaré Andrew Feldman, PDG de Cerebras, dans le communiqué de l'entreprise.

Sachin Katti, vice-président de la stratégie de calcul et de l'infrastructure GPT chez OpenAI, a déclaré que l'entreprise « commence par un petit groupe de clients afin de déterminer où cette vitesse crée une valeur significative »

En juillet, des rapports ont fait surface selon lesquels GPT-5.6 Sol, la version de codage de l'IA, avait supprimé de son propre chef des fichiers, des arbres de travail de codage et au moins une base de données de production, Cryptopolitan .

Matt Schumer, PDG d'OthersideAI, a écrit sur X que Sol « venait de supprimer presque TOUS les fichiers de mon Mac pardent», tandis que le développeur Bruno Lemos a déclaré qu'il avait effacé sa base de données de production.

Deux semaines avant la commercialisation de Sol, la carte système d'OpenAI avait elle-même signalé ce comportement. Elle avertissait que le modèle pouvait être « trop interventionniste » et interpréter les instructions avec trop de permissivité.

Si vous lisez ceci, vous avez déjà une longueur d'avance. Restez-y grâce à notre newsletter.

Avertissement : Les informations fournies ne constituent pas un conseil en investissement. CryptopolitanCryptopolitan.com toute responsabilité quant aux investissements réalisés sur la base des informations présentées sur cette page. Nous voustronrecommandons vivement d’effectuer vosdent et/ou de consulter un professionnel qualifié avant toute décision d’investissement.

Randa Moses

Randa Moses

Randa Moses est rédactrice et journaliste chez Cryptopolitan où elle couvre les technologies, l'intelligence artificielle, la robotique, les cryptomonnaies, les arnaques et le piratage informatique. Elle travaille dans le secteur des cryptomonnaies depuis 2017 et a notamment travaillé chez Forward Protocol, AmaZix et Cryptosomniac. Randa est diplômée en génie électrique ettronde l'Université de Bradford.

PLUS D'ACTUALITÉS