DERNIÈRES NOUVELLES
SÉLECTIONNÉ POUR VOUS

Grok 4.7 surpasse Fable 5.1 et GPT-5.6 Sol au test d'agent légal de Harvey, pour un cinquième du coût d'entrée de Fable

ParRanda MosesRanda Moses 2 minutes de lecture
Grok 4.7 surpasse Fable 5.1 et GPT-5.6 Sol sur le test d'agent légal de Harvey à un cinquième du prix d'entrée de Fable.
  • Grok 4.7 a obtenu un score de 19,6 % sur le Harvey Legal Agent Benchmark, devant Fable 5.1 à 6,7 % et GPT-5.6 Sol à 2,5 %.
  • xAI fixe le prix de Grok 4.7 à 2$ par million de jetons d'entrée, soit un cinquième des 10$ de Fable 5.1.
  • Fable 5.1 bat toujours Grok 4.7 sur Terminal-Bench 4.0, 57,9 % contre 38,0 %.

xAI a lancé Grok 4.7 lundi. Il a surpassé Fable 5.1 d'Anthropic et GPT-5.6 Sol d'OpenAI sur un benchmark d'agent légal, tout en facturant un cinquième du prix de Fable par jeton d'entrée.

Output facture 6$ par million de jetons contre 50$ chez Anthropic

Selon le communiqué de xAI, Grok 4.7 a obtenu un score de 19,6 % au test de performance Harvey Legal Agent Benchmark. Fable 5.1 a obtenu 6,7 % au même test et GPT-5.6 Sol 2,5 %.

Cela place Grok 4.7 à environ trois fois le score d'Anthropic et près de huit fois celui de Sol. Cryptopolitan a rapporté le mois dernier que Grok 4.6 devançait déjà ce duo avec 15,8 %.

Le domaine juridique est l'un des rares où Grok 4.7 surpasse nettement ses deux concurrents. Il obtient également de meilleurs résultats que Fable 5.1 au test d'ingénierie électrique EEBench et le devance légèrement au test de programmation DeepSWE.

La tarification de Grok 4.7 est 2$ par million de jetons d'entrée et 6$ par million de jetons de sortie, soit la même que celle de Grok 4.6. Ce taux d'entrée est la moitié de celui de GPT-5.6 Sol ( 4$ et un cinquième de celui de Fable 5.1 ( 10$ .

Le coût de production est de 6$ pour Sol contre 20$ pour Sol et 50$ pour Fable, soit environ un huitième du coût d'Anthropic.

xAI a comparé les scores de CursorBench 4.0 au coût moyen par tâche accomplie et affirme que le modèle se situe à la frontière des performances en termes de prix. Grok 4.7 obtient environ 46 % sur ce graphique pour un coût d'environ 6$ par tâche, tandis que Claude Opus 5 nécessite presque le double pour un résultat similaire.

Fable 5.1 est plus performant avec des budgets plus élevés, atteignant 51,8 % à environ 17$ par tâche. Cette version représente « une combinaisontrond'intelligence, de rapidité et de faible coût », a déclaré Musk sur X.

Grok 4.7 surpasse Fable 5.1 et GPT-5.6 Sol sur le test d'agent légal de Harvey à un cinquième du prix d'entrée de Fable.
Prix ​​des jetons et scores de référence tirés de l'article de lancement de Grok 4.7 de SpaceXAI , publié le 21 septembre 2026.

Terminal-Bench 4.0 donne à Anthropic une avance de 57,9 % à 38,0 %

Grok 4.7 s'est classé deuxième derrière Fable 5.1 sur GDPval et le test de tâches bureautiques AA Briefcase. Le modèle d'Anthropic conserve une nette avance sur les tests de programmation longue et les benchmarks de terminal.

La plus grande marge se trouve sur Terminal-Bench 4.0, où Fable 5.1 avait 57,9 % contre 38,0 % pour Grok 4.7, soit une différence d'environ 20 points.

Fable est également en tête sur CursorBench et sur HealthBench Professional en raisonnement clinique, où GPT-5.6 Sol bat également Grok.

Grok 4.7 a obtenu un score Elo de 1 695 sur GDPval, qui évalue les modèles sur des tâches effectuées par des avocats, des infirmières et des analystes financiers, contre 1 605 pour Grok 4.6. Ce score est inférieur à celui de Fable 5.1 (1 735), mais supérieur à celui de GPT-6 Astra d'OpenAI (1 542) sur le même graphique.

Grok 4.7 surpasse GPT-5.6 Sol sur cinq des sept tests de performance. Seuls DeepSWE et le test clinique le devancent.

Grok 4.7 fonctionne avec 2,1 billions de paramètres, soit 40 % de plus que les 1,5 billions qui alimentent Grok 4.6. xAI a inclus des données d'entraînement supplémentaires de SpaceX, notamment la télémétrie du satellite Starlink et les dossiers de fabrication.

L'entreprise affirme que ce modèle est plus susceptible de consacrer plus de temps aux problèmes complexes et de revérifier ses propres réponses que Grok 4.6.

Le modèle a été lancé sur l'application Grok, Cursor, Grok Build et l'API xAI, sans liste d'attente.

Tous les chiffres présentés ici proviennent des tests réalisés par xAI. CursorBench, le test principal utilisé par xAI, est développé par Cursor, société rachetée par SpaceX le mois dernier.

xAI a été comparé à GPT-5.6 Sol, et le plus récent GPT-6 Astra d'OpenAI n'apparaît que dans les graphiques GDPval, AA Briefcase et EEBench.

Les plus grands experts en cryptomonnaies lisent déjà notre newsletter. Envie d'en faire partie ? Rejoignez-les !

FAQ

Quel est le prix de Grok 4.7 par rapport à Fable 5.1 et GPT-5.6 Sol ?

Grok 4.7 coûte 2$ par million de jetons d'entrée et 6$ par million de jetons de sortie, contre 10$ et 50$ pour Fable 5.1.

Quels sont les benchmarks sur lesquels Grok 4.7 excelle et ceux sur lesquels il est moins performant ?

Grok 4.7 remporte le benchmark juridique Harvey à 19,6 %, tandis que Fable 5.1 est en tête sur CursorBench, Terminal-Bench et HealthBench Professional.

Quelle est la taille de Grok 4.7 et sur quel matériel a-t-il été entraîné ?

Grok 4.7 fonctionne avec 2,1 billions de paramètres et inclut des données d'entraînement supplémentaires de SpaceX telles que la télémétrie du satellite Starlink.

Partagez cet article

Avertissement : Les informations fournies ne constituent pas un conseil en investissement. CryptopolitanCryptopolitan.com toute responsabilité quant aux investissements réalisés sur la base des informations présentées sur cette page. Nous voustronrecommandons vivement d’effectuer vosdent et/ou de consulter un professionnel qualifié avant toute décision d’investissement.

Randa Moses

Randa Moses

Randa Moses est rédactrice et journaliste chez Cryptopolitan où elle couvre les technologies, l'intelligence artificielle, la robotique, les cryptomonnaies, les arnaques et le piratage informatique. Elle travaille dans le secteur des cryptomonnaies depuis 2017 et a notamment travaillé chez Forward Protocol, AmaZix et Cryptosomniac. Randa est diplômée en génie électrique ettronde l'Université de Bradford.

PLUS D'ACTUALITÉS