DERNIÈRES NOUVELLES
SÉLECTIONNÉ POUR VOUS

Face à l'augmentation des coûts liés à l'IA, les employés de Google se tournent vers Gemini 3.8 Flash

ParAshish KumarAshish Kumar 3 minutes de lecture
Les employés de Google testent Gemini 3.8 Flash alors que la pression sur les coûts s'accentue sur le marché de l'IA
  • Des employés de Google testeraient en interne la version préliminaire de Gemini 3.8 Flash, bien que Google n'ait pas officiellement confirmé le modèle ni la date de sortie.
  • Google accélère le déploiement de Flash, avec Gemini 3.6 Flash et 3.7 Flash arrivant à quelques semaines d'intervalle, dans le but de cibler des charges de travail d'IA moins coûteuses et à volume élevé.
  • Les coûts de l'IA subissent une pression croissante : Gartner prévoit que les dépenses liées aux plateformes et aux modèles d'IA atteindront 64,25 milliards de dollars en 2026, tandis que les entreprises exigent de plus en plus de retours sur investissement mesurables.

Des employés de Google auraient commencé à tester la version préliminaire de Gemini 3.8 Flash sur sa propre plateforme de codage, ce qui confirme une fois de plus que les principales entreprises d'IA travaillent à un rythme remarquable sur des modèles innovants et rentables.

La rapidité est essentielle pour les entreprises qui constatent la hausse des coûts de l'IA. Selon Gartner, les dépenses mondiales consacrées aux plateformes et modèles d'IA devraient atteindre 64,25 milliards de dollars en 2026, soit une augmentation annuelle de 63,4 % par rapport à 2025, les entreprises étant de plus en plus exigeantes quant à la rentabilité de leurs investissements.

Business Insider a appris, grâce à des images, que le modèle « Gemini 3.8 Flash Preview » a été publié sur la plateforme interne Jetski de Google. Un employé a indiqué qu'il semblait supérieur à la version 3.7 de Flash, tout en précisant que cette évaluation pourrait être erronée. Google n'a fait aucun commentaire. Par conséquent, le numéro de version et la date de sortie publique restent inconnus.

Une fréquence quasi mensuelle destinée au segment à bas coût

Google a été très actif ces derniers temps. Gemini 3.6 Flash a été lancé le 21 juillet et la version 3.7 Flash est devenue disponible le 13 août, le tout en un peu plus de trois semaines.

C'est intentionnel. Lors de la conférence téléphonique sur les résultats du deuxième trimestre d'Alphabet, le PDG Sundar Pichai a déclaré que Google prévoyait de publier des modèles « quasiment tous les mois » pendant le développement de Gemini 4.

Flash représente également le domaine où Google déploie ses plus importants efforts en matière de tarification. Google qualifie cette série de « véritable pilier » pour le développement et les agents – des applications où l’utilisation répétée du modèle de langage engendre des coûts de jetons importants.

Gemini 3.7 Flash a été lancé à un prix de lancement de 0,75 $ par million de jetons d'entrée et de 3,75 $ par million de jetons de sortie jusqu'à fin 2026. Cela représente exactement la moitié du prix de lancement de Gemini 3.6 Flash, qui était de 1,50 $ pour les jetons d'entrée et de 7,50 $ pour les jetons de sortie.

Course aux prix car la frontière est hors de portée

L'approche de Google révèle clairementdent lacunes dans son offre de produits grand public, notamment au sommet de sa gamme. Le 19 mai, l'entreprise annonçait que le Gemini 3.5 Pro était utilisé en interne et serait disponible pour le marché en juin. Cependant, le 21 juillet, le modèle était encore en phase de test avec des partenaires et Google annonçait son lancement public une fois finalisé.

Pour l'instant, Google se retrouve donc à devoir rivaliser agressivement sur les prix et la rapidité de lancement, tandis que son produit phare reste en suspens.

L'analyse artificielle donne à Gemini 3.7 Flash, avec un effort de raisonnement élevé, un score d'indice d'intelligence de 56, contre 61 pour GPT-5.6 Sol avec un effort maximal et 62 pour Claude Fable 5.

L'offre Luna d'OpenAI reste nettement moins chère que l'offre Flash de Google, à 0,20 $ par million de jetons d'entrée et 1,20 $ par million de jetons de sortie. Plus généralement, cette comparaison illustre l'écart important entre les prix de l'IA, qui varient de quelques centimes à plusieurs dizaines de dollars par million de jetons selon les fonctionnalités.

Pourquoi ce sont les acheteurs qui fixent les conditions

Le contexte du marché permet de mieux comprendre l'approche de Google. Gartner prévoit une forte hausse des dépenses liées aux modèles et plateformes d'IA cette année, mais l'analyste Arunasree Cheparthi indique que les budgets des entreprises font l'objet d'un examen plus approfondi, avec une attention accrue portée à l'efficacité, à la maîtrise des coûts et aux résultats mesurables.

Les données de dépenses de Ramp montrent comment cette pression peut affecter même les modèles les plus performants. Durant son premier mois, Claude Fable 5 n'a représenté que 6 % des jetons achetés par les entreprises auprès d'Anthropic et 11,4 % des dépenses liées aux modèles d'Anthropic, malgré son lancement en tête du classement d'intelligence d'Artificial Analysis. Anthropic facture 10 $ par million de jetons d'entrée et 50 $ par million de jetons de sortie pour ce modèle.

L'économiste Ara Kharazian, de Ramp, a déclaré que cette tendance suggère qu'il existe une limite supérieure à ce que les entreprises sont prêtes à payer pour des capacités brutes. Cela favorise les modèles bon marché, rapides et suffisamment performants pour la tâche — précisément le segment de marché que Google cherche à conquérir.

L'annonce d'une version publique de Gemini 3.8 Flash reste incertaine. À l'heure actuelle, les informations concernant sa démonstration proviennent d'un article de Business Insider, ce qui signifie que Google n'a pas encore fait de déclaration officielle. Or, compte tenu des changements fréquents de noms de modèles et de dates de sortie sur le marché, cette information est cruciale.

 

Si vous lisez ceci, vous avez déjà une longueur d'avance. Restez-y grâce à notre newsletter.

FAQ

Qu'est-ce que Gemini 3.8 Flash ?

D'après Business Insider, il s'agit d'un modèle d'IA Google non encore commercialisé, testé en avant-première par les employés de Google sur Jetski, sa plateforme de développement interne. Un employé a déclaré qu'il était plus performant que Flash 3.7, mais Google n'a pas souhaité faire de commentaires et son lancement public n'est pas garanti.

Pourquoi Google privilégie-t-il les modèles Flash plutôt qu'un modèle phare ?

Le Gemini 3.5 Pro, fleuron promis par Google aux développeurs en mai, n'a jamais été commercialisé, laissant l'entreprise sans modèle de pointe, alors qu'Anthropic et OpenAI dominent le marché, selon Cryptopolitan. Google a donc misé davantage sur ses modèles Flash, plus rapides et moins coûteux, pour le développement et les agents.

Combien coûte la Gemini 3.7 Flash ?

Google a fixé le prix de Flash 3.7 à 0,75 $ par million de jetons d'entrée et à 3,75 $ par million de jetons de sortie jusqu'à fin 2026, soit la moitié du prix de lancement de Flash 3.6, selon l'annonce de Google. L'offre Luna de GPT-5.6 d'OpenAI est encore moins chère, à 0,20 $ et 1,20 $ respectivement.

Partagez cet article

Avertissement : Les informations fournies ne constituent pas un conseil en investissement. CryptopolitanCryptopolitan.com toute responsabilité quant aux investissements réalisés sur la base des informations présentées sur cette page. Nous voustronrecommandons vivement d’effectuer vosdent et/ou de consulter un professionnel qualifié avant toute décision d’investissement.

Ashish Kumar

Ashish Kumar

Ashish Kumar est un journaliste spécialisé dans les cryptomonnaies et la finance, fort de huit ans d'expérience en rédaction. Il couvre l'actualité des marchés des cryptomonnaies, la réglementation, DeFiet les écosystèmes d'échange. Il a collaboré avec CoinGape, Todayq et Newsroompost. Ashish est titulaire d'un PGDP en journalisme anglais de l'IIMC. Il a également interviewé des personnalités du secteur telles qu'Arthur Hayes, Yat Siu, Austin Federa et bien d'autres.

PLUS D'ACTUALITÉS