Aller au contenu
Français
Contenu FikirPilot

Google indique que le nouveau modèle Gemini 3.8 Flash « works harder », mais pourrait coûter plus cher

Mis à jour: 05/09/2026 · 3 min de lecture · 458 mots

Publié: · Dépêche reçue: · Durée de traitement: 71 h 8 min

Google indique que le nouveau modèle Gemini 3.8 Flash « works harder », mais pourrait coûter plus cher
Un couloir moderne de centre de données

Google a présenté Gemini 3.8 Flash quelques semaines après la mise sur le marché de son modèle précédent. L’entreprise indique que le modèle effectue davantage d’étapes de raisonnement pour les tâches complexes et utilise les outils de manière itérative. Le prix de lancement est le même que celui de Gemini 3.7 Flash : 0,75 $ par million de tokens d’entrée et 3,75 $ par million de tokens de sortie. Google avertit toutefois que davantage de tokens pourraient être utilisés afin d’améliorer les performances, notamment aux niveaux d’effort élevés. Les développeurs souhaitant réduire la consommation de tokens pourront continuer à utiliser Gemini 3.7 Flash.

Artificial Analysis a rapporté que le modèle était l’option la moins chère qu’ils aient mesurée à ce niveau d’intelligence, mais que son coût était environ 40 % plus élevé que celui de Gemini 3.7 Flash en raison d’une hausse de 30 % du nombre de tokens de sortie par tâche et d’un plus grand nombre de tours de traitement. Google a annoncé des progrès importants dans l’ingénierie logicielle et les agents d’IA autonomes ; le modèle a devancé ses concurrents lors des tests DeepSWE v1.1, Vals Finance Agent V2 et Harvey’s Legal Agent. Le modèle est doté de mesures de sécurité visant à prévenir les utilisations abusives dans les domaines CBRN et des cyberattaques.

Gemini 3.8 Flash Cyber est proposé dans le cadre du Fairwind Program, accessible à ses 650 membres ainsi qu’aux gouvernements et aux partenaires de confiance. Le programme donne également accès à l’outil CodeMender. Gemini 3.8 Flash est accessible aux consommateurs, aux développeurs et aux utilisateurs professionnels.

Pourquoi est-ce important

Pour les développeurs, le principal changement tient au fait que, malgré le maintien du même tarif d’entrée, l’intensité de traitement des tâches complexes peut augmenter le coût total. Le choix du modèle dépend donc désormais non seulement du tarif unitaire des tokens, mais aussi du nombre de tokens de sortie et de tours de traitement nécessaires à la tâche ; pour ceux qui souhaitent une consommation moindre, la version précédente reste une option. Les résultats des tests en ingénierie logicielle et avec des agents autonomes offrent une base de comparaison aux équipes qui évaluent l’utilisation du modèle dans ces domaines ; toutefois, il apparaît qu’une partie des données de performance repose sur les propres déclarations de Google. L’ouverture de la version dédiée à la cybersécurité à un programme limité distingue quant à elle son périmètre d’accès de l’utilisation générale et laisse ouverte la question de savoir qui pourra utiliser cette version spéciale et dans quelles conditions.

Contexte

Google n’est pas un nouveau nom dans les archives de FikirPilot : nous avons publié 24 articles mentionnant ce nom au cours des 90 derniers jours ; le plus récent date du 5 septembre 2026.

Source: The Verge