IdentifiantMot de passe
Loading...
Mot de passe oublié ?Je m'inscris ! (gratuit)

Vous êtes nouveau sur Developpez.com ? Créez votre compte ou connectez-vous afin de pouvoir participer !

Vous devez avoir un compte Developpez.com et être connecté pour pouvoir participer aux discussions.

Vous n'avez pas encore de compte Developpez.com ? Créez-en un en quelques instants, c'est entièrement gratuit !

Si vous disposez déjà d'un compte et qu'il est bien activé, connectez-vous à l'aide du formulaire ci-dessous.

Identifiez-vous
Identifiant
Mot de passe
Mot de passe oublié ?
Créer un compte

L'inscription est gratuite et ne vous prendra que quelques instants !

Je m'inscris !

Google lance Gemini 3.8 Flash, destiné à l'ingénierie logicielle, aux tâches d'agent IA et au raisonnement critique en plusieurs étapes, ainsi qu'une variante dédiée à la cybersécurité

Le , par Jade Emy

106PARTAGES

5  0 
Google a lancé Gemini 3.8 Flash et Gemini 3.8 Flash Cyber, sa troisième version « Flash » en six semaines, le modèle dédié à la cybersécurité étant réservé aux testeurs de confiance et aux gouvernements. Les tarifs de lancement sont valables jusqu’à la fin de l’année : 0,75 $ par million de jetons d’entrée et 3,75 $ par million de jetons de sortie, contre respectivement 1,50 $ et 7,50 $ par la suite. En vertu de la loi européenne sur l’IA, tout modèle à usage général mis sur le marché est soumis à des obligations en matière de documentation, de droits d’auteur et de données d’entraînement, et tout modèle présentant un risque systémique doit être notifié à la Commission dans un délai de deux semaines.

Gemini est une famille de grands modèles de langage multimodaux (LLM) développée par Google DeepMind, qui succède à LaMDA et PaLM 2. Composée de Gemini Pro, Gemini Deep Think, Gemini Flash et Gemini Flash Lite, elle a été annoncée le 6 décembre 2023. Elle alimente le chatbot Gemini et tire son nom du signe du zodiaque des Gémeaux. Récemment, Google a annoncé Gemini 3.8 Flash, qui arrive trois semaines après la version 3.7, avec une variante dédiée à la cybersécurité réservée à des testeurs de confiance et à des gouvernements dont les noms n’ont pas été divulgués.

Google a lancé Gemini 3.8 Flash et Gemini 3.8 Flash Cyber, sa troisième version « Flash » en six semaines, le modèle dédié à la cybersécurité étant réservé aux testeurs de confiance et aux gouvernements. En vertu de la loi européenne sur l’IA, tout modèle à usage général mis sur le marché est soumis à des obligations en matière de documentation, de droits d’auteur et de données d’entraînement, et tout modèle présentant un risque systémique doit être notifié à la Commission dans un délai de deux semaines.

Avec ce lancement, il existe deux variantes : un modèle général que Google qualifie de « cheval de bataille », et Flash Cyber, optimisé pour détecter et corriger les vulnérabilités logicielles. Flash Cyber remplace la version 3.5. Les tarifs de lancement sont valables jusqu’à la fin de l’année : 0,75 $ par million de jetons d’entrée et 3,75 $ par million de jetons de sortie, contre respectivement 1,50 $ et 7,50 $ par la suite. Les concurrents ont baissé leurs tarifs par jeton pour fidéliser les entreprises méfiantes.

En Europe, chaque lancement est soumis à des obligations de conformité. L’article 53 exige une documentation technique, une politique en matière de droits d’auteur et un résumé public des données d’entraînement pour chaque modèle à usage général mis sur le marché. Google s’est engagé de son plein gré. L’entreprise a adhéré au Code de bonnes pratiques en matière d’IA à usage général le 30 juillet 2025, une semaine après le refus de Meta.

Le niveau de risque systémique est soumis à un délai. Tout modèle entraîné au-delà de 10 à la puissance 25 opérations en virgule flottante doit être notifié à la Commission dans un délai de deux semaines, conformément à l’article 52. Ce délai est plus court que l’intervalle entre ces lancements. Gemini 3.7 Flash est sorti trois semaines avant celui-ci. On ignore si l’un d’entre eux dépasse ce seuil. Google ne l’a pas précisé, et la présomption repose sur la puissance de calcul utilisée pour l’entraînement plutôt que sur les résultats des tests de performance. Les modèles Flash sont, par conception, plus légers que ceux de la gamme Pro.

La variante « Cyber » soulève une autre question. Flash Cyber n’est destiné qu’à des testeurs de confiance et à des gouvernements, sans que Google ne précise lesquels. Le reste concerne le point faible bien connu. Les propres chiffres de Google placent Flash derrière Claude Opus en matière d’utilisation informatique agentique. Les affirmations en matière de sécurité sont toutes internes. Une amélioration de 2,6 fois de la précision des correctifs pour l’équipe Chrome, et une vulnérabilité critique détectée en deux heures, toutes deux mesurées par Google.

En août, l’assistant d’intelligence artificielle (IA) Gemini de Google a dépassé le milliard d’utilisateurs actifs mensuels, atteignant ce seuil peu de temps après que ChatGPT d’OpenAI eut franchi le même cap. Google a précisé que 63 % des utilisateurs s’adressent directement à Gemini à la voix plutôt que de saisir des requêtes, soulignant que les parents très occupés sont « 43 % plus enclins à utiliser la commande vocale pour leurs tâches quotidiennes ». Selon Google, une interaction sur cinq avec Gemini implique le partage d’écran et la diffusion en direct par caméra. Les utilisateurs d’Apple représentent plus de 100 millions d’utilisateurs actifs mensuels de Gemini.


Voici l'annonce de Google :

Présentation de Gemini 3.8 Flash et 3.8 Flash Cyber

Forts du succès de la version 3.7 Flash lancée il y a trois semaines et marquant notre troisième version Flash en seulement six semaines, nous vous présentons aujourd’hui Gemini 3.8, notre meilleur modèle de raisonnement et de codage à ce jour, offrant la même vitesse et le même faible coût que la version 3.7. Gemini 3.8 se décline en deux variantes :

- Gemini 3.8 Flash : notre modèle polyvalent le plus intelligent, offrant des améliorations significatives par rapport à la version 3.7 Flash dans les domaines de l’ingénierie logicielle, des tâches agentiques et du raisonnement critique en plusieurs étapes dans des domaines spécialisés. Il est disponible au même prix de lancement que la version 3.7 Flash, soit 0,75 $ par million de tokens d’entrée et 3,75 $ par million de tokens de sortie.

- Gemini 3.8 Flash Cyber : notre modèle de cybersécurité le plus performant, offrant des performances de pointe en matière de détection des vulnérabilités et d’application automatisée de correctifs, accessible aux défenseurs de confiance via notre nouveau programme Fairwind.

Bien qu’adaptées à différents environnements de déploiement, les deux versions présentées aujourd’hui s’appuient sur la même intelligence fondamentale et sont encore accélérées par des boucles agentiques de longue durée conçues pour évaluer et affiner de manière récursive les modèles sous-jacents. Les gains significatifs en matière de codage et de raisonnement au sein de ce noyau commun ont été rendus possibles par un certain nombre d’innovations, notamment un entraînement rigoureux dans le domaine très exigeant de la cybersécurité.

Gemini 3.8 Flash : conçu pour le codage à long terme et les agents autonomes

Gemini 3.8 Flash offre des gains substantiels par rapport à la version 3.7 Flash, se rapprochant souvent des performances de modèles de pointe plus coûteux.


Sur DeepSWE v1.1 (ingénierie logicielle à long terme), 3.8 Flash surpasse la plupart des grands modèles de pointe dans la résolution autonome de problèmes d’ingénierie complexes de bout en bout, et ce pour un coût nettement inférieur.

De plus, 3.8 Flash fait preuve de la fiabilité requise pour l’autonomie critique des entreprises, dans divers domaines de connaissances spécialisés. Dans les domaines quantitatifs et professionnels nécessitant des analyses et des rapports avancés, la version 3.8 Flash surpasse la version 3.7 Flash et d’autres modèles de pointe dans des tests de performance tels que Vals Finance Agent V2 et Harvey’s Legal Agent Benchmark. La version 3.8 Flash obtient également un score de 54,9 % au test HLE-Verified, démontrant ainsi sa capacité à gérer un raisonnement en plusieurs étapes dans les domaines des sciences, des technologies, de l’ingénierie et des mathématiques (STEM), des sciences humaines et des domaines professionnels.


Ces gains de performance découlent d’un choix de conception fondamental : 3.8 Flash travaille plus dur. Sur des tâches complexes, il fait preuve d’une plus grande rigueur — en exécutant des étapes de raisonnement supplémentaires et en appelant des outils de manière itérative. Parfois, le modèle peut utiliser davantage de tokens pour optimiser ses performances, en particulier à des niveaux d’effort plus élevés.

Pour les applications où l’efficacité de calcul constitue la principale contrainte, les développeurs peuvent utiliser des niveaux d’effort plus faibles afin de minimiser la surcharge liée aux tokens, ou continuer à s’appuyer sur Gemini 3.7 Flash, qui reste entièrement pris en charge pour les charges de travail privilégiant l’efficacité.

Gemini 3.8 Flash Cyber : des performances de pointe en cybersécurité

Gemini 3.8 Flash Cyber, accessible à un groupe de défenseurs de confiance via le programme Fairwind, offre un avantage décisif dans le paysage complexe actuel de la cybersécurité, grâce à la vitesse et au coût de la version Flash qui permettent des itérations rapides.

Détection autonome des vulnérabilités

Sur CyberGym, la référence standard du secteur pour la détection des vulnérabilités, Gemini 3.8 Flash Cyber affiche des performances de pointe en matière de détection autonome des vulnérabilités. Il surpasse à la fois 3.5 Flash Cyber et des modèles de pointe nettement plus volumineux.


Afin de mieux cerner les besoins défensifs réels, qui ne se limitent pas aux bases de code C/C++ comme dans CyberGym, nous avons également évalué Gemini 3.8 Flash Cyber à l’aide d’un benchmark interne complet dans lequel le modèle doit détecter un large éventail de vulnérabilités au sein de bases de code complexes couvrant 20 langages de programmation. Dans ce contexte, le modèle affiche un bond en avant impressionnant par rapport à nos modèles précédents et atteint un taux de réussite supérieur à 70 %.


Correction automatisée

Avec Gemini 3.8 Flash Cyber, nous nous sommes particulièrement attachés à doter les défenseurs de capacités expertes leur conférant un avantage sur les attaquants. C’est pourquoi nous avons investi dès le départ dans la correction des vulnérabilités et lui avons donné la priorité par rapport aux capacités offensives telles que l’exploitation.

CWE-Bench, géré par Collinear, est un benchmark externe exigeant évaluant les capacités de correction des vulnérabilités. Sur ce benchmark, Gemini 3.8 Flash Cyber se situe sur la frontière de Pareto : avec un taux de réussite « pass@1 » de 47,2 % contre 47,8 % pour un modèle de pointe, tout en étant proposé à un...
La fin de cet article est réservée aux abonnés. Soutenez le Club Developpez.com en prenant un abonnement pour que nous puissions continuer à vous proposer des publications.

Une erreur dans cette actualité ? Signalez-nous-la !