IdentifiantMot de passe
Loading...
Mot de passe oublié ?Je m'inscris ! (gratuit)

Vous êtes nouveau sur Developpez.com ? Créez votre compte ou connectez-vous afin de pouvoir participer !

Vous devez avoir un compte Developpez.com et être connecté pour pouvoir participer aux discussions.

Vous n'avez pas encore de compte Developpez.com ? Créez-en un en quelques instants, c'est entièrement gratuit !

Si vous disposez déjà d'un compte et qu'il est bien activé, connectez-vous à l'aide du formulaire ci-dessous.

Identifiez-vous
Identifiant
Mot de passe
Mot de passe oublié ?
Créer un compte

L'inscription est gratuite et ne vous prendra que quelques instants !

Je m'inscris !

Google DeepMind lance Gemma 4, qu'il présente comme son modèle ouvert le plus intelligent à ce jour, axé sur le raisonnement avancé, destiné aux développeurs, aux centres de données et aux smartphones

Le , par Jade Emy

351PARTAGES

4  0 
Google vient de lancer Gemma 4, la version la plus récente et la plus performante de sa famille de modèles d'IA open source. Google lance Gemma 4 en quatre tailles, conçues pour couvrir tous les besoins, des appareils mobiles aux machines de développement haut de gamme. Le PDG de Google, Sundar Pichai, a déclaré que ces modèles renfermaient « une quantité incroyable d’intelligence par paramètre », tandis que le directeur général de Google DeepMind a qualifié Gemma 4 de « meilleurs modèles ouverts au monde pour leurs tailles respectives ». L'un des principaux atouts de Gemma 4 réside peut-être dans la façon dont Google a réussi à le rendre si compact tout en conservant sa puissance.

Gemma est une série de grands modèles de langage open source développés par Google DeepMind. Elle repose sur des technologies similaires à celles de Gemini. La première version a été publiée en février 2024, suivie de Gemma 2 en juin 2024, de Gemma 3 en mars 2025 et de Gemma 4 en avril 2026. Des variantes de Gemma ont également été développées, telles que le modèle vision-langage PaliGemma et le modèle MedGemma dédié aux consultations médicales.

Google vient de lancer Gemma 4, la version la plus récente et la plus performante de sa famille de modèles d'IA open source. L'entreprise affirme que ces derniers modèles marquent une avancée significative pour rendre l'intelligence artificielle (IA) de pointe accessible aux développeurs partout dans le monde : des puissantes stations de travail des centres de données au smartphone que vous avez dans votre poche. Google affirme que depuis la sortie de la première génération de Gemma, les développeurs l'ont téléchargée plus de 400 millions de fois, donnant naissance à un écosystème communautaire de plus de 100 000 variantes de modèles construites sur la base de Google.

Le PDG de Google, Sundar Pichai, a déclaré que ces modèles renfermaient « une quantité incroyable d’intelligence par paramètre », tandis que le directeur général de Google DeepMind a qualifié Gemma 4 de « meilleurs modèles ouverts au monde pour leurs tailles respectives ». « Gemma 4 est arrivé, et il renferme une quantité incroyable d’intelligence par paramètre », a déclaré Pichai, tout en partageant un message de Hassabis, qui a déclaré : « Je suis ravi de lancer Gemma 4 : les meilleurs modèles ouverts au monde pour leurs tailles respectives. Disponibles en 4 tailles pouvant être ajustées à votre tâche spécifique : 31B dense pour d’excellentes performances brutes, 26B MoE pour une faible latence, et 2B & 4B efficaces pour une utilisation sur des appareils périphériques – bonne création ! »


Quatre modèles Gemma 4, un seul objectif

Google lance Gemma 4 en quatre tailles, conçues pour couvrir tous les besoins, des appareils mobiles aux machines de développement haut de gamme :

- E2B (2 milliards de paramètres effectifs) — Conçu pour les téléphones et les appareils IoT
- E4B (4 milliards de paramètres effectifs) — Également optimisé pour une utilisation en périphérie et sur mobile
- 26B Mixture of Experts (MoE) — Une puissance de milieu de gamme
- 31B Dense — Le modèle phare, actuellement classé n° 3 parmi tous les modèles d'IA ouverts au monde sur le classement Arena AI, référence du secteur. Ce dernier chiffre est particulièrement frappant. Le modèle 31B aurait surpassé des concurrents 20 fois plus volumineux.

Selon Google, Gemma 4 va bien au-delà du simple chat de questions-réponses. Ses principales capacités incluent :

- Raisonnement avancé : le modèle peut gérer une planification en plusieurs étapes et une logique complexe, avec des améliorations dans les tâches mathématiques et de suivi d'instructions.
- Workflows agentiques : Gemma 4 prend en charge nativement l'appel de fonctions, la sortie de données structurées et les instructions système, permettant aux développeurs de créer des agents IA capables d'interagir de manière autonome avec des outils, des API et des services externes.
- Génération de code : les développeurs peuvent exécuter Gemma 4 entièrement hors ligne sur une machine locale, transformant ainsi un poste de travail standard en assistant de codage IA privé.
- Vision et audio : les quatre modèles peuvent traiter nativement les images et les vidéos. Les deux modèles « edge » les plus petits prennent également en charge l’entrée audio pour la reconnaissance vocale.
- Fenêtres de contexte longues : les modèles edge peuvent traiter jusqu'à 128 000 tokens en une seule invite, tandis que les modèles plus volumineux peuvent aller jusqu'à 256 000 tokens.
- Plus de 140 langues : enfin, Gemma 4 a été formé en natif sur plus de 140 langues, ce qui en fait l'un des modèles ouverts les plus inclusifs au monde.

L'un des principaux atouts de Gemma 4 réside peut-être dans la façon dont Google a réussi à le rendre si compact tout en conservant sa puissance. Ces modèles ont été entièrement conçus en étroite collaboration avec l'équipe Pixel de Google, Qualcomm Technologies et MediaTek — les entreprises à l'origine des puces qui équipent des milliards d'appareils Android à travers le monde. Le résultat est un modèle qui fonctionne entièrement hors ligne, avec une latence quasi nulle, sur des appareils courants tels que les téléphones, les cartes Raspberry Pi et le matériel Nvidia Jetson.

Google décrit Gemma 4 comme étant le fruit de la même recherche et de la même technologie de classe mondiale qui alimentent Gemini 3, son modèle propriétaire phare. Gemma 4 est désormais disponible sous licence Apache 2.0, ce qui signifie que les développeurs peuvent l'utiliser, le modifier et s'en servir librement comme base.

Voici un extrait de l'annonce de Gemma 4:

Présentation de Gemma 4 : les modèles ouverts les plus performants

Aujourd'hui, nous vous présentons Gemma 4, notre modèle ouvert le plus intelligent à ce jour. Spécialement conçu pour le raisonnement avancé et les flux de travail autonomes, Gemma 4 offre un niveau d'intelligence par paramètre sans précédent. Cette avancée s'appuie sur l'incroyable élan de la communauté : depuis le lancement de notre première génération, les développeurs ont téléchargé Gemma plus de 400 millions de fois, créant ainsi un Gemmaverse dynamique comptant plus de 100 000 variantes. Nous avons écouté attentivement ce dont les innovateurs ont besoin pour repousser les limites de l'IA, et Gemma 4 est notre réponse : des capacités révolutionnaires rendues largement accessibles sous licence Apache 2.0.


Conçue à partir des mêmes recherches et technologies de classe mondiale que Gemini 3, Gemma 4 est la famille de modèles la plus performante que vous puissiez exécuter sur votre matériel. Elle complète nos modèles Gemini, offrant aux développeurs la combinaison la plus puissante du secteur, alliant outils ouverts et propriétaires.

Des capacités de pointe et une IA axée sur le mobile

Nous lançons Gemma 4 en quatre tailles polyvalentes : Effective 2B (E2B), Effective 4B (E4B), 26B Mixture of Experts (MoE) et 31B Dense. L'ensemble de la famille va au-delà du simple chat pour gérer une logique complexe et des workflows agentiques. Nos modèles les plus volumineux offrent des performances de pointe pour leur taille : le modèle 31B occupe actuellement la 3e place mondiale des modèles ouverts dans le classement Arena AI Text, référence du secteur, tandis que le modèle 26B se classe en 6e position. Gemma 4 y surpasse des modèles 20 fois plus volumineux. Pour les développeurs, ce nouveau niveau d'intelligence par paramètre permet d'atteindre des capacités de pointe avec une charge matérielle nettement réduite.

En périphérie, nos modèles E2B et E4B redéfinissent l'utilité sur appareil, en privilégiant les capacités multimodales, le traitement à faible latence et l'intégration transparente dans l'écosystème plutôt que le nombre brut de paramètres.

Des modèles polyvalents pour divers matériels

Nous publions les poids du modèle Gemma 4 dans des tailles adaptées à des matériels et des cas d'utilisation spécifiques, vous garantissant ainsi un raisonnement de pointe partout où vous en avez besoin :

- Modèles 26B et 31B : une intelligence de pointe, hors ligne sur vos ordinateurs personnels

Optimisés pour fournir aux chercheurs et aux développeurs un raisonnement de pointe sur du matériel accessible, nos poids bfloat16 non quantifiés s'adaptent efficacement à un seul GPU NVIDIA H100 de 80 Go. Pour les configurations locales, les versions quantifiées s'exécutent en mode natif sur des GPU grand public afin d'alimenter vos IDE, vos assistants de codage et vos workflows agentiques. Notre modèle Mixture of Experts (MoE) de 26 milliards de paramètres se concentre sur la latence, n'activant que 3,8 milliards de ses paramètres totaux lors de l'inférence pour offrir un débit de tokens par seconde exceptionnellement rapide, tandis que notre modèle Dense de 31 milliards de paramètres maximise la qualité brute et fournit une base puissante pour le réglage fin.


- Modèles E2B et E4B : un nouveau niveau d'intelligence pour les appareils mobiles et IoT

Conçus dès le départ pour optimiser l'efficacité du calcul et de la mémoire, ces modèles utilisent respectivement 2 milliards et 4 milliards de paramètres lors de l'inférence afin de préserver la mémoire vive et l'autonomie de la batterie. En étroite collaboration avec notre équipe Google Pixel et des leaders du matériel mobile tels que Qualcomm Technologies et MediaTek, ces modèles multimodaux fonctionnent entièrement hors ligne avec une latence quasi nulle sur des appareils périphériques tels que les téléphones, le Raspberry Pi et le NVIDIA Jetson Orin Nano. Les développeurs Android peuvent dès aujourd’hui créer des prototypes de flux agentiques dans l’AICore Developer Preview pour assurer la compatibilité ascendante avec Gemini Nano 4.


Voici l'annonce de Gemma 4 dans la version AICore Developer Preview :

Présentation de Gemma 4 dans la version AICore Developer Preview

Chez Google, nous nous engageons à intégrer les modèles d'IA les plus performants directement dans les appareils Android que vous avez dans votre poche. Aujourd'hui, nous sommes ravis d'annoncer la sortie de notre tout dernier modèle ouvert à la pointe de la technologie : Gemma 4.

Ces modèles constituent la base de la prochaine génération de Gemini Nano. Ainsi, le code que vous écrivez aujourd’hui pour Gemma 4 fonctionnera automatiquement sur les appareils compatibles avec Gemini Nano 4 qui seront disponibles plus tard cette année. Avec Gemini Nano 4, vous bénéficierez de nos optimisations de performances supplémentaires, ce qui vous permettra de déployer en production dans tout l’écosystème Android avec l’inférence sur appareil la plus efficace qui soit.

Vous pouvez accéder en avant-première à ce modèle dès aujourd’hui via...
La fin de cet article est réservée aux abonnés. Soutenez le Club Developpez.com en prenant un abonnement pour que nous puissions continuer à vous proposer des publications.

Une erreur dans cette actualité ? Signalez-nous-la !