IdentifiantMot de passe
Loading...
Mot de passe oublié ?Je m'inscris ! (gratuit)

Vous êtes nouveau sur Developpez.com ? Créez votre compte ou connectez-vous afin de pouvoir participer !

Vous devez avoir un compte Developpez.com et être connecté pour pouvoir participer aux discussions.

Vous n'avez pas encore de compte Developpez.com ? Créez-en un en quelques instants, c'est entièrement gratuit !

Si vous disposez déjà d'un compte et qu'il est bien activé, connectez-vous à l'aide du formulaire ci-dessous.

Identifiez-vous
Identifiant
Mot de passe
Mot de passe oublié ?
Créer un compte

L'inscription est gratuite et ne vous prendra que quelques instants !

Je m'inscris !

Gemini Omni 1.1 Flash de Google offre un meilleur contrôle sur la génération de vidéos par IA, avec des extensions de scènes, des transitions basées sur des images clés et une sortie en 4K

Le , par Anthony

107PARTAGES

5  0 
Google a lancé Gemini Omni 1.1 Flash, une nouvelle suite de commandes créatives et de fonctionnalités de vidéo générative offrant un meilleur contrôle de la génération de vidéos par intelligence artificielle (IA). Cette mise à jour permet aux utilisateurs de prolonger leurs scènes par incréments de 10 secondes jusqu’à 40 secondes, de définir des transitions basées sur des images clés de début et de fin pour les mouvements de caméra ou les zooms, de générer des aperçus en 360p pour un prototypage rapide, ainsi que des sorties en 4K adaptées aux flux de travail de production professionnels. Omni 1.1 Flash est disponible pour les développeurs via Google AI Studio et la plateforme Gemini Enterprise Agent, ainsi que pour les abonnés Google AI Plus, Pro et Ultra via Flow.

Google LLC est une multinationale américaine spécialisée dans les technologies de l'information, la publicité en ligne, les moteurs de recherche, la messagerie électronique, le cloud computing, les logiciels, l'informatique quantique, le commerce électronique, l'électronique grand public et l'IA. Qualifiée de « société la plus puissante au monde » par la BBC, elle figure parmi les marques les plus valorisées au monde. Alphabet Inc., la société mère de Google, est souvent considérée comme une entreprise du secteur des « Big Tech ».

Au début du mois d'août 2026, l'IA Gemini de Google a dépassé le milliard d’utilisateurs actifs par mois, devenant, selon l'entreprise, le produit dont la croissance est la plus rapide de son histoire. Cette adoption ne se limite pas aux requêtes textuelles : 63 % des utilisateurs s’adressent directement à Gemini par la voix, tandis qu’une interaction sur cinq implique le partage d’écran ou la diffusion en direct par caméra.

Le 27 août, Google a dévoilé une nouvelle série de commandes créatives et de fonctionnalités de vidéo générative avec Gemini Omni 1.1, destinées à offrir aux développeurs et aux professionnels de la création un meilleur contrôle sur les vidéos générées par l'IA. Cette mise à jour apporte de nouveaux outils permettant d'étendre les scènes, de contrôler les transitions et les mouvements de caméra, de générer des aperçus plus rapidement et de produire des résultats en haute résolution.

« Aujourd’hui, nous vous présentons Gemini Omni 1.1 Flash, une nouvelle suite de commandes créatives et de fonctionnalités vidéo génératives destinées à aider les développeurs », a déclaré Google dans un communiqué. « Que vous développiez des workflows de vidéo générative, des outils créatifs ou des logiciels de montage multimédia, ces mises à jour rendent la vidéo générative plus facile à contrôler, permettent des itérations plus rapides et offrent un résultat plus abouti, prêt à être déployé en conditions réelles. »


Gemini Omni 1.1, qui introduit le « raisonnement basé sur le monde réel dans la création générative », est désormais prêt à être utilisé en production via l'API Gemini dans Google AI Studio.

Des scènes prolongées pour une narration plus longue

Les utilisateurs peuvent désormais prolonger des vidéos existantes en générant de nouvelles séquences qui s'enchaînent de manière fluide à la fin du clip d'origine. La fonctionnalité « Extension de scène » permet de reprendre une vidéo existante et de continuer à générer des séquences, là où la vidéo s'était arrêtée.

Omni 1.1 est capable d'analyser jusqu'à 10 secondes de contexte vidéo antérieur, ce qui améliore la cohérence visuelle et la continuité narrative. Les vidéos peuvent être prolongées par incréments de 10 secondes, pour une durée cumulée pouvant atteindre 40 secondes, ce qui permet aux utilisateurs de créer des séquences plus longues ou d'orienter l'histoire vers de nouvelles directions créatives.


Voici comment les utilisateurs peuvent étendre leur scène à l'aide de l'API Gemini :

Code : Sélectionner tout
1
2
3
4
5
6
7
8
9
10
11
12
13
14
from google import genai
 
client = genai.Client()
 
interaction = client.interactions.create(
    model="gemini-omni-1.1-flash",
    previous_interaction_id=previous_video_interaction.id,
    input=[
        {"type": "text", "text": "Continue the scene."}
    ],
    response_format={
        "resolution": "360p",
    },
)

Définir l'image de début et l'image de fin d'un plan

Cette mise à jour permet également aux utilisateurs de définir les images de début et de fin d’un plan. Omni 1.1 peut alors générer une vidéo continue entre ces deux images clés, ce qui rend cette fonctionnalité particulièrement utile pour les trajectoires de caméra, les transitions de zoom et les clips en boucle sans coupure.


Réaliser des prototypages rapides en 360p

Pour un prototypage plus rapide, le modèle peut générer des aperçus légers en résolution 360p jusqu’à 60 % plus rapidement et pour un tiers du coût de la génération standard en 720p d’Omni 1.1. Cela permet aux utilisateurs de tester et d’affiner leurs scènes avant de générer des versions de meilleure qualité. Cette fonctionnalité s’avère utile pour l’itération de storyboards et le rendu rapide sur les plateformes de développement.


Conversion en résolution 4K et entrées multimodales

Omni 1.1 permet désormais de générer des sorties en 1080p et 4K adaptées aux flux de travail de production professionnels. Google a également ajouté la prise en charge des entrées multimodales, ce qui permet aux utilisateurs de fournir jusqu'à trois secondes de vidéo servant de référence lors de la création d'une scène, ainsi que des détails supplémentaires pour orienter la génération de vidéos.


Disponibilité et tarifs

Omni 1.1 est accessible aux développeurs via Google AI Studio et la plateforme Gemini Enterprise Agent, avec une documentation, un guide pratique et des conseils de formulation des instructions génératives disponibles pour faciliter l'intégration.

Omni 1.1 est également accessible dans le monde entier aux abonnés Google AI Plus, Pro et Ultra via Google Flow. La fonctionnalité « Extension de scène » est disponible pour tous les abonnés aux formules Google AI Plus, Pro et Ultra à travers le monde dans l'application Gemini.


Tableau des tarifs pour Gemini Omni 1.1 Flash.

Le lancement de Gemini Omni 1.1 Flash intervient alors que la concurrence entre Google et OpenAI dans la course à l'IA générative s'intensifie. Trois ans après le choc initial provoqué par ChatGPT, plusieurs benchmarks et chercheurs estiment que le modèle Gemini de Google a les atouts nécessaires pour détrôner OpenAI et tous ses concurrents. Alors que la course à l’IA se joue souvent à coups d’annonces et de démonstrations médiatiques, Google avance avec une stratégie plus structurelle autour de Gemini. Le groupe apparaît ainsi comme un acteur de plus en plus central de cette compétition, une analyse notamment défendue par Geoffrey Hinton, souvent présenté comme le « parrain de l’IA ».

Source : Google

Et vous ?

Quel est votre avis sur le sujet ?
Trouvez-vous cette initiative de Google crédible ou pertinente ?
Que pensez-vous des fonctionnalités proposées par Gemini Omni 1.1 Flash ? Les trouvez-vous utiles et intéressantes ?

Voir aussi :

Google lance Gemini Omni, une nouvelle gamme de modèles d'IA conçus pour associer un raisonnement textuel avancé à la création multimédia, et transforme les images, les fichiers audio et le texte en vidéo

Google lance Gemini 3.5 Flash, son modèle d'IA le plus performant pour la programmation, la création d'agents IA autonomes, la gestion de projets de recherche ou le développement de systèmes d'exploitation

L'IA Gemini de Google a dépassé les 750 millions d'utilisateurs actifs par mois, réduisant ainsi l'écart qui la sépare de son plus grand rival, ChatGPT, qui compte 810 millions d'utilisateurs actifs par mois
Vous avez lu gratuitement 3 383 articles depuis plus d'un an.
Soutenez le club developpez.com en souscrivant un abonnement pour que nous puissions continuer à vous proposer des publications.

Une erreur dans cette actualité ? Signalez-nous-la !