HitPaw VikPea HitPaw VikPea
Acheter
hitpaw video enhancer header image

HitPaw VikPea

  • Amélioration automatique de la qualité vidéo grâce à l'intelligence artificielle basée sur l'apprentissage automatique.
  • Upscaler vidéo IA pour déflouter et coloriser les vidéos
  • IA spécialement conçue pour réparer les vidéos endommagées ou illisibles
  • Suppression et remplacement rapides et fluides de l'arrière-plan vidéo

Gemini Omni 1.1 Flash : Avis, fonctionnalités, tarifs et API

hitpaw editor in chief Par Clément Poulain
Dernière mise à jour : 2026-09-15 17:04:30

Google n'a pas attendu longtemps pour mettre à jour son modèle vidéo. Gemini Omni Flash n'était sorti que depuis juin, et à la fin août, Google DeepMind avait déjà lancé Gemini Omni 1.1 Flash, une version qui corrige de nombreuses plaintes que les gens avaient à propos de l'original. Des scènes plus longues, un véritable contrôle des images, un moyen moins cher de tester des idées avant de payer pour un clip terminé, c'est la version courte.

Mais savoir si cela vaut réellement la peine de faire le switch, ou de construire un flux de travail autour en premier lieu, dépend de choses comme le prix par seconde, la façon dont le montage tient réellement, et où cela reste insuffisant par rapport à Veo ou Sora. C'est ce que cette critique examine.

Partie 1. Qu'est-ce que Gemini Omni 1.1 Flash et que peut-il faire?

What is Gemini Omni 1.1 Flash AI model and its key features

Vue d'ensemble de Gemini Omni 1.1 Flash et date de sortie

L'endpoint gemini-omni-flash-preview a été déployé avec le modèle original ce juin, et sera discontinué le 27 août 2026, avec la sortie de Gemini Omni 1.1 Flash. L'ID du modèle pour l'API est gemini-omni-1.1-flash, et Google indique que l'ancien endpoint de prévisualisation restera jusqu'au 30 septembre 2026, rendant difficile pour ceux qui continuent à développer sur cet endpoint d'avoir une date limite.

C'est un modèle multimodal, ce qui signifie qu'il accepte du texte, des images, de l'audio et de la vidéo comme entrée, et n'utilise pas un simple appel de génération en une seule fois - il utilise plutôt l'API Interactions de Google.

Toutes ses vidéos ont des effets sonores, du bruit ambiant, des dialogues et des effets sonores synchronisés, pas une vidéo silencieuse à laquelle vous devez ajouter de la musique. Il prend en charge 360p, 720p, 1080p et 4K dans un rapport d'aspect de 16:9 ou 9:16 - bien que 1080p et 4K soient techniquement des "upscales" et non rendus nativement.

Quoi de neuf dans Gemini Omni 1.1 Flash pour la génération vidéo AI?

Gemini Omni 1.1 Flash for AI video generation and creative video creation

Les fonctionnalités de base de l'original Omni Flash sont restées largement inchangées : texte-vidéo, image-vidéo, référence-vidéo et montage conversationnel. La différence réside dans le degré de contrôle que vous pouvez exercer sur le résultat.

  • Avec plus seulement le dernier cadre de la scène précédente à regarder, les continuations sont désormais lues jusqu'à 10 secondes auparavant. Maintenant, l'extension de scène lit jusqu'à 10 secondes de séquences précédentes, ce qui rend les continuations beaucoup moins saccadées que dans les versions précédentes.
  • Les clips peuvent désormais être prolongés par intervalles de 10 secondes jusqu'à un total de 40 secondes, par rapport à la limite plate de 10 secondes de l'original.
  • L'interpolation du premier et du dernier cadre vous permet de spécifier une première image et une dernière image, et le modèle interpolera entre elles pour produire une transition fluide, ce qui est bon pour les prises d'orbite, de zoom et de time-lapse.
  • Le nouveau mode brouillon 360p coûte environ un tiers du prix et est 60 % plus rapide, et peut être utilisé pour tester des idées avant de prendre le temps de rendre une image en pleine qualité.
  • Des clips vidéo courts sont maintenant acceptés comme référence, en plus des images fixes, donc transférer un personnage ou un style de mouvement entre des prises est plus fiable.

Aucune de ces fonctionnalités ne fait d'Omni un produit complètement nouveau. Le même concept, juste avec le détail supplémentaire que les gens recherchaient depuis la première sortie, de générer et d'éditer des vidéos naturellement avec la parole.

Partie 2. Comment utiliser Gemini Omni 1.1 Flash?

Comment utiliser Gemini Omni 1.1 Flash dans Google AI Studio

Pour quiconque souhaite simplement essayer sans écrire de code, Google AI Studio est le point d'entrée le plus facile.

Ouvrez AI Studio, choisissez Gemini Omni 1.1 Flash dans la liste des modèles, et soit tapez une invite, soit téléchargez une image ou un clip de référence.

Gemini Omni 1.1 Flash in Google AI Studio for AI development and testing

Google recommande d'être spécifique sur la scène, le mouvement de la caméra et l'éclairage plutôt qu'une vague phrase, car le modèle s'appuie sur ces détails pour remplir la physique et le cadrage de la prise.

Une fois qu'un brouillon revient, vous pouvez le régénérer, demander une résolution différente, ou passer directement à l'édition à travers des invites de suivi.

Comment Gemini Omni 1.1 Flash gère-t-il l'édition vidéo et l'extension?

C'est là que l'API Interactions justifie son utilité. Au lieu d'écrire une longue invite et d'espérer que la sortie corresponde, vous générez un clip et puis vous lui parlez : échanger un arrière-plan, changer l'heure de la journée, faire tourner un personnage pour faire face à la caméra. Le modèle applique juste le changement que vous avez demandé et laisse le reste de la prise intact, ce qui est beaucoup moins fragile que de régénérer à partir de zéro chaque fois que quelque chose ne va pas.

L'extension fonctionne de la même manière conversationnelle. Vous pointez le modèle vers un clip existant, et parce qu'il lit désormais jusqu'à 10 secondes de ce footage plutôt qu'une seule image, la continuation maintient la lumière, la position du personnage, et le mouvement cohérents au lieu de réinitialiser la scène. Enchaînez suffisamment de ces éléments et vous pouvez accumuler jusqu'à cette limite cumulative de 40 secondes.

Partie 3. Combien coûte l'API Gemini Omni 1.1 Flash et comment l'utiliser?

Quel est l'ID du modèle API Gemini Omni 1.1 Flash?

L'ID de modèle stable est gemini-omni-1.1-flash, disponible via l'API Gemini et Google AI Studio. Google l'énumère également, marqué comme Prévisualisation, à l'intérieur de la plateforme Gemini Enterprise Agent pour les équipes construisant des outils internes, et il apparaît dans Google Flow pour quiconque ayant un abonnement AI Plus, Pro ou Ultra.

Comment utiliser l'API Gemini Omni 1.1 Flash?

Le flux de base est un seul appel à l'endpoint d'interaction. Vous passez une invite textuelle (et éventuellement une image, un clip audio, ou une vidéo de référence) avec une résolution souhaitée, et le modèle renvoie la vidéo générée sous forme de données encodées en base64. À partir de là, peaufiner le résultat n'est qu'un autre appel d'interaction référencant la même session, décrivant le changement que vous souhaitez dans un langage simple plutôt que de renvoyer toute l'invite.

Combien coûte l'API Gemini Omni 1.1 Flash?

Les prix fonctionnent selon le modèle de jetons standard de Google, avec des vidéos facturées par résolution plutôt qu'un tarif forfaitaire unique :

  • Entrée (texte, image, vidéo ou audio, tous facturés de la même manière) : 1,50 $ par 1M de jetons
  • Sortie texte : 9,00 $ par 1M de jetons
  • Sortie vidéo : 17,50 $ par 1M de jetons, avec 720p facturé à 5 792 jetons par seconde

Calculé par seconde, cela donne à peu près ces chiffres :

  • Brouillon 360p : environ 0,03 $ par seconde
  • 720p : environ 0,10 $ par seconde
  • 1080p : environ 0,15 $ par seconde
  • 4K : environ 0,30 $ par seconde

Donc, un clip complet de 10 secondes à 720p coûte près d'un dollar, tandis que le même clip brouillon à 360p coûte environ trente cents. Il n'y a pas de niveau gratuit et pas de remise pour les lots, ce qui rend le flux de travail brouillon-puis-upscale réellement valable si vous testez beaucoup d'invites avant de vous engager dans un rendu final.

Quelles sont les limites de l'API Gemini Omni 1.1 Flash?

Quelques limites pratiques valent la peine d'être connues avant de construire quelque chose de sérieux sur ce modèle :

  • Les générations uniques sont toujours limitées à 10 secondes ; toute chose plus longue nécessite de chaîner des extensions jusqu'à un total de 40 secondes.
  • 1080p et 4K sont produits comme des upscales de la base de rendu, pas générés nativement à cette résolution.
  • L'extension de scène tire le contexte de jusqu'à 10 secondes de footage précédent, donc la continuité au-delà de cette fenêtre peut dériver.
  • La carte modèle propre de Google est claire que le mouvement complexe, les montages multi-étapes, et la précision du texte à l'écran sont toujours des domaines où les résultats peuvent être incohérents.

Partie 4. Gemini Omni 1.1 Flash est-il meilleur que les anciens modèles Gemini?

Gemini Omni 1.1 Flash vs Gemini Omni Flash

Le saut de l'original Omni Flash à 1.1 concerne principalement le contrôle plutôt que la qualité brute. La première version atteignait un maximum de 10 secondes sans chemin d'extension et sans moyen de définir un cadre de fin spécifique, donc la documentation de Google dirigeait les gens vers Veo pour tout nécessitant une extension de scène ou un contrôle du dernier cadre. 1.1 intègre ces capacités directement dans Omni : des scènes cumulatives de 40 secondes, une interpolation du premier et du dernier cadre, et un niveau de 360p moins cher pour le prototypage. Les prix à 720p n'ont pas changé, donc vous obtenez plus de capacités au même tarif affiché.

Gemini Omni 1.1 Flash vs Autres modèles de génération vidéo AI

Par rapport au reste du terrain, le plus grand différenciateur d'Omni 1.1 reste l'édition conversationnelle à plusieurs tours intégrée dans l'API Interactions, la plupart des modèles concurrents traitent la génération et l'édition comme deux outils séparés. Veo 3.1 reste l'autre option de Google et est toujours le choix pour certaines chaînes existantes, bien qu'Omni ait comblé beaucoup de cet écart avec cette mise à jour. Comparé à Sora ou des modèles de type Kling, la piste audio native d'Omni et le support référence-vidéo lui donnent un avantage pour quiconque souhaite un clip utilisable en un seul passage plutôt que de coudre vidéo et son ensemble par la suite. Google revendique un score de premier plan sur le tableau des leaders de la Text-to-Video Arena pour Omni 1.1, bien que ce soit un chiffre propre à Google et n'ait pas été vérifié indépendamment.

Gemini Omni 1.1 Flash vaut-il la peine d'être utilisé?

Pour quiconque faisant un travail créatif itératif, des publicités, des clips sociaux, des vidéos concepts rapides, la tarification brouillon-puis-upscale et l'édition conversationnelle en font un outil réellement pratique plutôt qu'une nouveauté. Les développeurs obtiennent une structure de coût claire basée sur la résolution et un chemin de migration documenté hors de l'ancien endpoint de prévisualisation. Les bords rugueux sont les mêmes que ceux que Google admet : le mouvement reste tremblant dans des scènes complexes, et le texte rendu à l'intérieur d'une vidéo n'est pas toujours fiable. Si votre cas d'utilisation repose sur des clips courts et itératifs, cela vaut le prix. Si vous avez besoin d'une sortie longue, native 4K dès le départ, vous voudrez toujours ajuster vos attentes en conséquence.

Partie 5. Conseils Pro : Comment améliorer les vidéos AI Gemini Omni 1.1 Flash à 8K

Pourquoi devriez-vous améliorer les vidéos générées par AI après la génération?

Même avec 4K répertorié comme option de sortie, cette résolution est un upscale de la génération originale, pas une capture native 4K. Cela signifie que les détails fins, la texture de la peau, les cheveux, le tissu, les éléments d'arrière-plan, peuvent toujours sembler un peu flous, et les artefacts de compression ou un léger bruit tendent à apparaître une fois que vous visualisez le clip sur un écran plus grand ou que vous l'intégrez dans une chronologie de montage. Les visages en particulier sont l'une des premières choses à perdre de la netteté lors de la génération AI, puisque le modèle prédit les détails plutôt que de les enregistrer.

Comment améliorer les vidéos Gemini Omni 1.1 Flash à 8K avec HitPaw VikPea

C'est là qu'un amélioreur vidéo dédié trouve sa place dans le flux de travail. HitPaw VikPea AI Video Enhancer est conçu spécifiquement pour prendre des séquences comme celle-ci, générées par AI ou non, et les porter jusqu'à 8K tout en nettoyant les problèmes que les modèles de génération ont tendance à laisser derrière : détails flous, bruit, artefactage, et rendu facial incohérent.

Caractéristiques clés de HitPaw VikPea

  • Réparation vidéo AI : Les fichiers vidéo corrompus, endommagés ou de basse qualité doivent être réparés.
  • Modèle génératif AI : Restaurer les vidéos de basse résolution inférieures à 720p, y compris les vieux films et les cassettes VHS, avec des détails et une clarté améliorés.
  • Coloriser la vidéo : Restaurateur et coloriseur de séquences en noir et blanc naturel.
  • Améliorer la vidéo à 4K/8k : Upscaling AI des vidéos de basse résolution à 4k et 8k
  • Exportation de résolution personnalisée : Exporter des résolutions sans difficulté vers 5K et même 8k.
  • Interface facile à utiliser : Suffisamment bonne pour être utilisée par des amateurs et des experts.

Ce sont les caractéristiques qui permettent à HitPaw VikPea d'être un excellent choix lorsqu'il s'agit de résolutions sophistiquées.

Comment améliorer la vidéo à 8K avec HitPaw VikPea

Étape 1 : Installer et télécharger

Allez sur le site officiel et téléchargez HitPaw VikPea. Après l'avoir installé, lancez l'application et connectez-vous si nécessaire.

Étape 2 : Importez votre séquence dans l'amélioreur vidéo

Cliquez sur le panneau de gauche pour ouvrir le module Amélioreur vidéo. Appuyez sur l'icône pour importer votre fichier vidéo dans l'interface.

upload to boost video quality on PC

Étape 3 : Utilisez le modèle AI approprié

Avec un modèle général qui applique une amélioration globale, il existe plusieurs modèles spécialisés qui peuvent être appliqués à la vidéo selon les besoins d'amélioration particuliers.

choose the desired AI model and apply it

Vous pouvez appliquer d'autres modèles comme le Modèle de Restauration UHD qui améliorera encore la qualité vidéo d'une vidéo haute résolution 720p, améliorant la visibilité et restaurant la netteté.

ultra hd model enhance

Choisissez votre longueur d'aperçu (3 ou 5 sec). Si vous devez améliorer seulement quelques éléments de la vidéo, utilisez l'outil de découpe. Fixez la résolution et le format de sortie.

Conseils : Si vous n'êtes pas sûr du modèle à utiliser, utilisez AI Pilot. Il examinera automatiquement votre vidéo et conseillera l'amélioration la plus appropriée.

Étape 4 : Prévisualiser et enregistrer

Après avoir effectué tous les ajustements nécessaires, cliquez sur Prévisualiser pour comparer les résultats avant et après de votre vidéo. Cela vous permet de voir clairement la différence entre la version originale et la version améliorée avant de finaliser.

before-and-after comparison of video enhancement

Étape 5 : Exporter ou exporter vers le cloud

Une fois satisfait de l'aperçu, sélectionnez Exporter ou Exporter vers le cloud pour enregistrer votre vidéo. Profitez de vidéos améliorées avec une clarté époustouflante.

preview and export the enhanced video.

FAQ sur Gemini Omni 1.1 Flash

C'est le modèle de génération et d'édition vidéo généralement disponible de Google, sorti le 27 août 2026, qui prend des entrées de texte, d'image, d'audio et de vidéo et produit de courts clips avec audio synchronisé, plus un support pour l'édition conversationnelle et l'extension de scène.

Non. Il est uniquement disponible sur le niveau payant de l'API Gemini, sans allocation gratuite pour la génération vidéo. Les abonnés Google AI Plus, Pro et Ultra peuvent y accéder via Google Flow en utilisant les crédits de leur plan au lieu d'une facturation directe de l'API.

Il gère le texte-en-vidéo, l'image-en-vidéo, la référence-en-vidéo utilisant des images ou des clips courts, l'interpolation du premier et du dernier cadre, et l'extension de scène jusqu'à une longueur cumulée de 40 secondes, le tout modifiable à travers une conversation naturelle, à plusieurs tours.

La sortie vidéo est facturée à 17,50 $ par 1M de jetons, ce qui revient à environ 0,03 $ par seconde à 360p, 0,10 $ à 720p, 0,15 $ à 1080p, et 0,30 $ à 4K. L'entrée à travers le texte, l'image, l'audio et la vidéo est de 1,50 $ par 1M de jetons.

1.1 ajoute une extension de scène de 40 secondes (contre une limite plate de 10 secondes), une interpolation du premier et du dernier cadre, un niveau brouillon de 360p, et une sortie 4K, toutes des fonctionnalités que le modèle original manquait au lancement.

Conclusion

Gemini Omni 1.1 Flash est moins une réinvention qu'une correction de ce que les gens ont réellement demandé après la première sortie : des scènes plus longues, un vrai contrôle des images, et un moyen peu coûteux de tester des idées avant de dépenser de l'argent réel sur un rendu final. L'entrée multimodale, l'audio natif, et l'édition conversationnelle via l'API Interactions restent la colonne vertébrale de ce qui le rend utile, et la nouvelle tarification brouillon-puis-upscale le rend beaucoup plus indulgent pour expérimenter.

Étant donné que même la sortie 4K ici est un upscale plutôt qu'une capture native, faire passer vos clips finis par HitPaw VikPea par la suite est un moyen simple d'affiner les détails, de calmer le bruit, et de nettoyer les visages avant que la vidéo ne soit diffusée.

Laissez un avis

Donnez votre avis pour les articles HitPaw

Articles concernés

Avez-vous des questions ?

download
Cliquez ici pour installer