Retour au blog

Cinq plateformes vendent Gemini Omni 1.1 Flash. Le prix varie de 44 %

E2X Team··17 min de lecture
gemini-omnigooglepricingtext-to-videovideo-generation

Personne ne compare les prix des poids d'un modèle. On choisit un nom de modèle, on atterrit sur la page fournisseur que Google a remontée, et on paie ce qui est affiché.

Le 28 août 2026, nous sommes partis chercher tous les endroits publiant un prix appelable pour un seul modèle — gemini-omni-1.1-flash, sorti par Google la veille. Cinq le font. Mêmes poids, même audio natif, même filigrane SynthID sur chaque image. Le chiffre en bas de page varie de quarante-quatre pour cent.

Ce qui suit est cet audit — y compris le passage où nous vous conseillons d'acheter quelque chose neuf fois moins cher que le modèle dont parle ce post.

Une rangée de boîtes en fer-blanc identiques et sans étiquette sur un comptoir de zinc usé, chacune avec une étiquette en papier vierge pendant à une hauteur différente

Les cinq prix, relevés le même après-midi

Tout ce qui suit est en 720p, par seconde de vidéo finie, relevé sur la page en ligne de chaque fournisseur le 28 août 2026. L'audio est inclus partout : le modèle n'a pas d'interrupteur son, donc le son est généré avec l'image et personne ne le facture séparément.

Où vous l'appelezPar seconde, 720pClip de huit secondes
E2X$0.09$0.72
fal.ai v1.1/edit$0.10$0.80
Runware$0.10$0.80
Google, en direct$0.1014 effectif$0.81
fal.ai base text-to-video$0.125$1.00
fal.ai base reference / image-to-video$0.13$1.04
WaveSpeed$0.13$1.04

Du bas vers le haut, $0.09 contre $0.13. Voilà les quarante-quatre pour cent, et ils n'achètent rien — pas une meilleure seconde de vidéo, pas un clip plus long, pas un plafond plus élevé. Même fichier, même datacenter.

Trois de ces lignes appartiennent à une seule entreprise, ce qui fait l'objet de la section suivante.

La ligne Google demande une note, parce que la page tarifaire de Google facture en tokens plutôt qu'en secondes. La sortie vidéo est à $17.50 le million de tokens, et le 720p consomme 5 792 tokens par seconde ; multipliez et vous obtenez $0.1014. Cette conversion est l'arithmétique de Google, pas la nôtre — la page l'imprime comme « un prix effectif d'environ $0.10 par seconde ».

Une entreprise, une famille de modèles, deux logiques tarifaires

La trouvaille la plus étrange n'est pas un concurrent. C'est fal.ai en désaccord avec lui-même.

Ouvrez fal.ai/models/google/gemini-omni-flash/v1.1/edit et vous avez $0.10 la seconde sur une échelle identique à la liste arrondie de Google, barreau pour barreau, sans aucune marge. Ce n'est pas un prix indépendant mais une répercussion — traitez-le comme un second point de données et vous comptez Google deux fois. Ouvrez les pages de base gemini-omni-flash sur le même domaine et le modèle est tarifé en tokens, à $21.875 le million — soit environ $0.125 pour le text-to-video et $0.13 pour les jobs reference et image. Même entreprise, même famille, une fiche à prix coûtant et une avec marge.

Cette marge fait exactement vingt-cinq pour cent au-dessus du tarif token de Google. Rien de choquant : un agrégateur qui gère les retries et vous offre une seule surface d'authentification a le droit de facturer. Mais cela veut dire que « le prix d'Omni 1.1 Flash » n'a aucun référent unique, même à l'intérieur d'une seule boutique. Donc vérifiez la chaîne de version sur la page que vous facturez — une page qui affiche gemini-omni-flash sans numéro de version ne vous vend peut-être ni la 1.1 ni son prix.

Un mur de boîtes postales anciennes en laiton identiques, une petite porte entrouverte laissant voir un intérieur sombre et vide

Il manque un chiffre à un fournisseur. Replicate liste le modèle et ne publie aucun tarif à la seconde pour lui — nous avons cherché, il n'y a rien à citer. C'est un constat, pas une omission de notre part : un modèle vidéo dont vous ne pouvez pas lire le coût avant de l'exécuter est un modèle que vous ne pouvez pas budgéter.

L'échelle de résolutions de Google est publiée deux fois, sous deux formes différentes

Tout ce qui précède ne concerne qu'un barreau. Omni 1.1 Flash en vend quatre, et trouver les trois autres a pris bien plus de temps que ça n'aurait dû.

Google la publie deux fois, dans aucun des endroits où vous chercheriez. La note de bas de page de Cloud pricing donne des comptes de tokens par seconde, par palier — la vérité de facturation, puisque la facture est établie sur les tokens. L'annonce de lancement porte un tableau en dollars arrondis, mais sous forme d'image rendue, donc les scrapers et les articles qui en découlent passent à côté. La page tarifaire de l'API Gemini, l'arrêt évident, n'a que la cellule 720p.

Nous sommes allés assez loin sur cette route pour conclure que l'échelle à quatre barreaux était une invention de revendeur, et nous avions rédigé une section le disant, avant de revenir en arrière et de lire l'image. Ça vaut la peine de l'avouer, parce que c'est exactement le mode de défaillance dont parle ce post : un chiffre publié, sourcé et correct peut rester invisible à la façon dont la plupart des gens vérifient.

L'échelle issue des comptes de tokens, qui est ce que vous payez réellement :

RésolutionTokens/s Google$/s GoogleE2XÉcart
360p1 931$0.0338$0.0297E2X 12 % moins cher
720p5 792$0.1014$0.09E2X 11 % moins cher
1080p8 688$0.1520$0.135E2X 11 % moins cher
4K17 376$0.3041$0.18E2X 41 % moins cher

Lisez la première ligne pour ce qui change vraiment votre façon de travailler. Une seconde de 360p coûte exactement un tiers d'une seconde de 720p sur notre échelle — $0.0297 contre $0.09 — donc trois brouillons coûtent ce que coûte une passe en pleine résolution. C'est tout l'argument du palier brouillon en une phrase, et c'est pourquoi le barreau bon marché vaut la peine d'exister même quand la qualité est manifestement inférieure.

Maintenant la dernière ligne, où le travail à partir des comptes de tokens paie : l'argument des multiplicateurs cesse d'être de la rhétorique et devient la donnée de Google elle-même. Prenez le 720p comme 1×. Les paliers de Google font 0,33 · 1 · 1,5 · 3. Les nôtres font 0,33 · 1 · 1,5 · 2. Identiques en bas, identiques au milieu, puis Google triple vers le 4K là où nous doublons — et c'est pourquoi dix secondes de 4K coûtent $3.04 chez Google et $1.80 chez nous.

Quatre grandes éprouvettes en verre sur du calcaire clair, chacune remplie d'eau claire à un niveau progressivement plus haut, lumière douce de fenêtre venant de la droite

Les quatre capacités se facturent sur cette même échelle ici — reference-to-video coûte ce que coûte start-end-frame-to-video, soit ce que coûtent image-to-video et le simple text-to-video. Ce n'est pas universel : sur les pages de base de fal, les jobs reference et image coûtent plus cher que ceux qui n'utilisent qu'un prompt.

Le barreau bon marché de Runware surplombe un barreau cher

En 720p, Runware s'aligne sur le peloton à $0.10. Montez d'un barreau et il facture $0.16 en 1080p et $0.32 en 4K — contre les $0.1520 et $0.3041 de Google. Il est plus cher que la source qu'il revend exactement aux deux résolutions où la seconde coûte le plus. Environ cinq pour cent au-dessus de Google seulement ; mais comparez les fournisseurs sur le premier chiffre venu, choisissez-le pour un job 4K, et vous payez presque le double des $0.18 que coûte ce barreau ici.

La leçon vaut plus que le chiffre : comparez au palier où vous rendez réellement. Un tarif d'appel est presque toujours le barreau utile le moins cher d'un fournisseur, et le rapport entre les barreaux est fixé par le revendeur.

Ce que l'appel direct à Google n'inclut pas

L'instinct dit de supprimer l'intermédiaire et d'acheter à la source. Ici, la source n'est ni l'option la moins chère ni la moins contraignante.

  • Pas d'offre gratuite pour la sortie vidéo. Le texte et l'image fonctionnent sur le palier gratuit de Gemini ; la vidéo non. Rien pour tester.
  • Pas de remise Batch. D'autres modèles Gemini 3.x bénéficient d'environ cinquante pour cent de remise en soumission batch. La vidéo est exclue, donc le levier qui divise par deux un gros job disparaît.
  • Traitement des données. Même sur le palier payant, les conditions de Google marquent le contenu soumis à ce modèle comme utilisable pour l'amélioration produit.
  • Un prix qu'il faut chasser. La documentation affiche une seule cellule vidéo ; l'échelle est une image dans un billet de blog.

Rien de tout cela ne rend l'appel à Google mauvais. Cela fait de « acheter en direct, sauter la marge » une heuristique plus faible qu'elle n'en a l'air — sur ce modèle il n'y a presque pas de marge à sauter, puisque le revendeur qui reflète le prix catalogue vous le passe à prix coûtant.

Le clip ci-dessous a coûté $0.72

Nous l'avons généré avec Omni 1.1 Flash lui-même, huit secondes en 720p, au prix dont ce post débat. Huit fois neuf cents.

Une vue aérienne nocturne de Midtown Manhattan plonge dans Times Square jusqu'à ce qu'un panneau numérique remplisse le cadre : OMNI FLASH 1.1, puis AVAILABLE NOW ON E2X.AI, se résolvant sur le logo E2X au-dessus de l'asphalte mouillé.

Le prompt, mot pour mot :

Cinematic 8-second commercial set in New York City at night. Opens on a wide aerial shot of Manhattan, then pushes rapidly into Times Square. Neon billboards, yellow taxis, pedestrians, wet asphalt reflecting colored light. The camera flies toward one massive digital billboard dominating the square. On the billboard, clearly readable text appears: "OMNI FLASH 1.1". Then: "THE LOWEST PRICE." The billboard transitions to: "AVAILABLE NOW ON E2X.AI". Final text: "START USING OMNI FLASH 1.1 TODAY". End with a clean bold E2X.AI logo filling the billboard. Fast energetic camera movement, realistic New York atmosphere, cinematic lighting, photorealistic detail, premium tech commercial look, high contrast, shallow depth of field, realistic reflections, subtle lens flares, smooth transitions. No narration, no one speaks. The message is carried entirely by the giant Times Square billboard. Sound design: city ambience, distant traffic, a rising synth swell, no voices, no speech.

(Le prompt est laissé en anglais : le modèle n'a été évalué que pour l'anglais.)

Exécuté en text-to-video, huit secondes, 720p, 16:9. Il est revenu en 94 secondes contre l'estimation d'environ 240 de notre propre pipeline — cette estimation est la nôtre ; Google ne publie aucun chiffre de latence. Un échantillon ne fait pas un benchmark, mais si vous budgétiez quatre minutes par génération, budgétez moins.

Maintenant lisez le prompt en regard de l'image, parce que c'est devenu un test accidentel de la faiblesse la plus nette du modèle. Le prompt nomme le texte du panneau quatre fois, entre guillemets, et le panneau principal livre — les deux lignes propres, le logo posé. Tous les autres panneaux du cadre, ceux que le prompt évoquait vaguement par « neon billboards », reviennent en charabia convaincant. La règle n'est donc pas « ce modèle ne sait pas faire de texte » mais quelque chose de plus étroit : le texte que vous spécifiez a tendance à s'afficher ; le texte que le modèle invente pour habiller le décor, non. Un rendu de texte fragile est signalé sur cette famille depuis le lancement — implicator.ai l'a relevé, et nous n'avons pas trouvé la chose formulée ainsi sur la fiche modèle de Google — donc prenez le clip comme notre preuve, pas comme un aveu du fournisseur.

Avant de payer neuf cents, regardez à un cent

C'est ici que l'audit plaide contre son propre sujet.

Veo 3.1 Fast coûte $0.01 la seconde sur la même API, la même clé — un neuvième d'Omni 1.1 Flash. Le clip ci-dessus aurait coûté huit cents au lieu de soixante-douze, et pour un plan isolé dont rien ne dépend, très probablement assez bon. Sur le tableau de Google, Veo 3.1 Fast est listé à $0.10 la seconde, donc là nous sommes à un dixième de la source plutôt qu'à onze pour cent en dessous.

Le classement honnête n'est donc pas « Omni est le moins cher ici ». C'est que la plupart des gens qui lisent un post sur la façon la moins chère d'appeler Omni devraient appeler autre chose. Sortez-le quand le travail exige ce que lui seul fait — une première et une dernière image spécifiées, un personnage qui survit d'un plan à l'autre, une extension jusqu'à quarante secondes. Un travelling n'en fait pas partie.

Une comparaison serait malhonnête à faire à l'envers. Omni Flash, la preview de juin, se facture $0.0825 la seconde en text-to-video et $0.075 pour les jobs reference ici — donc la 1.1 est neuf à vingt pour cent plus chère que le modèle qu'elle remplace, pas moins chère. Autant être précis sur l'origine : les trois reposent sur le même tarif catalogue de $0.15 et ne diffèrent que par la remise appliquée, 40 pour cent contre 45 et 50. La hausse est une remise plus faible, pas un produit plus cher. Ce qu'elle achète, c'est l'image-to-video et le contrôle première/dernière image, un barreau 360p que l'ancien enum n'a pas, et un plafond de dix secondes — un échange équitable, mais une hausse, et quiconque vous dit que le nouveau modèle est moins cher a la direction à l'envers.

Refaire cet audit vous-même

Cinq habitudes qui survivront à ces chiffres particuliers :

  1. Lisez la chaîne de version, pas le nom du modèle. Deux pages sur un même domaine nous ont vendu la même famille à $0.10 et $0.125 le même après-midi.
  2. Vérifiez si la source est du texte. L'échelle en dollars de Google est une image et la vraie une note de bas de page en tokens, donc les scrapers ne citent que le chiffre présent dans la documentation en HTML.
  3. Tarifez le palier où vous rendez, pas celui que le fournisseur met en avant. Runware est au niveau du peloton en 720p et la fiche la plus chère en 4K.
  4. Convertissez les tokens en secondes avant de comparer. $17.50 le million ne veut rien dire tant que vous n'avez pas multiplié par les tokens que brûle votre palier.
  5. Vérifiez qu'un prix à la seconde existe seulement. Replicate porte le modèle sans en publier un.

Les prix et les conditions commerciales peuvent changer. Vérifiez la tarification en vigueur de chaque fournisseur avant toute décision d'achat. La tarification Google Batch ou Flex n'est pas directement équivalente à une requête API standard à la demande, parce que la planification, la disponibilité et les conditions de traitement diffèrent ; elle est donc exclue ici. Il s'agit d'une comparaison cadrée sur les cinq fournisseurs publiant un prix appelable à la seconde, pas d'une affirmation qu'E2X est l'option la moins chère dans toutes les configurations. La façon la moins chère de faire la plupart des clips n'est pas ce modèle du tout, comme le dit la section ci-dessus.

Ensuite, brouillonnez au barreau le moins cher que vous pouvez tolérer et rendez le gardé en 720p. Les paramètres et les tarifs en vigueur par capacité sont dans la spécification lisible par machine ; la gamme est dans notre catalogue. Nous avons traité ce qui est sorti dans la 1.1, ce que les classements ont mesuré, comment la prompter et pourquoi une scène de 40 secondes arrive sous forme de quatre factures distinctes séparément.

Questions fréquentes

Quelle est la façon la moins chère d'appeler Gemini Omni 1.1 Flash ?

Parmi les cinq fournisseurs publiant un prix appelable le 28 août 2026, E2X est ressorti le plus bas sur les quatre barreaux — $0.0297 pour une seconde en 360p, neuf cents en 720p, $0.135 au palier au-dessus, $0.18 en 4K. Le peloton 720p va de $0.10 sur la page v1.1 de fal.ai et chez Runware à $0.1014 chez Google, et $0.13 chez WaveSpeed et sur les endpoints de base reference et image de fal. Notre marge est la plus mince en 360p, environ un pour cent face à fal, et la plus large en 4K.

Combien coûte Gemini Omni 1.1 Flash si j'appelle Google directement ?

Google facture en tokens, pas en secondes : $17.50 le million pour la sortie vidéo. Sa note de bas de page Cloud pricing liste les tokens que chaque résolution brûle par seconde, et la multiplication donne un peu plus de trois cents pour une seconde en 360p, un peu plus de dix pour le 720p, quinze et un cinquième pour le 1080p, et juste au-delà de trente en 4K. Une version arrondie de la même échelle apparaît dans l'annonce de lancement, sous forme d'image plutôt que de texte. Pas d'offre gratuite, pas de remise Batch.

Pourquoi différents fournisseurs facturent-ils des prix différents pour le même modèle ?

Ils tarifient sur des bases différentes. Certains reflètent la liste arrondie de Google, ce qui explique que la page v1.1 de fal.ai et Runware atterrissent tous deux à $0.10. D'autres tarifent en tokens avec une marge ajoutée : les pages de base de fal utilisent $21.875 le million contre $17.50 chez Google, une majoration de 25 % qui atteint $0.125 à $0.13. WaveSpeed annonce un forfait de $0.13. Les poids et la sortie sont identiques partout.

Replicate publie-t-il un prix pour Gemini Omni 1.1 Flash ?

Replicate liste le modèle mais ne publie aucun tarif à la seconde pour lui, au 28 août 2026. Cela le rend impossible à inclure dans une comparaison à périmètre égal et difficile à budgéter, puisque la facturation vidéo évolue avec la durée et la résolution plutôt qu'avec le nombre de requêtes.

Gemini Omni 1.1 Flash est-il moins cher que le modèle qu'il remplace ?

Non. La preview précédente, Gemini Omni Flash, se facture $0.0825 la seconde en text-to-video et $0.075 en reference-to-video sur E2X, contre $0.09 pour Omni 1.1 Flash — neuf à vingt pour cent de plus. Les trois partent du même tarif catalogue de $0.15 et ne diffèrent que par la remise, donc la hausse est une remise plus faible plutôt qu'un modèle plus cher. Le supplément achète l'image-to-video, le contrôle première/dernière image, un barreau brouillon 360p et des clips de dix secondes.

À quelle résolution générer pour limiter les coûts ?

Brouillonnez en 360p et ne rendez que le gardé en 720p. Sur E2X, une seconde de 360p vaut exactement un tiers d'une seconde de 720p, donc quatre secondes coûtent $0.1188 contre $0.36 — cinq brouillons plus un rendu complet reviennent à $0.954, toujours sous les $1.08 de trois tentatives directes en 720p. Le 4K justifie rarement son coût pour une diffusion web : dix secondes coûtent $1.80 ici contre $3.04 chez Google.

Existe-t-il un modèle vidéo moins cher que Gemini Omni 1.1 Flash ?

Oui, et pour la plupart des travaux à clip unique c'est le meilleur choix. Veo 3.1 Fast est à un cent la seconde sur E2X — un neuvième d'Omni 1.1 Flash, et un dixième des $0.10 que Google affiche pour lui — et couvre les jobs à prompt seul, les images fixes animées, les clips de référence et le travail première/dernière image. Omni ne justifie sa prime que sur l'extension de scène, les générations de dix secondes, le palier 360p ou la cohérence par référence d'un plan à l'autre.