Zurück zum Blog

Fünf Anbieter verkaufen Gemini Omni 1.1 Flash. Der Preis schwankt um 44 %

E2X Team··15 Min. Lesezeit
gemini-omnigooglepricingtext-to-videovideo-generation

Niemand vergleicht Preise für Modellgewichte. Man wählt einen Modellnamen, landet auf der Anbieterseite, die Google gerade nach oben gespült hat, und zahlt, was dort steht.

Am 28. August 2026 haben wir jede Stelle gesucht, die für ein einziges Modell einen aufrufbaren Preis veröffentlicht — gemini-omni-1.1-flash, von Google am Tag zuvor ausgeliefert. Fünf tun es. Dieselben Gewichte, dasselbe native Audio, dasselbe SynthID-Wasserzeichen in jedem Frame. Die Zahl am Fuß der Seite bewegte sich um vierundvierzig Prozent.

Was folgt, ist dieser Abgleich — samt der Stelle, an der wir Ihnen raten, etwas zu kaufen, das neunmal günstiger ist als das Modell, um das es in diesem Text geht.

Eine Reihe identischer, unbeschrifteter Blechdosen auf einer abgenutzten Zinktheke, an jeder ein leeres Papieretikett, das auf einer anderen Höhe hängt

Die fünf Preise, an einem Nachmittag abgelesen

Alles Folgende bezieht sich auf 720p, pro Sekunde fertigen Videos, abgelesen von der Live-Seite des jeweiligen Anbieters am 28. August 2026. Audio ist überall enthalten: Das Modell hat keinen Audioschalter, der Ton entsteht also zusammen mit dem Bild, und niemand rechnet ihn getrennt ab.

Wo Sie es aufrufenPro Sekunde, 720pAchtsekundenclip
E2X$0.09$0.72
fal.ai v1.1/edit$0.10$0.80
Runware$0.10$0.80
Google, direkt$0.1014 effektiv$0.81
fal.ai Basisseite text-to-video$0.125$1.00
fal.ai Basisseite reference / image-to-video$0.13$1.04
WaveSpeed$0.13$1.04

Von unten nach oben: $0.09 gegen $0.13. Das sind die vierundvierzig Prozent, und sie kaufen nichts — keine bessere Sekunde Video, keinen längeren Clip, keine höhere Obergrenze. Dieselbe Datei, dasselbe Rechenzentrum.

Drei dieser Zeilen gehören zu einem einzigen Unternehmen, und darum geht es im nächsten Abschnitt.

Googles Zeile braucht eine Fußnote, denn Googles Preisseite rechnet in Tokens ab statt in Sekunden. Video-Output kostet $17.50 pro Million Tokens, und 720p verbraucht 5.792 Tokens pro Sekunde; multipliziert ergibt das $0.1014. Diese Umrechnung ist Googles eigene Rechnung, nicht unsere — die Seite druckt sie als „ein effektiver Preis von ungefähr $0.10 pro Sekunde“.

Ein Unternehmen, eine Modellfamilie, zwei Preislogiken

Der merkwürdigste Fund ist kein Wettbewerber. Es ist fal.ai, das sich mit sich selbst widerspricht.

Öffnen Sie fal.ai/models/google/gemini-omni-flash/v1.1/edit, und Sie bekommen $0.10 pro Sekunde auf einer Staffel, die Googles gerundeter Liste Stufe für Stufe gleicht, ganz ohne Marge. Das ist kein unabhängiger Preis, sondern eine Durchreichung — behandeln Sie ihn als zweiten Datenpunkt, und Sie zählen Google doppelt. Öffnen Sie auf derselben Domain die Basisseiten von gemini-omni-flash, wird das Modell stattdessen in Tokens bepreist, zu $21.875 pro Million — also rund $0.125 für text-to-video und $0.13 für Referenz- und Bildaufträge. Dasselbe Unternehmen, dieselbe Familie, ein Eintrag zum Einkaufspreis und einer mit Aufschlag.

Dieser Aufschlag beträgt exakt fünfundzwanzig Prozent über Googles Tokenrate. Daran ist nichts falsch: Ein Aggregator, der Retries übernimmt und Ihnen eine einzige Auth-Oberfläche gibt, darf dafür Geld nehmen. Aber es heißt, dass „der Preis von Omni 1.1 Flash“ nicht einmal innerhalb eines einzigen Shops einen eindeutigen Bezugspunkt hat. Also prüfen Sie den Versionsstring auf der Seite, gegen die Sie abgerechnet werden — eine Seite, auf der gemini-omni-flash ohne Version steht, verkauft Ihnen womöglich weder 1.1 noch dessen Preis.

Eine Wand aus identischen antiken Postfächern aus Messing, eine kleine Tür steht einen Spalt offen und gibt den Blick auf ein dunkles, leeres Inneres frei

Bei einem Anbieter fehlt die Zahl ganz. Replicate führt das Modell und veröffentlicht keinen Sekundenpreis dafür — wir haben nachgesehen, es gibt nichts zu zitieren. Das ist ein Befund und kein Versäumnis unsererseits: Ein Videomodell, dessen Kosten Sie nicht lesen können, bevor Sie es starten, ist ein Modell, das Sie nicht budgetieren können.

Googles Auflösungsstaffel ist zweimal veröffentlicht, in zwei verschiedenen Formen

Alles bisher Genannte ist eine einzige Stufe. Omni 1.1 Flash verkauft vier, und die anderen drei zu finden hat weit länger gedauert, als es sollte.

Google veröffentlicht sie zweimal, an keiner der Stellen, an denen man nachsehen würde. Die Fußnote der Cloud-Preisseite nennt Tokenzahlen pro Sekunde und pro Stufe — die abrechnungsrelevante Wahrheit, denn die Rechnung wird auf Tokens ausgestellt. Die Ankündigung zum Launch führt eine gerundete Dollartabelle, aber als gerendertes Bild, weshalb Scraper und die daraus gebauten Artikel daran vorbeilaufen. Die Preisseite der Gemini API, die naheliegende Anlaufstelle, hat nur die 720p-Zelle.

Wir sind auf diesem Weg weit genug gekommen, um zu schließen, die vierstufige Staffel sei die Erfindung eines Wiederverkäufers, und hatten dazu bereits einen Abschnitt geschrieben — bevor wir zurückgingen und das Bild lasen. Das gehört zugegeben, denn es ist genau der Fehlermodus, um den es in diesem Text geht: Eine Zahl kann veröffentlicht, belegt und richtig sein und trotzdem unsichtbar bleiben für die Art, wie die meisten Menschen nachsehen.

Die Staffel aus den Tokenzahlen, und das ist, was Sie tatsächlich zahlen:

AuflösungGoogle Tokens/sGoogle $/sE2XUnterschied
360p1.931$0.0338$0.0297E2X 12 % günstiger
720p5.792$0.1014$0.09E2X 11 % günstiger
1080p8.688$0.1520$0.135E2X 11 % günstiger
4K17.376$0.3041$0.18E2X 41 % günstiger

Lesen Sie die oberste Zeile für das, was Ihre Arbeitsweise wirklich verändert. Eine Sekunde 360p kostet auf unserer Staffel exakt ein Drittel einer Sekunde 720p — $0.0297 gegen $0.09 —, drei Entwürfe kosten also so viel wie ein einziger Durchgang in voller Auflösung. Das ist das gesamte Argument für eine Draft-Stufe in einem Satz, und deshalb lohnt sich die günstige Stufe auch dann, wenn die Qualität offensichtlich schlechter ist.

Jetzt die unterste Zeile, an der sich die Arbeit mit Tokenzahlen auszahlt: Das Multiplikator-Argument hört auf, Rhetorik zu sein, und wird zu Googles eigenen Daten. Nehmen Sie 720p als 1×. Googles Stufen laufen 0,33 · 1 · 1,5 · 3. Unsere laufen 0,33 · 1 · 1,5 · 2. Unten identisch, in der Mitte identisch, und dann verdreifacht Google in 4K, wo wir verdoppeln — weshalb zehn Sekunden 4K bei Google $3.04 kosten und bei uns $1.80.

Vier hohe Messzylinder aus Glas auf hellem Kalkstein, jeder mit klarem Wasser bis zu einem jeweils höheren Stand gefüllt, weiches Fensterlicht von rechts

Alle vier Capabilities rechnen hier auf derselben Staffel ab — Reference-to-Video kostet, was Start-End-Frame-to-Video kostet, und das ist, was Image-to-Video und einfaches Text-to-Video kosten. Das ist nicht überall so: Auf fals Basisseiten kosten Referenz- und Bildaufträge mehr als reine Prompt-Aufträge.

Runwares günstige Stufe steht über einer teuren

Bei 720p liegt Runware mit $0.10 im Feld. Eine Stufe höher verlangt es $0.16 bei 1080p und $0.32 bei 4K — gegenüber Googles eigenen $0.1520 und $0.3041. Es ist teurer als die Quelle, die es weiterverkauft, und zwar genau bei den beiden Auflösungen, bei denen eine Sekunde am meisten kostet. Nur etwa fünf Prozent über Google; aber vergleichen Sie Anbieter nach der ersten Zahl, die Sie sehen, wählen Sie ihn für einen 4K-Auftrag, und Sie zahlen fast das Doppelte der $0.18, die diese Stufe hier kostet.

Die Lehre ist mehr wert als die Zahl: Vergleichen Sie auf der Stufe, auf der Sie tatsächlich rendern. Ein Schlagzeilenpreis ist fast immer die günstigste brauchbare Stufe eines Anbieters, und das Verhältnis zwischen den Stufen legt der Wiederverkäufer fest.

Was der direkte Aufruf bei Google nicht enthält

Der Instinkt sagt: Zwischenschicht weglassen, an der Quelle kaufen. Hier ist die Quelle weder die günstigste noch die am wenigsten eingeschränkte Option.

  • Kein kostenloses Kontingent für Video-Output. Text und Bild laufen in Geminis kostenlosem Kontingent; Video nicht. Es gibt nichts, wogegen man testen könnte.
  • Kein Batch-Rabatt. Andere Gemini-3.x-Modelle geben bei Batch-Einreichung rund fünfzig Prozent nach. Video ist ausgenommen, der Hebel, der einen großen Auftrag halbiert, fällt also weg.
  • Datenverarbeitung. Selbst im kostenpflichtigen Tarif markieren Googles Bedingungen Inhalte, die an dieses Modell übermittelt werden, als nutzbar für die Produktverbesserung.
  • Ein Preis, den man suchen muss. Die Dokumentation zeigt eine einzige Videozelle; die Staffel ist ein Bild in einem Blogbeitrag.

Nichts davon macht den Aufruf bei Google falsch. Es macht „direkt kaufen, Marge sparen“ zu einer schwächeren Faustregel, als sie klingt — bei diesem Modell gibt es kaum eine Marge zu sparen, denn der Wiederverkäufer, der den Listenpreis spiegelt, reicht ihn zum Einkaufspreis an Sie weiter.

Der Clip unten hat $0.72 gekostet

Wir haben ihn mit Omni 1.1 Flash selbst erzeugt, acht Sekunden in 720p, zu genau dem Preis, um den dieser Text streitet. Achtmal neun Cent.

Eine nächtliche Luftaufnahme über Midtown Manhattan fährt in den Times Square hinein, bis eine einzige digitale Tafel das Bild füllt: OMNI FLASH 1.1, dann AVAILABLE NOW ON E2X.AI, und zuletzt das E2X-Logo über nassem Asphalt.

Der Prompt, wortwörtlich:

Cinematic 8-second commercial set in New York City at night. Opens on a wide aerial shot of Manhattan, then pushes rapidly into Times Square. Neon billboards, yellow taxis, pedestrians, wet asphalt reflecting colored light. The camera flies toward one massive digital billboard dominating the square. On the billboard, clearly readable text appears: "OMNI FLASH 1.1". Then: "THE LOWEST PRICE." The billboard transitions to: "AVAILABLE NOW ON E2X.AI". Final text: "START USING OMNI FLASH 1.1 TODAY". End with a clean bold E2X.AI logo filling the billboard. Fast energetic camera movement, realistic New York atmosphere, cinematic lighting, photorealistic detail, premium tech commercial look, high contrast, shallow depth of field, realistic reflections, subtle lens flares, smooth transitions. No narration, no one speaks. The message is carried entirely by the giant Times Square billboard. Sound design: city ambience, distant traffic, a rising synth swell, no voices, no speech.

(Der Prompt bleibt auf Englisch: Das Modell wurde ausschließlich für Englisch evaluiert.)

Ausgeführt als text-to-video, acht Sekunden, 720p, 16:9. Er kam nach 94 Sekunden zurück, gegenüber der Schätzung unserer eigenen Pipeline von rund 240 — diese Schätzung ist unsere; Google veröffentlicht keine Latenzangabe. Ein einzelnes Sample ist kein Benchmark, aber wenn Sie bisher vier Minuten pro Generierung eingeplant haben, planen Sie weniger ein.

Lesen Sie jetzt den Prompt gegen das Bild, denn daraus wurde ein unbeabsichtigter Test der schwächsten Fähigkeit des Modells. Der Prompt nennt Werbetafeltext viermal, in Anführungszeichen, und die Haupttafel liefert — beide Zeilen sauber, das Logo sitzt. Jede andere Tafel im Bild, jene, die der Prompt nur mit „neon billboards“ andeutet, kommt als überzeugend aussehendes Kauderwelsch zurück. Die Regel lautet also nicht „dieses Modell kann keinen Text“, sondern etwas Engeres: Text, den Sie vorgeben, wird meist gerendert; Text, den das Modell zur Ausstattung erfindet, nicht. Wackelige Textwiedergabe wird in dieser Familie seit dem Launch berichtet — implicator.ai hat darauf hingewiesen, und in Googles Model Card konnten wir es so formuliert nicht finden —, nehmen Sie den Clip also als unseren Beleg und nicht als Eingeständnis des Anbieters.

Bevor Sie neun Cent zahlen, sehen Sie sich einen Cent an

Hier argumentiert der Abgleich gegen seinen eigenen Gegenstand.

Veo 3.1 Fast kostet $0.01 pro Sekunde über dieselbe API, mit demselben Schlüssel — ein Neuntel von Omni 1.1 Flash. Der Clip oben hätte dort acht Cent gekostet statt zweiundsiebzig, und für eine allein stehende Einstellung, an der nichts hängt, sehr wahrscheinlich gut genug. In Googles eigener Tabelle steht Veo 3.1 Fast mit $0.10 pro Sekunde, dort liegen wir also bei einem Zehntel der Quelle statt elf Prozent darunter.

Die ehrliche Rangfolge lautet also nicht „Omni ist hier am günstigsten“. Sie lautet: Die meisten, die einen Text über den günstigsten Weg zum Aufruf von Omni lesen, sollten etwas anderes aufrufen. Greifen Sie dann dazu, wenn der Auftrag braucht, was nur dieses Modell kann — einen vorgegebenen ersten und letzten Frame, eine Figur, die mehrere Einstellungen übersteht, Erweiterung auf vierzig Sekunden. Eine Kamerafahrt gehört nicht dazu.

Einen Vergleich falsch herum zu ziehen wäre unehrlich. Omni Flash, die Preview vom Juni, kostet hier $0.0825 pro Sekunde für text-to-video und $0.075 für Referenzaufträge — 1.1 ist also neun bis zwanzig Prozent teurer als das Modell, das es ablöst, nicht günstiger. Es lohnt sich, genau zu sagen, woher das kommt: Alle drei liegen auf demselben Listenpreis von $0.15 und unterscheiden sich nur im Rabatt, den wir geben, 40 Prozent gegenüber 45 und 50. Der Anstieg ist ein kleinerer Rabatt, kein teureres Produkt. Was er kauft, sind image-to-video und die Steuerung über ersten und letzten Frame, eine 360p-Stufe, für die das ältere Enum keinen Eintrag hat, und eine Obergrenze von zehn Sekunden — ein fairer Tausch, aber ein Anstieg, und wer Ihnen sagt, das neue Modell sei günstiger, hat die Richtung verdreht.

Diesen Abgleich selbst durchführen

Fünf Gewohnheiten, die diese konkreten Zahlen überdauern werden:

  1. Lesen Sie den Versionsstring, nicht den Modellnamen. Zwei Seiten auf einer Domain haben uns an einem Nachmittag dieselbe Familie für $0.10 und für $0.125 verkauft.
  2. Prüfen Sie, ob die Quelle Text ist. Googles Dollarstaffel ist ein Bild und die tatsächliche eine Token-Fußnote, weshalb Scraper nur die Zahl zitieren, die in der Dokumentation als HTML steht.
  3. Bepreisen Sie die Stufe, auf der Sie rendern, nicht die, mit der der Anbieter aufmacht. Runware liegt bei 720p gleichauf und ist bei 4K der teuerste Eintrag.
  4. Rechnen Sie Tokens in Sekunden um, bevor Sie vergleichen. $17.50 pro Million bedeutet nichts, solange Sie es nicht mit den Tokens multiplizieren, die Ihre Stufe verbraucht.
  5. Prüfen Sie, ob überhaupt ein Sekundenpreis existiert. Replicate führt das Modell, ohne einen zu veröffentlichen.

Preise und Produktbedingungen können sich ändern. Prüfen Sie die aktuellen Preise des jeweiligen Anbieters, bevor Sie eine Kaufentscheidung treffen. Googles Batch- oder Flex-Preise sind einer regulären On-Demand-API-Anfrage nicht direkt gleichzusetzen, weil Planung, Verfügbarkeit und Verarbeitungsbedingungen sich unterscheiden; sie bleiben hier deshalb außen vor. Dies ist ein eingegrenzter Vergleich über die fünf Anbieter hinweg, die einen aufrufbaren Sekundenpreis veröffentlichen, und keine Behauptung, dass E2X in jeder Konfiguration die günstigste Option ist. Der günstigste Weg, die meisten Clips zu machen, führt gar nicht über dieses Modell, wie der Abschnitt oben sagt.

Entwerfen Sie dann auf der günstigsten Stufe, die Sie ertragen, und rendern Sie den Keeper in 720p. Parameter und aktuelle Preise je Capability stehen in der maschinenlesbaren Spezifikation; die Aufstellung steht in unserem Katalog. Wir haben was in 1.1 ausgeliefert wurde, was die Leaderboards gemessen haben, wie man es promptet und warum eine Vierzig-Sekunden-Szene als vier getrennte Rechnungen ankommt jeweils gesondert behandelt.

Häufig gestellte Fragen

Was ist der günstigste Weg, Gemini Omni 1.1 Flash aufzurufen?

Über die fünf Anbieter hinweg, die am 28. August 2026 einen aufrufbaren Preis veröffentlichen, lag E2X auf allen vier Stufen am niedrigsten — $0.0297 für eine Sekunde 360p, neun Cent bei 720p, $0.135 eine Stufe höher, $0.18 bei 4K. Das 720p-Feld reicht von $0.10 auf fal.ais v1.1-Seite und bei Runware über $0.1014 bei Google bis zu $0.13 bei WaveSpeed und auf fals Basis-Endpunkten für Referenz und Bild. Unser Abstand ist bei 360p am dünnsten, rund ein Prozent gegenüber fal, und bei 4K am größten.

Was kostet Gemini Omni 1.1 Flash, wenn ich Google direkt aufrufe?

Google rechnet in Tokens ab, nicht in Sekunden: $17.50 pro Million für Video-Output. Die Fußnote der Cloud-Preisseite nennt die Tokens, die jede Auflösung pro Sekunde verbraucht; multipliziert ergibt das gut drei Cent für eine Sekunde 360p, gut zehn für 720p, fünfzehn Komma zwei für 1080p und knapp über dreißig bei 4K. Eine gerundete Fassung derselben Staffel steht in der Launch-Ankündigung, als Bild statt als Text. Kein kostenloses Kontingent, kein Batch-Rabatt.

Warum verlangen verschiedene Anbieter unterschiedliche Preise für dasselbe Modell?

Sie bepreisen auf unterschiedlichen Grundlagen. Manche spiegeln Googles gerundete Liste, weshalb fal.ais v1.1-Seite und Runware beide bei $0.10 landen. Andere rechnen in Tokens und schlagen eine Marge auf: fals Basisseiten setzen $21.875 pro Million gegen Googles $17.50 an, ein Aufschlag von 25 %, der auf $0.125 bis $0.13 führt. WaveSpeed nennt pauschal $0.13. Gewichte und Output sind durchgehend identisch.

Veröffentlicht Replicate einen Preis für Gemini Omni 1.1 Flash?

Replicate führt das Modell, veröffentlicht dafür aber keinen Sekundenpreis, Stand 28. August 2026. Damit lässt es sich nicht in einen Vergleich gleicher Größen aufnehmen und nur schwer budgetieren, denn die Videoabrechnung skaliert mit Dauer und Auflösung statt mit der Zahl der Anfragen.

Ist Gemini Omni 1.1 Flash günstiger als das Modell, das es ablöst?

Nein. Die vorherige Preview Gemini Omni Flash kostet auf E2X $0.0825 pro Sekunde für text-to-video und $0.075 für reference-to-video, gegenüber $0.09 für Omni 1.1 Flash — neun bis zwanzig Prozent mehr. Alle drei laufen auf demselben Listenpreis von $0.15 und unterscheiden sich nur im Rabatt, der Anstieg ist also ein kleinerer Rabatt und kein teureres Modell. Der Aufpreis kauft image-to-video, die Steuerung über ersten und letzten Frame, eine 360p-Draft-Stufe und Zehnsekundenclips.

In welcher Auflösung sollte ich generieren, um die Kosten niedrig zu halten?

Entwerfen Sie in 360p und rendern Sie nur den Keeper in 720p. Auf E2X ist eine Sekunde 360p exakt ein Drittel einer Sekunde 720p, vier Sekunden kosten also $0.1188 gegenüber $0.36 — fünf Entwürfe plus ein vollständiger Render kommen auf $0.954 und bleiben damit unter drei direkten 720p-Versuchen zu $1.08. 4K lohnt sich für die Auslieferung im Web selten: Zehn Sekunden kosten hier $1.80 gegenüber $3.04 bei Google.

Gibt es ein günstigeres Videomodell als Gemini Omni 1.1 Flash?

Ja, und für die meiste Arbeit an einzelnen Clips ist es die bessere Wahl. Veo 3.1 Fast kostet auf E2X einen Cent pro Sekunde — ein Neuntel von Omni 1.1 Flash und ein Zehntel von Googles eigenem Eintrag zu $0.10 — und deckt reine Prompt-Aufträge, animierte Standbilder, Referenzclips und Arbeit mit erstem und letztem Frame ab. Omni verdient seinen Aufpreis nur bei Szenenerweiterung, Zehnsekunden-Generierungen, der 360p-Stufe oder Referenzkonsistenz über mehrere Einstellungen hinweg.