Torna al Blog

Cinque posti vendono Gemini Omni 1.1 Flash. Il prezzo si muove del 44%

E2X Team··16 min di lettura
gemini-omnigooglepricingtext-to-videovideo-generation

Nessuno va a confrontare i pesi di un modello. Lei sceglie un nome di modello, atterra sulla pagina del provider che Google Le ha messo davanti e paga quello che dice la pagina.

Il 28 agosto 2026 siamo andati a cercare ogni posto che pubblichi un prezzo chiamabile per un solo modello — gemini-omni-1.1-flash, rilasciato da Google il giorno prima. Cinque lo fanno. Stessi pesi, stesso audio nativo, stesso watermark SynthID in ogni fotogramma. Il numero in fondo alla pagina si muoveva del quarantaquattro per cento.

Quello che segue è quell'audit — inclusa la parte in cui Le diciamo di comprare qualcosa nove volte più economico del modello di cui parla questo post.

Una fila di barattoli di latta identici e senza etichetta su un bancone di zinco consumato, ognuno con un cartellino di carta bianco appeso a un'altezza diversa

I cinque prezzi, letti nello stesso pomeriggio

Tutto quello che segue è a 720p, al secondo di video finito, letto dalla pagina live di ciascun provider il 28 agosto 2026. L'audio è incluso ovunque: il modello non ha un interruttore per l'audio, quindi il suono viene generato insieme all'immagine e nessuno lo fattura a parte.

Dove lo chiamaAl secondo, 720pClip da otto secondi
E2X$0.09$0.72
fal.ai v1.1/edit$0.10$0.80
Runware$0.10$0.80
Google, diretto$0.1014 effettivi$0.81
fal.ai base text-to-video$0.125$1.00
fal.ai base reference / image-to-video$0.13$1.04
WaveSpeed$0.13$1.04

Dal basso in alto, $0.09 contro $0.13. Ecco il quarantaquattro per cento, e non compra niente — nessun secondo di video migliore, nessuna clip più lunga, nessun tetto più alto. Stesso file, stesso datacenter.

Tre di quelle righe appartengono a una sola azienda, ed è la sezione successiva.

La riga di Google ha bisogno di una nota, perché la pagina prezzi di Google fattura a token e non a secondi. L'output video è $17.50 per milione di token, e il 720p consuma 5.792 token al secondo; moltiplichi e ottiene $0.1014. Quella conversione è aritmetica di Google, non nostra — la pagina la stampa come "un prezzo effettivo di circa $0.10 al secondo."

Un'azienda, una famiglia di modelli, due logiche di prezzo

Il risultato più strano non è un concorrente. È fal.ai che dà torto a sé stessa.

Apra fal.ai/models/google/gemini-omni-flash/v1.1/edit e trova $0.10 al secondo, su una scala identica alla lista arrotondata di Google, gradino per gradino, senza alcun margine. Quello non è un prezzo indipendente ma un passthrough — se lo tratta come un secondo dato, sta contando Google due volte. Apra le pagine base gemini-omni-flash sullo stesso dominio e il modello è prezzato a token, a $21.875 per milione — circa $0.125 per text-to-video, $0.13 per i lavori con reference e immagini. Stessa azienda, stessa famiglia, un listino a costo e uno con ricarico.

Quel ricarico è esattamente il venticinque per cento sopra la tariffa a token di Google. Niente di male: un aggregatore che gestisce i retry e Le dà un'unica superficie di autenticazione ha diritto di farsi pagare. Ma significa che "il prezzo di Omni 1.1 Flash" non ha un referente unico nemmeno dentro una sola vetrina. Quindi controlli la stringa di versione sulla pagina su cui viene fatturato — una pagina che dice gemini-omni-flash senza versione potrebbe non venderLe né la 1.1 né il suo prezzo.

Una parete di identiche caselle postali antiche in ottone, con uno sportellino socchiuso che lascia vedere un interno buio e vuoto

A un provider manca del tutto un numero. Replicate elenca il modello e non pubblica alcuna tariffa al secondo — abbiamo guardato, e non c'è niente da citare. Questo è un risultato, non una nostra omissione: un modello video di cui non può leggere il costo prima di lanciarlo è un modello che non può mettere a budget.

La scala delle risoluzioni di Google è pubblicata due volte, in due forme diverse

Tutto quello che precede è un gradino solo. Omni 1.1 Flash ne vende quattro, e trovare gli altri tre è stato molto più lungo di quanto avrebbe dovuto.

Google la pubblica due volte, in nessuno dei due posti in cui andrebbe a cercare. La nota della pagina Cloud pricing dà i conteggi di token al secondo, per ogni tier — la verità di fatturazione, visto che la fattura è tagliata sui token. L'annuncio di lancio porta una tabella in dollari arrotondata, ma come immagine renderizzata, così gli scraper e gli articoli costruiti su di essi la saltano. La pagina prezzi della Gemini API, la tappa ovvia, ha solo la cella del 720p.

Su quella strada eravamo arrivati abbastanza avanti da concludere che la scala a quattro gradini fosse un'invenzione di un rivenditore, e avevamo scritto una sezione che lo diceva, prima di tornare indietro e leggere l'immagine. Vale la pena ammetterlo, perché è esattamente il tipo di errore di cui parla questo post: un numero pubblicato, con fonte e corretto può comunque restare invisibile al modo in cui la maggior parte delle persone verifica.

La scala che nasce dai conteggi di token, che è quello che paga davvero:

RisoluzioneToken/sec Google$/sec GoogleE2XDifferenza
360p1.931$0.0338$0.0297E2X 12% più economico
720p5.792$0.1014$0.09E2X 11% più economico
1080p8.688$0.1520$0.135E2X 11% più economico
4K17.376$0.3041$0.18E2X 41% più economico

Legga la prima riga per la cosa che cambia davvero il modo di lavorare. Un secondo a 360p costa esattamente un terzo di un secondo a 720p sulla nostra scala — $0.0297 contro $0.09 — quindi tre bozze costano quanto una singola passata a piena risoluzione. È tutto l'argomento a favore di un tier di bozza in una frase, ed è il motivo per cui il gradino economico vale la pena anche quando la qualità è palesemente peggiore.

Ora l'ultima riga, dove lavorare dai conteggi di token ripaga: l'argomento dei moltiplicatori smette di essere retorica e diventa un dato di Google. Prenda il 720p come 1×. I tier di Google fanno 0,33 · 1 · 1,5 · 3. I nostri fanno 0,33 · 1 · 1,5 · 2. Identici in basso, identici in mezzo, e poi Google triplica nel 4K dove noi raddoppiamo — ed è per questo che dieci secondi di 4K sono $3.04 chiamando Google e $1.80 chiamando noi.

Quattro alti cilindri graduati di vetro su pietra calcarea chiara, ciascuno riempito d'acqua limpida a un livello via via più alto, luce morbida da una finestra sulla destra

Qui tutte e quattro le capability fatturano su quella stessa scala — reference-to-video costa quanto start-end-frame-to-video, che è quanto costano image-to-video e il semplice text-to-video. Non è universale: sulle pagine base di fal, i lavori con reference e immagini costano più di quelli con il solo prompt.

Il gradino economico di Runware sta sopra uno caro

A 720p Runware si allinea al resto del campo a $0.10. Salga di un gradino e chiede $0.16 a 1080p e $0.32 a 4K — contro i $0.1520 e $0.3041 di Google. È più caro della fonte che rivende esattamente alle due risoluzioni in cui un secondo costa di più. Solo circa il cinque per cento sopra Google; ma se confronta i provider dal primo numero che vede, lo sceglie per un lavoro in 4K e finisce per pagare quasi il doppio dei $0.18 che quel gradino costa qui.

La lezione vale più della cifra: confronti al tier a cui renderizza davvero. Una tariffa da vetrina è quasi sempre il gradino utile più economico di un provider, e il rapporto tra i gradini lo decide il rivenditore.

Cosa non include chiamare Google direttamente

L'istinto dice di tagliare il livello intermedio e comprare dalla fonte. Qui la fonte non è né l'opzione più economica né la meno vincolata.

  • Nessun free tier per l'output video. Testo e immagini funzionano sul free tier di Gemini; il video no. Non c'è niente su cui fare prove.
  • Nessuno sconto Batch. Altri modelli Gemini 3.x tolgono circa il cinquanta per cento per l'invio in batch. Il video è escluso, quindi la leva che dimezza un lavoro grande non c'è.
  • Trattamento dei dati. Anche sul tier a pagamento, i termini di Google indicano i contenuti inviati a questo modello come utilizzabili per il miglioramento del prodotto.
  • Un prezzo che deve andare a caccia. La documentazione mostra una sola cella video; la scala è un'immagine dentro un post di blog.

Niente di tutto questo rende sbagliato chiamare Google. Rende "compra diretto, salta il margine" un'euristica più debole di quanto sembri — su questo modello c'è a malapena un margine da saltare, visto che il rivenditore che rispecchia il prezzo di listino glielo passa a costo.

La clip qui sotto è costata $0.72

L'abbiamo generata con Omni 1.1 Flash stesso, otto secondi a 720p, al prezzo di cui discute questo post. Otto volte nove centesimi.

Una ripresa aerea notturna sopra midtown Manhattan entra dentro Times Square finché un solo cartellone digitale riempie l'inquadratura: OMNI FLASH 1.1, poi AVAILABLE NOW ON E2X.AI, che si risolve nel logo E2X sull'asfalto bagnato.

Il prompt, alla lettera:

Cinematic 8-second commercial set in New York City at night. Opens on a wide aerial shot of Manhattan, then pushes rapidly into Times Square. Neon billboards, yellow taxis, pedestrians, wet asphalt reflecting colored light. The camera flies toward one massive digital billboard dominating the square. On the billboard, clearly readable text appears: "OMNI FLASH 1.1". Then: "THE LOWEST PRICE." The billboard transitions to: "AVAILABLE NOW ON E2X.AI". Final text: "START USING OMNI FLASH 1.1 TODAY". End with a clean bold E2X.AI logo filling the billboard. Fast energetic camera movement, realistic New York atmosphere, cinematic lighting, photorealistic detail, premium tech commercial look, high contrast, shallow depth of field, realistic reflections, subtle lens flares, smooth transitions. No narration, no one speaks. The message is carried entirely by the giant Times Square billboard. Sound design: city ambience, distant traffic, a rising synth swell, no voices, no speech.

(Il prompt è lasciato in inglese: il modello è stato valutato solo per l'inglese.)

Eseguito come text-to-video, otto secondi, 720p, 16:9. È tornato in 94 secondi contro la stima di circa 240 della nostra pipeline — quella stima è nostra; Google non pubblica alcun dato di latenza. Un campione non è un benchmark, ma se stava mettendo a budget quattro minuti per generazione, ne metta meno.

Ora legga il prompt guardando l'immagine, perché questo è diventato un test involontario dell'abilità più debole del modello. Il prompt nomina il testo del cartellone quattro volte, tra virgolette, e il cartellone protagonista consegna — entrambe le righe pulite, logo a segno. Ogni altro cartellone in campo, quelli a cui il prompt accennava con "neon billboards", torna come scarabocchio convincente. Quindi la regola non è "questo modello non sa fare il testo" ma qualcosa di più stretto: il testo che specifica tende a renderizzare; il testo che il modello inventa per arredare la scena no. Un rendering del testo traballante è stato segnalato su questa famiglia fin dal lancio — implicator.ai l'ha rilevato, e noi non siamo riusciti a trovarlo detto così sulla model card di Google — quindi prenda la clip come nostra evidenza, non come un'ammissione del fornitore.

Prima di pagare nove centesimi, guardi un centesimo

Ecco il punto in cui l'audit argomenta contro il proprio oggetto.

Veo 3.1 Fast costa $0.01 al secondo sulla stessa API, con la stessa chiave — un nono di Omni 1.1 Flash. La clip qui sopra lì sarebbe costata otto centesimi invece di settantadue, e per un'inquadratura a sé stante da cui non dipende nulla, molto probabilmente sarebbe stata abbastanza buona. Nella tabella di Google stessa Veo 3.1 Fast è listato a $0.10 al secondo, quindi lì siamo un decimo della fonte, non l'undici per cento sotto.

Perciò la classifica onesta non è "Omni qui è il più economico". È che la maggior parte di chi legge un post sul modo più economico di chiamare Omni dovrebbe chiamare qualcos'altro. Ci ricorra quando il lavoro ha bisogno di ciò che solo lui fa — un primo e un ultimo frame specificati, un personaggio che sopravvive da un'inquadratura all'altra, l'estensione fino a quaranta secondi. Un carrello non è una di quelle cose.

Un confronto sarebbe disonesto farlo al contrario. Omni Flash, la preview di giugno, qui fattura $0.0825 al secondo per text-to-video e $0.075 per i lavori con reference — quindi la 1.1 costa dal nove al venti per cento in più del modello che sostituisce, non di meno. Vale la pena essere precisi su da dove viene: tutti e tre stanno sullo stesso listino da $0.15 e differiscono solo per lo sconto che applichiamo, 40 per cento contro 45 e 50. L'aumento è uno sconto più piccolo, non un prodotto più caro. Quello che compra è image-to-video e il controllo del primo e dell'ultimo frame, un gradino a 360p per cui l'enum più vecchio non ha una voce, e un tetto di dieci secondi — uno scambio equo, ma un aumento, e chiunque Le dica che il modello nuovo costa meno ha la direzione al contrario.

Rifare questo audit da soli

Cinque abitudini che sopravviveranno a questi numeri particolari:

  1. Legga la stringa di versione, non il nome del modello. Due pagine su un solo dominio ci hanno venduto la stessa famiglia a $0.10 e a $0.125 nello stesso pomeriggio.
  2. Controlli se la fonte è testo. La scala in dollari di Google è un'immagine e quella vera è una nota a piè di pagina sui token, così gli scraper citano solo il numero che sta nella documentazione come HTML.
  3. Prezzi il tier a cui renderizza, non quello con cui il provider apre. Runware è allineato a 720p ed è il listino più caro a 4K.
  4. Converta i token in secondi prima di confrontare. $17.50 per milione non significa niente finché non lo moltiplica per i token che brucia il Suo tier.
  5. Controlli se un prezzo al secondo esiste. Replicate porta il modello senza pubblicarne uno.

Prezzi e condizioni di prodotto possono cambiare. Verifichi i prezzi correnti di ogni provider prima di prendere una decisione d'acquisto. Il pricing Google Batch o Flex non è direttamente equivalente a una normale richiesta API on-demand, perché scheduling, disponibilità e condizioni di elaborazione sono diversi; per questo è escluso qui. Questo è un confronto circoscritto ai cinque provider che pubblicano un prezzo al secondo chiamabile, non l'affermazione che E2X sia l'opzione più economica in ogni configurazione. Il modo più economico di fare la maggior parte delle clip non è affatto questo modello, come dice la sezione qui sopra.

Poi abbozzi al gradino più economico che riesce a tollerare e renderizzi a 720p quella da tenere. Parametri e tariffe correnti per capability sono nella spec leggibile da macchina; la lineup è nel nostro catalogo. Abbiamo trattato a parte cosa è uscito nella 1.1, cosa hanno misurato le classifiche, come scrivere i prompt e perché una scena da 40 secondi arriva come quattro fatture separate.

Domande frequenti

Qual è il modo più economico di chiamare Gemini Omni 1.1 Flash?

Tra i cinque provider che pubblicavano un prezzo chiamabile il 28 agosto 2026, E2X è risultato il più basso su tutti e quattro i gradini — $0.0297 per un secondo a 360p, nove centesimi a 720p, $0.135 un tier più su, $0.18 a 4K. Il campo a 720p va da $0.10 sulla pagina v1.1 di fal.ai e su Runware, $0.1014 da Google, fino a $0.13 su WaveSpeed e sugli endpoint base reference e image di fal. Il nostro margine è più sottile a 360p, circa un per cento contro fal, e più largo a 4K.

Quanto costa Gemini Omni 1.1 Flash se chiamo Google direttamente?

Google fattura a token, non a secondi: $17.50 per milione per l'output video. La nota della sua pagina Cloud pricing elenca i token che ogni risoluzione brucia al secondo, e moltiplicando si ottiene poco più di tre centesimi per un secondo a 360p, poco più di dieci per il 720p, quindici e un quinto per il 1080p e appena oltre trenta a 4K. Una versione arrotondata della stessa scala compare nell'annuncio di lancio, come immagine e non come testo. Nessun free tier, nessuno sconto Batch.

Perché provider diversi chiedono prezzi diversi per lo stesso modello?

Perché prezzano su basi diverse. Alcuni rispecchiano la lista arrotondata di Google, ed è il motivo per cui la pagina v1.1 di fal.ai e Runware finiscono entrambe a $0.10. Altri prezzano a token con un margine aggiunto: le pagine base di fal usano $21.875 per milione contro i $17.50 di Google, un rincaro del 25% che arriva da $0.125 a $0.13. WaveSpeed dichiara un forfait di $0.13. I pesi e l'output sono identici in tutti i casi.

Replicate pubblica un prezzo per Gemini Omni 1.1 Flash?

Replicate elenca il modello ma non ne pubblica alcuna tariffa al secondo, al 28 agosto 2026. Questo rende impossibile includerlo in un confronto alla pari e difficile metterlo a budget, dato che la fatturazione del video scala con durata e risoluzione e non con il numero di richieste.

Gemini Omni 1.1 Flash costa meno del modello che sostituisce?

No. La preview precedente, Gemini Omni Flash, su E2X fattura $0.0825 al secondo per text-to-video e $0.075 per reference-to-video, contro i $0.09 di Omni 1.1 Flash — dal nove al venti per cento in più. Tutti e tre partono dallo stesso listino da $0.15 e differiscono solo per lo sconto, quindi l'aumento è uno sconto più piccolo e non un modello più caro. Il sovrapprezzo compra image-to-video, il controllo del primo e dell'ultimo frame, un gradino di bozza a 360p e clip da dieci secondi.

A quale risoluzione conviene generare per tenere bassi i costi?

Abbozzi a 360p e renderizzi a 720p solo quella da tenere. Su E2X un secondo a 360p è esattamente un terzo di uno a 720p, quindi quattro secondi costano $0.1188 contro $0.36 — cinque bozze più un render completo fanno $0.954, ancora sotto tre tentativi diretti a 720p da $1.08. Il 4K raramente si ripaga per la distribuzione web: dieci secondi sono $1.80 qui contro $3.04 da Google.

Esiste un modello video più economico di Gemini Omni 1.1 Flash?

Sì, e per la maggior parte dei lavori a clip singola è la scelta migliore. Veo 3.1 Fast costa un centesimo al secondo su E2X — un nono di Omni 1.1 Flash, e un decimo dei $0.10 con cui Google stessa lo lista — e copre lavori con il solo prompt, immagini animate, clip con reference e lavori sul primo e ultimo frame. Omni si guadagna il sovrapprezzo solo sull'estensione di scena, le generazioni da dieci secondi, il tier a 360p o la coerenza da reference tra le inquadrature.