ब्लॉग पर वापस जाएं

पाँच जगहें Gemini Omni 1.1 Flash बेचती हैं। दाम 44% तक हिलता है

E2X Team··17 मिनट पढ़ें
gemini-omnigooglepricingtext-to-videovideo-generation

मॉडल के weights की तुलना करके कोई ख़रीदारी नहीं करता। आप एक मॉडल का नाम चुनते हैं, Google जिस प्रोवाइडर का पेज सामने ले आया उस पर उतरते हैं, और जो पेज पर लिखा है वह चुका देते हैं।

28 अगस्त 2026 को हम हर उस जगह की तलाश में निकले जो एक ही मॉडल के लिए कॉल करने लायक़ दाम छापती है — gemini-omni-1.1-flash, जिसे Google ने एक दिन पहले भेजा था। पाँच छापती हैं। वही weights, वही नेटिव ऑडियो, हर frame में वही SynthID वॉटरमार्क। और पेज के नीचे बैठा वह नंबर 44 फ़ीसदी तक हिल गया।

आगे जो है वह वही ऑडिट है — उस हिस्से समेत जहाँ हम आपसे कहते हैं कि इस पोस्ट का विषय जो मॉडल है, उससे नौ गुना सस्ती कोई चीज़ ख़रीदिए।

घिसे हुए ज़िंक काउंटर पर एक जैसे बिना लेबल वाले टिन के डिब्बों की एक क़तार, हर डिब्बे पर एक ख़ाली काग़ज़ी टैग अलग-अलग ऊँचाई पर लटका हुआ

पाँच दाम, एक ही दोपहर में पढ़े गए

नीचे सब कुछ 720p है, तैयार वीडियो के प्रति सेकंड के हिसाब से, 28 अगस्त 2026 को हर प्रोवाइडर के लाइव पेज से पढ़ा गया। ऑडियो हर जगह शामिल है: मॉडल में ऑडियो का कोई स्विच नहीं, इसलिए आवाज़ तस्वीर के साथ ही बनती है और कोई उसका अलग बिल नहीं बनाता।

कहाँ से कॉल करते हैंप्रति सेकंड, 720pआठ-सेकंड की clip
E2X$0.09$0.72
fal.ai v1.1/edit$0.10$0.80
Runware$0.10$0.80
Google, सीधे$0.1014 प्रभावी$0.81
fal.ai बेस text-to-video$0.125$1.00
fal.ai बेस reference / image-to-video$0.13$1.04
WaveSpeed$0.13$1.04

सबसे नीचे से सबसे ऊपर, $0.09 के मुक़ाबले $0.13। यही वे 44 फ़ीसदी हैं, और वे कुछ भी नहीं ख़रीदते — न वीडियो का बेहतर एक सेकंड, न लंबी clip, न ऊँची सीमा। वही फ़ाइल, वही डेटासेंटर।

उन पंक्तियों में से तीन एक ही कंपनी की हैं, और यही अगला हिस्सा है।

Google की पंक्ति को एक footnote चाहिए, क्योंकि Google का pricing पेज सेकंड के बजाय tokens में बिल बनाता है। वीडियो output $17.50 प्रति दस लाख tokens है, और 720p हर सेकंड 5,792 tokens खाता है; गुणा कीजिए तो $0.1014 निकलता है। यह रूपांतरण Google का अपना हिसाब है, हमारा नहीं — पेज उसे यूँ छापता है: "an effective price of approximately $0.10 per second."

एक कंपनी, एक मॉडल परिवार, दो pricing तर्क

सबसे अजीब खोज कोई प्रतिस्पर्धी नहीं है। यह fal.ai का ख़ुद से असहमत होना है।

fal.ai/models/google/gemini-omni-flash/v1.1/edit खोलिए और आपको $0.10 प्रति सेकंड मिलता है, एक ऐसी सीढ़ी पर जो Google की गोल की हुई सूची से पायदान-दर-पायदान बिल्कुल एक जैसी है, बिल्कुल कोई मार्जिन नहीं। वह कोई स्वतंत्र दाम नहीं बल्कि एक passthrough है — उसे दूसरा डेटा पॉइंट मानिए और आप Google को दो बार गिन रहे हैं। उसी डोमेन पर बेस gemini-omni-flash पेज खोलिए और मॉडल की क़ीमत इसके बजाय tokens में लगी है, $21.875 प्रति दस लाख — text-to-video के लिए क़रीब $0.125, reference और image वाले कामों के लिए $0.13। वही कंपनी, वही परिवार, एक लिस्टिंग लागत पर और एक मार्जिन चढ़ाकर।

वह मार्जिन Google की token दर से ठीक पच्चीस फ़ीसदी ऊपर है। इसमें कुछ ग़लत नहीं: retries सँभालने वाला और आपको एक ही auth सतह देने वाला aggregator पैसे लेने का हक़दार है। लेकिन इसका मतलब है कि "Omni 1.1 Flash का दाम" वाक्यांश का, एक ही दुकान के भीतर भी, कोई एक निश्चित संदर्भ नहीं है। इसलिए जिस पेज के हिसाब से आपका बिल बन रहा है, उस पर version string देखिए — बिना version वाला gemini-omni-flash लिखा पेज आपको न 1.1 बेच रहा हो सकता है, न उसका दाम।

एक जैसे पुराने पीतल के डाकघर बक्सों की पूरी दीवार, जिनमें से एक छोटा दरवाज़ा हल्का-सा खुला है और अंदर का अँधेरा ख़ालीपन दिखाता है

एक प्रोवाइडर के पास तो यह नंबर है ही नहीं। Replicate मॉडल को सूचीबद्ध करता है और उसके लिए कोई प्रति-सेकंड दर नहीं छापता — हमने देखा, उद्धृत करने को कुछ नहीं है। यह अपने आप में एक निष्कर्ष है, हमारी चूक नहीं: जिस वीडियो मॉडल की लागत आप चलाने से पहले पढ़ ही नहीं सकते, वह वह मॉडल है जिसका बजट आप नहीं बना सकते।

Google की resolution सीढ़ी दो बार छपी है, दो अलग शक्लों में

ऊपर जो कुछ है वह बस एक पायदान है। Omni 1.1 Flash चार बेचता है, और बाक़ी तीन ढूँढ़ने में जितना वक़्त लगना चाहिए था उससे कहीं ज़्यादा लगा।

Google इसे दो बार छापता है, और दोनों बार उन जगहों पर नहीं जहाँ आप देखेंगे। Cloud pricing का footnote हर टियर पर प्रति सेकंड token की गिनती देता है — यही बिलिंग का सच है, क्योंकि इनवॉइस tokens पर कटता है। लॉन्च घोषणा में डॉलर की गोल की हुई तालिका है, मगर एक रेंडर की हुई इमेज के रूप में, इसलिए scrapers और उनसे बने लेख उसे लाँघ जाते हैं। और Gemini API pricing पेज, जो सबसे ज़ाहिर पड़ाव है, उसमें सिर्फ़ 720p वाला ख़ाना है।

हम इस रास्ते पर इतनी दूर चले गए कि यह नतीजा निकाल बैठे कि चार-पायदान वाली सीढ़ी किसी रीसेलर की गढ़ी हुई है, और वैसा कहने वाला एक हिस्सा लिख भी डाला — उसके बाद लौटकर उस तस्वीर को पढ़ा। यह मान लेना ज़रूरी है, क्योंकि यही ठीक वह नाकामी है जिसके बारे में यह पोस्ट है: एक ऐसा नंबर जो छपा हुआ, स्रोत सहित और सही है, फिर भी ज़्यादातर लोगों के जाँचने के तरीक़े के लिए अदृश्य रह सकता है।

token गिनतियों से निकली सीढ़ी, यानी जो आप असल में चुकाते हैं:

ResolutionGoogle tokens/सेकंडGoogle $/सेकंडE2Xअंतर
360p1,931$0.0338$0.0297E2X 12% सस्ता
720p5,792$0.1014$0.09E2X 11% सस्ता
1080p8,688$0.1520$0.135E2X 11% सस्ता
4K17,376$0.3041$0.18E2X 41% सस्ता

ऊपर वाली पंक्ति उस चीज़ के लिए पढ़िए जो सचमुच आपके काम करने का तरीक़ा बदलती है। हमारी सीढ़ी पर 360p का एक सेकंड 720p के एक सेकंड का ठीक एक-तिहाई पड़ता है — $0.0297 के मुक़ाबले $0.09 — यानी तीन drafts उतने के पड़ते हैं जितने की एक पूरी resolution वाली पास। यही एक वाक्य में draft टियर की पूरी दलील है, और यही वजह है कि सस्ता पायदान रखने लायक़ है, भले ही क्वालिटी साफ़ तौर पर ख़राब हो।

अब नीचे वाली पंक्ति, जहाँ token गिनतियों से काम करने का फल मिलता है: गुणक वाली दलील बयानबाज़ी नहीं रह जाती, Google का अपना डेटा बन जाती है। 720p को 1× मानिए। Google के टियर 0.33 · 1 · 1.5 · 3 पर चलते हैं। हमारे 0.33 · 1 · 1.5 · 2 पर। नीचे एक जैसे, बीच में एक जैसे, और फिर 4K में जाकर Google तिगुना करता है जहाँ हम दोगुना — यही वजह है कि 4K के दस सेकंड Google को कॉल करने पर $3.04 और हमें कॉल करने पर $1.80 पड़ते हैं।

हल्के चूना-पत्थर पर चार लंबे काँच के मापक सिलेंडर, हर एक में साफ़ पानी क्रमशः ऊँचे स्तर तक भरा, दाईं ओर से नरम खिड़की की रोशनी

यहाँ चारों capabilities उसी एक सीढ़ी पर बिल बनाती हैं — reference-to-video उतने का है जितने का start-end-frame-to-video, और उतने ही का image-to-video और सादा text-to-video। यह सार्वभौमिक नहीं है: fal के बेस पेजों पर reference और image वाले काम सिर्फ़-prompt वालों से महँगे हैं।

Runware के सस्ते पायदान के ऊपर एक महँगा पायदान है

720p पर Runware मैदान के बराबर है, $0.10। एक पायदान चढ़िए और वह 1080p पर $0.16 और 4K पर $0.32 लेता है — जबकि Google का अपना $0.1520 और $0.3041 है। जिन ठीक दो resolutions पर एक सेकंड सबसे महँगा पड़ता है, वहीं वह उस स्रोत से महँगा है जिसे वह दोबारा बेच रहा है। Google से बस क़रीब पाँच फ़ीसदी ऊपर; लेकिन प्रोवाइडरों की तुलना पहली दिखने वाली संख्या से कीजिए, उसे किसी 4K काम के लिए चुनिए, और आप उस $0.18 के लगभग दोगुने चुकाते हैं जो वह पायदान यहाँ पड़ता है।

सबक़ आँकड़े से ज़्यादा क़ीमती है: उसी टियर पर तुलना कीजिए जिस पर आप सचमुच render करते हैं। सुर्ख़ी वाली दर लगभग हमेशा किसी प्रोवाइडर का सबसे सस्ता काम का पायदान होती है, और पायदानों के बीच का अनुपात रीसेलर तय करता है।

Google को सीधे कॉल करने में क्या शामिल नहीं है

सहज बुद्धि कहती है कि बीच की परत काटिए और स्रोत से ख़रीदिए। यहाँ स्रोत न सबसे सस्ता विकल्प है, न सबसे कम पाबंदी वाला।

  • वीडियो output के लिए कोई मुफ़्त टियर नहीं। टेक्स्ट और इमेज Gemini के मुफ़्त टियर पर चलते हैं; वीडियो नहीं। परखने को कुछ नहीं।
  • कोई Batch छूट नहीं। दूसरे Gemini 3.x मॉडल batch सबमिशन पर मोटे तौर पर आधा दाम लेते हैं। वीडियो इससे बाहर है, इसलिए बड़े काम को आधा कर देने वाला लीवर ही नहीं रहा।
  • डेटा का बरताव। पेड टियर पर भी, Google की शर्तें इस मॉडल को भेजी गई सामग्री को प्रोडक्ट सुधार के लिए इस्तेमाल-योग्य बताती हैं।
  • एक दाम जिसे आपको ढूँढ़ना पड़ता है। दस्तावेज़ में वीडियो का एक ख़ाना है; सीढ़ी एक ब्लॉग पोस्ट में इमेज है।

इनमें से कोई भी Google को कॉल करना ग़लत नहीं बनाता। ये "सीधे ख़रीदो, मार्जिन बचाओ" को उससे कमज़ोर नुस्ख़ा बनाते हैं जितना वह सुनाई देता है — इस मॉडल पर बचाने लायक़ मार्जिन है ही मुश्किल से, क्योंकि list price की नक़ल करने वाला रीसेलर उसे आपको लागत पर ही थमा देता है।

नीचे वाली clip $0.72 की पड़ी

यह हमने ख़ुद Omni 1.1 Flash से बनाई, 720p पर आठ सेकंड, ठीक उसी दाम पर जिस पर यह पोस्ट बहस कर रही है। आठ गुणा नौ सेंट।

मिडटाउन मैनहट्टन के ऊपर एक रात का एरियल Times Square में घुसता है, जब तक कि एक डिजिटल बोर्ड पूरा शॉट न भर ले: OMNI FLASH 1.1, फिर AVAILABLE NOW ON E2X.AI, और अंत में गीली सड़क के ऊपर E2X का लोगो।

prompt, हूबहू:

Cinematic 8-second commercial set in New York City at night. Opens on a wide aerial shot of Manhattan, then pushes rapidly into Times Square. Neon billboards, yellow taxis, pedestrians, wet asphalt reflecting colored light. The camera flies toward one massive digital billboard dominating the square. On the billboard, clearly readable text appears: "OMNI FLASH 1.1". Then: "THE LOWEST PRICE." The billboard transitions to: "AVAILABLE NOW ON E2X.AI". Final text: "START USING OMNI FLASH 1.1 TODAY". End with a clean bold E2X.AI logo filling the billboard. Fast energetic camera movement, realistic New York atmosphere, cinematic lighting, photorealistic detail, premium tech commercial look, high contrast, shallow depth of field, realistic reflections, subtle lens flares, smooth transitions. No narration, no one speaks. The message is carried entirely by the giant Times Square billboard. Sound design: city ambience, distant traffic, a rising synth swell, no voices, no speech.

(prompt अंग्रेज़ी में ही रखा गया है: मॉडल का मूल्यांकन सिर्फ़ अंग्रेज़ी के लिए हुआ है।)

text-to-video के तौर पर चलाया, आठ सेकंड, 720p, 16:9। यह 94 सेकंड में लौटा, जबकि हमारी अपनी pipeline का अनुमान क़रीब 240 का था — वह अनुमान हमारा है; Google कोई latency आँकड़ा नहीं छापता। एक sample कोई benchmark नहीं है, लेकिन अगर आप हर generation के लिए चार मिनट का बजट रखते आए हैं, तो कम रखिए।

अब prompt को तस्वीर के सामने रखकर पढ़िए, क्योंकि यह अनजाने में मॉडल के सबसे कमज़ोर हुनर की परीक्षा बन गया। prompt बिलबोर्ड के टेक्स्ट का चार बार, उद्धरण चिह्नों में, नाम लेता है, और मुख्य बोर्ड कर दिखाता है — दोनों पंक्तियाँ साफ़, लोगो सही जगह। शॉट में बाक़ी हर बिलबोर्ड, यानी वे जिनकी तरफ़ prompt ने बस "neon billboards" कहकर इशारा किया, भरोसेमंद दिखने वाली बकवास बनकर लौटते हैं। तो नियम यह नहीं है कि यह मॉडल टेक्स्ट नहीं कर सकता, बल्कि कुछ और सँकरा है: जो टेक्स्ट आप निर्दिष्ट करते हैं वह अमूमन render हो जाता है; सेट सजाने के लिए मॉडल जो टेक्स्ट ख़ुद गढ़ता है, वह नहीं। इस परिवार में लॉन्च से ही डगमगाते टेक्स्ट rendering की रिपोर्टें हैं — implicator.ai ने इसे उठाया, और हमें Google के model card पर यह बात इस तरह कही हुई नहीं मिली — इसलिए इस clip को हमारा सबूत मानिए, विक्रेता की स्वीकारोक्ति नहीं।

नौ सेंट चुकाने से पहले, एक सेंट पर नज़र डालिए

यहीं यह ऑडिट अपने ही विषय के ख़िलाफ़ दलील देने लगता है।

Veo 3.1 Fast उसी API पर, उसी key पर, $0.01 प्रति सेकंड है — Omni 1.1 Flash का नौवाँ हिस्सा। ऊपर वाली clip वहाँ बहत्तर के बजाय आठ सेंट की पड़ती, और एक ऐसे अकेले shot के लिए जिस पर आगे कुछ टिका न हो, बहुत मुमकिन है कि काफ़ी अच्छी भी होती। Google की अपनी तालिका में Veo 3.1 Fast $0.10 प्रति सेकंड पर दर्ज है, यानी उस पर हम स्रोत के दाम का दसवाँ हिस्सा हैं, ग्यारह फ़ीसदी नीचे नहीं।

तो ईमानदार निष्कर्ष यह नहीं है कि Omni यहाँ सबसे सस्ता है। यह है कि Omni को सबसे सस्ते तरीक़े से कॉल करने पर लिखी पोस्ट पढ़ने वाले ज़्यादातर लोगों को कुछ और कॉल करना चाहिए। इसे तब उठाइए जब काम को वही चाहिए जो सिर्फ़ यह करता है — निर्दिष्ट पहला और आख़िरी frame, एक किरदार जो कई shots के आर-पार टिका रहे, चालीस सेकंड तक का extension। एक dolly shot उनमें से नहीं है।

एक तुलना ऐसी है जिसे उलटकर कहना बेईमानी होगी। जून का preview, Omni Flash, यहाँ text-to-video के लिए $0.0825 प्रति सेकंड और reference वाले कामों के लिए $0.075 का बिल बनाता है — यानी 1.1 उस मॉडल से नौ से बीस फ़ीसदी महँगा है जिसकी वह जगह लेता है, सस्ता नहीं। यह फ़र्क़ कहाँ से आता है, इस बारे में ठीक-ठीक होना ज़रूरी है: तीनों एक ही $0.15 की list दर पर बैठे हैं और सिर्फ़ उस छूट में अलग हैं जो हम देते हैं, चालीस फ़ीसदी बनाम पैंतालीस और पचास। बढ़ोतरी छोटी छूट है, महँगा प्रोडक्ट नहीं। इससे जो मिलता है वह है image-to-video और पहले-और-आख़िरी frame का कंट्रोल, एक 360p पायदान जिसकी पुराने enum में कोई एंट्री ही नहीं, और दस सेकंड की सीमा — एक जायज़ सौदा, मगर बढ़ोतरी; और जो आपसे कहे कि नया मॉडल सस्ता है, उसने दिशा उलटी पकड़ी है।

यह ऑडिट ख़ुद करना

पाँच आदतें जो इन ख़ास आँकड़ों से ज़्यादा जिएँगी:

  1. मॉडल का नाम नहीं, version string पढ़िए। एक ही डोमेन के दो पेजों ने एक ही दोपहर में हमें एक ही परिवार $0.10 और $0.125 पर बेचा।
  2. देखिए कि स्रोत टेक्स्ट है या नहीं। Google की डॉलर वाली सीढ़ी एक इमेज है और असली वाली एक token footnote, इसलिए scrapers सिर्फ़ वही नंबर उद्धृत करते हैं जो दस्तावेज़ में HTML की तरह बैठा है।
  3. जिस टियर पर render करते हैं उसी का दाम लगाइए, उसका नहीं जिससे प्रोवाइडर शुरुआत करता है। Runware 720p पर बराबरी पर है और 4K पर सबसे महँगी लिस्टिंग।
  4. तुलना से पहले tokens को सेकंड में बदलिए। $17.50 प्रति दस लाख का तब तक कोई मतलब नहीं जब तक आप उसे अपने टियर के जलने वाले tokens से गुणा न कर लें।
  5. पहले यह जाँचिए कि प्रति-सेकंड दाम मौजूद भी है या नहीं। Replicate मॉडल रखता है, दाम छापे बिना।

दाम और प्रोडक्ट की शर्तें बदल सकती हैं। ख़रीदारी का फ़ैसला करने से पहले हर प्रोवाइडर की मौजूदा pricing जाँच लीजिए। Google की Batch या Flex pricing किसी मानक on-demand API अनुरोध के सीधे बराबर नहीं है, क्योंकि शेड्यूलिंग, उपलब्धता और प्रोसेसिंग की शर्तें अलग हैं; इसलिए उसे यहाँ शामिल नहीं किया गया। यह उन पाँच प्रोवाइडरों के बीच एक सीमित दायरे की तुलना है जो कॉल करने लायक़ प्रति-सेकंड दाम छापते हैं, यह दावा नहीं कि E2X हर configuration में सबसे सस्ता विकल्प है। जैसा ऊपर वाला हिस्सा कहता है, ज़्यादातर clips बनाने का सबसे सस्ता तरीक़ा यह मॉडल है ही नहीं।

फिर जिस सबसे सस्ते पायदान को आप बर्दाश्त कर सकें उस पर draft कीजिए और रखने लायक़ वाली को 720p पर render कीजिए। हर capability के parameters और मौजूदा दरें मशीन-पठनीय spec में हैं; पूरी सूची हमारे कैटलॉग में है। 1.1 में क्या आया, बोर्डों ने क्या नापा, इसे prompt कैसे करें और चालीस सेकंड की एक सीन चार अलग बिलों में क्यों आती है — इन पर हमने अलग से लिखा है।

अक्सर पूछे जाने वाले सवाल

Gemini Omni 1.1 Flash को कॉल करने का सबसे सस्ता तरीक़ा क्या है?

28 अगस्त 2026 को कॉल करने लायक़ दाम छापने वाले पाँच प्रोवाइडरों में से E2X चारों पायदानों पर सबसे नीचे रहा — 360p के एक सेकंड के लिए $0.0297, 720p पर नौ सेंट, एक टियर ऊपर $0.135, 4K पर $0.18। 720p का मैदान यूँ है: fal.ai के v1.1 पेज और Runware पर $0.10, Google से $0.1014, WaveSpeed पर और fal के बेस reference तथा image endpoints पर $0.13। हमारा फ़ासला 360p पर सबसे पतला है, fal के मुक़ाबले क़रीब एक फ़ीसदी, और 4K पर सबसे चौड़ा।

अगर मैं सीधे Google को कॉल करूँ तो Gemini Omni 1.1 Flash का दाम क्या है?

Google सेकंड नहीं, tokens में बिल बनाता है: वीडियो output के लिए $17.50 प्रति दस लाख। उसका Cloud pricing footnote बताता है कि हर resolution प्रति सेकंड कितने tokens जलाता है, और गुणा करने पर 360p का एक सेकंड तीन सेंट से थोड़ा ऊपर, 720p दस से थोड़ा ऊपर, 1080p पंद्रह और एक बटा पाँच, और 4K तीस से बस आगे बैठता है। उसी सीढ़ी का गोल किया हुआ संस्करण लॉन्च घोषणा में है, टेक्स्ट के बजाय इमेज के रूप में। कोई मुफ़्त टियर नहीं, कोई Batch छूट नहीं।

एक ही मॉडल के लिए अलग-अलग प्रोवाइडर अलग-अलग दाम क्यों लेते हैं?

क्योंकि उनके दाम का आधार अलग है। कुछ Google की गोल की हुई सूची की नक़ल करते हैं, इसीलिए fal.ai का v1.1 पेज और Runware दोनों $0.10 पर उतरते हैं। बाक़ी tokens में दाम लगाकर मार्जिन जोड़ते हैं: fal के बेस पेज Google के $17.50 के मुक़ाबले $21.875 प्रति दस लाख इस्तेमाल करते हैं, यानी 25% की बढ़त, जो $0.125 से $0.13 तक पहुँचती है। WaveSpeed एक सपाट $0.13 बताता है। weights और output शुरू से आख़िर तक एक जैसे हैं।

क्या Replicate Gemini Omni 1.1 Flash का दाम छापता है?

28 अगस्त 2026 तक, Replicate मॉडल को सूचीबद्ध करता है मगर उसके लिए कोई प्रति-सेकंड दर नहीं छापता। इससे उसे एक समान-आधार तुलना में शामिल करना नामुमकिन हो जाता है और बजट बनाना मुश्किल, क्योंकि वीडियो की बिलिंग अनुरोधों की गिनती से नहीं, अवधि और resolution से बढ़ती है।

क्या Gemini Omni 1.1 Flash उस मॉडल से सस्ता है जिसकी वह जगह लेता है?

नहीं। पिछला Gemini Omni Flash preview E2X पर text-to-video के लिए $0.0825 प्रति सेकंड और reference-to-video के लिए $0.075 का बिल बनाता है, जबकि Omni 1.1 Flash $0.09 का — नौ से बीस फ़ीसदी ज़्यादा। तीनों उसी $0.15 की list दर से चलते हैं और सिर्फ़ छूट में अलग हैं, इसलिए यह बढ़ोतरी छोटी छूट है, महँगा मॉडल नहीं। अतिरिक्त दाम से image-to-video, पहले-और-आख़िरी frame का कंट्रोल, एक 360p draft पायदान और दस-सेकंड की clips मिलती हैं।

लागत नीचे रखने के लिए मुझे किस resolution पर generate करना चाहिए?

360p पर draft कीजिए और सिर्फ़ रखने लायक़ वाली को 720p पर render कीजिए। E2X पर 360p का एक सेकंड 720p के ठीक एक-तिहाई का है, इसलिए चार सेकंड $0.36 के मुक़ाबले $0.1188 के पड़ते हैं — पाँच drafts और एक पूरा render मिलाकर $0.954, जो सीधे तीन 720p कोशिशों के $1.08 से अब भी कम है। वेब डिलीवरी के लिए 4K शायद ही अपनी क़ीमत वसूल करता है: दस सेकंड यहाँ $1.80 के हैं और Google से $3.04 के।

क्या Gemini Omni 1.1 Flash से सस्ता कोई वीडियो मॉडल है?

हाँ, और अकेली clip वाले ज़्यादातर कामों के लिए वही बेहतर चुनाव है। Veo 3.1 Fast E2X पर एक सेंट प्रति सेकंड है — Omni 1.1 Flash का नौवाँ हिस्सा, और Google की अपनी $0.10 वाली लिस्टिंग का दसवाँ — और वह सिर्फ़-prompt वाले काम, स्थिर तस्वीरों को हिलाना, reference clips और पहले-और-आख़िरी frame का काम सँभालता है। Omni अपना प्रीमियम सिर्फ़ scene extension, दस-सेकंड की generations, 360p टियर, या shots के आर-पार reference की एकरूपता पर कमाता है।