क्या Gemini Omni 1.1 Flash सचमुच नंबर एक है? बोर्ड क्या कहते हैं
आज आपने "Google का नया वीडियो मॉडल नंबर एक है" वाली जो भी पोस्ट पढ़ी, वह किसी और मॉडल की रैंकिंग का हवाला दे रही है।
Gemini Omni 1.1 Flash कल आम तौर पर उपलब्ध हुआ। Artificial Analysis, जिस बोर्ड की तरफ़ उनमें से ज़्यादातर पोस्ट इशारा करती हैं, उसे ट्रैक ही नहीं करता — न text-to-video पर, न image-to-video पर, न वीडियो एडिटिंग पर। जिन स्थानों का हवाला दिया जा रहा है वे Gemini Omni Flash के हैं, यानी जून वाले preview मॉडल के, और उनमें से ज़्यादातर एक ख़ास बोर्ड के एक ख़ास view के हैं।
यह मॉडल को ख़ारिज करने की वजह नहीं है। यह वजह है कि देखा जाए कि असल में नापा क्या गया है, जो सुर्ख़ी से ज़्यादा दिलचस्प निकलता है।

1.1 को सचमुच कहाँ रैंक किया गया है
एक ही जगह: arena.ai, जिसने 27 अगस्त 2026 को, यानी रिलीज़ वाले दिन ही, gemini-omni-1.1-flash को अपने दो बोर्डों में जोड़ा। 28 अगस्त को पढ़ा गया:
| बोर्ड | स्थान | Elo | वोट |
|---|---|---|---|
| arena.ai Text-to-Video | 1st | 1515 ±16 | 1,762 |
| arena.ai Image-to-Video | 2nd | 1488 ±11 | 3,720 |
तो हाँ — एक बोर्ड ऐसा है जहाँ Gemini Omni 1.1 Flash पहले नंबर पर बैठा है। अब वह हिस्सा जो सुर्ख़ियाँ छोड़ देती हैं। उस बोर्ड पर दूसरा स्थान Gemini Omni Flash का है, 1512 ±10 पर, 19,830 वोटों पर। तीन Elo अंक, ऐसे confidence intervals के साथ जो पूरी तरह ओवरलैप करते हैं, और मोटे तौर पर दसवाँ हिस्सा नमूना।
यह जीत नहीं, सांख्यिकीय बराबरी है। 1,762 वोटों पर तीन अंक का फ़ासला शोर के भीतर ही है, और वोट जमा होने के साथ यह नंबर हिलेगा। अगर अगले महीने आप इसे "Omni 1.1 सबसे ऊपर का text-to-video मॉडल है" के तौर पर उद्धृत होते देखें, तो जाँचिए कि हवाला देने वाले ने interval देखा था या नहीं।
फिर वह है जो ग़ायब है। 1.1 को किसी भी वीडियो एडिटिंग बोर्ड में नहीं जोड़ा गया है, न arena.ai पर, न कहीं और — और एडिटिंग ही वह क्षमता है जिसके इर्द-गिर्द Google ने पूरा लॉन्च बुना।
Artificial Analysis के नंबरों में ऑडियो का जाल
Artificial Analysis हर वीडियो बोर्ड दो बार छापता है — ऑडियो के साथ और बिना। इन नंबरों का हवाला देने वाले लगभग कोई नहीं बताते कि उनका मतलब किससे है, और दोनों में तीखा मतभेद है।
यह रहा Gemini Omni Flash दोनों views पर, 28 अगस्त 2026 को पढ़ा गया:
| बोर्ड | ऑडियो के बिना | ऑडियो के साथ |
|---|---|---|
| Text-to-Video | 1st — 1,322 | 2nd — 1,237, 1,240 पर Wan 3.0 से पीछे |
| Image-to-Video | 1st — 1,365 | 4th — 1,179 |
image-to-video वाली पंक्ति पर ठहरना बनता है। आप कौन-सा view खोलते हैं, इस पर पहला स्थान चौथा बन जाता है, और जो पोस्ट view का नाम लिए बिना "image-to-video पर नंबर एक" कहती है, वह नतीजा नहीं बता रही, वह एक नतीजा चुन रही है।
दोनों views जायज़ हैं। ये मॉडल अब जो बनाते हैं उसका ऑडियो असली हिस्सा है, और जो मॉडल मज़बूत तस्वीर के साथ कमज़ोर आवाज़ बनाता है उसे आवाज़ गिनने वाले बोर्ड पर सचमुच नीचे ही रहना चाहिए। लेकिन पहले और चौथे के बीच का फ़ासला ठीक उसी क़िस्म की तफ़सील है जो सुर्ख़ी में ग़ायब हो जाती है।
एडिटिंग बोर्ड, तारीख़ के साथ ठीक-ठीक
एक क़िस्सा घूम रहा है कि Gemini Omni Flash ने वीडियो एडिटिंग पर नंबर एक से शुरुआत की और बाद में MiniMax H3 ने उसे दूसरे नंबर पर धकेल दिया। यह सच था। यह सच रहना काफ़ी पहले बंद हो चुका है।
- जुलाई 2026 का आख़िर — तभी 2nd, 1,122 पर, 1,130 वाले MiniMax H3 से पीछे
- 6 अगस्त 2026 — 2nd, 1,132 के मुक़ाबले 1,123
- 28 अगस्त 2026 — 3rd, 1,124 पर, 1,189 के साथ Wan 3.0 पहले और 1,128 के साथ MiniMax H3 दूसरे नंबर पर
Alibaba का Wan 3.0 अब तीन में से दो Artificial Analysis बोर्डों में आगे है, जो इस पूरे विषय का सबसे कम रिपोर्ट किया गया तथ्य है। arena.ai के video-edit बोर्ड पर Gemini Omni Flash चौथे नंबर पर है, दो Seedance वेरिएंट और MiniMax H3 से पीछे — और वहाँ उसका स्कोर इस दौरान असल में बढ़ा है, 1,347 से 1,358। वह ख़राब नहीं हुआ। उससे आगे निकल लिया गया।
इस बाज़ार की ईमानदार शक्ल यही है। चार labs जगहें बदल रही हैं, आगे कौन है यह इस पर निर्भर है कि आप कौन-सा बोर्ड और कौन-सा view खोलते हैं, और सब कुछ किसी के पास नहीं है।

Google ने ख़ुद क्या दावा किया
कुछ नहीं। Google की घोषणा में, model card में, या API दस्तावेज़ों में एक भी Elo, benchmark या leaderboard स्थान नहीं आता। लॉन्च एक फ़ीचर सूची और एक दाम है।
हमें लगता है कि इसे चूक के बजाय एक संकेत की तरह पढ़ना बनता है। जिस lab के पास कोई निर्णायक benchmark नतीजा हो, वह आम तौर पर उसी से शुरू करती है। Google ने scene extension, frame कंट्रोल और एक सस्ते draft टियर से शुरुआत की — यानी वही चीज़ें जिन पर आप ज़ोर देते अगर आपके मॉडल की बढ़त आमने-सामने की जीत के बजाय workflow में होती। Google ने जो एक नंबर छापा वह दाम है, और लॉन्च ने असल में क्या बदला इसे हमने अलग से लिखा है।
आज की तारीख़ तक 1.1 की उसके पिछले मॉडल से कोई स्वतंत्र आमने-सामने की तुलना भी नहीं है। जो भी लेख आपको मिलेगा वह घोषणा का ही दोबारा लिखा रूप है। जो आपको बता रहा है कि 1.1 कितना बेहतर है, उसने उसे नापा नहीं है, क्योंकि नापने के लिए अभी कुछ है ही नहीं।
तो आज असल में चलाना क्या चाहिए
यह रहा वह हिस्सा जो बोर्ड चुपचाप आपको बता रहे हैं: उनके शीर्ष पर बैठा मॉडल नया वाला नहीं है। वह पिछली पीढ़ी वाला है। 28 अगस्त 2026 तक यह एक असली बंदिश थी, क्योंकि 1.1 तब यहाँ कॉल नहीं किया जा सकता था। अब किया जा सकता है, और इससे सवाल बदल जाता है — आप क्या चला सकते हैं से आपको क्या चलाना चाहिए।
Omni Flash, वही मॉडल जो ऊपर उद्धृत हर बिना-ऑडियो वाले पहले स्थान के पीछे है, अब भी हमारे API पर चलता है। लेकिन Gemini Omni 1.1 Flash 28 अगस्त 2026 से यहाँ कॉल किया जा सकता है, 720p पर $0.09 प्रति सेकंड पर, और इसके पक्ष में दलील कभी कोई रैंकिंग होने वाली थी ही नहीं। दलील वे चीज़ें हैं जो पुराना मॉडल कर ही नहीं सकता: image-to-video और start-end-frame-to-video, दोनों E2X पर इस परिवार के लिए नए; reference-to-video जो सात reference इमेज तक लेता है; $0.0297 प्रति सेकंड वाला 360p draft टियर; और दस सेकंड तक चलने वाली clips। इनके बीच असल में क्या बदला, इसके लिए लॉन्च का लेखा-जोखा देखिए।
अब असहज हिसाब। Veo 3.1 Fast एक सेंट प्रति सेकंड पड़ता है, यानी Omni 1.1 Flash का नौवाँ हिस्सा, और वह साफ़ तौर पर कमज़ोर मॉडल है, ऑडियो गिनते ही नौवें के आसपास बैठ जाता है।
लेकिन रैंकिंग के बजाय अनुपात देखिए। कुछ दर्जन Elo अंकों के मुक़ाबले नौ गुना पैसा, उस पैमाने पर जहाँ पूरा टॉप टेन क़रीब 120 अंकों में फैला है। एक आठ-सेकंड का shot आठ सेंट और बहत्तर सेंट का फ़र्क़ है, और बीच के चौंसठ सेंट में सस्ते टियर पर आठ कोशिशें और आ जाती हैं। ज़्यादातर shots को सबसे अच्छा मॉडल नहीं चाहिए। उन्हें तीन कोशिशें और चाहिए।
प्रीमियम तब वैकल्पिक नहीं रह जाता जब किसी काम को continuity चाहिए हो: ऐसा किरदार जिसे shots के बीच बचा रहना है, तय किया हुआ खुलने और बंद होने वाला frame, ऐसी clip जिसे बाद में बढ़ाया जाएगा। वहाँ कमज़ोर मॉडल शालीनता से नहीं गिरता, वह सीधे फ़ेल हो जाता है। Veo 3.1 Fast इसमें से बहुत कुछ फिर भी सँभाल लेगा — image-to-video, reference-to-video, पहला और आख़िरी frame — इसलिए आपको ऊपर ले जाने वाली चीज़ कोई leaderboard नहीं, कोई असली नाकामी हो।
दाम और प्रोडक्ट की शर्तें बदल सकती हैं। ख़रीद का फ़ैसला करने से पहले हर provider की मौजूदा pricing जाँच लीजिए। यह एक सीमित दायरे की तुलना है, यह दावा नहीं कि हर configuration में E2X सबसे सस्ता विकल्प है।
वीडियो leaderboard को बिना नुक़सान उठाए कैसे पढ़ें
चार आदतें, और ये इन ख़ास नंबरों के बासी हो जाने के बाद भी लंबे समय तक काम आएँगी:
- मार्केटिंग नाम नहीं, मॉडल string जाँचिए। "Gemini Omni Flash" और "Gemini Omni 1.1 Flash" अलग प्रोडक्ट हैं, और इस हफ़्ते छपा लगभग हर लेख दूसरे मॉडल के लिए पहला नाम इस्तेमाल कर रहा है।
- पूछिए कि कौन-सा view। ऊपर के एक बोर्ड पर ऑडियो के साथ या बिना, पहला स्थान चौथे में बदल जाता है।
- वोटों की संख्या और interval पढ़िए। 1,762 वोटों पर तीन अंक की बढ़त नतीजे के भेस में सिक्का उछालना है।
- लेख की तारीख़ नहीं, स्थान की तारीख़ जाँचिए। कल छपा टुकड़ा जुलाई का snapshot उद्धृत कर सकता है, और इस विषय के दो सबसे ज़्यादा शेयर हुए दावे ठीक यही हैं।
काम के हिसाब से text-to-video या reference-to-video से चुनिए, या मशीन-पठनीय spec पढ़िए — Omni 1.1 Flash एक छापता है जिसमें हर parameter और मौजूदा दाम है। पूरी सूची हमारे कैटलॉग में है।
अक्सर पूछे जाने वाले सवाल
क्या Gemini Omni 1.1 Flash वीडियो leaderboards पर नंबर एक है?
एक बोर्ड पर, मामूली अंतर से और अस्थायी तौर पर। यह arena.ai के Text-to-Video Arena पर 1515 ±16 के साथ पहले नंबर पर है, लेकिन 19,830 के मुक़ाबले 1,762 वोटों पर अपने ही पिछले मॉडल से सिर्फ़ तीन Elo अंक आगे, और confidence intervals ओवरलैप करते हुए — यानी सांख्यिकीय बराबरी। arena.ai Image-to-Video पर यह दूसरे नंबर पर है और Artificial Analysis के बोर्डों पर आता ही नहीं।
क्या Artificial Analysis, Gemini Omni 1.1 Flash को रैंक करता है?
नहीं। 28 अगस्त 2026 तक Gemini Omni 1.1 Flash, Artificial Analysis के तीनों वीडियो leaderboards में से किसी पर भी नहीं आता। "Omni Flash" के लिए घूम रहा हर Artificial Analysis आँकड़ा पहले वाले Gemini Omni Flash preview मॉडल का है, जो जून 2026 में आया था।
एक ही मॉडल के लिए अलग-अलग साइटें अलग रैंकिंग क्यों देती हैं?
ज़्यादातर इसलिए कि Artificial Analysis हर बोर्ड दो बार छापता है, ऑडियो के साथ और बिना, और ज़्यादातर लेख यह नहीं बताते कि उन्होंने कौन-सा इस्तेमाल किया। Gemini Omni Flash बिना ऑडियो वाले image-to-video पर पहले नंबर पर है और ऑडियो के साथ वाले पर चौथे। बोर्ड का चुनाव, तारीख़ और ऑडियो वाला सवाल — ये तीनों मिलकर लगभग हर विरोधाभास समझा देते हैं जो आपको मिलेगा।
क्या Gemini Omni Flash अब भी वीडियो एडिटिंग पर नंबर एक है?
नहीं। इसने शीर्ष से शुरुआत की थी, जुलाई के आख़िर और अगस्त की शुरुआत में MiniMax H3 के पीछे दूसरे नंबर पर रहा, और 28 अगस्त 2026 तक तीसरे नंबर पर है, जहाँ Wan 3.0 पहले नंबर पर है। इसका स्कोर गिरा नहीं — वह arena.ai पर 1,347 से 1,358 तक थोड़ा बढ़ा ही — मगर दूसरे मॉडल उससे तेज़ी से सुधरे।
क्या Google ने Gemini Omni 1.1 Flash के लिए कोई benchmark नतीजे छापे?
नहीं। Google के घोषणा ब्लॉग, API दस्तावेज़ों और DeepMind model card में मॉडल के लिए कोई Elo, benchmark या leaderboard दावा नहीं है। लॉन्च की सामग्री सिर्फ़ फ़ीचर, उपलब्धता और pricing को कवर करती है।
इस वक़्त सबसे अच्छा वीडियो मॉडल कौन-सा है?
कोई एक जवाब नहीं है, और बोर्डों का ईमानदार पाठ यही है। Alibaba का Wan 3.0 तीन में से दो Artificial Analysis बोर्डों में आगे है, MiniMax H3, arena.ai के image-to-video में आगे है, ByteDance का Seedance 2.5 उसके video-edit बोर्ड में आगे है, और Gemini Omni Flash दो Artificial Analysis बोर्डों के बिना-ऑडियो वाले view में आगे है। जो काम आपके पास है उसके हिसाब से चुनिए, सुर्ख़ी के हिसाब से नहीं।
क्या Gemini Omni 1.1 Flash किसी सस्ते मॉडल के मुक़ाबले अपने दाम के लायक़ है?
बिना एडिटिंग या continuity की ज़रूरत वाली अकेली clips के लिए, आमतौर पर नहीं। हमारे API पर 28 अगस्त 2026 तक Veo 3.1 Fast $0.01 प्रति सेकंड पर चलता है जबकि Gemini Omni 1.1 Flash $0.09 पर — कुछ दर्जन Elo अंकों के फ़र्क़ के लिए नौ गुना फ़ासला। प्रीमियम अपनी क़ीमत reference consistency, पहले-और-आख़िरी frame के कंट्रोल और scene extension पर वसूलता है, जहाँ कमज़ोर मॉडल सिर्फ़ ख़राब नहीं दिखता बल्कि काम में फ़ेल हो जाता है।