ब्लॉग पर वापस जाएं

Gemini Omni 1.1 Flash जिन कैमरा शब्दों पर अमल करता है, और जिन्हें अनदेखा करता है

E2X Team··18 मिनट पढ़ें
gemini-omniprompt-engineeringcinematographytext-to-videovideo-generation

Google की video prompting सामग्री को काफ़ी देर पढ़िए और आपको कुछ पैराग्राफ़ की दूरी पर दो वाक्य मिलेंगे। एक camera moves की सूची छापता है — dolly, truck, pedestal, crane, whip pan, arc — मानो आप किसी मेन्यू से ऑर्डर कर रहे हों। दूसरा चेतावनी देता है कि "Some advanced camera angles are not officially supported. The results and reliability may vary depending on the overall prompt and your specific use case."

दोनों सच हैं, और इन दोनों के बीच की खाई ही वह जगह है जहाँ से ज़्यादातर निराश करने वाली clips आती हैं। नाम लेकर बताया गया एक move एक अनुरोध है जिसे मॉडल शायद पूरा कर देगा, कोई parameter नहीं जिसे उसे निभाना ही है। gemini-omni-1.1-flash पर camera-pose का कोई field नहीं है — न rig, न lens, सिर्फ़ शब्द जो आपके बाक़ी शब्दों से होड़ करते हैं। यह पोस्ट इसी पर है कि उन शब्दों में से कौन-से अपनी जगह के हक़दार हैं; यह Google जो दर्ज करता है, Runway जो बताता है और schema जो खोलता है — उसी से बनी है।

मद्धिम रोशनी वाले rental house में काली मख़मल पर सीधी खड़ी पाँच vintage cinema prime lenses, सबसे छोटी से सबसे लंबी के क्रम में, पीतल के focus rings बाईं ओर से आती एक तीखी side light पकड़ते हुए

वे शब्द जो सीधे बाहर हो जाते हैं

घटाने से शुरू कीजिए; इसकी कोई क़ीमत नहीं और यह prompt की जगह ख़रीदता है। Runway का camera-prompting reference AI video prompts के दो सबसे आम शब्दों पर दो-टूक है: "'Cinematic' and '4k' come out because they're doing no work. Neither one changes what the camera does, and the prompt space they occupy is better spent on the move."

यह उनके अपने औज़ारों के बारे में दावा है, Google के बारे में नहीं, लेकिन तर्क साथ चलता है। "Cinematic" एक प्रभाव बताता है, कोई दृष्टिबिंदु नहीं: यह नहीं कहता कि कहाँ खड़े होना है, कितनी दूर, क्या तेज़ रखना है, या किस दिशा में जाना है। पीछे लटके बाक़ी माल का भी यही हाल है — masterpiece, award-winning, 8k, ultra detailed — ये सब image-model prompt संस्कृति से विरासत में आए, जहाँ वे tokens एक बिलकुल अलग training distribution के सामने गुणवत्ता के मंत्र की तरह काम करते थे।

इसका सकारात्मक रूप भी उतना ही सीधा है: "dynamic cinematic camera" माँगने के बजाय किसी ख़ास move का नाम लीजिए, क्योंकि ये मॉडल "camera instructions as spatial direction, not decoration" के रूप में लेते हैं। वहाँ कहीं यह नहीं लिखा कि "cinematic" नुक़सान करता है। लिखा यह है कि वह शब्द किसी बेहतर चीज़ को हटा देता है, और कुछ दर्जन शब्दों के prompt में यही हटाना पूरा खेल है।

Google की सूची, और उस पर कितना भरोसा करें

दर्ज की गई शब्दावली prompt threads में घूम रही हर चीज़ से बेहतर है:

श्रेणीGoogle जिनका नाम लेता है
Movementstatic · pan · tilt · dolly (in, out) · truck (बाएँ, दाएँ) · pedestal (ऊपर, नीचे) · zoom · crane · aerial या drone · handheld · whip pan · arc
Angle और scaleeye-level · low · high · bird's-eye · Dutch · point-of-view · over-the-shoulder · extreme close-up · close-up · medium · full · wide या establishing
Opticswide-angle · telephoto · उथली और गहरी depth of field · lens flare · rack focus · fisheye · dolly zoom

दो बातें ध्यान माँगती हैं। Google zoom को dolly से जानबूझकर अलग करता है, क्योंकि मॉडल दोनों को गड्डमड्ड कर देते हैं: zoom focal length का बदलाव है, और "This is different from a dolly, as the camera itself doesn't move." चाहते हैं कि background आपके subject के मुक़ाबले बढ़ता दिखे? dolly माँगिए। चाहते हैं कि geometry बदले बिना frame सिकुड़े? zoom माँगिए। "zoom in slowly as the camera pushes forward" लिखा और आपने दोनों ऑर्डर कर दिए — एक dolly zoom, और मतलब लगभग कभी यह नहीं होता।

दूसरी बात, जिन शब्दों का श्रेय व्यापक रूप से Google को दिया जाता है वे उसके पन्नों पर हैं ही नहीं। Oner, push in और natural smartphone zoom उन गाइडों में मिलते हैं जो Google के दस्तावेज़ का हवाला देती हैं; हमें वे वहाँ नहीं मिले। दर्ज न होना मना होना नहीं है, पर वे किसी ऐसे वाक्यांश से ज़्यादा अधिकार नहीं रखते जो आप ख़ुद गढ़ लें। पूरा दर्ज किया गया syntax हमारी prompting गाइड में है।

हर clip में एक ही move

Runway के reference का सबसे तीखा निष्कर्ष यह नहीं कि कौन-सी क्रियाएँ काम करती हैं, बल्कि यह कि कितनी।

"Stacked verbs (unreliable): 'Orbit the subject and crane up and push in.' Phased description (reliable): 'The camera arcs around the seated figure, then rises above the table to reveal the empty chairs surrounding her.'"

इसके बाद की सलाह यह है कि क्रियाएँ ढेर करने के बजाय हर चरण पर frame में क्या भर रहा है यह बताइए, और अगर संयुक्त move फिर भी नाकाम रहे तो "cut back to one move and generate the second beat as its own clip."

Omni इसमें एक यांत्रिक धार जोड़ता है, ख़ुद Google के दस्तावेज़ से: जब तक कुछ और न कहा जाए, मॉडल डिफ़ॉल्ट रूप से कई shots बनाता है। तीन एक साथ चलने वाले moves माँगिए और आपने उसे भागने का रास्ता दे दिया — cut। दो सेकंड orbit, cut, दो सेकंड crane, cut, बाक़ी में push in। हर निर्देश पूरा हुआ, आपकी चाही कोई चीज़ नहीं। एक-वाक्यांश वाला उपाय, "In a single continuous shot" या "No scene cuts", मॉडल को आपकी अस्पष्टता एक edit से सुलझाने से रोक देता है।

एक ही दृश्य, दो बार बनाया गया, सिर्फ़ camera clause बदलकर:

720p पर हर तरफ़ चार सेकंड, छत्तीस-छत्तीस सेंट। Subject, कमरा, रोशनी और आवाज़ की लकीर एक जैसी है; सिर्फ़ पहला वाक्य अलग है, एक locked-off frame बनाम एक धीमा dolly in। Camera clause prompt का सबसे ज़्यादा असर रखने वाला वाक्य है, और वही जिसे ज़्यादातर लोग सबसे आख़िर में लिखते हैं।

Focal length optics नहीं, निर्देशन है

कोई lens है ही नहीं। इसे साफ़ कह देना ज़रूरी है, क्योंकि mental model मायने रखता है। "85mm" लिखिए और मॉडल कोई angle of view नहीं गिन रहा; वह training data में उस तरह लेबल की गई हर चीज़ तक पहुँचता है, और तस्वीरें यह लेबल लाखों बार लिए हुए हैं। जो लौटता है वह उस संख्या से जुड़ा look है: दबा हुआ background, नरम मैदान से कटा हुआ subject, चपटी हुई दूरी। छोटी lens पर खिंचा हुआ perspective, frame में ज़्यादा जगह, मुड़ते किनारे।

यही focal length को उपलब्ध सबसे कारगर शब्दों में से एक बनाता है, जो चार अक्षरों में framing और अनुभूति दोनों को हिला देता है। जो मार्गदर्शन प्रचलन में है वह एकसमान है — चौड़े संदर्भ के लिए मोटे तौर पर 24mm, documentary अनुभव के लिए 35mm, तटस्थ कथन के लिए 50mm, दबे हुए आत्मीय काम के लिए 85mm — इसे शाब्दिक optics के वादे के बजाय दृश्य निर्देश की तरह पढ़िए।

कच्चे कंक्रीट फ़र्श पर एक क़तार में सीधी खड़ी, बढ़ती लंबाई वाली पाँच चमकाई हुई पीतल की telescoping नलियाँ, सबसे छोटी बाईं ओर

इससे दो आदतें निकलती हैं। संख्या को विशेषण छोड़ने के बजाय उसे एक काम दीजिए: अकेला "35mm" एक token है, जबकि "35mm, पूरे shot में उसके पीछे workshop दिखती रहे" बताता है कि वह चौड़ी lens किसलिए है, और यह वाक्यांश तब भी बचा रहता है जब संख्या अनदेखी कर दी जाए। Google के दर्ज किए optical शब्द — उथली depth of field, deep focus, rack focus, telephoto — यही काम सादे शब्दों में करते हैं। और focal length को कभी किसी विरोधी निर्देश के साथ मत जोड़िए: "85mm wide establishing shot of the valley" एक साथ दबाव और विस्तार दोनों माँगता है।

Framing वह सबसे भरोसेमंद चीज़ है जो आप तय कर सकते हैं

कैमरा-भाषा को इस आधार पर छाँटिए कि वह कितने भरोसे से उतरती है और एक पैटर्न उभरता है: स्थिर गुण कालिक गुणों को हरा देते हैं।

Shot scale — extreme close-up से wide establishing तक — एक अकेले frame का गुण है। Angle भी, और two-shot या over-the-shoulder की geometry भी। मॉडल इनमें से किसी को भी अपने पहले ही render किए frame में पूरा कर सकता है और फिर टिकाए रख सकता है।

लेकिन एक dolly in पहले frame बनाम छियानबेवें frame का दावा है, और उसे बीच के हर frame से गुज़रकर बचना है — उस प्रक्रिया में, जिसमें कैमरा कहाँ है इसका कोई स्पष्ट प्रतिनिधित्व ही नहीं। शोध-साहित्य इसी खाई को पाटने के लिए मौजूद है: video diffusion में camera control पर संदर्भ-कार्य CameraCtrl यह नोट करते हुए शुरू होता है कि मौजूदा मॉडलों में "lack control of camera pose that serves as a cinematic language to express deeper narrative nuances", और फिर एक pose-conditioning module जोड़ता है क्योंकि अकेला text काफ़ी नहीं था। हमारी जानकारी में कोई production video API यह चैनल नहीं खोलता।

इसलिए एक क्रम याद रखने लायक़ है। Framing और angle: बेझिझक बताइए, पालन की उम्मीद रखिए। नाम लेकर बताया गया एक move: ज़्यादातर बार उम्मीद रखिए। दो moves, या रफ़्तार और रुकने की जगह बताए गए एक move: कई takes की उम्मीद रखिए, या beat को बाँट दीजिए।

गोधूलि में धुँधले तटीय परिदृश्य के सामने, बाँह भर की दूरी पर काले गत्ते का director's viewfinder कार्ड थामे एक हाथ

पहले और बाद में

एक prompt, जैसे ज़्यादातर camera prompts लिखे जाते हैं। इसका हर शब्द वह है जो हमने ख़ुद इस्तेमाल किया है।

Cinematic 4k video of a silversmith working at her bench in a workshop.
Dynamic camera movement, the camera orbits her and pushes in and cranes
up over the bench. Epic atmospheric lighting, ultra detailed, shallow
depth of field, professional colour grade, film look, masterpiece,
award winning cinematography, highly detailed hands and face,
beautiful composition, 8k resolution, moody and dramatic.

गिनिए कि इसमें अमल करने लायक़ क्या है। तीन ढेर की गई क्रियाएँ जो एक ही take में साथ नहीं टिक सकतीं। न shot scale, न focal length, न shot-count पर कोई निर्देश — तो दर्ज किया गया multi-shot default बेरोक चल पड़ता है, और मेज़ पर तीन होड़ करते moves के साथ काटना ही सबसे कम प्रतिरोध का रास्ता है।

वही shot, सिर्फ़ वह कहने के लिए दोबारा लिखा गया जिस पर मॉडल अमल कर सकता है:

In a single continuous shot, no scene cuts. Slow dolly in on a silversmith
at her bench, starting on a medium shot and ending tight on her hands. She
turns a thin silver bracelet against a small torch flame, then taps the
seam twice with a jeweller's hammer. 50mm lens, shallow depth of field, the
far wall of the workshop falling out of focus as the camera closes in.
Eye-level, camera slightly to her right. Sound design: the hiss of the
torch, two light metallic taps, a radio playing faintly in another room.
No dialogue. No music.

वज़न के क्रम में चार बदलाव। Shot-count वाला वाक्यांश सबसे पहले, ताकि अस्पष्टता का जवाब किसी edit से न दिया जा सके। तीन moves सिमटकर एक हो जाते हैं, शुरुआती और अंतिम framing का नाम लेकर — Runway की सुझाई हुई phased description, एक ही यात्रा के रूप में लिखी हुई। Focal length एक परिणाम से जुड़ी हुई आती है। और आवाज़ को अपने वाक्य मिलते हैं, Google के इस मार्गदर्शन के मुताबिक़ कि audio अलग से बताया जाए, negatives छोटे पिछले वाक्यांशों के रूप में। दोबारा लिखी गई शक्ल पढ़ने में ज़्यादा सादी और ज़्यादा नीरस है, जो आमतौर पर इसका संकेत है कि prompt ने मूड बताना छोड़कर shot बताना शुरू कर दिया है।

Prompt में कैमरा कहाँ जाता है

क्रम वह सवाल था जिसका हमें कोई जवाब मिलने की उम्मीद नहीं थी। जवाब है, और वह Omni के पन्ने से नहीं बल्कि Google के Veo मार्गदर्शन से आता है: वहाँ का फ़ॉर्मूला चलता है cinematography, subject, action, context, style और ambiance — कैमरा पहले, यह बताने से पहले कि shot में कौन है — क्योंकि वह तत्व "is the most powerful tool for conveying tone and emotion." Omni का अपना दस्तावेज़ तत्वों को अलग क्रम में गिनाता है, कैमरा सूची के बीच में; यानी Google दो क्रम छापता है और हमने कोई नियंत्रित तुलना नहीं चलाई।

कैमरा से शुरू करना Omni के बाक़ी दर्ज व्यवहार से टकराकर भी टिका रहता है, क्योंकि shot-count का निर्देश मॉडल के कथा गढ़ना शुरू करने से पहले दर्ज होना चाहिए। यह prompt को जाँचने-योग्य भी बनाता है: अगर पहला वाक्य कोई दृष्टिबिंदु नहीं बताता, तो आपने कोई shot निर्देशित ही नहीं किया।

Schema जो आपको नहीं देगा

दो संरचनात्मक सीमाएँ, और दोनों बेहतर शब्दों से ठीक नहीं होतीं।

पहली है दोहराने की क्षमता। Google का API दस्तावेज़ कहता है कि "System instructions, temperature, top_p, stop sequences, and negative prompts are not supported", और आपसे कहता है कि negatives इसके बजाय prompt के भीतर लिखिए। कसने के लिए कोई sampler नहीं है। जो बचता है वह seed है, इस मॉडल के लिए हमारे schema पर एक वैकल्पिक integer, और यही पूरा नियंत्रण-तल है।

यह prompt की बाक़ी हर चीज़ से ज़्यादा camera work के लिए मायने रखता है। थोड़ी अलग लौटी रोशनी उसी shot का अलग grade है; pan बनकर लौटा dolly एक अलग shot है। इसलिए takes के बीच किसी move को स्थिर रखने का मतलब है seed तय करना और बाक़ी कुछ न बदलना — और एक शब्द बदलने का मतलब है नए सिरे से sampling। जो seed काम करे उसे संपत्ति मानिए और prompt के बग़ल में लिख लीजिए।

दूसरी सीमा यह है कि कैमरे की रफ़्तार की कोई शब्दावली नहीं है। "Slow dolly in" ही नियंत्रण-तल है: न कोई इकाई, न अवधि, न यह कहने का तरीक़ा कि push पाँचवें सेकंड तक ख़त्म होकर टिक जाए। Timecode syntax थोड़ी मदद करता है — Omni कोष्ठक वाली रेंज लेता है — तो एक prompt कैमरे से चौथे सेकंड पर ठहरने को कह सकता है। वह ऐसा करेगा या नहीं, यह अलग बात है।

Shutter angle और motion blur उसी ख़ाने में बैठते हैं: दोनों Google की दर्ज शब्दावली में नहीं आते। Frame rate क़रीब से चूकता है — 24 fps, Omni के पन्ने पर सिर्फ़ एक हल किए गए timing उदाहरण के भीतर आता है, "12 frames at 24fps", किसी prompt lever के रूप में नहीं। Timecodes पर सोचने के लिए उपयोगी; लिखकर दिशा तय करने की उम्मीद रखने लायक़ नहीं।

जिस tier पर फ़र्क़ पड़ता है, वहाँ camera प्रयोगों की क़ीमत

Camera work prompting का वह हिस्सा है जिसे आप एक ही बार में ठीक नहीं कर सकते: आप समय के आर-पार एक व्यवहार माँग रहे हैं और उसे बाँधने वाला कोई parameter है नहीं, तो आप बनाते हैं, देखते हैं, बदलते हैं, फिर बनाते हैं। जो संख्या मायने रखती है वह एक take की क़ीमत है।

4K पर आठ सेकंड का take यहाँ $1.44 है, जबकि सीधे Google को कॉल करने पर $2.43। एक move पकड़ने में छह takes — किसी भी ख़ास यात्रा वाले काम के लिए मामूली — यहाँ $8.64 और वहाँ $14.60। यह अंतर 41% है, चारों resolutions में साफ़ तौर पर सबसे बड़ा और यही वजह है कि 4K वाली पंक्ति ही बहस के लायक़ है। बाक़ी जगहों पर 4K का एक सेकंड fal पर $0.30, Runware पर $0.32 और WaveSpeed पर $0.39 है, जबकि यहाँ $0.18; Replicate मॉडल सूचीबद्ध करता है पर प्रति-सेकंड कोई दर देता ही नहीं।

फिर भी कम ख़र्च करने का रास्ता सस्ता 4K सेकंड नहीं है, बल्कि camera moves की जाँच 4K पर करना बंद करना है। 360p tier पर आठ सेकंड के दस drafts $2.38 पड़ते हैं, और यह देखने के लिए 360p काफ़ी है कि कैमरे ने वह किया या नहीं जो आपने कहा — एक move किसी भी resolution पर पढ़ा जाता है, और यही उसे जाँचने में सस्ता बनाता है। दस drafts और एक रखा हुआ 4K take $3.82 है, जबकि दस 4K takes $14.40।

ऊपर की दो सीढ़ियाँ native render नहीं, upscale हैं — Google का model reference उन्हें "1080p output (upscaled)" और "4K output (upscaled)" लिखता है — तो एक 4K take आपको delivery के आयाम ख़रीदकर देता है, उस shot में अतिरिक्त डिटेल नहीं जिसे आप जाँच रहे हैं। चालीस सेकंड के दृश्यों पर हमारी पोस्ट बताती है कि फिर भी उसके लिए भुगतान कहाँ जायज़ है।

क़ीमतें और उत्पाद की शर्तें बदल सकती हैं। ख़रीद का फ़ैसला लेने से पहले हर provider की मौजूदा क़ीमत देख लीजिए।

छोटा संस्करण

पहले shot-count कहिए, फिर एक move, फिर वह framing जिस पर वह शुरू और ख़त्म होता है। Focal length को वहाँ होने की एक वजह दीजिए। Audio को उसके अपने वाक्य दीजिए। हर वह शब्द हटा दीजिए जो बताता है कि video किसी को कैसा महसूस कराए, और वह जगह इस पर ख़र्च कीजिए कि कैमरा कहाँ है।

1.1 में क्या आया यह लॉन्च लेख में है, और provider क़ीमत ऑडिट समझाता है कि एक जैसे weights पन्ने-दर-पन्ने अलग क्यों पड़ते हैं। Parameters और मौजूदा दरें text-to-video मॉडल पेज पर हैं। ऐसे अकेले move के लिए जिस पर कुछ टिका न हो, पहले एक सेंट प्रति सेकंड वाले Veo 3.1 Fast की क़ीमत देखिए — camera शब्दावली उसी गाइड से आती है जो Google दोनों के लिए छापता है, इसलिए अभ्यास साथ चला जाता है।

अक्सर पूछे जाने वाले सवाल

Gemini Omni 1.1 Flash कौन-से camera movement शब्द समझता है?

Google एक movement शब्दावली का नाम लेता है — static, pan और tilt, dolly, truck और pedestal की जोड़ियाँ, zoom, crane, drone या aerial, handheld, whip pan, arc — साथ ही angle, shot-scale और optical शब्द। वह यह भी चेताता है कि कुछ advanced camera angles आधिकारिक रूप से समर्थित नहीं हैं और भरोसेमंदी prompt के साथ बदलती है, इसलिए नाम लेकर बताए गए move को parameter नहीं, अनुरोध मानिए।

किसी video prompt में "cinematic" लिखने से कुछ होता है?

अकेले, ज़्यादा नहीं। Runway का camera-prompting reference "cinematic" और "4k" दोनों को हटा देता है, इस आधार पर कि इनमें से कोई कैमरे का काम नहीं बदलता और वह जगह किसी move का नाम लेने में बेहतर ख़र्च होती है। यह शब्द दृष्टिबिंदु नहीं बल्कि एक प्रभाव बताता है, इसलिए मॉडल को अमल करने लायक़ कुछ नहीं देता — ठीक जैसे "masterpiece", "8k" और image-prompting से आया बाक़ी माल।

35mm या 85mm जैसी focal length संख्याएँ output बदलती हैं?

वे look खिसकाती हैं, क्योंकि training data की तस्वीरें अपने metadata में focal length लिए हुए हैं और संख्या एक style संकेत की तरह पढ़ी जाती है। लंबी lens background को दबाने और subject को अलग करने की ओर झुकती है; छोटी lens perspective खींचती है और कमरे का ज़्यादा हिस्सा भीतर लेती है। इसे शाब्दिक optics के बजाय दृश्य निर्देश मानिए, और किसी परिणाम से जोड़िए।

Omni prompt में camera निर्देश कहाँ जाना चाहिए?

Google की Veo prompting गाइड cinematography को सबसे पहले रखती है, subject, action, context और style से आगे, और उसे tone पहुँचाने वाला सबसे ताक़तवर तत्व कहती है। Omni का अपना दस्तावेज़ camera शब्दों को सूची के बीच में रखता है। दोनों Google हैं। कैमरे से शुरू करने का एक व्यावहारिक फ़ायदा है: shot-count का निर्देश एक camera फ़ैसला है और उसे मॉडल के कथा गढ़ना शुरू करने से पहले दर्ज होना चाहिए।

क्या Gemini Omni 1.1 Flash से वही camera move दो बार मिल सकता है?

सिर्फ़ एक seed दोबारा इस्तेमाल करके। Google का दस्तावेज़ कहता है कि temperature, top_p, system instructions, stop sequences और negative prompts समर्थित नहीं हैं, जिससे दोहराव का पूरा नियंत्रण seed पर बचता है — हमारे schema पर एक वैकल्पिक integer। Prompt का एक शब्द बदलिए और आप नए सिरे से sampling कर रहे हैं, इसलिए जो seed आपको पसंद आया move देता है उसे उसी वक़्त लिख लीजिए जब वह काम करे।

मैंने एक move माँगा था, फिर कैमरा shot के बीच में क्यों काट देता है?

क्योंकि कई shots ही डिफ़ॉल्ट हैं। Google दर्ज करता है कि जब तक कुछ और न कहा जाए Omni कई shots की कोशिश करेगा और एक कथा गढ़ेगा, इसलिए दो-तीन moves ढेर करने वाला prompt उसे हर एक को अलग cut में पूरा करने का बहाना दे देता है। दर्ज किया गया उपाय एक अटूट दृश्य माँगने वाला वाक्यांश है, और एक ही नामित move पर लौटना उस प्रोत्साहन को ख़त्म कर देता है।

क्या Gemini Omni prompt में shutter speed या frame rate तय किया जा सकता है?

Google की दर्ज camera शब्दावली में shutter angle या motion blur को कवर करने वाला कुछ नहीं है, और हम यह दावा नहीं करेंगे कि वे शब्द निभाए जाते हैं। Frame rate भी कोई prompt lever नहीं है: Google के Omni पन्ने पर 24 fps एक timing उदाहरण के भीतर आता है — "12 frames at 24fps" — किसी ऐसे spec के रूप में नहीं जिसे आप सेट कर सकें। Frame rate को post में सँभालिए।

4K पर camera prompts जाँचने में कितना ख़र्च आता है?

आठ सेकंड का 4K take E2X पर $1.44 है और सीधे Google को कॉल करने पर $2.43, यानी छह takes $14.60 के बजाय $8.64 में — 41% का अंतर, चारों resolutions में सबसे चौड़ा। फिर भी 4K पर जाँचना आमतौर पर बर्बादी है: एक move 360p पर पढ़ा जाता है, जहाँ आठ सेकंड के दस drafts कुल $2.38 हैं, और एक रखा हुआ 4K take पूरे दौर को $3.82 पर ले आता है।