Loading...
Loading...
Metin promptlarından veya referans görsellerden klip üreten, hızlı sonuç için ayarlanmış Google video üretim ailesi.
0/7 öğe
Modelleri çalıştırmak için giriş yapın
No output yet
Run the model to see generated results.
import requests
result = requests.post(
'https://api.e2x.ai/v1/jobs/submit',
headers={
'Authorization': f'Bearer {API_KEY}',
'Content-Type': 'application/json'
},
json={
'model': 'google/omni-flash/reference-to-video',
'input': {}
}
)import time
job_id = result.json()['jobId']
while True:
response = requests.get(
f'https://api.e2x.ai/v1/jobs/{'{job_id}'}',
headers={'Authorization': f'Bearer {'{API_KEY}'}'}
)
data = response.json()['data']
if data['status'] == 'completed':
print('Done!', data['outputs'][0]['url'])
break
elif data['status'] == 'failed':
raise Exception(f"Job failed: {'{'}data['error']['message']{'}'}")
time.sleep(2)Süre ve çözünürlüğe göre tahmini üretim maliyeti. Yalnızca çalıştırdığınız için ödersiniz.
Omni Flash, Google'ın gemini-omni-flash-preview modeli — bir Veo değil, Gemini ailesinden bir video modeli — ve DeepMind'ın kendi tanıtımı tek cümle: "Gemini Omni'yi Nano Banana gibi düşünün, ama video için." Onun reference-to-video capability'sini google/omni-flash/reference-to-video olarak çalıştırıyoruz ve bitmiş 720p videonun her saniyesi için $0.10 alıyoruz. Varsayılan 8 saniyelik klip dolayısıyla $0.80 ediyor, ses dahil.
Birime dikkat edin. Burada kimse bir klibi sabit ücretle satmıyor, dolayısıyla karşılaştırdığınız her rakamı render etmeyi düşündüğünüz uzunlukla çarpmanız gerekiyor.
Senaryonuz var ama çekime taşıyacak görseliniz yok mu? O zaman istediğiniz endpoint Veo 3.1 Fast text-to-video — yalnızca prompt'tan başlıyor ve bizim platformumuzda çok daha az tutuyor. Buna aşağıda dürüstçe geri dönüyoruz.
Bu modeli çağırabileceğiniz diğer yerlere karşı konumumuz, 26 Ağustos 2026'da kontrol edildi:
| API sağlayıcısı | Saniye başına (720p) | 8 saniyelik klip | E2X'e göre |
|---|---|---|---|
| E2X | $0.10 | $0.80 | — |
| fal.ai | $0.13 | $1.04 | %23 daha düşüğüz |
| Atlas Cloud | $0.135 | $1.08 | %26 daha düşüğüz |
| Runware | $0.10 | $0.80 | eşit |
| Google Gemini API | $0.10 | $0.80 | eşit |
Fiyatlar ve ürün koşulları zamanla değişebilir; satın alma kararı öncesinde güncel fiyatları kontrol edin. Google Batch veya Flex fiyatlandırması, zamanlama, kapasite ve işleme koşulları farklı olduğu için standart on-demand API request'iyle birebir eşdeğer değildir ve bu tabloya dahil edilmemiştir. Bu karşılaştırma belirli bir kullanım senaryosuna aittir; E2X'in her koşulda "dünyanın en ucuzu" olduğu iddia edilmemektedir.
Bunu süsleyecek değiliz: bu modelde Google'ın ücretini altına inerek değil, eşitleyerek karşılıyoruz ve tasarruf yalnızca fal.ai ile Atlas karşısında gerçek. Reference görseller neredeyse hiç yer tutmuyor — Google bir görseli 2.040 token sayıyor, yani üç tanesi yaklaşık bir sent. Faturanızı hareket ettiren alan duration.
Bu endpoint'in amacı süreklilik. Modele bir özne verin — bir kişi, bir ürün, bir dekor, bir görünüm — hiç fotoğraflanmadığı bir sahneyi tarif edin, özne yolculuktan sağ çıksın.
Bir tane değil, birkaç reference ekleyebilirsiniz. Google'ın yayınlanmış örnekleri altıya kadar çıkıyor; resmi bir maksimum dokümante edilmemiş ve üçüncü taraf rakamları birbiriyle çelişiyor, dolayısıyla biz bir sayı yazmayacağız. Bir avuç görsele göre kurgulayın, kendi tavanınızı test edin.
Ses görüntüyle birlikte üretiliyor, sonradan takılmıyor. Aksiyonla senkronlanıyor ve onu da aynı prompt'tan yönlendiriyorsunuz — teneke çatıya vuran yağmur ve alçak bir oda tonu isteyin, geri gelen o oluyor. Sonradan düzenlenecek ayrı bir ses track'i yok.
Tavan on saniye. duration enum'umuz 4, 6, 8 ve 10 değerlerini sunuyor; Google'ın modeli 3 ile 10 saniye arasında çalışıyor ve 10 kesin sınır. Extension endpoint'i yok, interpolasyon yok. Daha uzunu kendi kurgu programınızda bir birleştirme işi — ve kesmeler arasındaki süreklilik sizin sorununuz oluyor.
720p, 24 fps ve liste bundan ibaret. resolution alanımız 1080p ve 4k değerlerini taşıyor, Google da daha yüksek çözünürlükleri yakında olarak listeliyor, ancak model bugün 720p döndürüyor. Varsayılanda bırakın. Burada 1080p ilan eden bir sağlayıcı sayfası, Google'ın kendi dokümantasyonunun önünde gidiyor.
Standart bir klip için kabaca 45 saniyelik işlem süresi bekleyin — eachlabs'ten ölçülmüş bir p50, resmi bir rakam değil; dolayısıyla buna göre plan yapın ama söz vermeyin.
İki alan zorunlu: image_urls ve prompt. Dashboard'ınızdan bir key üretin, kontrol ettiğiniz bir sunucuda tutun, sonra job'ı gönderin.
curl -X POST https://api.e2x.ai/v1/jobs/submit \
-H "Authorization: Bearer YOUR_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "google/omni-flash/reference-to-video",
"input": {
"prompt": "1. görseldeki spor ayakkabı ıslak asfaltın üzerinde duruyor, arkasında bir otobüs uzaklaşıyor. Yavaş push-in. Ortam trafiği ve hafif yağmur, müzik yok.",
"image_urls": [
"https://example.com/sneaker-front.jpg",
"https://example.com/sneaker-side.jpg"
],
"duration": "8",
"aspect_ratio": "16:9",
"resolution": "720p"
}
}'
Response bir job ID taşıyor. Video dakikalar sürüyor, o yüzden yavaş polling yapın — ya da polling'i tümden atlayıp submit gövdesine bir webhookUrl geçin:
const headers = {
Authorization: `Bearer ${process.env.E2X_API_KEY}`,
"Content-Type": "application/json",
};
const { data } = await fetch("https://api.e2x.ai/v1/jobs/submit", {
method: "POST",
headers,
body: JSON.stringify({
model: "google/omni-flash/reference-to-video",
input: {
prompt:
"Reference'taki kadın bir gece pazarında yürüyor, neon tabelalar ceketine yansıyor. Elde çekim. Kalabalık uğultusu ve uzaktan kızartma sesi.",
image_urls: ["https://example.com/talent.jpg"],
duration: "10",
aspect_ratio: "9:16",
},
}),
}).then((r) => r.json());
const poll = async (id, attempt = 0) => {
const job = await fetch(`https://api.e2x.ai/v1/jobs/${id}`, { headers })
.then((r) => r.json());
if (job.data.status === "completed") return job.data.outputs[0].url;
if (job.data.status === "failed") throw new Error(job.data.error?.message);
if (attempt > 90) throw new Error("Timed out waiting for the render");
await new Promise((r) => setTimeout(r, 5000));
return poll(id, attempt + 1);
};
const videoUrl = await poll(data.jobId);
Durumlar pending → processing → completed şeklinde ilerliyor ya da failed veya cancelled üzerinde duruyor. Bunları programatik okumayı tercih ederseniz canlı schema ve fiyat makine tarafından okunabilir spesifikasyonda duruyor.
Asıl önemli olan karşılaştırma, ki bu sayfanın lehine değil:
| Model | Fiyatımız (8s, 720p, ses) | Şu durumda seçin |
|---|---|---|
| Omni Flash reference-to-video | $0.80 | Birden fazla reference tutarlı kalmalı ya da 10 saniyelik bir klip gerekiyor |
| Veo 3.1 Fast reference-to-video | $0.12 | Üçe kadar reference, 8 saniye ve daha ucuz fatura istiyorsunuz |
| Veo 3.1 Fast image-to-video | $0.12 | Canlandırmak istediğiniz tek bir fotoğraf var |
| Veo 3.1 Fast text-to-video | $0.12 | Hiç kaynak materyal yok |
Veo 3.1 Fast, platformumuzda Omni Flash'ın küçük bir kesri kadar tutuyor ve Omni Flash'ın şu an ulaşamadığı 1080p ile 4K'ya çıkıyor. Google'ın kendi liste fiyatında ikisi 720p için aynı $0.10/saniyede duruyor — aradaki farkı açan şey bizim indirimimiz. Yani Veo Fast'ten başlayın. Buraya, üç reference sınırı sizi tıkadığında, o iki saniyeye ihtiyaç duyduğunuzda ya da "video için Nano Banana" çerçevesinin arkasındaki video düzenleme davranışını istediğinizde geri dönün. Daha fazla seçenek reference-to-video kategorisinde ve tüm model kataloğu tek sayfa.
Public Preview, pürüzlerin gizlenmek yerine dokümante edildiği anlamına geliyor. Kurmadan önce bunları okuyun:
Hikâyeyi değil, çekimi yazın. Tek özne, tek kamera hareketi, tek ışık koşulu — sonra nasıl duyulduğunu söyleyin, çünkü ses aynı prompt'tan çıkıyor ve sessizlik açıkça dile getirdiğiniz bir tercih.
Birden fazla ek gönderdiğinizde etiketleyin: "1. görsel şişe, 2. görsel etiket yakın plan." Modele hangi reference'ın başrol olduğunu söyleyecek başka hiçbir şey yok. Kamera dilini sade tutun — "yavaş push-in", "sabit", "elde takip" bir paragraf sinematografi tarifini yener.
Her klip bir SynthID watermark'ı taşıyor — izleyiciye görünmez, programatik olarak tespit edilebilir — ve C2PA içerik kimlik bilgileri varsayılan olarak ekleniyor. Bu modeli çalıştıran hiçbir sağlayıcı bunları kapatamıyor, biz de dahil. Bir müşteri sözleşmesi etiketli AI varlıklarını yasaklıyorsa, entegre etmeden önce bunu netleştirin.
Çıktılarınızı tamamlanma handler'ının içinde kendi depolamanıza yeniden host edin. Sonuç URL'leri kalıcı adresler değil ve geri alamadığınız bir video, iki kez ödediğiniz bir videodur.
Google'ın gemini-omni-flash-preview modeli; Veo ailesinden değil, Gemini ailesinden bir video üretme ve düzenleme modeli. DeepMind onu "Nano Banana, ama video için" diye tarif ediyor — vurgu reference'ları tutarlı taşımak ve mevcut görüntüyü düzenlemek üzerinde, Veo ise sıfırdan sinematik üretimi hedefliyor. Public Preview'da.
$0.80. 720p çıktının saniyesi başına $0.10 alıyoruz, dolayısıyla faturayı uzunluk belirliyor — 4 saniyelik bir klip $0.40, 10 saniyelik maksimum $1.00. 26 Ağustos 2026 kontrolündeki ücretimiz buydu.
Birden fazla ve Google'ın dokümante ettiği örnekler altıya kadar çıkıyor — ancak resmi bir maksimum yayınlanmamıştır. Google dışındaki kaynaklar farklı tavanlar söylüyor ve birbiriyle çelişiyor, dolayısıyla doğrulayamadığımız bir sayıyı tekrarlamayacağız. Belirli bir adede göre tasarım yapmadan önce kendi payload'larınızı test edin.
Bugün için hayır. 24 fps'te 720p çıkarıyor ve Google daha yüksek çözünürlükleri yakında olarak listeliyor. Şimdi 1080p ya da 4K gerekiyorsa Veo 3.1 Fast ikisine de ulaşıyor.
Çoğu iş için Veo 3.1 Fast. Platformumuzda sesli 8 saniyelik bir klip için buradaki $0.80'e karşılık $0.12 tutuyor ve 4K'ya çıkıyor. Omni Flash'ı üçten fazla reference görsele, 10 saniyelik süreye ya da video düzenleme davranışına ihtiyacınız olduğunda seçin.
Evet, native olarak ve ekrandaki aksiyonla senkron. Onu aynı prompt'tan yönlendiriyorsunuz — ambiyansı, efektleri adlandırın ya da müzik isteyin. Ses API üzerinden sonradan düzenlenemiyor, dolayısıyla bir değişiklik yeniden render demek.
Evet. Her çıktı, izleyicilerin göremediği ama tespit araçlarının okuyabildiği bir SynthID watermark'ı taşıyor, üstüne varsayılan olarak açık C2PA içerik kimlik bilgileri var. Hiçbir sağlayıcı ikisini de devre dışı bırakacak bir parametre sunmuyor.
Yalnızca AEA, İsviçre ve Birleşik Krallık dışında — Google bu bölgelerde yüklenen video düzenlemesini kısıtlıyor. Reference-to-video üretiminin kendisi bundan etkilenmiyor. Ayrıca video reference'larının schema tarafından kabul edildiğini ama doğru işlenmediğini de not edin; o yüzden görsel gönderin.