Gemini Omni Flash'in gerçek API fiyatı, 720p video için yaklaşık saniyede $0.10'dur — bu, milyon çıktı tokenı başına $17.50 demektir; dakikada 5,792 token üzerinden faturalandırılır, Google'ın kendi Gemini API fiyatlandırma sayfasına göre, Temmuz 2026'da kontrol edilmiştir. Bu model için ücretsiz katman yoktur. Model kimliği — dokümanların içinde gömülü olduğu için fark edilmesi kolay değildir — gemini-omni-flash-preview'dir; hâlâ "preview" olarak etiketlenmiştir, bu yüzden fiyatlandırma ve erişim ayrıntıları genel kullanıma sunulmadan önce değişebilir. Model, kod paylaşmayan iki ayrı kapıdan, Google AI Studio ve Vertex AI üzerinden sunulur. Bir yerde "$0.20–0.60 per second" tahminini gördüyseniz, bu Google gerçek rakamları yayımlamadan önce yazılmış bir lansman öncesi tahmindi; artık güncel değildir.
Gemini Omni Flash Gerçekte Nedir
Google’ın lansman gönderisine göre, Gemini Omni Flash, yeni bir "Omni" ailesindeki ilk modeldir — metin, görseller, ses ve videoyu girdi olarak alan ve Gemini’nin dünya bilgisinden yararlanarak video üreten bir any-to-any transformer. Gemini uygulaması, Google Flow ve YouTube Shorts/Create üzerinden Google AI Plus, Pro ve Ultra aboneleri için ücretsizdir; geliştirici API erişimi ise Haziran 2026’nın sonlarında geldi, VentureBeat’e göre.
Onun öne çıkan özelliği, sohbet tabanlı çok turlu düzenlemedir: bir değişikliği tarif edersiniz, o da karakterleri ve sahneleri tutarlı tutarak düzenlemeyi uygular ve siz aynı sohbet akışında yinelemeye devam edersiniz.
DeepMind model kartı, güvenlik önlemlerini listeliyor — her klipte SynthID filigranlama ve C2PA içerik kimlik bilgileri, gerçek bir kişinin sabit fotoğrafını sese lip-sync yapmak yok, kısıtlı ses düzenleme — ve bilinen üç zayıf noktayı: çok adımlı düzenlemeler arasında tutarlılık, karmaşık hareketli sahneler ve doğru ekrandaki metin. Aşağıda üçünü de test ettik.
Çok Turlu Düzenlemeyi Kendimiz Test Ettik
Onu iki aşamalı bir düzenleme sırasıyla Google Flow’dan geçirdik: önce elde el yazısıyla yazılmış bir karton tabela tutan bir kadın oluştur, ardından aynı klibi geceye çevirip neon bir tabelayla değiştir ve onun dönüp kameraya doğru yürümesini sağla. Her iki çıktı dosyası da 720p, 24fps, 8 saniye ve yerel stereo ses ile geri geldi — üçüncü taraf entegratörlerin bildirdikleriyle aynı; bu durum artık kendi dosyalarımız üzerinde bağımsız olarak da doğrulandı.
Karton tabeladaki ekran üzerindeki metin — "OPEN TODAY" — tüm 8 saniye boyunca kusursuz bir şekilde, bozulma olmadan görüntülendi. Bu dikkat çekici çünkü model kartının kendisinin de kabul ettiği zayıflıklardan biri doğru metin oluşturmaktır.
Karakter tutarlılığı iddiası pratikte oldukça iyi karşılık buluyor: aynı yüz, aynı kırmızı şişme mont, aynı beyaz kazak, aynı saç; sahneye eklenen yeni bir neon tabela ile tamamen farklı bir ışıklandırma düzenine temiz bir şekilde aktarılmış. Ancak iki şey yönergede belirtildiği gibi gitmedi:
Arka plandaki mağaza tabelası metin oluşturmayı bozdu — penceredeki "COFFEE" tabelası "COFFFEE" olarak geri geldi (fazladan bir harf), oysa ilk turdaki ön plandaki karton tabela kusursuzdu. Metin doğruluğu, modelin metin oluşturup oluşturamamasından çok, metnin кадrajdaki ne kadar belirgin ve merkezî olduğuna güçlü biçimde bağlı görünüyor.
İstenen "kameraya dön ve yürü" hareketi neredeyse hiç gerçekleşmedi. Yukarıdaki klibe bakın — bunun yerine elde ettiğimiz şey, özne büyük ölçüde yerinde kalırken kameraya mesafenin hafifçe değişmesiydi; promptta istenen açık dönme ve yürüme hareketi değildi. Bu durum, Google'ın model kartında açıkladığı "complex-motion scenes" sınırlamasıyla örtüşüyor; çok adımlı beden hareketi, statikten statike ışık veya sahne değişimi kadar talimatı henüz güvenilir biçimde takip etmiyor.
Bütçe ayırmaya değer bir şey daha var: yanlış yazılmış tek bir düzenleme, Flow üzerindeki kullanılabilir üretimlerimizden birini tüketti; bu da bir test oturumunu beklenenden daha hızlı tüketmeye yetiyor. Google, Omni Flash için plan başına tam bir üretim kotası yayımlamıyor; bu yüzden ciddi şekilde test yapıyorsanız, planladığınızdan daha fazla deneme harcamayı bekleyin ve bozuk bir promptu ücretsiz olarak yeniden deneyebileceğinizi varsaymayın.
Gemini Omni Flash Fiyatlandırması, Ayrıntılı Olarak
İşte fiyat tablosu, Google’ın Gemini API fiyatlandırma sayfasına göre — ücretsiz katman yok, yalnızca Standart ücret:
Fiyat | |
|---|---|
Girdi (metin / görsel / video / ses) | 1M token başına $1.50 |
Çıktı — metin | 1M token başına $9.00 |
Çıktı — video | 1M token başına $17.50 |
Video doğrudan saniye başına faturalandırılmaz — çıktı token'ları üzerinden faturalandırılır ve Google dönüşümü belirtir: 720p video için saniye başına 5.792 token. Hesabı yapın ($17.50 ÷ 1,000,000 × 5,792) ve yaklaşık saniye başına $0.101 sonucuna ulaşırsınız; Google'ın belgeleri bunu "yaklaşık saniye başına $0.10" olarak yuvarlar.
Gerçek bir klip için bunun anlamı, 720p’de şudur:
Klip uzunluğu | Tahmini maliyet |
|---|---|
4s | $0.41 |
5s | $0.51 |
6s | $0.61 |
8s | $0.81 |
10s | $1.01 |
Giriş tokenlarını da ekleyin — kısa bir metin istemi artı bir veya iki referans görsel genellikle $1.50/1M fiyatında birkaç sent ekler — ve 8 saniyelik bir klip toplamda yaklaşık $0.85 seviyesine gelir. Google'ın sayfası yalnızca 720p için token-to-second dönüşümünü belgeliyor; 1080p ve 4K ayrı ayrı listelenmiyor, bu yüzden bunları muhtemelen daha pahalı olarak bütçelendirin ve bir üretim çalıştırmasından önce canlı sayfayı tekrar kontrol edin.
API Erişimine Gerçekte Nasıl Ulaşılır
Aslında yalnızca iki kanal resmi olarak doğrulanmıştır — Google’ın kendi kanalları tamamen açılmadan daha geniş yeniden satış erişimi iddia eden herhangi bir üçüncü taraf kılavuza şüpheyle yaklaşın:
Google AI Studio —
aistudio.google.com/apikeyadresinden bir anahtar alın, onuGEMINI_API_KEYolarak dışa aktarın ve modeli Interactions API üzerindengemini-omni-flash-previewolarak çağırın (pip install -U google-genaiveyanpm install @google/genai). Test için en hızlı yol.Vertex AI — aynı temel model, ancak ayrıca bir GCP proje kimliği, bir bölge/konum ayarı ve düz bir API anahtarı yerine IAM tabanlı kimlik doğrulama gerektiren ayrı, kurumsal düzeyde bir uç nokta üzerinden sunulur. Google Cloud faturalandırmasına daha önce dokunmadıysanız, kurulum için 30-60 dakika ayırın.
Dikkate alınmaya değer: AI Studio ve Vertex AI, ayrı Google ürün yüzeyleridir — farklı dokümantasyon, farklı SDK'ler ve sırasıyla API-key kimlik doğrulaması ile GCP IAM kimlik doğrulaması kullanırlar. Tasarım gereği birbirlerinin yerine kullanılamazlar; bu yüzden geliştirmeye başlamadan önce, AI Studio'da prototip oluşturup daha sonra Vertex'e kopyala-yapıştırla geçebileceğinizi varsaymak yerine, gerçekten dağıtım yapacağınız platformu seçin.
Başlamadan önce bilinmesi gereken bir şey daha var: Google'ın Interactions API başlangıç kılavuzuna göre, video oluşturma uzun süren görevler için eşzamanlı bir yanıt yerine varsayılan olarak background=True kullanır; bu da OpenAI chat-completions ile uyumlu olmadığı anlamına gelir. Minimal bir Python kalıbı — örnek amaçlıdır; yayınlamadan önce tam alan adları için mevcut google-genai SDK referansını kontrol edin:
from google import genai
import time
client = genai.Client() # GEMINI_API_KEY'yi ortamdan okur
interaction = client.interactions.create(
model="gemini-omni-flash-preview",
input="Gün batımında bir deniz fenerinden geri doğru uzaklaşan bir drone çekimi",
background=True,
)
while interaction.status not in ("completed", "failed"):
time.sleep(3)
interaction = client.interactions.get(interaction.id)
if interaction.status == "completed":
with open("output.mp4", "wb") as f:
f.write(interaction.output_video.read())
Burada doğrudan tak-çalıştır bir chat-completions yapısı yok — mevcut entegrasyon kodunuz OpenAI'nin senkron yanıt formatını varsayıyorsa, bir model dizesini değiştirmiyorsunuz; istek/yanıt işlemeyi yeniden yazıyorsunuz.
Gemini Omni Flash ve Tek Atışlı Video Modelleri
Konuşmalı düzenleme döngüsü için Omni Flash’i seçin. Sabit çözünürlük ve süreye sahip doğrudan bir metin/görüntüden videoya işi için, tek seferlik bir model hakkında düşünmek daha basit ve daha ucuzdur:
En iyi kullanım | Erişim | |
|---|---|---|
Gemini Omni Flash | Çok turlu konuşmalı düzenleme, düzenlemeler arasında karakter tutarlılığı | Doğrudan Google AI Studio veya Vertex AI |
Sabit bir spesifikasyonda tek seferlik metin/görüntüden videoya | Her sağlayıcıdan doğrudan veya AIReiter gibi relay platformlarında paket halinde |
Omni Flash henüz AIReiter veya benzeri paketlenmiş relay platformlarında yok — çok turlu iş akışı için doğrudan Google'ın kendi API'sine gitmek hâlâ en basit seçenek.
SSS
Gemini Omni Flash model kimliği nedir?
gemini-omni-flash-preview. Google AI Studio veya Vertex AI içinde Interactions API aracılığıyla çağırırken bu tam dizeyi kullanın. Hâlâ bir önizleme modeli olduğu için, genel kullanıma sunulduğunda kimlik değişebilir.
Gemini Omni Flash'ın video başına maliyeti ne kadar?
720p’de saniyede yaklaşık $0.10, bu yüzden tipik 4-10 saniyelik bir klip $0.50-$1 tutar.
Gemini Omni Flash için ücretsiz bir katman var mı?
Hayır. Google'ın fiyatlandırma sayfasında ücretsiz katmanda hem giriş hem de çıkış için "Kullanılamıyor" yazıyor — yalnızca Standard (ücretli) katman.
AI Studio ve Vertex AI üzerinde aynı kodu kullanabilir miyim?
Doğrudan değil. Bunlar, farklı SDK’lar ve kimlik doğrulama yöntemlerine (API key vs. GCP IAM) sahip ayrı Google ürün yüzeyleridir; bu yüzden biri için yazılmış kodun diğerine taşınması için ciddi bir yeniden çalışma gerekir. Oluşturmadan önce dağıtım hedefinizi seçin.
Gemini Omni Flash, OpenAI tarzı chat completions koduyla çalışır mı?
Hayır. Video oluşturma, eşzamanlı olmayan görev oluşturma ve sorgulama (background=True artı interactions.get()) üzerinden çalışır; senkron bir chat-completions yanıt biçimi üzerinden değil.
Çok turlu karakter tutarlılığı gerçekten çalışıyor mu?
Google Flow üzerinden kendi iki turlu testimizde, görünüm açısından evet — aynı yüz, ceket ve saç, tam bir gündüzden geceye sahne değişimi boyunca temiz bir şekilde korundu. Karmaşık hareket talimatlarını takip etmede (istenen dönüp yürüme hareketi neredeyse hiç algılanmadı) ve arka plan metnini doğru şekilde oluşturmakta daha fazla zorlandı; bunların her ikisi de Google’ın model kartında açıkladığı sınırlamalarla örtüşüyor.