Özet: 30 Saniyede Gemini Omni 1.1 Flash
  • Gemini Omni 1.1 Flash, Google’ın 27 Ağustos 2026‘da yayınladığı video üretim modeli. Google’ın video tarafındaki önceki modeli Veo 3.1’in yerini alıyor.
  • Tek seferde ürettiği klip hâlâ 10 saniye. Duyurudaki “40 saniye” rakamı, aynı videoyu 10’ar saniyelik parçalarla uzatmaktan geliyor.
  • Sahne uzatırken artık önceki videonun son 10 saniyesini okuyor. Eski modeller yalnızca son 1 saniyeye bakıyordu; tutarlılık farkı buradan geliyor.
  • İlk ve son kareyi verip aradaki geçişi modele ürettirebiliyorsunuz. Yörünge hareketleri ve döngüye giren klipler için tasarlanmış bir kontrol.
  • 360p taslak modu 720p’ye göre yüzde 60’a kadar hızlı ve üçte bir fiyat. Google’ın önerdiği akış: 360p’de dene, beğendiğini 720p’de al, sonunda 1080p veya 4K’ya yükselt.
  • 4K yerel üretim değil, yükseltme (upscale). Model 720p üretiyor, 4K çıktı bunun büyütülmüş hali.
  • Fiyat saniye başına: 360p $0,03 · 720p $0,10 · 1080p $0,15 · 4K $0,30. Token cinsinden 1 milyon token başına $1,50 girdi, video çıktıda $17,50.
  • API tarafında eksikler var: sistem talimatı, fonksiyon çağırma, yapılandırılmış çıktı ve bağlam önbelleği desteklenmiyor.

Google’ın video modeli tarafında bir yıldır süren sorun kısalıktı: 8-10 saniyelik klipler etkileyici ama bir sahne değil. Gemini Omni 1.1 Flash bu sorunu klibi uzatarak değil, klipleri birbirine ekleyebilir hale getirerek çözmeye çalışıyor.

Duyurunun manşeti “40 saniye” ama asıl teknik değişiklik daha sessiz bir yerde: modelin uzatma sırasında geriye kaç saniye bakabildiği. Bir de fiyat tarafında yeni bir basamak var, 360p taslak modu.

Gelin sırayla bakalım. 👇🏻


Gemini Omni 1.1 Flash Nedir?

Metin, görsel ve videoyu girdi olarak alıp video ve metin üreten çok modlu bir model. Google bunu ayrı bir “video modeli” olarak değil, Gemini ailesinin video çıkışı olan üyesi olarak konumluyor: aynı model hem sahneyi anlıyor hem üretiyor.

Gemini Omni 1.1 Flash
Model kimliğigemini-omni-1.1-flash (Agent Platform’da -preview ekli)
Çıkış tarihi27 Ağustos 2026
GirdiMetin, görsel, video
ÇıktıVideo + metin
Ses girdisiDesteklenmiyor
Ses çıktısıKonuşma, müzik, efekt
Maksimum girdi131.072 token
Maksimum çıktı57.920 token
Klip uzunluğu10 saniye (uzatarak toplam 40)
Çözünürlük360p, 720p, 1080p, 4K
En-boy oranı16:9 ve 9:16
İçerik imzasıC2PA Content Credentials

Çıktı sınırındaki 57.920 sayısı rastgele değil: Google video faturasını saniyede 5.792 token üzerinden kesiyor, yani 57.920 token tam olarak 10 saniyelik 720p video demek. Model kartındaki token sınırı ile klip süresi aynı şeyin iki farklı yazılışı.


Reklam

40 Saniye Nasıl Oluyor?

Tek çağrıda 40 saniyelik video üretmiyorsunuz. Ürettiğiniz 10 saniyelik klibi modele geri verip “devam et” diyorsunuz, model kaldığı yerden 10 saniye daha üretiyor. Bunu toplam 40 saniyeye kadar tekrarlayabiliyorsunuz.

Asıl gelişme uzatmanın kalitesinde. Önceki modeller devam ederken yalnızca son 1 saniyeyi referans alıyordu; kamera hareketi ve karakter tutarlılığı bu yüzden ekleme noktasında bozuluyordu. Omni 1.1 önceki videonun 10 saniyesine kadar bakıyor.

Buradaki dürüst uyarı şu: Google 40 saniyenin tamamında tutarlılığın nasıl korunduğuna dair karşılaştırmalı bir ölçüm yayınlamadı. Dört uzatmanın sonunda karakterin yüzü ilk karedeki yüz mü, bunu kendi denemenizle görmeniz gerekiyor.

API tarafında uzatma, önceki üretimin kimliğini vermekten ibaret:

from google import genai

client = genai.Client()

interaction = client.interactions.create(
    model="gemini-omni-1.1-flash",
    previous_interaction_id=previous_video_interaction.id,
    input=[
        {"type": "text", "text": "Sahneye devam et."}
    ],
    response_format={
        "resolution": "360p",
    },
)

Aynı özellik Gemini uygulamasında da açıldı: Google AI Plus, Pro ve Ultra abonelerinin tamamı sahne uzatmayı kod yazmadan kullanabiliyor.

0:00
Aynı klibin farklı yönlere uzatılması, Google DeepMind

İlk ve Son Kare Kontrolü

Bir çekimin başlangıç ve bitiş karesini verip aradaki hareketi modele ürettirebiliyorsunuz. Klasik “metinden video” akışında kamera hareketini kelimelerle tarif etmek zorundasınız; burada iki sabit noktayı verip yolu modele bırakıyorsunuz.

Pratikte üç iş için değerli:

  • Yörünge ve dolly hareketleri: Karakterin etrafında 360 derece dönen bir kamera, kelimelerle tarif edilmesi en zor çekimlerden biri.
  • Geçişler: Bir sahnenin son karesini bir sonrakinin ilk karesi yapıp kesme olmadan bağlamak.
  • Döngüye giren klipler: İlk kare ile son kare aynıysa, video sorunsuz döngüye giriyor. Arka plan videoları ve web animasyonları için doğrudan kullanışlı.
0:00
İlk ve son kare verilip aradaki geçişin üretilmesi, Google DeepMind

360p Taslak Modu ve Fiyat Mantığı

Model tarafındaki en pratik yenilik bu. 360p çözünürlükte üretim 720p’ye göre yüzde 60’a kadar hızlı ve üçte bir fiyat.

Sebebi basit: video üretiminde ilk denemelerin çoğu çöpe gidiyor. Prompt tutmadı, kamera yanlış yöne gitti, karakter değişti. Bunları 720p kalitesinde öğrenmenin bir anlamı yok.

Google’ın önerdiği akış üç adımlı:

  1. 360p’de dene. Aynı sahnenin 3-4 varyasyonunu üret, tek seferde tek şeyi değiştir, yan yana karşılaştır.
  2. Seçtiğini 720p’de al. Asıl üretim burada.
  3. Gerekiyorsa 1080p veya 4K’ya yükselt. Teslim aşaması.

Rakamlarla: 10 saniyelik bir sahnenin dört varyasyonu 360p’de $1,20 tutuyor. Aynı dört varyasyonu doğrudan 720p’de üretseydiniz $4 ödeyecektiniz.

0:00
360p taslak modunda dört varyasyonun yan yana karşılaştırılması, Google DeepMind

4K Aslında Yükseltme

Duyurudaki “4K” kelimesi yanıltıcı olabilir. Model 4K’yı yerel olarak üretmiyor; belgelerde çıktı açıkça yükseltilmiş (upscaled) olarak etiketleniyor. Varsayılan çözünürlük 720p, üstündeki basamaklar bunun büyütülmüş hali.

Bu, 4K’nın işe yaramaz olduğu anlamına gelmiyor. Modern yükseltme modelleri iyi iş çıkarıyor ve teslim formatı olarak 4K istenen işler var. Ama 4K’da yerel üretimin getireceği ek detayı beklemeyin; ödediğiniz saniye başına $0,30 detay üretimi için değil, çözünürlük artırma için.


Video Referansı ve Sesin Durumu

Prompt’a 3 saniyeye kadar video referansı ekleyebiliyorsunuz, istem başına en fazla 3 video. Amaç karakter ve stil tutarlılığı: “bu dansı, bu karaktere yaptır” tarzı işler.

Burada dikkat edilecek üç sınır var:

  • Model birden fazla video arasında çapraz akıl yürütme yapmıyor. Üç referansı verip “aralarındaki farkı analiz et” diyemezsiniz.
  • Referans videodaki ses yok sayılıyor.
  • Model ses dosyasını girdi olarak kabul etmiyor ve mevcut sesi düzenlemiyor.

Çıktı tarafında ise ses üretimi var: konuşma, müzik ve efekt üretebiliyor. Yani sesi yaratabiliyor ama sesi okuyamıyor.

0:00
Üç video referansındaki hareketin farklı karakterlere aktarılması, Google DeepMind

Bir başka pratik sınır: resmi belgelerde tam desteklendiği belirtilen tek dil İngilizce. Türkçe prompt yazabilirsiniz ama Google Türkçe için bir değerlendirme paylaşmadı; özellikle konuşma üretiminde İngilizce kadar keskin olmasını beklemeyin.


Fiyat

Video faturası iki farklı şekilde okunabiliyor. Kolay olanı saniye başına:

ÇözünürlükSaniye başına
360p (taslak)$0,03
720p (standart)$0,10
1080p$0,15
4K$0,30

Token cinsinden ise girdi 1 milyon token başına $1,50, çıktı metinde $9, videoda $17,50. Saniyede 5.792 token üzerinden 720p bir saniye $0,101 ediyor, yani iki tablo aynı şeyi söylüyor.

Kıyas için Veo 3.1’in hızlı sürümü 720p’de $0,10, 1080p’de $0,12 ve 4K’da $0,30 alıyordu. Yani Omni 1.1 standart çözünürlükte bir indirim getirmiyor; tasarruf tamamen 360p basamağından ve çöpe giden denemenin azalmasından geliyor.

Kendi iş yükünüzün ne tutacağını LLM maliyet hesaplayıcımızda Gemini, Claude ve GPT fiyatlarıyla yan yana görebilirsiniz; metin isteminizin kaç token tuttuğunu ise token sayacı aracımıza yapıştırarak ölçebilirsiniz.


API Tarafında Ne Yok?

Model kartındaki “desteklenmiyor” satırları, bu modeli bir sohbet modeli gibi kullanmayı planlıyorsanız önemli:

ÖzellikDurum
Düşünme (thinking)Var
Token saymaVar
Sistem talimatıYok
Fonksiyon çağırmaYok
Yapılandırılmış çıktıYok
Bağlam önbelleğiYok
Arama ile temellendirmeYok
Kod çalıştırmaYok
Live APIYok
İnce ayarYok

Enterprise Agent Platform tarafında ayrıca kullandıkça öde ve toplu çıkarım desteklenmiyor; model sabit kota ile çalışıyor ve launch aşaması Preview. Google preview şartlarında üretim kullanımına izin veriyor ama bu, GA bir modelin garantileriyle aynı şey değil.

Sistem talimatının olmaması pratikte şu demek: stil kurallarınızı her istemin içine tekrar yazmanız gerekiyor. Fonksiyon çağırmanın olmaması ise bu modelin bir ajanın aracı olduğunu, ajanın kendisi olmadığını söylüyor.


Nereden Kullanılır?

  • Google AI Studio: API anahtarıyla en hızlı deneme yolu.
  • Gemini Enterprise Agent Platform: Kurumsal tarafta Agent Platform API üzerinden, global bölgede.
  • Google Flow: Google AI Plus, Pro ve Ultra abonelerinin tamamına açık.
  • Gemini uygulaması: Sahne uzatma özelliği aynı abonelik seviyelerinde kullanılabiliyor.

Üçüncü taraf tarafında da hızlı yayıldı: Adobe modeli Firefly’a, Figma ise Weave’e entegre etti; Runway ve GMI Cloud da kendi platformlarında sunuyor.


Kimin İçin Mantıklı?

  • Video aracı geliştirenler: İlk/son kare kontrolü ve uzatma, bir arayüzün üstüne oturtulacak türden özellikler. “Geçişi üret” düğmesi artık tek API çağrısı.
  • Çok deneme yapan ekipler: 360p taslak basamağı asıl kazanç. Fikir başına maliyet üçte birine iniyor.
  • Reklam ve sosyal içerik: 9:16 desteği ve 40 saniyeye kadar uzatma, dikey formatta bir hikâye anlatmaya yetiyor.
  • Uzun form video üretmek isteyenler: Bu model değil. 40 saniye tavan ve tutarlılık dört uzatmadan sonra ölçülmemiş.
  • Sesli iş akışları: Bu model de değil. Ses girdisi yok, mevcut sesi düzenlemiyor, referans videodaki sesi duymuyor.
  • Ajan mimarileri: Fonksiyon çağırma ve sistem talimatı olmadığı için modeli bir ajan döngüsünün beyni yapamazsınız; üretim adımı olarak çağırın.

Sıkça Sorulan Sorular

Soru: Gemini Omni 1.1 Flash ne zaman çıktı? Cevap: 27 Ağustos 2026. Aynı gün Google AI Studio, Gemini Enterprise Agent Platform, Google Flow ve Gemini uygulamasında kullanıma açıldı.

Soru: Gemini Omni ücretli mi? Cevap: API tarafında evet, saniye başına ücretlendiriliyor. Google AI Plus, Pro veya Ultra aboneliğiniz varsa Google Flow ve Gemini uygulaması üzerinden abonelik kotanız dahilinde kod yazmadan kullanabilirsiniz.

Soru: Gemini Omni fiyatı ne kadar? Cevap: Saniye başına 360p $0,03, 720p $0,10, 1080p $0,15, 4K $0,30. Token cinsinden 1 milyon token başına $1,50 girdi, $17,50 video çıktı, $9 metin çıktı.

Soru: Kaç saniyelik video üretebiliyor? Cevap: Tek üretimde 10 saniye. Aynı videoyu 10’ar saniyelik adımlarla toplam 40 saniyeye kadar uzatabiliyorsunuz.

Soru: 4K gerçekten 4K mi? Cevap: Hayır, yükseltilmiş çıktı. Model 720p üretiyor; 1080p ve 4K bunun büyütülmüş hali. Belgeler bunu açıkça upscale olarak etiketliyor.

Soru: Veo 3.1’den farkı ne? Cevap: Omni 1.1 Veo 3.1’in yerini alıyor. Farklar: 10 saniyeye kadar geriye bakan sahne uzatma, ilk/son kare kontrolü, 3 saniyelik video referansı ve 360p taslak basamağı. Standart 720p fiyatı ise aynı seviyede.

Soru: Ses üretebiliyor mu? Cevap: Çıktı tarafında evet: konuşma, müzik ve efekt. Girdi tarafında hayır: ses dosyası kabul etmiyor, mevcut sesi düzenlemiyor ve referans videodaki sesi yok sayıyor.

Soru: Türkçe prompt yazabilir miyim? Cevap: Yazabilirsiniz ama resmi belgelerde tam desteklendiği belirtilen tek dil İngilizce. Diğer diller için Google bir değerlendirme paylaşmadı, bu yüzden özellikle konuşmalı sahnelerde İngilizce prompt daha güvenli.

Soru: API’de sistem talimatı verebilir miyim? Cevap: Hayır. Sistem talimatı, fonksiyon çağırma, yapılandırılmış çıktı ve bağlam önbelleği bu modelde desteklenmiyor. Kalıcı stil kurallarını her istemin içine yazmanız gerekiyor.

Soru: Üretilen videoda içerik etiketi var mı? Cevap: Model C2PA Content Credentials destekliyor, yani çıktıya içeriğin yapay zeka ile üretildiğini belirten kriptografik bir kimlik gömülüyor.


Sağlıcakla kalın… 🙂

Yapay Zeka Tarafından Oluşturulan İçerik Uyarısı
Bu blog tamamen yapay zeka tarafından oluşturulmuştur. Yapay zeka içerik oluşturmaya yardımcı olsa da, hala hatalar veya önyargılar içerebilir. Kritik detayları kullanmadan önce doğrulayın.