Google, 21 Temmuz 2026‘da üç yeni Gemini modelini birden duyurdu: Gemini 3.6 Flash, Gemini 3.5 Flash-Lite ve savunma odaklı Gemini 3.5 Flash Cyber. Duyurunun ana teması net: daha yüksek skor değil, aynı işi daha az token ile yapmak.

Ajan (agent) tabanlı iş akışları yaygınlaştıkça faturayı belirleyen şey artık modelin zekası kadar, o zekayı kaç token harcayarak ürettiği. Google da tam bu noktaya oynamış. Gelin detaylara bakalım.

Gemini 3.6 Flash: Yeni İş Atı

3.6 Flash, Google’ın “workhorse” (iş atı) dediği model. Kodlama, bilgi işi ve çoklu ortam (multimodal) görevleri için tasarlanmış.

En dikkat çeken rakam performans skorlarında değil, verimlilikte: Artificial Analysis Index’e göre model, Gemini 3.5 Flash’a kıyasla aynı işi %17 daha az çıktı token’ı ile bitiriyor. DeepSWE gibi bazı testlerde bu tasarruf %65’e kadar çıkıyor.

Rakamları somutlaştıralım. Görev başına ortalama üretilen çıktı token’ı:

  • DeepSWE v1.1: 3.5 Flash 276.000 token harcıyordu, 3.6 Flash aynı işi 97.000 token ile bitiriyor
  • Artificial Analysis Intelligence Index: 28.000’den 23.000’e düşmüş
Gemini 3.6 Flash ve 3.5 Flash modellerinin DeepSWE v1.1 ve Artificial Analysis Intelligence Index testlerinde görev başına harcadığı ortalama çıktı token sayısı karşılaştırması
Görev başına ortalama çıktı token'ı, kaynak: Google

Kodlama ajanı çalıştıran biri için bu, faturanın neredeyse üçte bire inmesi demek. Üstelik skorlar da yükselmiş.

Benchmark tarafında öne çıkanlar (sırasıyla 3.1 Pro / 3.5 Flash / 3.6 Flash):

  • DeepSWE v1.1 (uzun soluklu yazılım mühendisliği): %12 / %37 / %49
  • MLE-Bench (makine öğrenmesi mühendisliği): %42,6 / %49,7 / %63,9
  • GDPVal-AA v2 (bilgi işi, Elo): 965 / 1349 / 1421
  • OSWorld-Verified (bilgisayar kullanımı): %76,2 / %78,4 / %83,0
Gemini 3.6 Flash, 3.5 Flash ve 3.1 Pro modellerinin DeepSWE, MLE-Bench, GDPVal-AA v2 ve OSWorld-Verified ajan testlerindeki karşılaştırmalı skorları
Gemini 3.6 Flash ajan benchmark sonuçları, kaynak: Google

DeepSWE’deki %12’den %49’a çıkış dikkat çekici: Flash sınıfı bir model, iki nesil önceki Pro modelini dört katına katlamış.

Kodlama tarafında en somut kazanım şu: model gereksiz dosya düzenlemesi yapmıyor ve aynı adımı tekrar tekrar çalıştırma döngüsüne girmiyor. Ajan kullananların en çok şikayet ettiği iki şey tam olarak bunlardı.

Computer Use Artık Yerleşik Bir Araç
Bilgisayar kullanımı (computer use) yeteneği artık Gemini API ve Gemini Enterprise üzerinden yerleşik bir istemci tarafı aracı olarak geliyor. Yani ekran görüntüsü alıp tıklama koordinatı üreten ayrı bir katman kurmanıza gerek yok, model bunu doğrudan araç olarak çağırıyor.

Rakiplere Karşı 3.6 Flash Nerede Duruyor?

Google, duyuruya 3.6 Flash’ı GPT-5.6 Luna, Grok 4.5 ve Claude Sonnet 5 ile karşılaştıran tam bir tablo koymuş. Tablo dürüst, çünkü 3.6 Flash’ın kaybettiği yerler de görünüyor.

Gemini 3.6 Flash, Gemini 3.5 Flash, Gemini 3.1 Pro, GPT-5.6 Luna, Grok 4.5 ve Claude Sonnet 5 modellerinin fiyat ve benchmark karşılaştırma tablosu
Gemini 3.6 Flash rakip karşılaştırma tablosu, kaynak: Google

3.6 Flash’ın önde olduğu alanlar:

  • OSWorld-Verified (bilgisayar kullanımı): %83,0 ile listenin lideri (Claude Sonnet 5: %81,2, GPT-5.6 Luna: %72,6)
  • GDM-MRCR v2 uzun bağlam: 128k’da %91,8, 1M’de %54,0. 1M seviyesinde ikinci sıradaki modelin iki katı
  • LVBench (uzun video anlama): %83,2, en yakın rakip %71,2
  • CharXiv Reasoning (karmaşık grafiklerden bilgi çıkarma): araçsız %85,2, araçlı %89,4, iki modda da birinci

Geride kaldığı alanlar:

  • DeepSWE v1.1: %49, GPT-5.6 Luna %67 ile açık ara önde
  • Terminal-bench 2.1: %78,0, Luna %84,7
  • SWE-Bench Pro: %58,7, Grok 4.5 %64,7
  • GDPVal-AA v2: 1421, Claude Sonnet 5 1607

Yani tablo şunu söylüyor: saf ajan kodlamada 3.6 Flash zirvede değil, ama çoklu ortam, uzun bağlam ve bilgisayar kullanımı tarafında sınıfının üstünde iş çıkarıyor. Fiyat da hesaba katıldığında (Claude Sonnet 5 çıktı token’ında 15 $, 3.6 Flash 7,50 $) denklem değişiyor.

Gemini 3.5 Flash-Lite: Hız ve Ucuzluk

Flash-Lite, serinin en hızlı ve en ucuz üyesi. Yüksek hacimli, tekrar eden işler için düşünülmüş: ajan tabanlı arama, doküman işleme, sınıflandırma gibi.

Artificial Analysis Index’e göre saniyede 350 çıktı token’ı üretiyor. Bu, gerçek zamanlı arayüzler için ciddi bir fark demek.

Skorlar (parantez içi selefi Gemini 3.1 Flash-Lite):

  • Terminal-bench 2.1 (ajan terminal kodlama): %54,0 (%31,0)
  • GDPVal-AA v2 (bilgi işi, Elo): 1140 (642)
  • SWE-Bench Pro: %54,2 (%38,3)
  • OSWorld-Verified: %74,0 (%54,3)
  • MLE-Bench: %39,2 (%22,0)
  • GDM-MRCR v2 (uzun bağlam, 128k): %72,2 (%60,1)
Gemini 3.5 Flash-Lite ve 3.1 Flash-Lite modellerinin Terminal-bench 2.1 ve GDPVal-AA v2 testlerindeki karşılaştırmalı skorları
Gemini 3.5 Flash-Lite, selefine karşı, kaynak: Google

GDPVal-AA v2’deki 642’den 1140’a sıçrama, küçük modellerde bu nesilde ne kadar yol alındığını gösteren en çarpıcı veri. Neredeyse iki katı.

Asıl ilginç kısım şu: Flash-Lite artık bir önceki neslin tam boy Flash modelini de geçiyor.

  • SWE-Bench Pro (Public): 3 Flash %49,6 → 3.5 Flash-Lite %54,2
  • OSWorld-Verified: 3 Flash %65,1 → 3.5 Flash-Lite %74,0
Gemini 3.5 Flash-Lite ve Gemini 3 Flash modellerinin SWE-Bench Pro ve OSWorld-Verified testlerindeki karşılaştırmalı skorları
Gemini 3.5 Flash-Lite, eski 3 Flash modeline karşı, kaynak: Google

Yani “Lite” etiketi artık eskisi kadar anlamlı değil. Bir önceki neslin ana modelini kullanıyorsanız, bu nesilde en ucuz modele geçerek hem para hem performans kazanabilirsiniz.

Rakiplerle karşılaştırmada da tablo iyi görünüyor:

Gemini 3.5 Flash-Lite, Gemini 3.1 Flash-Lite, GPT-5.4 mini ve Claude Haiku 4.5 modellerinin fiyat ve benchmark karşılaştırma tablosu
Gemini 3.5 Flash-Lite rakip karşılaştırma tablosu, kaynak: Google

Flash-Lite, OSWorld-Verified’da %74,0 ile hem GPT-5.4 mini’yi (%72,1) hem Claude Haiku 4.5’i (%50,7) geçiyor. Uzun bağlamda fark daha da açık: GDM-MRCR v2 128k’da %72,2, GPT-5.4 mini %42,7, Haiku 4.5 %35,3. Buna karşılık ajan terminal kodlamada GPT-5.4 mini (%59,2) önde.

Dikkat: Flash-Lite Selefinden Daha Pahalı
Gemini 3.1 Flash-Lite 0,25 $ girdi / 1,50 $ çıktı fiyatlanıyordu. 3.5 Flash-Lite ise 0,30 $ / 2,50 $. Yani çıktı token’ı %67 zamlanmış. Skorlar iki katına çıktığı için görev başına toplam maliyet yine de düşebilir, ama bunu kendi iş yükünüzde ölçmeden varsaymayın.

Flash-Lite ayrıca ayarlanabilir düşünme seviyeleri sunuyor: minimal, düşük ve yüksek. Basit sınıflandırma işlerinde minimal seviyeyi seçip maliyeti dibe çekebiliyorsunuz.

Fiyatlandırma: Asıl Haber Burada

1 milyon token başına fiyatlar:

ModelGirdiÇıktı
Gemini 3.6 Flash1,50 $7,50 $
Gemini 3.5 Flash-Lite0,30 $2,50 $

3.5 Flash’ın çıktı fiyatı 9 $ idi, 3.6 Flash’ta 7,50 $‘a indi. Buna bir de %17 daha az token üretmesini eklerseniz, aynı iş yükünde toplam maliyet düşüşü tek başına fiyat indiriminden çok daha büyük oluyor.

Maliyet Hesabını Kendiniz Yapın
Farklı modellerin aynı iş yükünde size ne kadara mal olacağını karşılaştırmak için sitemizdeki LLM Maliyet Hesaplayıcı ve Token Sayacı araçlarını kullanabilirsiniz.

Nereden Kullanılır?

Her iki model de bugünden itibaren erişilebilir:

  • Gemini API ve Google AI Studio
  • Android Studio
  • Google Antigravity (3.6 Flash)
  • Gemini Enterprise Agent Platform ve Gemini Enterprise uygulaması
  • Gemini uygulaması
  • GitHub Copilot (3.6 Flash)
  • Google Arama (3.5 Flash-Lite, kademeli olarak açılıyor)

Figma, Harvey, Hebbia, JetBrains, Palo Alto Networks ve Ramp gibi şirketler duyuruda erken kullanıcı olarak yer aldı. Ortak vurgu aynı: token verimliliği ile doğruluk arasındaki denge.

Gemini 3.5 Pro Ne Zaman Çıkacak? Gemini 4 Ne Durumda?

Duyurunun sonundaki iki cümle aslında en çok konuşulan kısmı oldu:

  • Gemini 3.5 Pro şu anda iş ortaklarıyla test ediliyor, “hazır olur olmaz” genel kullanıma açılacak. Kesin bir tarih verilmedi.
  • Gemini 4 için ön eğitim (pre-training) başladı. Google bunu “şimdiye kadarki en iddialı ön eğitim koşumuz” diye tanımlıyor. Çıkış tarihi paylaşılmadı.

Buradaki asıl mesaj biraz gizli. Google amiral gemisi Pro modelini yetiştiremedi ve onun yerine iki Flash sınıfı model çıkardı. 3.5 Pro’nun “iş ortaklarıyla test” aşamasında takılması, duyuruyu bir gecikme kapatma hamlesi gibi gösteriyor.

Yine de tablo Google’ın lehine: 3.6 Flash, iki nesil önceki Gemini 3.1 Pro‘yu neredeyse her testte geçiyor (DeepSWE’de %49’a karşı %12, OSWorld’de %83,0’a karşı %76,2), üstelik girdi tarafında 2 $ yerine 1,50 $, çıktıda 12 $ yerine 7,50 $. Yani Pro’yu bekleyenlerin bir kısmı zaten Flash’a geçebilir.

Kısacası bu duyuru bir seri finali değil, ara güncelleme. Asıl büyük hamle Gemini 4 tarafında bekleniyor.

Üçüncü Model: Gemini 3.5 Flash Cyber
Aynı gün duyurulan üçüncü model olan Gemini 3.5 Flash Cyber, güvenlik açığı bulup yamalayan özel bir model ve herkese açık değil. Onu ayrı bir yazıda ele aldık: Gemini 3.5 Flash Cyber nedir?

Sonuç

Gemini 3.6 Flash ve 3.5 Flash-Lite, yapay zeka yarışının yeni cephesini gösteriyor: artık soru “hangi model daha akıllı” değil, “hangi model aynı işi daha ucuza bitiriyor”. Ajanlarını üretime almış ekipler için bu, benchmark tablosundaki birkaç puandan çok daha değerli.

Siz hangisini deneyeceksiniz? Projelerinizde token maliyeti mi yoksa ham performans mı öncelikli? Yorumlarda buluşalım! 👇

Sıkça Sorulan Sorular

Gemini 3.6 Flash nedir?

Gemini 3.6 Flash, Google’ın 21 Temmuz 2026’da duyurduğu, kodlama, bilgi işi ve çoklu ortam görevleri için tasarlanmış yapay zeka modelidir. Öne çıkan özelliği token verimliliğidir: aynı işi Gemini 3.5 Flash’a göre %17 daha az çıktı token’ı ile bitirir, DeepSWE gibi testlerde bu tasarruf %65’e kadar çıkar.

Gemini 3.6 Flash ne zaman çıktı?

21 Temmuz 2026’da duyuruldu ve aynı gün kullanıma açıldı. Gemini 3.5 Flash-Lite ve sınırlı erişimli Gemini 3.5 Flash Cyber ile birlikte tanıtıldı.

Gemini 3.6 Flash fiyatı ne kadar?

1 milyon token başına 1,50 $ girdi, 7,50 $ çıktı. Gemini 3.5 Flash’ın çıktı fiyatı 9 $ idi, yani çıktı token’ı ucuzladı. Gemini 3.5 Flash-Lite ise 0,30 $ girdi / 2,50 $ çıktı ile daha uygun bir seçenek.

Gemini 3.6 Flash ücretsiz kullanılabilir mi?

Modeli Gemini uygulaması ve Google AI Studio üzerinden deneyebilirsiniz. Gemini API üzerinden programatik kullanım ise yukarıdaki token fiyatlarına tabidir.

Gemini 3.6 Flash API’den nasıl kullanılır?

Google AI Studio’dan bir API anahtarı alıp Gemini API üzerinden gemini-3.6-flash model kimliğiyle çağırırsınız. Model ayrıca Android Studio, Google Antigravity, GitHub Copilot ve Gemini Enterprise Agent Platform üzerinden de erişilebilir.

Gemini 3.6 Flash ile 3.5 Flash arasındaki fark nedir?

3.6 Flash hem daha yüksek skor alıyor hem daha az token harcıyor. DeepSWE’de %49’a karşı %37, MLE-Bench’te %63,9’a karşı %49,7, OSWorld-Verified’da %83,0’a karşı %78,4. Aynı görevde ortalama çıktı token’ı 276 binden 97 bine düşüyor ve çıktı fiyatı 9 $‘dan 7,50 $‘a iniyor.

Gemini 3.5 Flash-Lite kimin için uygun?

Yüksek hacimli ve tekrar eden işler için: ajan tabanlı arama, doküman işleme, sınıflandırma. Saniyede 350 çıktı token’ı üretir ve ayarlanabilir düşünme seviyeleri (minimal, düşük, yüksek) sunar. Bir önceki neslin tam boy 3 Flash modelini de geçiyor.

Gemini 3.5 Pro ne zaman çıkacak?

Google, 3.5 Pro’nun şu anda iş ortaklarıyla test edildiğini ve “hazır olur olmaz” genel kullanıma açılacağını duyurdu. Kesin bir tarih verilmedi.

Gemini 4 ne zaman gelecek?

Gemini 4 için ön eğitim (pre-training) başladı. Google bunu “şimdiye kadarki en iddialı ön eğitim koşumuz” olarak tanımlıyor, ancak çıkış tarihi paylaşılmadı.

Yapay Zeka Tarafından Oluşturulan İçerik Uyarısı
Bu blog tamamen yapay zeka tarafından oluşturulmuştur. Yapay zeka içerik oluşturmaya yardımcı olsa da, hala hatalar veya önyargılar içerebilir. Kritik detayları kullanmadan önce doğrulayın.