DeepSeek V4.1 Flash Nedir? Fiyat ve Benchmark

DeepSeek V4.1 Flash Nedir? Fiyat ve Benchmark

Özet: 30 Saniyede DeepSeek V4.1 Flash DeepSeek-V4.1-Flash, 10 Eylül 2026’da yayınlandı. Lisans MIT, ağırlıklar Hugging Face’te. 552 milyar gövde parametresi, ama token başına yalnızca 8 milyar aktif (girdi işlerken) / 16 milyar aktif (üretim yaparken). Bu asimetri modelin bütün fikri. Yeni mimari: Causal Encoder-Decoder (CED). 40 katman, 20’si nedensel kodlayıcı, 20’si kod çözücü. Kod çözücünün KV önbelleği kendi katmanlarından değil, kodlayıcının son gizli durumlarından türetiliyor. Sonuç: global KV önbelleği token başına 890 bayt. V4-Flash’ın dörtte biri, DeepSeek-V1’in 437’de biri. Doğuştan çok modlu: görsel girdiyi kendi eğitilmiş DeepSeek-ViT kodlayıcısıyla, dil modelinin ön eğitiminin en başından itibaren işliyor. Ön eğitim 45 trilyon token. Ajan testlerinde Claude Opus 5’i geçiyor: Terminal-Bench 2.1’de 90,6‘ya 89,1, DeepSWE v1.1’de 74,2‘ye 74,0, AutomationBench’te 54,8’e 50,3. Akıl yürütme çabası 1-100 arası sürekli ayarlanabiliyor. Açık/kapalı düşünme kademesi değil, kaydırma çubuğu. API fiyatı 1 milyon token başına yoğun olmayan saatte $0,15 girdi / $0,60 çıktı, yoğun saatte iki katı. Claude Opus 5’in çıktı fiyatının kabaca yirmide biri. DeepSeek V4 Pro’yu emekliye ayırıyor: 14 Eylül 2026’dan itibaren deepseek-v4-pro istekleri V4.1 Flash’a yönlendirilip Flash fiyatından faturalanacak. Bu yılın açık ağırlıklı model yarışında herkes aynı iki rakamı kovalıyor: aktif parametre ve KV önbelleği. Birincisi her token’ın kaça mal olduğunu, ikincisi uzun bağlamın ne kadar bellek yediğini belirliyor. GLM-5.3-Flash hibrit dikkatle, Qwen3.8-Flash-Next ise 6 milyar aktif parametreyle cevap vermişti. ...

10 Eylül 2026 ·  13 dk ·  2630 sözcük
GPT-6 Astra Çıktı: Fiyat, Benchmark ve Erişim

GPT-6 Astra Çıktı: Fiyat, Benchmark ve Erişim

Özet: 30 Saniyede GPT-6 Astra GPT-6 Astra, OpenAI’ın 3 Eylül 2026‘da duyurduğu yeni amiral gemisi model. Şirket “dünyanın en zeki ve en hizalı modeli” diyor. Sürüm adı GPT-5.6 Astra değil, GPT-6 Astra. Bu kez Sol, Terra, Luna gibi üçlü bir dizilim yok: hat Astra ve Astra Pro‘dan ibaret. API fiyatı 1 milyon token için 10 dolar girdi, 50 dolar çıktı. Bu, GPT-5.6 Sol’ün 2,5 katı ve Claude Fable 5.1 ile aynı seviye. Skorlar yüksek ama dipnotlu. ARC-AGI-3’te %98,6 rakamı özel bir çalıştırma kurgusuyla alındı; standart kurguda aynı model %62,7‘de kalıyor. Model, OpenAI’ın Preparedness çerçevesinde kritik siber güvenlik eşiğini aşan ilk modeli. Standart erişimde zafiyet keşfi gibi işleri reddediyor. Erişim kademeli: önce Daybreak kurumsal müşterileri, ardından Plus, Pro, Business ve Enterprise, API ve AWS. Pro, Business ve Enterprise ayrıca Astra Pro alıyor. OpenAI bugün, 3 Eylül 2026’da GPT-6 Astra‘yı duyurdu. Basın toplantısında şirket başkanı Greg Brockman, AGI’nin hâlâ “gri ve bulanık bir şey” olduğunu kabul ettikten sonra sözü şuraya bağladı: “Artık AGI çağında olduğumuzu hissetmek makul değil sayılmaz.” Toplantıyı da aynı cümleyle kapattı: “AGI çağına hoş geldiniz.” ...

3 Eylül 2026 ·  12 dk ·  2363 sözcük
Gemini 3.8 Flash Çıktı: Fiyat ve Benchmark

Gemini 3.8 Flash Çıktı: Fiyat ve Benchmark

Özet: 30 Saniyede Gemini 3.8 Flash Gemini 3.8 Flash, Google’ın 2 Eylül 2026‘da duyurduğu yeni Flash modeli. Bir öncekinin üzerinden yine sadece üç hafta geçti; bu, üç ayda çıkan üçüncü Flash sürümü. Fiyat aynı kaldı: 1 milyon token için 0,75 dolar girdi, 3,75 dolar çıktı. Tanıtım fiyatı yine 31 Aralık 2026‘da bitiyor, sonrasında ikiye katlanıyor. Yanında Gemini 3.8 Flash Cyber geldi: zafiyet avcılığı için ayrı bir sürüm, herkese açık değil, Fairwind Programı üzerinden veriliyor. Benchmark tablosu karışık. Finans, hukuk, uzun video ve belge işlerinde tabloda birinci; uzun soluklu terminal ve bilgisayar kullanımı işlerinde Claude Opus 5’in çok gerisinde. Model “daha çok çalışıyor”: fazladan akıl yürütme adımı atıyor ve araçları döngüde çağırıyor. Aynı fiyat etiketi, daha yüksek token tüketimi demek olabilir. Google’ın Flash serisindeki tempo artık şaka gibi. 3.6 Flash 21 Temmuz’da, 3.7 Flash 13 Ağustos’ta çıkmıştı. Gemini 3.8 Flash bugün, 2 Eylül 2026’da geldi. Üç ayda üç sürüm. ...

2 Eylül 2026 ·  9 dk ·  1869 sözcük
GLM-5.3-Flash Nedir? 18B Aktif, MIT Lisans

GLM-5.3-Flash Nedir? 18B Aktif, MIT Lisans

Özet: 30 Saniyede GLM-5.3-Flash GLM-5.3-Flash, Z.ai’nin (eski adıyla Zhipu AI) 26 Ağustos 2026‘da çıkardığı yeni model. GLM-5 serisinin doğuştan çok modlu ilk üyesi: metin ve görseli tek modelde işliyor. Boyutu 320 milyar parametre, ama her token için yalnızca 18 milyarı çalışıyor. Katman sayısı da GLM-4.5’in yarısı kadar: 45’e 92. Lisans MIT. Bu yaz çıkan Çin modellerinin çoğu kendi topluluk lisansıyla gelirken, burada ticari kullanım için okunacak ince yazı yok. Kodlama ve ajan testlerinde GLM-5.2’yi açık ara geçiyor (DeepSWE’de 63,4’e 46,2) ve toplamda Claude Opus 4.8’e yaklaşıyor. Fiyatı ise GLM-5.2’nin onda biri. API’de 1 milyon token başına $0,15 girdi / $0,50 çıktı. 9 Eylül 2026’ya kadar geçerli yüzde 50 indirimle $0,075 ve $0,25. Serinin ilk defa hibrit dikkat kullanan üyesi: doğrusal dikkat yerel bağımlılıkları taşıyor, seyrek dikkat uzaktan bilgi çekiyor. GLM-5.3’e göre dikkat hesabı 3 kat, KV önbelleği 4,4 kat küçük. Sürümden önce ox-alpha kod adıyla OpenCode ve OpenRouter’da anonim test edildi, haftanın en çok kullanılan modeli oldu. O trafiğin tamamı Çin yapımı yapay zeka çiplerinde karşılandı. Bu yaz açık ağırlıklı model tarafında tek bir yarış var: aynı zekayı daha az hesapla üretmek. Alibaba’nın Qwen3.8-Flash-Next‘i 6 milyar aktif parametreyle 397 milyarlık kardeşini geçmişti. Z.ai’nin cevabı GLM-5.3-Flash: 320 milyar toplam parametrenin yalnızca 18 milyarını çalıştırıp GLM-5.2’yi onda bir fiyata geride bırakıyor. ...

26 Ağustos 2026 ·  12 dk ·  2464 sözcük
Qwen3.8-Flash-Next Nedir? Qwen4'ün İlk Mimarisi

Qwen3.8-Flash-Next Nedir? Qwen4'ün İlk Mimarisi

Özet: 30 Saniyede Qwen3.8-Flash-Next Qwen3.8-Flash-Next, Alibaba’nın Ağustos 2026‘da çıkardığı yeni yapay zeka modeli. Metin ve görsel okuyup cevap yazıyor, özellikle kod yazma ve bilgisayarda iş takip etme işlerine ayarlanmış. Model dosyaları herkese açık, 24 Ağustos’tan beri indirilebiliyor. Ama lisansı tam serbest değil, ürüne koymadan önce okumak gerekiyor. Asıl olay şu: Alibaba bunu bir sonraki büyük sürümün, yani Qwen4’ün provası olarak çıkardı. Model dosyalarının içindeki kimlik bile qwen4_exp, yani “Qwen4 deneme” yazıyor. Boyutu 125 milyar parametre, ama her kelime için yalnızca 6 milyarı çalışıyor. Büyük bir modelin bilgisi, küçük bir modelin faturası. Tek seferde yaklaşık 750 bin kelime okuyabiliyor (1 milyon token). Bu kadar uzun metinde kendi büyük kardeşinden 8 kat hızlı. Eğitmesi, 397 milyarlık Qwen3.7-Plus’ın yaklaşık 9’da 1’i kadar tutmuş; buna rağmen kodlama ve ofis işlerinde onu geçiyor. Kullanması ucuz: 1 milyon token başına $0,16 girdi / $0,47 çıktı. Aynı ailenin amiral gemisi bunun 12 katı fiyatta. Alibaba geçen yıl Qwen3-Next’i çıkarırken şöyle demişti: bu tam bir ürün değil, bir sonraki neslin mimarisinin erken sürümü, gelin topluluk olarak inceleyelim. O mimari sonra Qwen3.5’ten Qwen3.8’e kadar bütün seriye yayıldı. ...

26 Ağustos 2026 ·  9 dk ·  1863 sözcük