DeepSeek V4.1 Flash Nedir? Fiyat ve Benchmark

DeepSeek V4.1 Flash Nedir? Fiyat ve Benchmark

Özet: 30 Saniyede DeepSeek V4.1 Flash DeepSeek-V4.1-Flash, 10 Eylül 2026’da yayınlandı. Lisans MIT, ağırlıklar Hugging Face’te. 552 milyar gövde parametresi, ama token başına yalnızca 8 milyar aktif (girdi işlerken) / 16 milyar aktif (üretim yaparken). Bu asimetri modelin bütün fikri. Yeni mimari: Causal Encoder-Decoder (CED). 40 katman, 20’si nedensel kodlayıcı, 20’si kod çözücü. Kod çözücünün KV önbelleği kendi katmanlarından değil, kodlayıcının son gizli durumlarından türetiliyor. Sonuç: global KV önbelleği token başına 890 bayt. V4-Flash’ın dörtte biri, DeepSeek-V1’in 437’de biri. Doğuştan çok modlu: görsel girdiyi kendi eğitilmiş DeepSeek-ViT kodlayıcısıyla, dil modelinin ön eğitiminin en başından itibaren işliyor. Ön eğitim 45 trilyon token. Ajan testlerinde Claude Opus 5’i geçiyor: Terminal-Bench 2.1’de 90,6‘ya 89,1, DeepSWE v1.1’de 74,2‘ye 74,0, AutomationBench’te 54,8’e 50,3. Akıl yürütme çabası 1-100 arası sürekli ayarlanabiliyor. Açık/kapalı düşünme kademesi değil, kaydırma çubuğu. API fiyatı 1 milyon token başına yoğun olmayan saatte $0,15 girdi / $0,60 çıktı, yoğun saatte iki katı. Claude Opus 5’in çıktı fiyatının kabaca yirmide biri. DeepSeek V4 Pro’yu emekliye ayırıyor: 14 Eylül 2026’dan itibaren deepseek-v4-pro istekleri V4.1 Flash’a yönlendirilip Flash fiyatından faturalanacak. Bu yılın açık ağırlıklı model yarışında herkes aynı iki rakamı kovalıyor: aktif parametre ve KV önbelleği. Birincisi her token’ın kaça mal olduğunu, ikincisi uzun bağlamın ne kadar bellek yediğini belirliyor. GLM-5.3-Flash hibrit dikkatle, Qwen3.8-Flash-Next ise 6 milyar aktif parametreyle cevap vermişti. ...

10 Eylül 2026 ·  13 dk ·  2630 sözcük
GLM-5.3-Flash Nedir? 18B Aktif, MIT Lisans

GLM-5.3-Flash Nedir? 18B Aktif, MIT Lisans

Özet: 30 Saniyede GLM-5.3-Flash GLM-5.3-Flash, Z.ai’nin (eski adıyla Zhipu AI) 26 Ağustos 2026‘da çıkardığı yeni model. GLM-5 serisinin doğuştan çok modlu ilk üyesi: metin ve görseli tek modelde işliyor. Boyutu 320 milyar parametre, ama her token için yalnızca 18 milyarı çalışıyor. Katman sayısı da GLM-4.5’in yarısı kadar: 45’e 92. Lisans MIT. Bu yaz çıkan Çin modellerinin çoğu kendi topluluk lisansıyla gelirken, burada ticari kullanım için okunacak ince yazı yok. Kodlama ve ajan testlerinde GLM-5.2’yi açık ara geçiyor (DeepSWE’de 63,4’e 46,2) ve toplamda Claude Opus 4.8’e yaklaşıyor. Fiyatı ise GLM-5.2’nin onda biri. API’de 1 milyon token başına $0,15 girdi / $0,50 çıktı. 9 Eylül 2026’ya kadar geçerli yüzde 50 indirimle $0,075 ve $0,25. Serinin ilk defa hibrit dikkat kullanan üyesi: doğrusal dikkat yerel bağımlılıkları taşıyor, seyrek dikkat uzaktan bilgi çekiyor. GLM-5.3’e göre dikkat hesabı 3 kat, KV önbelleği 4,4 kat küçük. Sürümden önce ox-alpha kod adıyla OpenCode ve OpenRouter’da anonim test edildi, haftanın en çok kullanılan modeli oldu. O trafiğin tamamı Çin yapımı yapay zeka çiplerinde karşılandı. Bu yaz açık ağırlıklı model tarafında tek bir yarış var: aynı zekayı daha az hesapla üretmek. Alibaba’nın Qwen3.8-Flash-Next‘i 6 milyar aktif parametreyle 397 milyarlık kardeşini geçmişti. Z.ai’nin cevabı GLM-5.3-Flash: 320 milyar toplam parametrenin yalnızca 18 milyarını çalıştırıp GLM-5.2’yi onda bir fiyata geride bırakıyor. ...

26 Ağustos 2026 ·  12 dk ·  2464 sözcük
Qwen3.8-Flash-Next Nedir? Qwen4'ün İlk Mimarisi

Qwen3.8-Flash-Next Nedir? Qwen4'ün İlk Mimarisi

Özet: 30 Saniyede Qwen3.8-Flash-Next Qwen3.8-Flash-Next, Alibaba’nın Ağustos 2026‘da çıkardığı yeni yapay zeka modeli. Metin ve görsel okuyup cevap yazıyor, özellikle kod yazma ve bilgisayarda iş takip etme işlerine ayarlanmış. Model dosyaları herkese açık, 24 Ağustos’tan beri indirilebiliyor. Ama lisansı tam serbest değil, ürüne koymadan önce okumak gerekiyor. Asıl olay şu: Alibaba bunu bir sonraki büyük sürümün, yani Qwen4’ün provası olarak çıkardı. Model dosyalarının içindeki kimlik bile qwen4_exp, yani “Qwen4 deneme” yazıyor. Boyutu 125 milyar parametre, ama her kelime için yalnızca 6 milyarı çalışıyor. Büyük bir modelin bilgisi, küçük bir modelin faturası. Tek seferde yaklaşık 750 bin kelime okuyabiliyor (1 milyon token). Bu kadar uzun metinde kendi büyük kardeşinden 8 kat hızlı. Eğitmesi, 397 milyarlık Qwen3.7-Plus’ın yaklaşık 9’da 1’i kadar tutmuş; buna rağmen kodlama ve ofis işlerinde onu geçiyor. Kullanması ucuz: 1 milyon token başına $0,16 girdi / $0,47 çıktı. Aynı ailenin amiral gemisi bunun 12 katı fiyatta. Alibaba geçen yıl Qwen3-Next’i çıkarırken şöyle demişti: bu tam bir ürün değil, bir sonraki neslin mimarisinin erken sürümü, gelin topluluk olarak inceleyelim. O mimari sonra Qwen3.5’ten Qwen3.8’e kadar bütün seriye yayıldı. ...

26 Ağustos 2026 ·  9 dk ·  1863 sözcük
DeepSeek V4 Pro Nedir? Fiyat ve Benchmark

DeepSeek V4 Pro Nedir? Fiyat ve Benchmark

Özet: 30 Saniyede DeepSeek V4 Pro DeepSeek V4 Pro 0813, DeepSeek’in 13 Ağustos 2026‘da genel kullanıma açtığı yeni amiral gemisi modeli. Basın bülteni yok, sadece bir değişiklik günlüğü satırı. 1,7 trilyon parametre, uzmanlar karışımı (MoE) mimari, 1 milyon token bağlam, 384 bin token çıktı sınırı. Ağırlıklar MIT lisansıyla Hugging Face’te. İndirip kendi sunucunuzda çalıştırabilir, ticari üründe kullanabilirsiniz. Resmi skorlar iddialı: Terminal Bench 2.1’de 87,9, DeepSWE’de 62,7. Bağımsız ölçümde tablo daha ölçülü: Artificial Analysis zeka endeksinde 53 puan. Fiyat 1 milyon token için 0,435 dolar girdi, 0,87 dolar çıktı. 16 Ağustos’tan itibaren yoğun olmayan saatlerde yarı fiyat. Kritik detay: küçük kardeşi V4 Flash üçte bir fiyata, aynı endekste 52 puan alıyor. Yani bir puan için üç kat ödüyorsunuz. Model duyuruları artık bir ritüele dönüştü: tanıtım videosu, benchmark grafikleri, kurucunun heyecanlı paylaşımı. DeepSeek bu sefer bunların hiçbirini yapmadı. DeepSeek V4 Pro 0813, 13 Ağustos 2026’da sessizce genel kullanıma açıldı. Ne blog yazısı çıktı ne de duyuru; API dokümantasyonundaki değişiklik günlüğüne bir satır eklendi ve ağırlıklar Hugging Face’e yüklendi. ...

13 Ağustos 2026 ·  9 dk ·  1909 sözcük
Qwen3.8-Max Nedir? 125 Saat Tek Başına Çalışan Yapay Zeka

Qwen3.8-Max Nedir? 125 Saat Tek Başına Çalışan Yapay Zeka

Özet: 30 Saniyede Qwen3.8-Max Qwen3.8-Max, Alibaba’nın 2 Ağustos 2026‘da yayına aldığı yeni amiral gemisi modeli. 2,4 trilyon parametre, 95 milyarı aktif (MoE mimarisi). Metin, görsel ve video okuyup metin üretiyor. Bağlam penceresi 1 milyon token sınıfında. Tek bir görevde 125 saat (yaklaşık 5 gün) kimseye sormadan çalışıp bir makine öğrenmesi makalesindeki deneyi sıfırdan kurdu, altı bulgusunu doğruladı ve sonra makaleyi geçen yeni bir yöntem buldu. Kodlama ve ajan testlerinin çoğunda Claude Opus 4.8’i geçiyor, Claude Fable 5 ve GPT-5.6 Sol ile bazı testlerde başa baş, bazılarında geride. API fiyatı 1 milyon token başına $2 girdi / $6 çıktı. Tekrar eden girdi $0,25. Alibaba’nın Max sınıfında ilk kez açık ağırlık verdiği model. Ağırlıklar 12 Ağustos 2026‘da Hugging Face’e yüklendi, ama Apache 2.0 ile değil, kendi yazdığı Qwen3.8-Max lisansıyla. İki gün sonra, 14 Ağustos’ta Qwen3.8-27B de çıktı. Yoğun 27 milyarlık model, Apache 2.0, tek kartta çalışabiliyor. Bir yapay zekaya “şu makaledeki deneyi baştan kur, sonra da geliştir” derseniz ne olur? Normalde birkaç turda tıkanır, siz araya girip yönlendirirsiniz. ...

3 Ağustos 2026 ·  Güncellendi: 16 Ağustos 2026 ·  16 dk ·  3326 sözcük