GLM-5.3-Flash Nedir? 18B Aktif, MIT Lisans

GLM-5.3-Flash Nedir? 18B Aktif, MIT Lisans

Özet: 30 Saniyede GLM-5.3-Flash GLM-5.3-Flash, Z.ai’nin (eski adıyla Zhipu AI) 26 Ağustos 2026‘da çıkardığı yeni model. GLM-5 serisinin doğuştan çok modlu ilk üyesi: metin ve görseli tek modelde işliyor. Boyutu 320 milyar parametre, ama her token için yalnızca 18 milyarı çalışıyor. Katman sayısı da GLM-4.5’in yarısı kadar: 45’e 92. Lisans MIT. Bu yaz çıkan Çin modellerinin çoğu kendi topluluk lisansıyla gelirken, burada ticari kullanım için okunacak ince yazı yok. Kodlama ve ajan testlerinde GLM-5.2’yi açık ara geçiyor (DeepSWE’de 63,4’e 46,2) ve toplamda Claude Opus 4.8’e yaklaşıyor. Fiyatı ise GLM-5.2’nin onda biri. API’de 1 milyon token başına $0,15 girdi / $0,50 çıktı. 9 Eylül 2026’ya kadar geçerli yüzde 50 indirimle $0,075 ve $0,25. Serinin ilk defa hibrit dikkat kullanan üyesi: doğrusal dikkat yerel bağımlılıkları taşıyor, seyrek dikkat uzaktan bilgi çekiyor. GLM-5.3’e göre dikkat hesabı 3 kat, KV önbelleği 4,4 kat küçük. Sürümden önce ox-alpha kod adıyla OpenCode ve OpenRouter’da anonim test edildi, haftanın en çok kullanılan modeli oldu. O trafiğin tamamı Çin yapımı yapay zeka çiplerinde karşılandı. Bu yaz açık ağırlıklı model tarafında tek bir yarış var: aynı zekayı daha az hesapla üretmek. Alibaba’nın Qwen3.8-Flash-Next‘i 6 milyar aktif parametreyle 397 milyarlık kardeşini geçmişti. Z.ai’nin cevabı GLM-5.3-Flash: 320 milyar toplam parametrenin yalnızca 18 milyarını çalıştırıp GLM-5.2’yi onda bir fiyata geride bırakıyor. ...

26 Ağustos 2026 ·  12 dk ·  2463 sözcük
Qwen3.8-Flash-Next Nedir? Qwen4'ün İlk Mimarisi

Qwen3.8-Flash-Next Nedir? Qwen4'ün İlk Mimarisi

Özet: 30 Saniyede Qwen3.8-Flash-Next Qwen3.8-Flash-Next, Alibaba’nın Ağustos 2026‘da çıkardığı yeni yapay zeka modeli. Metin ve görsel okuyup cevap yazıyor, özellikle kod yazma ve bilgisayarda iş takip etme işlerine ayarlanmış. Model dosyaları herkese açık, 24 Ağustos’tan beri indirilebiliyor. Ama lisansı tam serbest değil, ürüne koymadan önce okumak gerekiyor. Asıl olay şu: Alibaba bunu bir sonraki büyük sürümün, yani Qwen4’ün provası olarak çıkardı. Model dosyalarının içindeki kimlik bile qwen4_exp, yani “Qwen4 deneme” yazıyor. Boyutu 125 milyar parametre, ama her kelime için yalnızca 6 milyarı çalışıyor. Büyük bir modelin bilgisi, küçük bir modelin faturası. Tek seferde yaklaşık 750 bin kelime okuyabiliyor (1 milyon token). Bu kadar uzun metinde kendi büyük kardeşinden 8 kat hızlı. Eğitmesi, 397 milyarlık Qwen3.7-Plus’ın yaklaşık 9’da 1’i kadar tutmuş; buna rağmen kodlama ve ofis işlerinde onu geçiyor. Kullanması ucuz: 1 milyon token başına $0,16 girdi / $0,47 çıktı. Aynı ailenin amiral gemisi bunun 12 katı fiyatta. Alibaba geçen yıl Qwen3-Next’i çıkarırken şöyle demişti: bu tam bir ürün değil, bir sonraki neslin mimarisinin erken sürümü, gelin topluluk olarak inceleyelim. O mimari sonra Qwen3.5’ten Qwen3.8’e kadar bütün seriye yayıldı. ...

26 Ağustos 2026 ·  9 dk ·  1862 sözcük