Anthropic, 1 Eylül 2026’da Claude Fable 5.1 ve Claude Mythos 5.1 modellerini yayınladı. Haziran ayındaki Claude Fable 5 çıkışının üzerinden yaklaşık üç ay geçti ve bu kez hikâyenin merkezinde ne bir hükümet müdahalesi ne de sürpriz bir kapatılma var. 🙂
Bu sefer asıl mesele şu: etiket fiyatı hiç değişmedi ama modeli çalıştırma maliyeti ciddi biçimde düştü. Üstelik model, geçen ay yayınlanan Claude Opus 5 ‘i test edilen kıyaslamaların tamamında geride bırakıyor. Gelin detaylara bakalım. 👇🏻
Claude Fable 5.1 Nedir? 🧠
Fable 5.1, Anthropic’in herkese açık en güçlü modeli. Opus ailesinin bir üstünde duran “Mythos sınıfı"nın en yeni üyesi ve doğrudan claude-fable-5-1 model kimliğiyle çağırılıyor.
Fable 5’te olduğu gibi yine aynı beyin iki farklı pakette sunuluyor:
- Claude Fable 5.1 (
claude-fable-5-1): Güvenlik sınıflandırıcılarıyla birlikte gelen, herkesin kullanabildiği sürüm. - Claude Mythos 5.1 (
claude-mythos-5-1): Birebir aynı model, ama siber güvenlik ve yaşam bilimleri çalışmaları için tasarlanmış daha esnek koruma seviyeleriyle. Yalnızca Project Glasswing kapsamında doğrulanmış kurumlara veriliyor.
Anthropic’in kendi ifadesiyle ikisi arasındaki fark yeteneklerde değil, hangi noktada güvenlik filtrelerinin devreye girdiğinde.
Benchmark Sonuçları 📊
Anthropic’in paylaştığı tablo, Fable 5.1’i hem selefi Fable 5 hem Opus 5 hem de OpenAI’ın GPT-5.6 Sol modeliyle karşılaştırıyor. Sıçramanın en net görüldüğü yer ajan tabanlı (agentic) testler:
| Test (Benchmark) | Fable 5.1 | Fable 5 | Opus 5 | GPT-5.6 Sol |
|---|---|---|---|---|
| Terminal-Bench-Science 0.1 | %52.6 | %24.7 | %29.0 | %22.4 |
| Terminal-Bench 4.0 | %55.8 | %42.0 | %52.3 | %37.3 |
| AutomationBench | %31.4 | %17.1 | %26.9 | %19.6 |
| CursorBench 3.2.0 | %73.4 | %70.5 | %70.0 | %67.2 |
| OSWorld 2.0 (kısmi) | %77.9 | %72.9 | %75.4 | veri yok |
| OSWorld 2.0 (katı) | %41.7 | %36.1 | %39.6 | veri yok |
| Humanity's Last Exam (araçsız) | %60.9 | %57.8 | %56.6 | veri yok |
| GDPval-AA v2 (puan) | 1853 | 1723 | 1824 | 1711 |
En çarpıcı satır Terminal-Bench-Science. Bilimsel araştırma görevlerini ölçen bu testte Fable 5.1, selefinin skorunu iki katından fazlasına çıkarıyor: %24.7’den %52.6’ya. Ajan tabanlı kodlamayı ölçen Terminal-Bench 4.0’da ise artış %30’un üzerinde. Mythos 5.1 aynı testte %60.9 ile daha da yukarıda, çünkü Fable sürümünde devreye giren bazı siber güvenlik filtreleri onda yok.
Bilgi işi (knowledge work) tarafında da durum benzer. GDPval-AA v2’de 1853 puanla hem Opus 5’in (1824) hem Fable 5’in (1723) üzerine çıkıyor. Yani kazanım sadece kodlamada değil.
Gerçek Dünyadan Örnekler 🚀
Sentetik testler bir yana, Anthropic’in paylaştığı erken kullanıcı sonuçları daha somut:
- Millennium: Yatırım şirketinin iç sistemlerinde nadiren tekrarlayan bir çökme vardı. Mühendisler yıllardır nedenini bulamamıştı, hiçbir model de açıklayamamıştı. Fable 5.1 kaynağı buldu.
- Browserbase: En zor tarayıcı ajanı görevlerinin %82’sini tamamladı. Aynı testte Opus 5 %74, Fable 5 ise %57’de kalmıştı.
- MongoDB: Karmaşık bir prototipi üç günde bitirdi, üstelik optimizasyon kısmını gözetimsiz yürüterek.
- Canva: Gerçek müzikle çalışan ve ritme uyumlu oynanışa sahip bir ritim oyunu geliştirdi.
- Jane Street: Daha fazla kodlama problemini çözdüğünü ve alım satım sezgisi testlerinde en iyi sonucu verdiğini bildirdi.
Bu örneklerin ortak noktası dikkat çekici: hepsi uzun soluklu, çok adımlı ve gözetimsiz işler. Fable 5.1’in asıl iddiası da tam olarak burada, yani tek soruya güzel cevap vermekte değil, saatler süren bir görevi yarıda bırakmadan bitirmekte.
Fiyatlandırma: Etiket Aynı, Fatura Farklı 💰
İşte bu sürümün en pratik yeniliği. Girdi ve çıktı fiyatları Fable 5 ile birebir aynı kaldı, ama önbellekten okuma fiyatı dörtte birine indi:
| Kalem | Fable 5.1 | Fable 5 | Değişim |
|---|---|---|---|
| Girdi (1M token) | $10.00 | $10.00 | Aynı |
| Çıktı (1M token) | $50.00 | $50.00 | Aynı |
| Önbellek okuma (1M token) | $0.25 | $1.00 | %75 indirim |
Bu ne demek? Önbellekten okunan bir token artık normal girdi fiyatının yalnızca %2.5’i kadar. Anthropic’in tahminine göre tipik iş yüklerinde toplam maliyet yaklaşık %25, yoğun ajan kullanımında ise %45’e varan oranda düşüyor.
Neden bu kadar fark yaratıyor? Çünkü uzun bir ajan oturumunda aynı sistem promptu, aynı araç tanımları ve büyüyen konuşma geçmişi her turda tekrar tekrar gönderilir. O tekrarlayan kısım önbellekten okunur ve bir görevin 50 turluk akışında maliyetin aslan payını oluşturur. Oradaki %75’lik indirim, doğrudan faturaya yansıyor.
Kendi senaryonuz için rakamları görmek isterseniz, LLM maliyet hesaplayıcı aracına Fable 5.1’i ekledim. Token sayınızı girip Opus 5 ve diğer modellerle karşılaştırabilirsiniz.
Geliştiriciler İçin: API’de Ne Değişti? ⚠️
Fable 5’ten Fable 5.1’e geçiyorsanız üç kırıcı değişiklik var. Bunlar kodunuzu sessizce bozmaz, doğrudan hata döndürür:
- Zorunlu araç kullanımı kaldırıldı.
tool_choice: {"type": "any"}ve{"type": "tool", "name": ...}artık 400 hatası veriyor. Yerineautokullanıp prompt içinde aracı açıkça isteyin, şema geçerliliği için araç tanımınastrict: trueekleyin. Sadece JSON almak için zorluyorduysanızoutput_config.format(yapılandırılmış çıktı) doğru yol. - Düşünme blokları modele bağlı. Bir turda üretilen
thinkingbloklarını başka bir modele geri gönderirseniz sessizce yok sayılır (ücret de alınmaz). Aynı modelde devam ediyorsanız blokları değiştirmeden geri gönderin. - Geçmişi düzenlemek düşünmeyi geçersiz kılıyor. “Preserved thinking” adı verilen bu kontrol nedeniyle, önceki turları düzenleyip düşünme bloklarını korumaya çalışmak hata veriyor. 31 Ağustos 2026’dan sonra açılan hesaplarda doğrudan 400 dönüyor. Kısacası konuşma geçmişinizi yalnızca sona ekleme mantığıyla kurun.
Bunun yanında birkaç güzel yenilik de geldi: mesaj başına effort ayarı (önbelleği sıfırlamadan), tek tur boyunca geçerli clear_at: "next_user_message" sistem mesajları ve araç çağrıları arasında ilerleme notu döndüren thinking.display: "updates" modu.
Basit bir çağrı şöyle görünüyor:
import anthropic
client = anthropic.Anthropic()
yanit = client.beta.messages.create(
model="claude-fable-5-1",
max_tokens=16000,
# Düşünme her zaman açık, derinliği effort belirliyor
output_config={"effort": "xhigh"},
# Reddedilen istekte sunucu tarafı otomatik geri dönüş
betas=["server-side-fallback-2026-07-01"],
fallbacks="default",
messages=[{"role": "user", "content": "Bu kod tabanındaki hatanın kök nedenini bul..."}],
)
print(yanit.stop_reason)
print(yanit.content[-1].text)
thinking: {"type": "disabled"} ya da eski budget_tokens alanını göndermek 400 hatası üretir. Derinliği effort ile ayarlayın: low, medium, high, xhigh ve max. Çoğu kodlama işi için xhigh iyi bir denge.Bir de şu ayrıntı önemli: Fable 5.1, Priority Tier kapsamında değil ve sıfır veri saklama (ZDR) politikasıyla çalışan kurumlar Anthropic’in ayrı onayı olmadan modeli kullanamıyor, aksi halde istek 400 ile dönüyor.
Somut Bir Hesap: Önbellek İndirimi Ne Kadar Kazandırıyor? 🧮
Yüzdeler soyut kalıyor, o yüzden gerçekçi bir ajan oturumu üzerinden gidelim. Diyelim ki uzun bir kodlama görevi boyunca toplam 20M token girdi gönderiyorsunuz ve bunun %95’i önbellekten okunuyor (uzun oturumlarda gayet normal bir oran, çünkü sistem promptu ve konuşma geçmişi her turda tekrar gidiyor). Çıktı ise 200K token olsun.
| Kalem | Fable 5.1 | Fable 5 |
|---|---|---|
| Önbelleksiz girdi (1M token) | $10.00 | $10.00 |
| Önbellekten girdi (19M token) | $4.75 | $19.00 |
| Çıktı (200K token) | $10.00 | $10.00 |
| Toplam | $24.75 | $39.00 |
Aynı iş, aynı model gücü, %36 daha ucuz. Dikkat edin, buradaki kazancın tamamı tek bir satırdan geliyor. Oturum ne kadar uzarsa önbellek payı o kadar büyüyor ve indirim o kadar belirginleşiyor. Kısa ve tek soruluk kullanımlarda ise neredeyse hiçbir fark hissetmezsiniz, çünkü orada önbellek zaten devreye girmiyor.
Fable 5.1 mi Opus 5 mi? 🤔
En sık sorulacak soru bu olacak. Fiyat farkı tam iki kat: Opus 5 milyon token başına $5 girdi ve $25 çıktı, Fable 5.1 ise $10 ve $50. Basit bir ayrım yapalım:
- Opus 5 yeterli olan işler: sohbet arayüzleri, sınıflandırma, özetleme, kısa kod düzeltmeleri, yüksek hacimli ve gecikmeye duyarlı akışlar. Bu işlerde Fable 5.1’in fazladan gücü faturaya yansıdığı kadar sonuca yansımıyor.
- Fable 5.1’in farkını hissedeceğiniz işler: saatlerce süren gözetimsiz ajan görevleri, kök neden analizi, büyük göç (migration) işleri, araştırma ve bilimsel akıl yürütme. Terminal-Bench-Science’taki iki kat fark tam olarak bu tarafta oluşuyor.
Pratik öneri: varsayılanı Opus 5’te bırakın, yalnızca tıkandığınız zor görevleri Fable 5.1’e yönlendirin. Ama tek bir uyarı var, önbellekler modele özel. İki model arasında gidip gelen bir mimari, önbellek avantajının bir kısmını baştan kaybeder.
Prompt Yazarken Nelere Dikkat Etmeli? ✍️
Fable 5.1’e geçerken sadece model adını değiştirmek yetmiyor. Anthropic’in kendi notlarında üç davranış değişikliği öne çıkıyor:
- Turlar gerçekten uzun sürebiliyor. Zor bir görevde tek bir istek dakikalarca sürebilir. Zaman aşımı sürelerinizi yükseltin, akış (streaming) kullanın ve kullanıcıya ilerleme gösterin.
thinking.display: "updates"modu tam bu iş için var. - Aşırı talimatlı promptlar kaliteyi düşürüyor. Eski modeller için yazılmış, her adımı tek tek tarif eden uzun promptlar Fable 5.1’de ters tepiyor. Görevi ve başarı ölçütünü net verin, yöntemi modele bırakın.
- Yazım stili değişti. Model artık daha az madde işareti ve daha az kalın metin kullanıyor, akan paragraflara yöneliyor. Çıktısını biçimlendirmeye göre ayrıştıran bir sisteminiz varsa kontrol edin.
Bir de effort ayarını görev bazında düşünün. Rutin işlerde low veya medium çoğu zaman yeterli ve belirgin biçimde ucuz. Kodlama ile uzun soluklu ajan görevlerinde ise xhigh iyi bir varsayılan.
Güvenlik: Daha Az Yanlış Alarm, Daha Fazla İzin 🛡️
Fable 5’in en çok eleştirilen yanı, güvenlik filtrelerinin masum isteklerde de devreye girmesiydi. Anthropic bu tarafta somut iyileştirmeler açıklıyor:
- Siber güvenlikte yanlış pozitifler %60 azaldı. Dahası model artık yazılım açıklarını tespit edebiliyor. Açığı sömüren bir istismar kodu yazmak hâlâ kapalı, ama savunma amaçlı analiz için önemli bir açılım.
- Biyoloji ve tıp sorularında yanlış alarmlar %85 azaldı. Temel düzey biyoloji sorusu soran bir öğrenci artık gereksiz yere reddedilmiyor.
- Kurumsal izleme verisi şirket içinde kalabiliyor. Enterprise Frontier Safeguards ile denetim verileri müşterinin kendi bulut ortamında, kendi şifreleme anahtarlarıyla saklanabiliyor.
Filigran: Metinde Görünmez İmza ✍️
Fable 5.1 ile birlikte dikkat çeken bir başka konu da filigran. AB Yapay Zeka Yasası (EU AI Act) gereği, 2 Ağustos 2026’dan sonra yayınlanan modellerin ürettiği metne görünmez bir filigran ekleniyor. Anthropic ayrıca bu filigranı tespit eden bir API’yi özel önizlemede sunuyor: düzenleyiciler, kolluk kuvvetleri, medya kuruluşları, doğrulama ekipleri, araştırmacılar ve eğitimciler için.
Filigranın nasıl çalıştığını, metni kopyalayıp yapıştırınca ne olduğunu ve sınırlarını daha önce ayrıntılı yazmıştım: Claude metin filigranı .
Nereden Kullanabilirsiniz? 🌍
Fable 5.1 çıkış günü itibarıyla şu kanallarda erişilebilir durumda:
- Claude API (
claude-fable-5-1) - Claude.ai ve mobil uygulamalar
- Claude Code
- Claude Enterprise
- Amazon Bedrock, Google Cloud ve Microsoft Azure
Mythos 5.1 ise ABD merkezli, doğrulanmış siber güvenlik ve yaşam bilimleri kurumlarıyla sınırlı.
Sıkça Sorulan Sorular (SSS) ❓
S: Claude Fable 5.1 fiyatı ne kadar? C: Milyon token başına $10 girdi ve $50 çıktı. Önbellekten okuma ise $0.25 ve bu, Fable 5’e göre %75 daha ucuz.
S: Fable 5.1 ile Opus 5 arasındaki fark nedir? C: Fable 5.1 daha güçlü ama iki kat pahalı. Opus 5 milyon token başına $5 girdi ve $25 çıktı ile çalışıyor. Terminal-Bench 4.0’da Fable 5.1 %55.8, Opus 5 ise %52.3 alıyor. Rutin işler için Opus 5 hâlâ mantıklı bir tercih.
S: Fable 5.1 ile Mythos 5.1 aynı model mi? C: Evet, aynı model. Fark yalnızca güvenlik korumalarının seviyesinde. Mythos 5.1 yalnızca Project Glasswing kapsamındaki onaylı kurumlara açık.
S: Kodumda ne değiştirmem gerekiyor? C: Zorunlu araç kullanımını (tool_choice: any veya tool) kaldırın, konuşma geçmişini yalnızca sona ekleyecek şekilde kurun ve düşünme derinliğini effort ile ayarlayın.
S: Fable 5.1’in eklediği filigran kaldırılabilir mi? C: Anthropic filigranı kaldırmak için bir yöntem sunmuyor, amacı zaten metnin kaynağını tespit edilebilir kılmak. Metni baştan yeniden yazmak sinyali zayıflatabilir ama bu kasıtlı bir dolanma girişimi sayılır ve AB Yapay Zeka Yasası’nın şeffaflık maddesiyle çelişir.
S: Fable 5.1 Claude Code’da kullanılabiliyor mu? C: Evet, çıkış günü itibarıyla Claude Code, Claude.ai ve Claude Enterprise üzerinde kullanılabiliyor.
Sonuç
Claude Fable 5.1, alışıldık bir “yeni model” duyurusundan biraz farklı. Skorlar elbette yükselmiş, ama asıl değişim fiyat mimarisinde. Önbellek okumasındaki %75’lik indirim, uzun süren ajan oturumlarını ilk kez gerçekten hesaplı hale getiriyor. Anthropic’in vurgusu da bu yönde: tek soruluk sohbetler değil, saatlerce süren gözetimsiz görevler.
Güvenlik tarafındaki gevşeme de aynı ölçüde önemli. Yanlış alarmların %60 ile %85 arasında azalması, modeli günlük işte kullanan herkesin doğrudan hissedeceği bir iyileşme.
Peki siz ne düşünüyorsunuz? İki kat fiyata rağmen Fable 5.1’e geçmeye değer mi, yoksa Opus 5 sizin işiniz için yeterli mi? Yorumlarda buluşalım, deneyimlerinizi gerçekten merak ediyorum! 👇🏻
Herkese sağlıklı günler ve keyifli kodlamalar! 😊
