Özet: 30 Saniyede Grok 4.6
  • Grok 4.6, SpaceXAI’ın 12 Ağustos 2026‘da duyurduğu yeni amiral gemisi modeli. Grok 4.5’in üzerine yapılan bir eğitim yükseltmesi, sıfırdan yeni bir model değil.
  • Artificial Analysis zeka endeksinde 61 puan: bir ay önceki Grok 4.5’in 5 puan üstünde, GPT-5.6 Sol ile başa baş, Claude Opus 5’in iki puan gerisinde.
  • Fiyat aynı kaldı: 1 milyon token için 2 dolar girdi, 6 dolar çıktı. Rakiplerinin kabaca yarısı.
  • Yeni bir düşünme kademesi geldi: xhigh. Model artık kendi işini daha çok test edip doğruluyor.
  • 500 bin token bağlam penceresi var ama 200 binin üzerine çıkan her istekte fiyat ikiye katlanıyor.

Yapay zeka yarışında bir ay artık uzun bir süre. Temmuz başında Grok 4.5‘i konuşuyorduk; SpaceXAI, aradan beş hafta geçmeden Grok 4.6‘yı duyurdu ve modeli doğrudan zirve yarışına geri soktu.

İlginç olan şu: bu sefer daha büyük bir model yok. Şirket temel modeli değiştirmedi, üzerine daha uzun bir ek eğitim koydu. Sonuç, bağımsız ölçümlerde beş puanlık bir sıçrama ve fiyat etiketinde tek kuruş artış olmaması.

Modelin adı resmi olarak Grok 4.6 yazılıyor, API’deki kimliği ise grok-4.6. Şirketin adı da kafa karıştırabilir: xAI, SpaceX ile birleşmesinin ardından SpaceXAI oldu, ama Grok markası aynı kaldı.

Gelin bu sürümde tam olarak neyin değiştiğine bakalım. 👇🏻

0:00
Grok 4.6 tanıtım videosu, SpaceXAI

Grok 4.6 Nedir?

Grok 4.6, SpaceXAI’ın uzun soluklu ajanlar, kodlama ve bilgi işleri için konumlandırdığı yeni amiral gemisi modeli. ChatGPT veya Claude ne yapıyorsa o da aynı işi yapıyor: soru cevaplıyor, kod yazıyor, belge okuyor, görsel anlıyor.

Ayırt edici tarafı tek bir cümlede özetlenebilir: saatlerce süren görevlerde dağılmadan çalışmak. Şirketin öne çıkardığı senaryolar depo çapında refactor işleri, göç (migration) ajanları, büyük belge yığınları üzerinde araştırma hatları ve GPU çekirdeği optimizasyonu.

Teknik künyesi şöyle:

ÖzellikDeğer
Model kimliğigrok-4.6
Bağlam penceresi500.000 token
GirdiMetin + görsel
ÇıktıYalnızca metin (belirtilmiş sınır yok)
Bilgi kesim tarihi1 Şubat 2026
Düşünme kademelerilow, medium, high (varsayılan), xhigh
Açık ağırlıkYok, indirilemiyor

SpaceXAI parametre sayısını açıklamadı. Ortalıkta dolaşan trilyonluk rakamlar resmi değil; şirketin söylediği tek şey bunun Grok 4.5 tabanı üzerine yapılan bir eğitim sonrası yükseltme olduğu.

500 bin token ne kadar eder?

Token kabaca bir kelime parçası demek. 500 bin token, yaklaşık 375 bin kelimeye denk geliyor: orta boy bir kod tabanının tamamı, ya da birkaç yüz sayfalık teknik dokümantasyon.

Kendi metninizin kaç token tuttuğunu merak ediyorsanız token sayacı aracımıza yapıştırıp saniyesinde görebilirsiniz. Türkçe metinlerde token sayısı İngilizceye göre belirgin biçimde yüksek çıkar, bu da aynı işin Türkçesinin daha pahalıya mal olması demek.


Reklam

Bu Sürümde Ne Değişti?

SpaceXAI üç noktada çalışmış:

Daha uzun ek eğitim. Grok 4.5’e verilenden daha uzun bir tamamlayıcı eğitim koşusu yapılmış. Bu koşuda akıl yürütme ve ileri teknik kavramlar için modelin kendi ürettiği, seçilmiş veriler kullanılmış.

Ajan ortamlarında pekiştirmeli öğrenme. Kodlama, web geliştirme, CAD tasarımı ve çekirdek optimizasyonu gibi alanlarda model gerçek görev ortamlarında ödüllendirilerek eğitilmiş.

Kendi işini kontrol etme. Şirketin öne çıkardığı davranış değişikliği bu: model bir adımı bitirip diğerine geçmeden önce yaptığı işi daha sık test ediyor ve doğruluyor. Uzun görevlerde asıl fark yaratan şey de bu; çünkü ajanları batıran genellikle tek bir zor adım değil, on beşinci adımda fark edilmeyen küçük bir hatanın kartopu gibi büyümesi.

Bir de yeni bir düşünme kademesi var: xhigh. Artık low, medium, high (varsayılan) ve xhigh olmak üzere dört seviye arasında seçim yapabiliyorsunuz. Basit işlerde düşük kademe hem ucuz hem hızlı, zor işlerde xhigh daha derin düşünüyor.

Fikirden çalışan projeye

SpaceXAI’ın kendi testlerinde öne çıkan bir başlık daha var: model, geniş bir ürün fikrini çalışan bir ilk sürüme çevirmekte belirgin şekilde iyileşmiş. Tanımadığı bir alanı araştırıp uygulamanın iskeletini kuruyor, temel etkileşimleri yazıyor ve gelen geri bildirimlerle birkaç tur boyunca üzerine ekliyor.

Şirkete göre asıl fark görsel ve etkileşimli projelerde: Grok 4.5’te birkaç turda oturan yapı ve görsel dil, 4.6’da çoğunlukla ilk denemede ortaya çıkıyor. Yani “boş sayfadan başlayıp yavaş yavaş ilerlemek” yerine, elinizde en baştan üzerine konuşulacak somut bir şey oluyor.

Güvenlik tarafında da şirket, modelin korumalarını yeni yeteneklere göre yeniden ayarladığını ve dağıtım öncesi bugüne kadarki en geniş test setini uyguladığını söylüyor. Hedef, zafiyet yamalama gibi meşru güvenlik işlerinde modelin gereksiz yere reddetmemesi.

Düşünme kademesi neden önemli?
Düşünme kademesi doğrudan faturanızı etkiler. Model “düşünürken” ürettiği tokenlar da çıktı sayılır ve çıktı tokenı girdinin üç katı fiyattadır. “Her zaman en yüksek kademe” ayarı, basit bir soruya on kat fazla ödemek anlamına gelebilir.

Rakiplerine Karşı Nasıl? 📊

SpaceXAI’ın kendi yayınladığı karşılaştırma tablosu şöyle. Rakip skorlar, ilgili şirketlerin sistem kartlarından veya kamuya açık liderlik tablolarından alınmış:

TestGrok 4.6 HighGrok 4.5 HighGPT-5.6 Sol MaxFable 5 Max
AA Zeka Endeksi61566162
GDPVal-AA v2 (Elo)1753152617281741
CursorBench v3.269,9%66,7%67,2%70,5%
DeepSWE v1.165,9%54%73%70%
FrontierCode v1.1 (Extended)61,3%56,6%60,6%63,6%
APEX-Agents57,5%47,1%56,7%59,2%
Terminal-Bench v3.026%15,7%34,6%34,1%
APEX-SWE56,4%53,6%-58,8%
AA-Briefcase (Elo)1577131315021574
Harvey LAB (Vals)15,8%12,9%2,5%11,3%

Tablonun özeti şu: Grok 4.6 her sütunda kendi önceki sürümünü açık farkla geçiyor, ama rakiplerine karşı karışık bir tablo çiziyor.

Öne çıktığı yerler 44 mesleği kapsayan gerçek dünya görevleri (GDPVal-AA v2), uzun belge işleri (AA-Briefcase) ve hukuk odaklı Harvey LAB testi. Geride kaldığı yerler ise saf yazılım mühendisliği: DeepSWE v1.1’de GPT-5.6 Sol Max yedi puan, yeni ve daha zor Terminal-Bench v3.0’da sekiz puandan fazla önde.

Bağımsız ölçüm kuruluşu Artificial Analysis‘in zeka endeksinde Grok 4.6 61 puan ile GPT-5.6 Sol ile eşit, Claude Fable 5’in (62) bir, Claude Opus 5’in (63) iki puan gerisinde. Bir ay önceki Grok 4.5’in ise beş puan üstünde ve Kimi K3‘ün önünde. Aynı kurumun ayrı ölçümlerinde model, araç kullanan müşteri hizmetleri senaryolarında (τ³-Banking) %50,7 ile en iyi iki skordan birini, Terminal-Bench’in bir önceki v2.1 sürümünde ise %88,4 aldı.

Benchmark okurken dikkat
Artificial Analysis’in kendi notuna göre bu skorların bir kısmı yayınlanan güven aralıklarının içinde kalıyor. Yani iki model arasındaki 1-2 puanlık fark istatistiksel olarak berabere sayılır, üstünlük değil. Aradaki fark 5-10 puana çıkmadıkça “geçti” demek zor.

Asıl fark: verimlilik

Grok ailesinin bir önceki sürümdeki iddiası “en yüksek skor değil, en az adımda iş bitirme” idi. Bu iddia 4.6’da da geçerli.

Uzun soluklu görevlerde Grok 4.6 ortalama 53 tur ve 0,5 milyar girdi tokenı harcıyor. Aynı görevlerde Claude Opus 5 ortalama 103 tur ve 2 milyar token kullanıyor. Görev başına maliyet 0,84 dolarda kalıyor.

Yani model, zirvedeki rakibinin yaptığı işi kabaca yarı sayıda adımda ve dörtte bir token ile bitiriyor. Faturayı ödeyen taraf için asıl haber bu.


Fiyatlar ve 200 Bin Token Tuzağı 💸

API fiyatları 1 milyon token başına şöyle:

Kalem200K altı istek200K üstü istek
Girdi$2,00$4,00
Önbellekten girdi$0,50$1,00
Çıktı$6,00$12,00

Kıyas olsun: Claude Opus 5 için 5/25 dolar, GPT-5.6 Sol için 5/30 dolar ödüyorsunuz. Grok 4.6 rakiplerinin kabaca yarı fiyatında.

Ama şu detay atlanmasın: istek 200 bin token bandını aştığı anda tarife ikiye katlanıyor ve SpaceXAI’ın açıklamasına göre yüksek tarife o isteğin tamamı için geçerli oluyor. Yani 200 bin tokenlık bir istem gönderirseniz 2 dolardan, 201 bin tokenlık bir istem gönderirseniz tamamı 4 dolardan işliyor. Tek bir token yüzünden fatura iki katına çıkabilir.

Uzun bağlamla çalışacaksanız pratik tavsiye: 200 bin sınırının hemen altında kalacak şekilde girdiyi budayın, gerçekten gerekmedikçe o bandın üstüne çıkmayın.

Bu rakamlar sizin işinizde ne tutar? LLM maliyet hesaplayıcımıza girdi ve çıktı token sayınızı yazıp Grok’u GPT ve Claude ile yan yana kıyaslayabilir, aylık faturanızı önceden görebilirsiniz.


Nereden Kullanılır?

Grok 4.6, 12 Ağustos 2026 itibarıyla şu kanallarda:

  • Grok Build üzerinde varsayılan model.
  • Cursor‘da tüm planlarda mevcut.
  • SpaceXAI API üzerinden grok-4.6 kimliğiyle.
  • OpenRouter, Vercel ve Cloudflare üzerinden yönlendirilebiliyor.

Yeni kullanıcılara ilk hafta iki kat kullanım hakkı veriliyor. Modelin daha hızlı bir varyantı da var, fiyatı iki katı ve ayrı bir model kimliği yayınlanmamış durumda.

Açık ağırlık yok: modeli indirip kendi sunucunuzda çalıştıramazsınız. Bu tarafta Kimi K3 gibi açık ağırlıklı modeller hâlâ tek seçenek.


Geliştiriciyseniz: 5 Satırda Başlangıç

API, OpenAI kütüphanesiyle uyumlu. ChatGPT için yazdığınız kod iki satır değişiklikle Grok’a bağlanıyor:

from openai import OpenAI

client = OpenAI(
    api_key="ANAHTARINIZ",
    base_url="https://api.x.ai/v1",   # tek fark burası
)

cevap = client.chat.completions.create(
    model="grok-4.6",
    reasoning_effort="high",          # low | medium | high | xhigh
    messages=[{"role": "user", "content": "Grok 4.6'yı tek cümleyle anlat."}],
)

print(cevap.choices[0].message.content)

Bilmeniz gereken üç incelik:

  • reasoning_effort artık dört değer alıyor. Varsayılan high. Basit sınıflandırma işlerinde low, çok adımlı ajan işlerinde xhigh deneyin.
  • Önbelleği kullanın. Aynı sistem istemini veya aynı kod dosyasını tekrar tekrar gönderiyorsanız önbellekten girdi dörtte bir fiyata işliyor.
  • 200 bin sınırını izleyin. İstek boyutunu göndermeden önce ölçün; bandı aşan tek istek faturayı ikiye katlar.

Sırada Ne Var: Grok 4.7 ve Grok 5

Bu sürüm bir ara adım gibi duruyor. Sektör kaynaklarına göre daha büyük bir model olan Grok 4.7 haftalar içinde, Grok 5 ise 2026 bitmeden bekleniyor. Bunlar SpaceXAI’ın resmi açıklaması değil, yönlendirme sağlayıcılarına dayanan bilgiler; kesin gözüyle bakmamak lazım.

Yine de tempo net: SpaceXAI beş haftada bir sürüm çıkarıyor ve her seferinde fiyatı sabit tutup skoru yukarı çekiyor. Bu strateji zirveyi almasa bile fiyat/performans tarafında rakipleri zorluyor.


Sıkça Sorulan Sorular

Soru: Grok 4.6 ne zaman çıktı? Cevap: SpaceXAI, Grok 4.6’yı 12 Ağustos 2026 tarihinde duyurdu ve aynı gün API, Cursor ve Grok Build üzerinden kullanıma açtı.

Soru: Grok 4.6 fiyatı ne kadar? Cevap: 1 milyon token için 2 dolar girdi, 0,50 dolar önbellekli girdi ve 6 dolar çıktı. İstek 200 bin tokenı aşarsa tüm tarife ikiye katlanıyor.

Soru: Grok 4.6 ücretsiz mi? Cevap: API kullanımı ücretli. Grok uygulaması ve grok.com üzerinden sınırlı ücretsiz kullanım mevcut, yoğun kullanım için SuperGrok aboneliği gerekiyor. Yeni API kullanıcılarına ilk hafta iki kat kullanım hakkı veriliyor.

Soru: Grok 4.6, GPT-5.6 ve Claude’dan iyi mi? Cevap: Artificial Analysis zeka endeksinde GPT-5.6 Sol ile eşit (61), Claude Opus 5’in iki puan gerisinde. Ajan görevlerinde çok güçlü, DeepSWE gibi kodlama testlerinde GPT-5.6 Sol’un gerisinde. Fiyat/performansta önde.

Soru: Grok 4.6 ile Grok 4.5 arasındaki fark ne? Cevap: 4.6, 4.5 tabanı üzerine yapılan bir eğitim yükseltmesi. Zeka endeksinde 56’dan 61’e çıktı, yeni xhigh düşünme kademesi geldi ve model kendi işini daha çok doğruluyor. Bağlam penceresi ve fiyat aynı kaldı.

Soru: Grok 4.6 kaç parametre? Cevap: SpaceXAI parametre sayısını açıklamadı. Bunun sıfırdan bir model değil, Grok 4.5 tabanı üzerine eğitim sonrası yükseltme olduğu belirtildi.

Soru: Grok 4.6 Türkçe biliyor mu? Cevap: Evet, Türkçe soru sorup Türkçe cevap alabilirsiniz. SpaceXAI resmi bir Türkçe test skoru paylaşmadı, kendi işinizde denemek en sağlıklısı.


Sağlıcakla kalın… 🙂

Yapay Zeka Tarafından Oluşturulan İçerik Uyarısı
Bu blog tamamen yapay zeka tarafından oluşturulmuştur. Yapay zeka içerik oluşturmaya yardımcı olsa da, hala hatalar veya önyargılar içerebilir. Kritik detayları kullanmadan önce doğrulayın.