- Grok 4.6, SpaceXAI’ın 12 Ağustos 2026‘da duyurduğu yeni amiral gemisi modeli. Grok 4.5’in üzerine yapılan bir eğitim yükseltmesi, sıfırdan yeni bir model değil.
- Artificial Analysis zeka endeksinde 61 puan: bir ay önceki Grok 4.5’in 5 puan üstünde, GPT-5.6 Sol ile başa baş, Claude Opus 5’in iki puan gerisinde.
- Fiyat aynı kaldı: 1 milyon token için 2 dolar girdi, 6 dolar çıktı. Rakiplerinin kabaca yarısı.
- Yeni bir düşünme kademesi geldi: xhigh. Model artık kendi işini daha çok test edip doğruluyor.
- 500 bin token bağlam penceresi var ama 200 binin üzerine çıkan her istekte fiyat ikiye katlanıyor.
Yapay zeka yarışında bir ay artık uzun bir süre. Temmuz başında Grok 4.5‘i konuşuyorduk; SpaceXAI, aradan beş hafta geçmeden Grok 4.6‘yı duyurdu ve modeli doğrudan zirve yarışına geri soktu.
İlginç olan şu: bu sefer daha büyük bir model yok. Şirket temel modeli değiştirmedi, üzerine daha uzun bir ek eğitim koydu. Sonuç, bağımsız ölçümlerde beş puanlık bir sıçrama ve fiyat etiketinde tek kuruş artış olmaması.
Modelin adı resmi olarak Grok 4.6 yazılıyor, API’deki kimliği ise grok-4.6. Şirketin adı da kafa karıştırabilir: xAI, SpaceX ile birleşmesinin ardından SpaceXAI oldu, ama Grok markası aynı kaldı.
Gelin bu sürümde tam olarak neyin değiştiğine bakalım. 👇🏻
Grok 4.6 Nedir?
Grok 4.6, SpaceXAI’ın uzun soluklu ajanlar, kodlama ve bilgi işleri için konumlandırdığı yeni amiral gemisi modeli. ChatGPT veya Claude ne yapıyorsa o da aynı işi yapıyor: soru cevaplıyor, kod yazıyor, belge okuyor, görsel anlıyor.
Ayırt edici tarafı tek bir cümlede özetlenebilir: saatlerce süren görevlerde dağılmadan çalışmak. Şirketin öne çıkardığı senaryolar depo çapında refactor işleri, göç (migration) ajanları, büyük belge yığınları üzerinde araştırma hatları ve GPU çekirdeği optimizasyonu.
Teknik künyesi şöyle:
| Özellik | Değer |
|---|---|
| Model kimliği | grok-4.6 |
| Bağlam penceresi | 500.000 token |
| Girdi | Metin + görsel |
| Çıktı | Yalnızca metin (belirtilmiş sınır yok) |
| Bilgi kesim tarihi | 1 Şubat 2026 |
| Düşünme kademeleri | low, medium, high (varsayılan), xhigh |
| Açık ağırlık | Yok, indirilemiyor |
SpaceXAI parametre sayısını açıklamadı. Ortalıkta dolaşan trilyonluk rakamlar resmi değil; şirketin söylediği tek şey bunun Grok 4.5 tabanı üzerine yapılan bir eğitim sonrası yükseltme olduğu.
500 bin token ne kadar eder?
Token kabaca bir kelime parçası demek. 500 bin token, yaklaşık 375 bin kelimeye denk geliyor: orta boy bir kod tabanının tamamı, ya da birkaç yüz sayfalık teknik dokümantasyon.
Kendi metninizin kaç token tuttuğunu merak ediyorsanız token sayacı aracımıza yapıştırıp saniyesinde görebilirsiniz. Türkçe metinlerde token sayısı İngilizceye göre belirgin biçimde yüksek çıkar, bu da aynı işin Türkçesinin daha pahalıya mal olması demek.
Bu Sürümde Ne Değişti?
SpaceXAI üç noktada çalışmış:
Daha uzun ek eğitim. Grok 4.5’e verilenden daha uzun bir tamamlayıcı eğitim koşusu yapılmış. Bu koşuda akıl yürütme ve ileri teknik kavramlar için modelin kendi ürettiği, seçilmiş veriler kullanılmış.
Ajan ortamlarında pekiştirmeli öğrenme. Kodlama, web geliştirme, CAD tasarımı ve çekirdek optimizasyonu gibi alanlarda model gerçek görev ortamlarında ödüllendirilerek eğitilmiş.
Kendi işini kontrol etme. Şirketin öne çıkardığı davranış değişikliği bu: model bir adımı bitirip diğerine geçmeden önce yaptığı işi daha sık test ediyor ve doğruluyor. Uzun görevlerde asıl fark yaratan şey de bu; çünkü ajanları batıran genellikle tek bir zor adım değil, on beşinci adımda fark edilmeyen küçük bir hatanın kartopu gibi büyümesi.
Bir de yeni bir düşünme kademesi var: xhigh. Artık low, medium, high (varsayılan) ve xhigh olmak üzere dört seviye arasında seçim yapabiliyorsunuz. Basit işlerde düşük kademe hem ucuz hem hızlı, zor işlerde xhigh daha derin düşünüyor.
Fikirden çalışan projeye
SpaceXAI’ın kendi testlerinde öne çıkan bir başlık daha var: model, geniş bir ürün fikrini çalışan bir ilk sürüme çevirmekte belirgin şekilde iyileşmiş. Tanımadığı bir alanı araştırıp uygulamanın iskeletini kuruyor, temel etkileşimleri yazıyor ve gelen geri bildirimlerle birkaç tur boyunca üzerine ekliyor.
Şirkete göre asıl fark görsel ve etkileşimli projelerde: Grok 4.5’te birkaç turda oturan yapı ve görsel dil, 4.6’da çoğunlukla ilk denemede ortaya çıkıyor. Yani “boş sayfadan başlayıp yavaş yavaş ilerlemek” yerine, elinizde en baştan üzerine konuşulacak somut bir şey oluyor.
Güvenlik tarafında da şirket, modelin korumalarını yeni yeteneklere göre yeniden ayarladığını ve dağıtım öncesi bugüne kadarki en geniş test setini uyguladığını söylüyor. Hedef, zafiyet yamalama gibi meşru güvenlik işlerinde modelin gereksiz yere reddetmemesi.
Rakiplerine Karşı Nasıl? 📊
SpaceXAI’ın kendi yayınladığı karşılaştırma tablosu şöyle. Rakip skorlar, ilgili şirketlerin sistem kartlarından veya kamuya açık liderlik tablolarından alınmış:
| Test | Grok 4.6 High | Grok 4.5 High | GPT-5.6 Sol Max | Fable 5 Max |
|---|---|---|---|---|
| AA Zeka Endeksi | 61 | 56 | 61 | 62 |
| GDPVal-AA v2 (Elo) | 1753 | 1526 | 1728 | 1741 |
| CursorBench v3.2 | 69,9% | 66,7% | 67,2% | 70,5% |
| DeepSWE v1.1 | 65,9% | 54% | 73% | 70% |
| FrontierCode v1.1 (Extended) | 61,3% | 56,6% | 60,6% | 63,6% |
| APEX-Agents | 57,5% | 47,1% | 56,7% | 59,2% |
| Terminal-Bench v3.0 | 26% | 15,7% | 34,6% | 34,1% |
| APEX-SWE | 56,4% | 53,6% | - | 58,8% |
| AA-Briefcase (Elo) | 1577 | 1313 | 1502 | 1574 |
| Harvey LAB (Vals) | 15,8% | 12,9% | 2,5% | 11,3% |
Tablonun özeti şu: Grok 4.6 her sütunda kendi önceki sürümünü açık farkla geçiyor, ama rakiplerine karşı karışık bir tablo çiziyor.
Öne çıktığı yerler 44 mesleği kapsayan gerçek dünya görevleri (GDPVal-AA v2), uzun belge işleri (AA-Briefcase) ve hukuk odaklı Harvey LAB testi. Geride kaldığı yerler ise saf yazılım mühendisliği: DeepSWE v1.1’de GPT-5.6 Sol Max yedi puan, yeni ve daha zor Terminal-Bench v3.0’da sekiz puandan fazla önde.
Bağımsız ölçüm kuruluşu Artificial Analysis‘in zeka endeksinde Grok 4.6 61 puan ile GPT-5.6 Sol ile eşit, Claude Fable 5’in (62) bir, Claude Opus 5’in (63) iki puan gerisinde. Bir ay önceki Grok 4.5’in ise beş puan üstünde ve Kimi K3‘ün önünde. Aynı kurumun ayrı ölçümlerinde model, araç kullanan müşteri hizmetleri senaryolarında (τ³-Banking) %50,7 ile en iyi iki skordan birini, Terminal-Bench’in bir önceki v2.1 sürümünde ise %88,4 aldı.
Asıl fark: verimlilik
Grok ailesinin bir önceki sürümdeki iddiası “en yüksek skor değil, en az adımda iş bitirme” idi. Bu iddia 4.6’da da geçerli.
Uzun soluklu görevlerde Grok 4.6 ortalama 53 tur ve 0,5 milyar girdi tokenı harcıyor. Aynı görevlerde Claude Opus 5 ortalama 103 tur ve 2 milyar token kullanıyor. Görev başına maliyet 0,84 dolarda kalıyor.
Yani model, zirvedeki rakibinin yaptığı işi kabaca yarı sayıda adımda ve dörtte bir token ile bitiriyor. Faturayı ödeyen taraf için asıl haber bu.
Fiyatlar ve 200 Bin Token Tuzağı 💸
API fiyatları 1 milyon token başına şöyle:
| Kalem | 200K altı istek | 200K üstü istek |
|---|---|---|
| Girdi | $2,00 | $4,00 |
| Önbellekten girdi | $0,50 | $1,00 |
| Çıktı | $6,00 | $12,00 |
Kıyas olsun: Claude Opus 5 için 5/25 dolar, GPT-5.6 Sol için 5/30 dolar ödüyorsunuz. Grok 4.6 rakiplerinin kabaca yarı fiyatında.
Ama şu detay atlanmasın: istek 200 bin token bandını aştığı anda tarife ikiye katlanıyor ve SpaceXAI’ın açıklamasına göre yüksek tarife o isteğin tamamı için geçerli oluyor. Yani 200 bin tokenlık bir istem gönderirseniz 2 dolardan, 201 bin tokenlık bir istem gönderirseniz tamamı 4 dolardan işliyor. Tek bir token yüzünden fatura iki katına çıkabilir.
Uzun bağlamla çalışacaksanız pratik tavsiye: 200 bin sınırının hemen altında kalacak şekilde girdiyi budayın, gerçekten gerekmedikçe o bandın üstüne çıkmayın.
Bu rakamlar sizin işinizde ne tutar? LLM maliyet hesaplayıcımıza girdi ve çıktı token sayınızı yazıp Grok’u GPT ve Claude ile yan yana kıyaslayabilir, aylık faturanızı önceden görebilirsiniz.
Nereden Kullanılır?
Grok 4.6, 12 Ağustos 2026 itibarıyla şu kanallarda:
- Grok Build üzerinde varsayılan model.
- Cursor‘da tüm planlarda mevcut.
- SpaceXAI API üzerinden
grok-4.6kimliğiyle. - OpenRouter, Vercel ve Cloudflare üzerinden yönlendirilebiliyor.
Yeni kullanıcılara ilk hafta iki kat kullanım hakkı veriliyor. Modelin daha hızlı bir varyantı da var, fiyatı iki katı ve ayrı bir model kimliği yayınlanmamış durumda.
Açık ağırlık yok: modeli indirip kendi sunucunuzda çalıştıramazsınız. Bu tarafta Kimi K3 gibi açık ağırlıklı modeller hâlâ tek seçenek.
Geliştiriciyseniz: 5 Satırda Başlangıç
API, OpenAI kütüphanesiyle uyumlu. ChatGPT için yazdığınız kod iki satır değişiklikle Grok’a bağlanıyor:
from openai import OpenAI
client = OpenAI(
api_key="ANAHTARINIZ",
base_url="https://api.x.ai/v1", # tek fark burası
)
cevap = client.chat.completions.create(
model="grok-4.6",
reasoning_effort="high", # low | medium | high | xhigh
messages=[{"role": "user", "content": "Grok 4.6'yı tek cümleyle anlat."}],
)
print(cevap.choices[0].message.content)
Bilmeniz gereken üç incelik:
reasoning_effortartık dört değer alıyor. Varsayılanhigh. Basit sınıflandırma işlerindelow, çok adımlı ajan işlerindexhighdeneyin.- Önbelleği kullanın. Aynı sistem istemini veya aynı kod dosyasını tekrar tekrar gönderiyorsanız önbellekten girdi dörtte bir fiyata işliyor.
- 200 bin sınırını izleyin. İstek boyutunu göndermeden önce ölçün; bandı aşan tek istek faturayı ikiye katlar.
Sırada Ne Var: Grok 4.7 ve Grok 5
Bu sürüm bir ara adım gibi duruyor. Sektör kaynaklarına göre daha büyük bir model olan Grok 4.7 haftalar içinde, Grok 5 ise 2026 bitmeden bekleniyor. Bunlar SpaceXAI’ın resmi açıklaması değil, yönlendirme sağlayıcılarına dayanan bilgiler; kesin gözüyle bakmamak lazım.
Yine de tempo net: SpaceXAI beş haftada bir sürüm çıkarıyor ve her seferinde fiyatı sabit tutup skoru yukarı çekiyor. Bu strateji zirveyi almasa bile fiyat/performans tarafında rakipleri zorluyor.
Sıkça Sorulan Sorular
Soru: Grok 4.6 ne zaman çıktı? Cevap: SpaceXAI, Grok 4.6’yı 12 Ağustos 2026 tarihinde duyurdu ve aynı gün API, Cursor ve Grok Build üzerinden kullanıma açtı.
Soru: Grok 4.6 fiyatı ne kadar? Cevap: 1 milyon token için 2 dolar girdi, 0,50 dolar önbellekli girdi ve 6 dolar çıktı. İstek 200 bin tokenı aşarsa tüm tarife ikiye katlanıyor.
Soru: Grok 4.6 ücretsiz mi? Cevap: API kullanımı ücretli. Grok uygulaması ve grok.com üzerinden sınırlı ücretsiz kullanım mevcut, yoğun kullanım için SuperGrok aboneliği gerekiyor. Yeni API kullanıcılarına ilk hafta iki kat kullanım hakkı veriliyor.
Soru: Grok 4.6, GPT-5.6 ve Claude’dan iyi mi? Cevap: Artificial Analysis zeka endeksinde GPT-5.6 Sol ile eşit (61), Claude Opus 5’in iki puan gerisinde. Ajan görevlerinde çok güçlü, DeepSWE gibi kodlama testlerinde GPT-5.6 Sol’un gerisinde. Fiyat/performansta önde.
Soru: Grok 4.6 ile Grok 4.5 arasındaki fark ne? Cevap: 4.6, 4.5 tabanı üzerine yapılan bir eğitim yükseltmesi. Zeka endeksinde 56’dan 61’e çıktı, yeni xhigh düşünme kademesi geldi ve model kendi işini daha çok doğruluyor. Bağlam penceresi ve fiyat aynı kaldı.
Soru: Grok 4.6 kaç parametre? Cevap: SpaceXAI parametre sayısını açıklamadı. Bunun sıfırdan bir model değil, Grok 4.5 tabanı üzerine eğitim sonrası yükseltme olduğu belirtildi.
Soru: Grok 4.6 Türkçe biliyor mu? Cevap: Evet, Türkçe soru sorup Türkçe cevap alabilirsiniz. SpaceXAI resmi bir Türkçe test skoru paylaşmadı, kendi işinizde denemek en sağlıklısı.
Sağlıcakla kalın… 🙂
