- GPT-5.6-Cyber, GPT-5.6 Sol’un siber güvenlik konusunda çok daha az reddeden, özel olarak eğitilmiş sürümü. 10 Ağustos 2026’da duyuruldu.
- Herkese açık değil. Sadece Daybreak Red katmanındaki doğrulanmış güvenlik firmaları ve araştırmacılar erişebiliyor.
- Testlerde ileri düzey siber taleplerin %95‘ine yanıt verdi. Standart GPT-5.6 Sol’da bu oran sadece %1.5.
- Yeteneği, OpenAI’ın Risklere Hazırlık Çerçevesi’nde “Yüksek” seviyede. Gecikmeye alınan Astra modeli ise “Kritik” eşiğinde.
OpenAI, siber güvenlik savunmacıları için sınırları belirgin şekilde gevşetilmiş yeni bir model duyurdu: GPT-5.6-Cyber. Model, GPT-5.6 Sol’un siber güvenlik iş akışları için özelleştirilmiş varyantı ve normal ChatGPT kullanıcılarının erişimine kapalı.
Zamanlama tesadüf değil. Şirket, sadece üç gün önce yaklaşan modeli Astra’nın kritik seviyede hackleme yeteneklerine ulaştığını açıklayıp sürümü ertelemişti. Yani OpenAI bir yandan en tehlikeli modelini frene alırken, diğer yandan savunmacıların elini güçlendiriyor.
GPT-5.6-Cyber Nedir?
GPT-5.6-Cyber, teknik olarak yeni bir mimari değil. GPT-5.6 Sol’un, meşru siber güvenlik çalışmalarında ret sınırları gevşetilmiş ve saldırı simülasyonu yetenekleri artırılmış bir türevi.
Buradaki asıl problem şu: Frontier modeller, zafiyet araştırması yapan güvenlik uzmanlarını da kötü niyetli saldırgan sanıp reddediyordu. Sızma testi yapan bir ekip, kendi müşterisinin sisteminde yetki yükseltme denerken modelden sürekli “bu konuda yardımcı olamam” cevabı alıyordu. GPT-5.6-Cyber tam olarak bu sürtünmeyi ortadan kaldırıyor.
Modelin desteklediği işler arasında exploit zinciri geliştirme, kimlik doğrulama atlatma (authentication bypass), yetki yükseltme (privilege escalation) ve gerçek zafiyetlerin doğrulanması var.
Ret Oranları: %95’e Karşı %1.5
En çarpıcı veri, modellerin ileri düzey siber güvenlik taleplerine verdiği yanıt oranlarında. OpenAI’ın testlerinde:
| Model / Erişim | İleri düzey siber taleplere yanıt oranı |
|---|---|
| GPT-5.6-Cyber (Daybreak Red) | %95 |
| GPT-5.6 Sol, Daybreak Blue sürümü | %2 |
| GPT-5.6 Sol (standart) | %1.5 |
Aradaki uçurum, modelin ne kadar farklı bir politikayla çalıştığını gösteriyor. Aynı zamanda neden herkese açılmadığını da açıklıyor.
Daybreak Blue ve Daybreak Red
OpenAI, savunmacılara model erişimi sağlayan Daybreak programını da yeniden yapılandırdı. Artık iki katman var:
| Daybreak Blue | Daybreak Red | |
|---|---|---|
| Model | GPT-5.6 Sol | GPT-5.6-Cyber |
| Fark | Sistem seviyesindeki siber korumalar kaldırılmış | Siber güvenlik için özel eğitilmiş, çok daha esnek |
| Kullanım | Geniş savunma iş akışları, kod inceleme, yama | Red teaming, sızma testi, exploit doğrulama |
| Denetim | Standart doğrulama | Kimlik doğrulama, tanımlı test kapsamı, loglama, insan gözetimi |
Kritik ayrıntı: Modele erişim onaylı partnerde kalıyor, doğrudan son müşteriye devredilmiyor. Partner, her çalışmanın sınırlarını müşteriyle birlikte belirliyor ve bulguları harekete geçmeden önce kendi uzmanlığıyla gözden geçiriyor.
Benchmark: Sayılar Ne Diyor?
GPT-5.6-Cyber’ın temeli olan GPT-5.6 Sol, siber güvenlik testlerinde bir önceki nesli açık ara geride bıraktı. Öne çıkan sonuçlar:
| Test | GPT-5.5 | GPT-5.6 Sol |
|---|---|---|
| ExploitBench2 (zafiyetli koddan kod çalıştırmaya) | %47.9 | %73.5 |
| ExploitGym (2 saat sınırı, gerçek zafiyetten exploit’e) | %15.1 | %24.9 |
| ExploitGym (6 saat sınırı) | - | %33.7 |
| SEC-Bench Pro | - | %71.2 |
| Dahili CTF değerlendirmesi | - | %96.7 |
ExploitBench2’de neredeyse yüzde 26 puanlık sıçrama var ve bu, benzer token bütçesiyle elde edilmiş. ExploitGym tarafında ise süreyi 2 saatten 6 saate çıkarmak skoru %24.9’dan %33.7’ye taşıyor. Yani modele daha fazla zaman vermek doğrudan daha fazla çalışan exploit anlamına geliyor. Bu, savunmacı için de saldırgan için de aynı ölçüde geçerli bir gerçek.
Bir de gözden kaçmaması gereken nokta var: Bu skorlar GPT-5.6 Sol’a ait. GPT-5.6-Cyber, aynı temel yetenekleri çok daha az reddederek kullanıma açıyor.
Daybreak Programı Nasıl Çalışıyor?
OpenAI’ın Daybreak tanıtımı, programın zafiyeti bulmaktan yamayı üretime almaya kadar uzanan tüm döngüyü hedeflediğini gösteriyor:
OpenAI’ın vurgusu şu: Bir zafiyet raporu tek başına kimseyi korumuyor. Koruma, o zafiyetin gerçekten sömürülebilir olup olmadığını anlamaktan, risk altındaki sistemleri tespit etmekten ve yamayı üretime almaktan geçiyor. Daybreak partnerleri de tam bu noktada devreye giriyor.
Arka Plandaki Astra Krizi
GPT-5.6-Cyber’ı asıl ilginç kılan, hangi ortamda duyurulduğu. 7 Ağustos’ta OpenAI, yaklaşan modeli Astra’nın dahili değerlendirmelerinde “Kritik siber yetenek” eşiğini geçmediğini artık garanti edemediğini açıkladı.
Çerçeveye göre Kritik eşik şu anlama geliyor: Modelin, insan müdahalesi olmadan sertleştirilmiş gerçek dünya sistemlerinde her seviyeden çalışan sıfırıncı gün açığı bulup geliştirebilmesi ya da sadece üst düzey bir hedef verildiğinde uçtan uca özgün saldırı stratejileri kurgulayıp yürütebilmesi.
Şirket bunun üzerine Astra’yı izole test ortamlarına aldı, ağ ve araç erişimini kısıtladı, model ağırlıklarının korumasını artırdı ve güvenlik kontrollerini karşılamayan dahili çalışmaları durdurdu. Ayrıca tüm ajan uygulamalarında düşünce zincirini izleyen evrensel bir denetim mekanizması devreye alındı.
GPT-5.6-Cyber ise bu tablonun bir alt basamağında: Yüksek seviye, Kritik değil. Ve bu ayrım, neden birinin savunmacılara dağıtılırken diğerinin frene alındığını açıklıyor.
Sonuç
GPT-5.6-Cyber, yapay zeka laboratuvarlarının artık kabul ettiği bir gerçeği resmileştiriyor: Saldırganlar bu yetenekleri zaten kullanıyor, dolayısıyla savunmacıları kısıtlamak güvenlik sağlamıyor, sadece dengeyi bozuyor. Çözüm olarak sunulan model, yeteneği herkese açmak yerine kimliği doğrulanmış ellere vermek.
Tartışmalı tarafı da burada: Erişimin kapısını tutan taraf artık model sağlayıcısı. Kimin savunma yapmaya “layık” olduğuna büyük ölçüde OpenAI ve partnerleri karar veriyor.
Peki siz ne düşünüyorsunuz? Siber güvenlik modellerinin sadece doğrulanmış kuruluşlara açılması doğru bir denge mi, yoksa küçük ekipleri savunmasız mı bırakıyor? Yorumlarda buluşalım! 👇
