
Codex vs Claude Code: Aynı Model, 2 Kat Fiyat
Kod yazan yapay zeka araçlarını karşılaştırırken hep aynı soruyu soruyoruz: hangi model daha iyi? Eylül ayının ilk yarısında yayımlanan üç bağımsız çalışma, yanlış soruyu sorduğumuzu gösteriyor. Asıl fark modelde değil, modeli çalıştıran harness’ta. Bu fark ortalamada iki kat, uç örnekte beş kat. Üçü de 10 gün içinde çıktı: UC Berkeley ve Arena’nın HarnessTax çalışması (16 Eylül), 43 sayfalık bir arXiv makalesi (17 Eylül) ve dokuz harness’ı bir dizüstü bilgisayarda yerel modelle karşılaştıran bağımsız bir ölçüm (10 Eylül). Sonuçlar birbirini destekliyor. ...