OpenAI eylülü üç hamleyle kapattı. 3 Eylül'de GPT-6 ailesinin zirvesi Astra'yı duyurdu, ertesi gün genel kullanıma açtı. 22 Eylül'de ailenin orta ve hafif modelleri Sol ve Luna geldi. Ay bitmeden, 29 Eylül'de de GPT-6.1 Sol.
İlk bakışta tanıdık bir hikâye: büyük model, orta model, küçük model. Ama bu kez hikâyenin kahramanı zirve değil, ortadaki.
Aile: Astra, Sol, Luna
- Astra: ailenin en yetenekli modeli. Bağlam penceresi bir milyon token'ı aşıyor (1.050.000); uzun belgeleri, büyük kod tabanlarını tek seferde okuyabiliyor.
- Sol: orta sınıf; günlük ağır iş için.
- Luna: hız ve maliyet için; doğruluktan biraz feragat eden hafif model.
Astra: güç ve güvenlik freni
Astra'nın çıkışı düz bir yol olmadı. OpenAI modeli siber güvenlik riskleri nedeniyle birkaç hafta bekletti ve ek önlemlerle yayınladı. Genel kullanıma açılan sürüm siber güvenlikle ilgili bazı istekleri reddediyor. İlk erişim OpenAI'nin başvuruyla katılınan siber güvenlik programındaki kurumlara verildi; ardından ChatGPT'nin üst planlarına, API'ye ve AWS'ye yayıldı.
Teknik tarafta iki ayrıntı dikkat çekiyor. OpenAI'nin araştırmadan sorumlu başkan yardımcısına göre Astra, Teksas'taki Stargate tesisinde ilk kez 100 binden fazla GPU üzerinde ön eğitimden geçen model. Bir de "döngülü derinlik" olarak anılan bir teknik kullanıldığı aktarılıyor; bu yöntem modelin akıl yürütme adımlarının bir kısmını dışarıdan görünmez kılıyor. İkincisi tartışmalı, çünkü bir modelin nasıl düşündüğünü izleyebilmek güvenlik açısından değerliydi.
Fiyat: milyon giriş token'ı 10 dolar, milyon çıkış token'ı 50 dolar. Zirve fiyatı.
GPT-6.1 Sol: Astra'ya beşte bir fiyatla yaklaşmak
Bu ayın asıl haberi bu. OpenAI'ye göre GPT-6.1 Sol; ajan olarak kod yazma, bilgisayar kullanımı ve profesyonel işlerde Astra'ya neredeyse yetişiyor. Fiyatı ise Astra'nın beşte biri: milyon giriş token'ı 2 dolar, çıkış 10 dolar.
Paylaşılan sonuçlar:
- DeepSWE 1.1 (yazılım mühendisliği): Astra ile aynı skor.
- OSWorld 2.0 (bilgisayar kullanımı): Astra'nın 2,1 puan gerisinde.
- AutomationBench (iş otomasyonu): önceki GPT-6 Sol'un 4,8 puan önünde.
Bağımsız ölçüm de benzer bir resim çiziyor. Artificial Analysis'in zekâ endeksinde en yüksek ayarlarda GPT-6.1 Sol 52, Astra 53 puan alıyor; görev başına maliyet ise Sol'da 0,72 dolar, Astra'da 3,26 dolar.
Bir puan fark, dört buçuk kat fiyat.
Bu rakamlara nasıl bakmalı
Testlerin çoğu OpenAI'nin kendi seçtikleri. Bağımsız ölçümler genel resmi doğruluyor gibi görünüyor ama ayrıntı her işte farklı çıkar. Benim için anlamlı olan oran: aynı işi beşte bir fiyata, çok yakın kaliteyle yapabilmek.
Benim için ne değişiyor
İki şirketin modellerini de takip ediyorum; bir yarışın tribününde değilim. Önemli olan, hangi işi hangi araca verdiğim.
GPT-6 ailesindeki tablo, aynı ay Anthropic'te gördüğüm tabloyla neredeyse birebir aynı: zirve performansı bir alt modele, çok daha düşük fiyata iniyor. Anthropic'te Opus 5.5 Fable seviyesine geldi; OpenAI'de GPT-6.1 Sol Astra'ya yaklaştı.
Pratik sonucu basit:
- Varsayılan iş için orta model. Uzun belgeler, çok adımlı işler, kod. GPT-6.1 Sol bu sınıfın yeni referansı.
- Zirve model, gerçekten gerektiğinde. Bir puanlık fark için beş kat ödemek çoğu işte mantıksız.
- Asıl beceri yönlendirmek. Hangi işi hangi modele vereceğini bilmek, en iyi modeli seçmekten daha değerli hâle geliyor.
Bir de güvenlik meselesi var. Astra'nın siber güvenlik nedeniyle bekletilmesi ve akıl yürütmesinin bir kısmının görünmez olması, bu modellerin artık alelade yazılımlar olmadığını hatırlatıyor. Ben bu araçları ajansımın teknik altyapısında kullanıyorum; güçlendikçe neyi otomatik bırakıp neyi kendim kontrol ettiğime daha çok dikkat ediyorum.
Sonuç
Bir yıl önce herkes "en iyi model hangisi?" diye soruyordu. Bugün doğru soru başka: bu iş için yeterince iyi olan en verimli model hangisi?
Sıradan, zirveye bakar. Asi, işin nerede bittiğine bakar.