OpenAI'dan GPT-6 Astra'ya yakın performansı beşte bir maliyetle sunan model: GPT-6.1 Sol
OpenAI, geçtiğimiz hafta kullanıma sunduğu GPT-6 Sol'un geliştirilmiş versiyonu GPT-6.1 Sol modelini tanıttı. Şirketin DevDay 2026 kapsamında duyurduğu yeni model; ajan tabanlı kodlama, bilgisayar kul
OpenAI, geçtiğimiz hafta kullanıma sunduğu GPT-6 Sol'un geliştirilmiş versiyonu GPT-6.1 Sol modelini tanıttı. Şirketin DevDay 2026 kapsamında duyurduğu yeni model; ajan tabanlı kodlama, bilgisayar kullanımı, belge analizi ve çok adımlı profesyonel iş akışlarında önceki modele kıyasla önemli performans artışları sunuyor. OpenAI'a göre GPT-6.1 Sol, bu görevlerin birçoğunda şirketin en güçlü modeli GPT-6 Astra'nın performansına yaklaşırken çok daha düşük maliyetle kullanılabiliyor.
OpenAI, GPT-6.1 Sol'u özellikle performans ve maliyet arasındaki dengeyi iyileştirmeye yönelik bir model olarak konumlandırıyor. Modelin standart API fiyatlandırması, 1 milyon girdi token'ı için 2 dolar, 1 milyon çıktı token'ı için 10 dolar olarak belirlendi. Önbelleğe alınmış girdilerin maliyeti ise 1 milyon token başına 0,10 dolar. Şirkete göre bu rakam, standart girdi fiyatına kıyasla yüzde 95'lik bir indirim anlamına geliyor. Modelin özellikle aynı bağlamın tekrar tekrar kullanıldığı ajan tabanlı uygulamalarda maliyeti önemli ölçüde azaltabildiğini de ekleyelim.
Kodlama görevlerinde GPT-6 Astra ile aynı puana ulaşıyor
GPT-6.1 Sol'un öne çıktığı alanlardan biri yazılım geliştirme. Gerçek kod tabanlarında uzun süreli yazılım mühendisliği görevlerini ölçen DeepSWE v1.1 benchmark'ında model, yaklaşık beşte bir maliyetle GPT-6 Astra ile aynı puanı elde ediyor. Aynı zamanda daha düşük akıl yürütme seviyesi ve maliyetle GPT-6 Sol'un en yüksek skorunu 6,4 puan geride bırakıyor.

Profesyonel belge analizini ölçen GDP.pdf testinde ise GPT-6.1 Sol, finans, sağlık ve hukuk gibi alanlardan tablolar, grafikler ve ayrıntılı PDF belgeleri içeren görevlerde GPT-6 Astra'nın performansına yaklaşıyor.

Çok adımlı iş akışlarını değerlendiren AutomationBench testinde model, orta seviyedeki akıl yürütme ayarında Opus 5.5'ten 2,2 puan, GPT-6 Sol'dan ise 4,8 puan daha yüksek performans gösteriyor.

GPT-6.1 Sol, bilgisayar kullanımına dayalı ajan görevlerinde de ilerleme kaydetmiş durumda. OSWorld 2.0'ın çevrimdışı testlerinde model, en yüksek akıl yürütme seviyesinde GPT-6 Sol'u 7 puan geride bırakırken görev başına maliyeti yarıdan daha düşük kalıyor. Aynı testte Astra'nın sonucunun yalnızca 2,1 puan gerisinde kalan GPT-6.1 Sol'un görev maliyeti ise Astra'nın yaklaşık yedide biri seviyesinde.

Bilimsel görevlerde maliyet farkı dikkat çekiyor Veri analizi, simülasyon ve teorem ispatı gibi bilimsel iş akışlarını ölçen Terminal-Bench Science 0.1 testinde GPT-6.1 Sol, GPT-6 Sol'un puanının iki katından fazlasına ulaşıyor. Bu testte GPT-6.1 Sol'un görev başına ortalama maliyeti 5,47 dolar olarak ölçülürken Opus 5.5 için bu rakam 23,21 dolar, GPT-6 Astra için ise 23,80 dolar seviyesinde. Bununla birlikte Astra, yüzde 68,1'lik skoruyla test edilen modeller arasında en yüksek performansı göstermeye devam ediyor.

OpenAI, yeni modelde olgusal doğruluğun da iyileştirildiğini belirtiyor. En yüksek akıl yürütme seviyesinde GPT-6 Sol'un yüzde 4,5 olan olgusal hata oranı GPT-6.1 Sol'da yüzde 4,1'e düşüyor. GPT-6 Astra'nın aynı testteki hata oranı ise yüzde 4 seviyesinde. Şirket, bu değerlendirmelerin özellikle hata üretme ihtimali yüksek olan zor istemlerden oluşturulduğunu ve tipik ChatGPT kullanımını temsil etmediğini de vurguluyor.

Güvenlik tarafı