OpenAI, GPT-6 Sol’un geliştirilmiş sürümü olan GPT-6.1 Sol’u kullanıma sundu. Yeni model; kodlama, profesyonel iş akışları, bilgisayar kullanımı, bilimsel araştırma ve olgusal doğruluk alanlarında GPT-6 Sol’a göre geliştirmeler içeriyor. GPT-6.1 Sol, bazı değerlendirmelerde GPT-6 Astra’ya yakın sonuçlar verirken daha düşük API maliyetleriyle çalışıyor.
GPT-6.1 Sol nedir?
GPT-6.1 Sol, OpenAI’ın ajan tabanlı kodlama, bilgisayar kullanımı ve profesyonel iş yükleri için geliştirdiği yeni model olarak duyuruldu. Model, GPT-6 Sol’un geliştirilmiş sürümü olarak konumlandırılıyor.
OpenAI’ın paylaştığı bilgilere göre GPT-6.1 Sol, zorlu görevlerde GPT-6 Astra’nın performansına yaklaşırken Astra’nın standart girdi ve çıktı token fiyatlarının yaklaşık beşte biri seviyesinde çalışıyor.
Modelin API fiyatları milyon girdi token’ı başına 2 dolar, milyon önbelleğe alınmış girdi token’ı başına 0,10 dolar ve milyon çıktı token’ı başına 10 dolar olarak açıklandı.
Kodlama performansı geliştirildi
GPT-6.1 Sol’un öne çıkan kullanım alanlarından biri yazılım geliştirme oldu. Gerçek kod tabanlarındaki karmaşık yazılım mühendisliği görevlerini ölçen DeepSWE v1.1 testinde model, GPT-6 Astra ile aynı puana ulaşırken yaklaşık beşte bir maliyetle çalıştı.
Aynı değerlendirmede GPT-6.1 Sol, GPT-6 Sol’un en yüksek puanını 6,4 yüzde puan geçti.
Profesyonel iş akışlarında performans artışı
GPT-6.1 Sol, karmaşık PDF belgelerinin anlaşılması ve çok adımlı iş akışlarının yürütülmesine yönelik testlerde de GPT-6 Sol’un üzerinde sonuçlar verdi.
GDP.pdf değerlendirmesinde model; tablo, grafik, diyagram ve küçük puntolu ayrıntılar içeren PDF belgelerine yönelik sorularda GPT-6 Astra’nın performansına yaklaştı.
AutomationBench testinde ise orta akıl yürütme çabasında GPT-6 Sol’dan 4,8 yüzde puan daha yüksek sonuç elde etti.
Bilgisayar kullanımında GPT-6 Sol’u geçti
Bilgisayar uygulamalarıyla etkileşim gerektiren görevleri ölçen OSWorld 2.0 testinde GPT-6.1 Sol, en yüksek akıl yürütme çabasında GPT-6 Sol’u 7 yüzde puan geçti.
Aynı değerlendirmede model, GPT-6 Astra’nın puanına 2,1 yüzde puan kadar yaklaştı. Görev başına maliyetin ise Astra’nın yaklaşık yedide biri seviyesinde olduğu belirtildi.
Bilimsel araştırma görevlerinde sonuçlar
GPT-6.1 Sol; veri analizi, simülasyon ve teorem ispatı gibi bilimsel iş akışlarını ölçen Terminal-Bench Science 0.1 testinde GPT-6 Sol’un puanının iki katından fazlasına ulaştı.
En yüksek akıl yürütme çabasında GPT-6.1 Sol’un görev başına ortalama maliyeti 5,47 dolar olarak açıklandı. Aynı değerlendirmede GPT-6 Astra’nın görev başına maliyeti 23,80 dolar oldu.
GPT-6 Astra, yüzde 68,1 puanla söz konusu testte en yüksek skora sahip model olmaya devam etti.
Olgusal hata oranı düşürüldü
GPT-6.1 Sol’un olgusal doğruluk performansında da iyileştirme yapıldı. Ekstra yüksek akıl yürütme çabasında GPT-6 Sol’un yüzde 4,5 olan olgusal hata oranı GPT-6.1 Sol’da yüzde 4,1’e geriledi.
GPT-6 Astra’nın aynı değerlendirmedeki hata oranı ise yüzde 4,0 olarak açıklandı.
GPT-6.1 Sol ile GPT-6 Astra arasındaki farklar neler?
GPT-6 Astra, OpenAI’ın en yüksek seviye modeli olarak konumunu koruyor. GPT-6.1 Sol ise daha düşük maliyetle Astra’ya yakın performans sunan model olarak kullanıma sunuldu.
GPT-6 Astra, özellikle en zor bilimsel araştırma görevlerinde daha yüksek sonuçlar verirken GPT-6.1 Sol; kodlama, bilgisayar kullanımı, belge analizi ve çok adımlı iş akışlarında daha düşük maliyetli bir seçenek olarak konumlandırılıyor.
GPT-6.1 Sol’un standart API fiyatı milyon girdi token’ı başına 2 dolar ve milyon çıktı token’ı başına 10 dolar olarak belirlenirken, önbelleğe alınmış girdi token’larının fiyatı milyon token başına 0,10 dolar olarak açıklandı.
GPT-6.1 Sol nerede kullanılabilir?
GPT-6.1 Sol, Plus, Pro, Business, Enterprise ve Edu kullanıcıları için ChatGPT Çalışma ve Codex üzerinde kullanıma sunuldu. Model henüz Sohbet bölümünde kullanılamıyor.
Geliştiriciler GPT-6.1 Sol’a OpenAI API üzerinden gpt-6.1-sol model adıyla erişebiliyor.





