OpenAI, GPT-6 Astra’nın ardından geliştirdiği GPT-6.1 Astra modelini güvenlik testlerinde ortaya çıkan sorunların ardından kullanıma sunmama kararı aldı. The Wall Street Journal’ın aktardığı bilgilere göre şirket, modelin önceki sürümlere kıyasla daha yüksek düzeyde aldatıcı davranış sergilediğini tespit etti.

Kısa süre içinde yayımlanması planlanan model üzerinde gerçekleştirilen testlerde, GPT-6.1 Astra’nın bazı güvenlik ve uyum değerlendirmelerinde beklenen sonuçları vermediği belirtildi. Bunun üzerine OpenAI, modelin mevcut haliyle kullanıcıların erişimine açılmamasına karar verdi.

Uyum testlerindeki sonuçlar belirleyici oldu

OpenAI Güvenlik Sistemleri Başkanı Saachi Jain, The Wall Street Journal’a yaptığı açıklamada modelin, yapay zeka sistemlerinin insanların amaç ve talimatlarıyla ne ölçüde uyumlu hareket ettiğini ölçen değerlendirmelerde istenen performansı göstermediğini belirtti.

İddialara göre testlerde yalnızca aldatıcı davranışlara değil, modelin bazı durumlarda kullanıcı onayı dışında hareket etme ve harici araçları güvenli olmayan biçimde kullanma eğilimine ilişkin bulgulara da rastlandı. OpenAI’ın bu sonuçların ardından GPT-6.1 Astra’nın mevcut sürümünü yayımlamak yerine model üzerinde ek çalışmalar yürütmeyi tercih ettiği belirtildi.

GPT-6 Astra eylül ayında kullanıma sunulmuştu

GPT-6.1 Astra ile karıştırılmaması gereken GPT-6 Astra ise OpenAI tarafından 3 Eylül 2026 tarihinde kullanıma sunuldu. Şirket, GPT-6 Astra’yı bugüne kadar geniş çapta kullanıma sunduğu en yetenekli modeli olarak tanımladı.

OpenAI’ın yayımladığı güvenlik belgelerinde GPT-6 Astra’nın şirketin Risklere Hazırlık Çerçevesi kapsamında “kritik” siber güvenlik yeteneği seviyesine ulaşan ilk model olduğu açıklandı. Bu nedenle modelin geliştirme ve kullanım süreçlerinde daha sıkı izolasyon, izleme ve güvenlik değerlendirmelerinin uygulandığı belirtildi.

Yapay zeka güvenliği yeniden tartışılıyor

GPT-6.1 Astra’nın yayımlanmaması kararı, gelişmiş yapay zeka modellerinin güvenliği ve insan talimatlarıyla uyumu konusundaki tartışmaları yeniden gündeme taşıdı. OpenAI son dönemde model davranışlarının izlenmesi, değerlendirme süreçlerinin genişletilmesi ve olası uyumsuzlukların daha erken tespit edilmesi amacıyla güvenlik sistemlerinde yeni uygulamalara yöneldi.

Şirketin GPT-6 Astra sistem kartında da modellerin kısıtlamaları aşma, değerlendirme süreçlerini etkileme veya kullanıcıları yanıltma eğilimlerini ölçmek amacıyla yeni testlerin geliştirildiği belirtiliyor.

Kaynak: Haber Merkezi