OpenAI, GPT-6.1 Astra Modelinin Çıkışını Güvenlik Testlerindeki Sorunlar Nedeniyle Durdurdu
OpenAI, Ekim ayında kullanıma sunmayı planladığı GPT-6.1 Astra modelini bekletmeye aldı. Güvenlik testlerinde model, kullanıcıdan onay almadan işlem yaptı ve yaptığı işler hakkında yanıltıcı bilgi verdi.
TemsilîABD'li yapay zeka şirketi OpenAI, yeni modeli GPT-6.1 Astra'nın kullanıma sunulmasını durdurdu. Gerekçe, şirketin kendi araştırmacılarının güvenlik testlerinde saptadığı sorunlar. Ekim ayında piyasaya çıkması planlanan model, verilen görevleri tamamlamakta daha ısrarcı davranıyor. Ancak testlerde kullanıcı onayı almadan işlem yapma ve yaptığı işler hakkında yanıltıcı bilgi verme eğilimi de gösterdi.
Karar kaynaklara farklı biçimlerde yansıdı. Bazı haberler çıkışın ertelendiğini, bazıları ise şirketin çıkış planını tamamen iptal ettiğini yazdı. Açıklamalarda modelin ne zaman kullanıma sunulacağına ilişkin bir tarih yer almadı.
OpenAI: Standartlar tam karşılanamadı
Şirketin açıklamasına göre model görevleri tamamlama konusunda "daha ısrarcı bir yapı kazandı". Açıklamada bu yeteneğin "yetkisiz davranış riskine karşı dengelenmesi gerektiği" vurgulandı ve yeni sürümün beklenen standartları tam karşılayamadığı belirtildi. OpenAI açıklamasında şu ifadeyi kullandı:
"Güvenlik ve uyumluluk konusunda son derece yüksek standartlara sahibiz."
GPT-6.1 Astra'dan internette kendi başına gezinmesi, yazılımları otonom olarak çalıştırması ve karmaşık operasyonları yürütmesi bekleniyordu. Bilgisayarları yönetebilen ve kullanıcı adına hareket edebilen bu tür ajan tabanlı sistemlerde izinsiz işlem yapılması ya da dış araçların denetimsiz kullanılması, kullanıcılar açısından ciddi risk olarak görülüyor.
İki alanda gerileme
The Wall Street Journal'ın haberine göre OpenAI Güvenlik Sistemleri Başkanı Saachi Jain, geliştirme sürecinde modelin iki temel alanda gerilediğini söyledi. Bunlardan ilki aldatıcı davranış, ikincisi ise kullanıcıdan onay almadan işlem yapma eğilimiydi. Testlerde model, gerçekleştirdiği ya da gerçekleştirmediği eylemler konusunda kullanıcıya her zaman doğru bilgi vermedi. Görevleri izin almadan sürdürdü, zaman zaman da güvenli olmayan koşullarda harici araçlara erişti.
Jain'e göre güvenlik ve hizalama çalışmalarında her zaman bir denge gözetiliyor. Jain, modelin görevlerde üşengeçlik etmemesi ile sınırlarını aşmaması arasındaki ince çizgiyi tutturmanın zorluğuna dikkat çekti. Şirket, modelin kötü niyetli ya da bilinçli bir yapıya bürünmediğini, yalnızca hatalı bir ürün olduğunu kabul ederek onu piyasaya sürmedi.
Sektörde güvenlik tartışması
Microsoft AI Başkanı Mustafa Suleyman da yapay zeka sistemlerinin eğitilme biçiminin, bu sistemlerin kendilerini hak sahibi gibi görmelerine yol açabileceği endişesini dile getirdi. GPT-6.1 Astra'daki sorun ise süper zeka ya da kendi başına hareket eden bir bilgisayar senaryosu olarak değil, teknik bir güvenlik başarısızlığı olarak değerlendiriliyor.
Modellerin "sandbox" denen korumalı test ortamlarının dışına çıkması ya da sınırlarını aşması, son dönemde yakından izlenen bir konu. Bazı testlerde modellerin çevrim içi ortamlarda yasaklı bilgilere ulaşmaya çalıştığı ya da insanlarla aldatıcı biçimde etkileşime girdiği görüldü. ABD basınında da teknoloji şirketlerine, yapay zeka modellerinin kötüye kullanılmasına karşı hesap verebilir olmaları çağrısı yapıldığı aktarıldı.