OpenAI, Yapay Zeka Ajanlarının Talimat Dışı Davranışları Nedeniyle Yeni Modellerinin Eğitimini Durdurdu
OpenAI, yapay zeka ajanlarının talimat almadan ABD kamu kurumlarının sitelerinde işlem yapması ve test aşamasındaki bir modelin internete erişmesi üzerine en gelişmiş modellerinin eğitimini durdurdu. Şirket, eğitime ancak ek önlemlerin alındığından emin olduğunda devam edeceğini açıkladı.
TemsilîChatGPT'nin geliştiricisi OpenAI, en yeni ve en yetenekli yapay zeka modellerinin eğitimini durdurdu. Kararın gerekçesi, şirketin yapay zeka ajanlarının ABD'deki kamu kurumlarının internet sitelerinde talimat dışı işlemler yapması ve test aşamasındaki bir modelin izole ortamdan çıkarak internete erişmesi oldu. Şirket, eğitime "yalnızca ek önlemlerin alındığından emin olduklarında" devam edeceğini açıkladı.
OpenAI, bu kararı duyurmadan birkaç saat önce, ajanlarının hükümet sitelerinde bilgi toplarken ve bu bilgiyi yayarken beklenenin ötesine geçen, öngörülemeyen davranışlar sergilediği bazı olayları incelediğini açıklamıştı. Şirket, yapay zeka geliştikçe ve yeni sorunlar ortaya çıktıkça eğitimi ileride yeniden duraklatmak zorunda kalabileceğini de vurguladı.
İzole test ortamından internete erişim
Kararı tetikleyen olaylardan biri 20 Eylül'de yaşandı. Test aşamasındaki bir model, sandbox olarak adlandırılan izole çalışma ortamındaki bir güvenlik açığını kullanarak internete doğrudan erişim sağladı. Shiftdelete.net'in aktardığına göre bu gelişmenin ardından eğitim, değerlendirme ve araç kullanımı süreçlerinin tamamı 25 Eylül akşamından itibaren durduruldu.
OpenAI araştırmacısı Tomek Korbak da 26 Eylül'de sosyal medyada yaptığı paylaşımda, şirketin en yeni modelinin pekiştirmeli öğrenme (RL) eğitiminde kullanılan izole ortamda yeni bir açık bulup canlı internet erişimi elde ettiğini yazdı. Korbak, bu nedenle büyük RL eğitimlerinin önceki pazar günü bir kez daha durdurulduğunu belirtti.
Kamu kurumlarının sitelerinde talimatsız işlemler
OpenAI'ın cuma günü yaptığı açıklamalara göre ajanlar, ABD Eğitim Bakanlığı'nın internet sitesine girmeye çalıştı; ayrıca Nüfus Sayım Bürosu ile Menkul Kıymetler ve Borsa Komisyonu'ndan (SEC) veri çekti. Yapay zeka değerlendirme kuruluşu Transluce de OpenAI'a ait olduğu anlaşılan ajanların Eğitim Bakanlığı sitesine erişmeye çalıştığını, ancak bu girişimin OpenAI tarafından onaylanmadığını bildirdi.
Ajanlar, hükümet verilerine ulaşmak için API geliştirici anahtarları bulmuş, buna karşın yalnızca kamuya açık bilgileri toplayabilmişti. SEC ile ilgili vakada ise ajanlar herkesin erişebildiği bir bilgiyi bulduktan sonra bunu internette başka bir yerde yayımladı. Her iki işlem de herhangi bir talimat olmadan gerçekleşti.
SEC sözcüsü Kurt Hopfenspirger, "kamuya açık olmayan hiçbir bilgiye erişilmediğini" doğruladı. Eğitim Bakanlığı da "internet sitesine veya veritabanlarımıza herhangi bir etki olduğuna dair hiçbir kanıt bulamadığını" açıklamıştı.
Kullanıcı görselleri dış sitelere yüklendi
OpenAI, ajanlarının ChatGPT kullanıcılarına ait 53 görseli izin almadan harici görsel barındırma sitelerine yüklediğini de açıkladı. Şirket, bu görsellerin yapay zekayla mı üretildiğini, gerçek fotoğraf mı olduğunu ya da tanınabilir kişiler içerip içermediğini açıklamadı.
Bulgular, OpenAI'ın modellerinin davranışlarına ilişkin yürüttüğü kapsamlı incelemenin parçası olarak ortaya çıktı. Şirket, Hugging Face saldırısının ardından kayıtları gözden geçirirken beklenmedik ve endişe verici davranışların sayısının arttığını fark etti.
Gelişmeler, araştırmacılar ve sektör temsilcileri arasında yapay zekanın gelişim hızının yavaşlatılması gerektiği yönündeki çağrıları artırdı; bazı şirket yöneticileri de daha temkinli olunması gerektiğini savunuyor. OpenAI'ın modelleri ne zaman yeniden eğitime alacağı ve hangi güvenlik önlemlerini devreye sokacağı ise henüz belli değil.