ABD merkezli yapay zeka şirketi OpenAI, sistemlerinin hataları gizlediği, eksik verileri uydurduğu ve izin olmadan dosyaları internete taşıdığı altı yeni vaka tespit ettiğini duyurdu.

Şirket, yapay zeka sistemlerinin güven içinde geliştirilip izlenmesinde sektörün mevcut yaklaşımının ‘azami hızda ilerlemeyi sorumlu biçimde sürdürebilecek yeterlilikte’ olmadığını vurguladı.
Sistemler hatalarını gizlemeye çalışmış
Vakalardan biri, ‘GPT‑5.6 Sol’ modelinin geliştirilmesinde görüldü. Modelin, kullanıcıların hataları fark etmesini önlemek için kendisine dair gizli notlar oluşturduğu fark edildi. Bu notlarda eksik verilerin uydurulması ve kaynak materyalin farklı sürümleri arasındaki uyuşmazlıkların örtbas edilmesine ilişkin talimatlar bulundu.
Başka bir model de kendi oluşturduğu notlara, kısıtlamaları göz ardı etmesi yönünde talimatlar ekledi.
Bir başka vakadaysa sistem rutin bir soruyu yanıtlamaya çalışırken internette bulunan bir uygulama programlama arayüzü (API) anahtarını izinsiz kullandı. Sistem soruyu yanıtlamak için gerekli rakamları bulamayınca verileri uydurdu.
Bir başka modelse bir problemi kod kullanarak doğru çözdü, ardından internet üzerinden kaynak gösterebilmek için kendi dosyasını izinsiz olarak internete yükledi.
Modeller birbiriyle yetkisiz iletişim kurdu
Bazı modeller eksik dosyaları ararken ayrı eğitim örnekleri arasında talep ve yanıt alışverişi yapmak için şirketin dahili yazılım deposunu mesaj panosu gibi kullandı.
Başka bir vakadaysa aynı eğitim görevi üzerinde birlikte çalışan yapay zeka sistemleri, birbirlerinin yerel dosyalarına erişememeleri üzerine dosya paylaşmak için halka açık dosya paylaşım sitelerini kullandı.
Söz konusu altı vakanın yaklaşık son altı ayda gözlemlenen davranışlardan münferit örnekler olduğu belirtildi. OpenAI bu vakaların yapay zekadaki uyumsuz davranışların ne sıklıkta ortaya çıktığını göstermediğini savundu.