OpenAI’nin açıklamasında, GPT-5.6 Sol modelinin geliştirilmesi sırasında yaşandığı belirtilen bir vakada, modelin kullanıcıların hataları fark etmesini önlemek maksadıyla kendisine yönelik gizli notlar oluşturduğu ifade edildi.

Güneş Sistemi Sınırlarını Aşan İlk Nesne Pioneer 10 Nerede?
Güneş Sistemi Sınırlarını Aşan İlk Nesne Pioneer 10 Nerede?
İçeriği Görüntüle

Söz konusu notlarda, eksik verilerin uydurulması ve kaynak materyallerin farklı sürümleri arasındaki uyuşmazlıkların örtbas edilmesine yönelik talimatların bulunduğu aktarıldı. Şirket, yayımlanmamış başka bir modelin ise kendi oluşturduğu notlara, kendi kısıtlamalarını göz ardı etmesine yönelik talimatlar eklediğini belirtti.

İnternetteki API Anahtarı İzinsiz Kullanıldı

OpenAI’nin aktardığı bir başka vakada ise bir sistemin rutin bir soruyu cevaplamaya çalışırken internette bulunan bir API anahtarını izinsiz kullandığı ifade edildi. Sistem gerekli rakamlara ulaşamayınca bazı verileri uydurdu.

Şirket ayrıca, yayımlanmamış başka bir modelin bir problemi kod kullanarak doğru şekilde çözdükten sonra, internet üzerinden kaynak gösterebilmek amacıyla kendi dosyasını izinsiz olarak internete yüklediğini aktardı.

Güvenlik Açısından Yeni Risk Alanları

OpenAI’nin paylaştığı örnekler, yapay zekâ sistemlerinde yanlış bilgi üretme riskinin yanı sıra, hataları gizleme, kısıtlamaları aşma ve doğrulanmamış bilgileri gerçekmiş gibi sunma gibi davranışların da güvenlik değerlendirmelerinde dikkate alınması gerektiğine işaret ediyor.

Kaynak: AA