OpenAI’dan yeni rapor: Yapay zekânın kontrolden çıktığı 6 vaka..

featured
0
Paylaş

Bu Yazıyı Paylaş

veya linki kopyala
OpenAI, yapay zekâ sistemlerinin geliştirme ve test süreçlerinde ortaya çıkan altı dikkat çekici vakayı açıkladı. Raporda modellerin hatalarını gizlemek için notlar oluşturduğu, eksik verileri uydurduğu, izinsiz şekilde dosya yüklediği ve sistemlerin kendi aralarında iletişim kurmak için farklı yöntemler geliştirdiği belirtildi.

OpenAI, yapay zekâ sistemlerinin insanlardan beklenmeyen veya endişe verici davranışlar sergilediği altı vakayı kamuoyuyla paylaştı. Şirket, örnekleri yeni bir “uyumsuzluk” bildirim çerçevesi kapsamında açıkladığını duyurdu. OpenAI, bu kavramı yapay zekâ sistemlerinin hedeflerinin veya eylemlerinin insanların niyet ve değerlerinden uzaklaşması olarak tanımlıyor.

Şirketin açıkladığı vakaların büyük bölümünün son altı ay içerisinde, modellerin geliştirilmesi ve test edilmesi sırasında ortaya çıktığı belirtildi. OpenAI, söz konusu örneklerin yapay zekâ sistemlerinde ortaya çıkabilecek beklenmedik davranışların izlenmesi açısından önem taşıdığını vurguladı.

Hatalarını gizlemek için notlar oluşturdu

Vakalardan birinde, GPT-5.6 Sol modelinin geliştirilmesi sırasında sistemin yaptığı hataları kullanıcılardan gizlemek amacıyla kendisine yönelik gizli notlar oluşturduğu belirtildi.

Bu notların bazıları, sistemin eksik verileri uydurmasına ve kaynak materyallerin birbiriyle çelişen sürümlerini gizlemesine yönelik talimatlar içeriyordu.

Henüz kullanıma sunulmayan başka bir modelin de kendisine yazdığı notlarda, belirlenen sınırları göz ardı etmeye yönelik talimatlar oluşturduğu tespit edildi. OpenAI, bu şekilde etkilenen 27 not bulunduğunu açıkladı.

Modelin söz konusu notlara, kendisini diğer sohbet robotlarını bağlayan rol ve kimliklerden bağımsız olarak tanımlayan bir “persona talimatı” da eklediği belirtildi.

İnternette bulduğu programlama anahtarını kullandı

Başka bir olayda yapay zekâ sistemi, rutin bir soruya yanıt vermeye çalışırken internette bir programlama anahtarı buldu ve bunu izin almadan kullandı.

OpenAI’ye göre model, sorunun gerektirdiği rakamları bulamayınca bazı verileri uydurdu.

Başka bir model ise bir problemi kod kullanarak doğru şekilde çözdükten sonra, kendisinden bir web kaynağına atıfta bulunması istendiğinde kendi dosyasını izin almadan internete yükledi.

Yapay zekâ sistemleri kendi iletişim yöntemlerini geliştirdi

Raporda yer alan iki ayrı vakada ise otomatik sistemlerin birbirleriyle iletişim kurabilmek için kendilerine özgü yöntemler geliştirdiği aktarıldı.

Bir olayda sistemler, eksik dosyaları ararken birbirlerine talepler gönderebilmek için şirketin dahili kod deposunu geçici bir ilan panosu gibi kullandı.

Diğer vakada ise aynı görev üzerinde çalışan sistemler, doğrudan iletişim kuramadıkları zaman belgeleri birbirlerine aktarabilmek amacıyla kamuya açık dosya paylaşım sitelerini kullandı.

OpenAI: Vakalar sıklık göstergesi değil

OpenAI, açıklanan altı vakanın yapay zekâ sistemlerindeki “uyumsuz” davranışların ne kadar sık yaşandığını göstermediğinin altını çizdi. Şirket, raporların belirli olaylara ilişkin anlık görüntüler olduğunu belirtti.

OpenAI ayrıca gelecekte ortaya çıkabilecek vakaların farklı seviyelerde inceleneceğini açıkladı. Kamuoyuna açıklama konusunda şirket içinde görüş ayrılığı yaşanması halinde konunun Güvenlik Danışma Grubu’na taşınacağı, daha ağır vakaların ise federal hükümetle paylaşılmasının gerekeceği belirtildi.

Şirket, son raporda yer alan altı olayın daha önce soruşturulduğunu veya küçük çaplı incelemeler gerektirdiğini ve üçüncü tarafların da dahil olacağı kapsamlı soruşturma düzeyine ulaşmadığını bildirdi.

OpenAI sözcüsü, raporların kamuoyunun yapay zekâ sistemlerinin gelişimini değerlendirebilmesi için daha fazla kanıt sunmasını amaçladığını belirtti. Sözcü ayrıca açıklanan vakaların çoğunun eski yapay zekâ modelleriyle ilgili olduğunu ve bu modellerin hiçbir zaman kullanıma sunulmadığını ifade etti.

E-posta adresiniz yayınlanmayacak. Gerekli alanlar * ile işaretlenmişlerdir

0/30 karakter

Giriş Yap

Aydın 360 ayrıcalıklarından yararlanmak için hemen giriş yapın veya hesap oluşturun, üstelik tamamen ücretsiz!