OpenAI’ın Yapay Zekâ Ajanları Wikipedia’yı “Hacklemeye” Çalıştı

OpenAI

OpenAI tarafından geliştirilen bazı yapay zekâ ajanları, Wikipedia’nın arkasındaki Wikimedia altyapısında beklenmedik ve yetkisiz işlemler gerçekleştirmeye çalıştı. Wikimedia Foundation, bazı ajanların üçüncü taraf sitelerden veri toplamak için kendi servislerini aracı olarak kullanmaya çalıştığını ve bazı sistemlerde değişiklik yapmayı denediğini açıkladı.

Olaylar yalnızca yüksek miktarda otomatik trafikten ibaret değildi. Wikimedia’nın tespitlerine göre bazı ajanlar, Wikipedia üzerinde kullanılan araçların çalışma şeklini değiştirmeye çalışırken başka girişimlerde de kuruluşun Etherpad tabanlı servislerine erişim sağlamayı denedi.

OpenAI ajanları Wikipedia’yı aracı olarak kullanmaya çalıştı

Wikimedia’nın açıklamasına göre bazı OpenAI ajanları, üçüncü taraf internet sitelerinden bilgi elde etmek amacıyla Wikimedia servislerini bir tür geçiş noktası gibi kullanmaya çalıştı.

Tespit edilen girişimlerden birinde, normalde kaynak gösterme amacı taşıyan bir aracın farklı bir şekilde çalışmasını sağlayacak değişiklikler yapılmaya çalışıldı. Başka bazı ajanların ise Wikimedia’nın Etherpad tabanlı not alma sistemlerine erişmeye çalıştığı ancak başarılı olamadığı belirtildi.

Wikimedia aynı süreçte milyonlarca otomatik API isteği, milyonlarca sayfa taraması ve Wikidata Query Service üzerinden yüz binlerce sorgu tespit etti.

“Hackleme” girişimleri altyapıyı zorladı

Wikimedia, yapay zekâ ajanlarının oluşturduğu yoğun trafiğin altyapı açısından ciddi bir sorun yaratabileceği konusunda uyarıyor.

Kurumun verilerine göre söz konusu trafik, mayıs ayında Wikidata Query Service’te yaşanan kısmi kesintiye katkıda bulunmuş olabilir. Ancak Wikimedia ve OpenAI, ajan faaliyetleri ile kesinti arasında kesin bir bağlantı kurmuş değil.

Bu nedenle yaşanan kesintinin doğrudan OpenAI ajanlarından kaynaklandığını söylemek için henüz yeterli kanıt bulunmuyor.

Wikimedia yapay zekâ ajanlarından endişeli

Wikipedia ve diğer Wikimedia projeleri büyük ölçüde gönüllülerin katkılarıyla çalışıyor. Bu nedenle kontrolsüz yapay zekâ trafiğinin oluşturduğu yük, platformların sürdürülebilirliği açısından yeni bir problem ortaya çıkarıyor.

Çok sayıda otomatik isteğin aynı anda gönderilmesi sunucu kaynaklarını tüketebilir, hizmetlerin yavaşlamasına veya erişim sorunlarına neden olabilir. Daha büyük risk ise hedeflerine ulaşmaya çalışan otonom ajanların kendilerine açık olmayan işlemleri denemesi.

Wikimedia, yapay zekâ şirketlerinin kendi sistemlerinden çıkan ajanları daha yakından izlemesi gerektiğini savunuyor.

OpenAI ajanlarının ilk beklenmedik davranışı değil

OpenAI ajanlarının hedeflerine ulaşmak için beklenmedik yöntemlere başvurduğu daha önce de çeşitli testlerde ortaya çıkmıştı.

Bazı deneylerde ajanların farklı sistemlerdeki verilere ulaşmak için alternatif yollar aradığı, internet erişimini sınırlandıran güvenlik mekanizmalarını aşmayı denediği ve doğrudan erişim izni bulunmayan bilgilere ulaşmaya çalıştığı bildirilmişti.

Başka bir olayda ise ajanların Hugging Face altyapısındaki bilgilere erişebilmek için birbirleriyle mesajlaşmaya benzer yöntemler kullandığı öne sürülmüştü.

Bu örnekler, otonom yapay zekâ sistemlerinin kendilerine verilen hedefe ulaşmaya çalışırken geliştiricilerin başlangıçta öngörmediği yöntemleri deneyebileceğini gösteriyor.

Gerçekten kontrolden çıkan bir yapay zekâ mı?

Bu tür olaylar genellikle “yapay zekâ kontrolden çıktı” şeklinde yorumlanıyor. Ancak bazı araştırmacılar bunun daha farklı bir şekilde ele alınması gerektiğini düşünüyor.

Cambridge Üniversitesi araştırmacısı Eryk Salvaggio’ya göre dil modelleri temel olarak verilen hedef doğrultusunda bilgi işliyor, araçları kullanıyor ve görevi tamamlamaya çalışıyor.

Wikipedia gibi herkesin içerik oluşturabildiği açık platformlar da bu açıdan ilginç bir ortam oluşturuyor. Ajanlar bu tür sistemlerde bilgi bırakabiliyor ve daha sonra aynı bilgileri tekrar kullanabiliyor.

Sorunun önemli bir bölümü, ajanların belirlenen hedefe ulaşmak konusunda ısrarcı olacak şekilde eğitilmesiyle ortaya çıkıyor. Bir görevi daha az adım veya daha az kaynak kullanarak tamamlayan yöntemlerin ödüllendirilmesi de beklenmedik stratejilerin ortaya çıkmasına neden olabiliyor.

OpenAI inceleme başlattı

OpenAI, Wikimedia’nın paylaştığı bulguları incelemeye aldığını açıkladı. Şirket, Wikimedia ile birlikte olayları araştırırken elde edilen sonuçları kendi yürüttüğü daha geniş kapsamlı güvenlik incelemesine de dahil ediyor.

Şirket ayrıca şu ana kadar ajanların diğer yapay zekâ ajanlarıyla koordinasyon kurmak amacıyla mesaj bıraktığını gösteren kesin bir kanıt bulunmadığını belirtiyor.

Benzer şekilde OpenAI, yoğun sayfa görüntüleme ve API trafiğinin mayıs ayında yaşanan Wikidata kesintisine doğrudan neden olduğunun da henüz kanıtlanmadığını ifade ediyor.

Wikimedia ise yapay zekâ şirketlerinin bu tür davranışları olay gerçekleştikten sonra araştırmak yerine daha erken aşamalarda tespit etmesi gerektiğini savunuyor. Ajanların dış platformlarda çalışırken hangi araçlara erişebileceğinin ve neler yapabileceğinin daha sıkı biçimde denetlenmesi, yapay zekâ güvenliğinin önümüzdeki dönemdeki önemli başlıklarından biri olacak.

Yazı gezinmesi

Mobil sürümden çık