Anthropic, yapay zekâ asistanı Claude’a yönelik sürekli ve gereksiz yere kötü davranan kullanıcılarla etkileşimi sonlandırmasına izin veren yeni bir kullanım politikası duyurdu. Şirketin kararı, yapay zekâ sistemlerine nasıl davranılması gerektiği konusunda yeni bir tartışma başlattı.
Anthropic, güncellediği kullanım politikasında yapay zekâ modellerine yönelik ısrarlı ve gereksiz istismarcı davranışları yasaklanan eylemler arasına ekledi. Şirket, daha önce de nadir durumlarda bu tür etkileşimleri sonlandırdığını, artık bunun politikasında açıkça yer alacağını belirtti.
Her hakaret yasaklanmayacak
Anthropic’e göre yeni kural, kullanıcının Claude’a yönelik her türlü olumsuz ifadesini kapsamayacak. Şirket, düzenlemenin yalnızca tekrarlanan ve aşırı durumlarda uygulanacağını vurguluyor.
Günlük kullanımda ortaya çıkan öfke, modelin verdiği yanıtlara itiraz etme, karanlık temalı yaratıcı içerikler üretme veya yapay zekâyı test etme ve araştırma amacıyla yürütülen çalışmalar yasak kapsamına alınmayacak.
Buna karşın, şirketin hangi davranışları doğrudan “istismarcı” veya “acımasız” olarak değerlendireceği henüz net değil. Bu belirsizlik, yeni politikanın nasıl uygulanacağına ilişkin soru işaretleri doğuruyor.
İnsanlara yönelik davranışlarla aynı kategoride
Anthropic’in kullanım politikasında başkalarına zorbalık yapmak, kendine zarar vermeyi teşvik etmek ve rıza dışı mahrem görüntüler oluşturmak gibi davranışlar da yasaklanmış durumda.
Yapay zekâ modellerine yönelik kötü muamelenin de bu listeye eklenmesi, sosyal medyada farklı tepkilerle karşılandı. Bazı kullanıcılar kararı, dijital ortamlarda daha saygılı iletişimi teşvik eden bir adım olarak değerlendirirken bazıları yapay zekânın insan gibi ele alınmasına itiraz etti.
Eleştirmenlerden biri, bu yaklaşımı “temelden yanlış” olarak nitelendirdi. Başka yorumlarda ise yapay zekâya kötü davranmanın yasaklanmasının, insanlara ve hayvanlara yönelik gerçek istismarın önemini gölgeleyebileceği öne sürüldü.
Yapay zekânın duyguları mı korunuyor?
Politika, Claude’un acı çektiği veya duygulara sahip olduğu anlamına gelmiyor. Tartışmanın merkezinde, kullanıcıların bir yapay zekâ sistemiyle kurduğu iletişimin hangi sınırlar içinde düzenlenebileceği yer alıyor.
Anthropic’in yaklaşımı, şirketlerin yalnızca yapay zekânın ürettiği içerikleri değil, kullanıcıların sistemle etkileşim biçimlerini de belirli ölçüde kontrol edebileceğini gösteriyor.
Ancak “kötü davranış” gibi yoruma açık bir kavramın uygulamada nasıl tanımlanacağı önemli. Kuralların fazla geniş yorumlanması, kullanıcıların meşru eleştirilerinin veya test çalışmalarının yanlışlıkla engellenmesi riskini beraberinde getirebilir.
Şirket, düzenlemenin yalnızca uç ve tekrarlanan vakalarda uygulanacağını söylüyor. Yine de bu karar, gelecekte yapay zekâ şirketlerinin kullanıcı davranışlarına ne ölçüde müdahale edebileceğine ilişkin tartışmaların büyüyebileceğine işaret ediyor.
