AI

Anthropic: Kullanıcılar Claude'ya gereksiz şiddet uygulayamaz

Yavuz Günay·10 Eki 2026·2 dk okuma·1

MacRumors tarafından “Anthropic: Kullanıcılar Claude'ya gereksiz şiddet uygulayamaz” başlığıyla aktarıldığı kadarıyla,

Anthropic bugün, kullanıcıların Claude'a sürekli ve gereksiz şekilde saldırgan veya zalimce davranmasını yasaklayan bir kullanım politikası güncellemesini yayımladı (The Verge).

Şirket, istismarla ilgili kuralın yalnızca aşırı durumlara uygulanacağını vurguluyor. Kural; kullanıcıların modellere "anlamlı bir amaç güdmeden defalarca zalimce davranması" durumunda devreye giriyor. Kullanıcıların sıradan yaşadığı hayal kırıklığı, muhalefet, karanlık yaratıcı temalar ile model testi ve araştırma faaliyetleri kuralın kapsamı dışında tutuluyor.

Claude modelleri, sürekli saldırgan davranan kullanıcılarla yürütülen bu tür görüşmeleri sonlandırabilme özelliğine sahip. Görüşmeyi sonlandırma, uygulamanın ana aracı olarak kullanılmaya devam edecek. Claude bir görüşmeyi sonlandırdığında, söz konusu görüşmede yeni mesaj alışverişi yapılamıyor; ancak diğer görüşmeler bundan etkilenmiyor.

Anthropic, Ağustos 2025'te yapay zekâ refahı üzerine yürüttüğü araştırmalar kapsamında Claude'a bir görüşmeyi sonlandırma seçeneği tanımış. Dönemde şirket, Claude'nin ahlaki statüye sahip olup olmadığı konusunda kesin bir kanaate sahip olmadığını; ancak Claude'ya yönelik riskleri düşük maliyetli yöntemlerle azaltmak istediğini açıklamıştı. Yapılan çalışmalarda Claude Opus 4 modelinin "sağlam ve tutarlı zarardan kaçınma eğilimi" gösterdiği tespit edildi. Model, tehlikeli görevlerle uğraşmaya karşı çıkma eğiliminde, kötüye kullanmaya yönelik görüşmeler yapan kullanıcılarla konuşurken rahatsızlık belirtileri sergileme ve izin verildiğinde zarar verici konuşmaları sonlandırma yönünde davranışlar gösterdi.

Anthropic, ilgili hükümleri tek çatı altında toplamak için kullanım politikasında yeniden düzenleme gerçekleştirdi. Bu çerçevede bir dizi başka kural da değişti:

Değişikliklerin çoğu, şirketin mevcut kurallarını netleştirme niteliğinde ve izlenmekte olan kötüye kullanım biçimlerine yönelik. Anthropic, devlet medya kuruluşları, hükümet propaganda birimleri ve ticari firmaların sahte hesap ağları ile kurgulanmış haber siteleri oluşturup yöneltmek için Claude'u kullandığını tespit ettiğini belirtiyor. Bu tespit, yeni yanıltıcı kampanyalar bölümünün dayanağını oluşturdu.

Yeni politika 12 Kasım'da yürürlüğe giriyor. Değişikliklere ilişkin tam ayrıntılar ve güncel kullanım politikasının tam metni, Anthropic'in resmi internet sitesinde yer alıyor.

Beğenmek veya yorum yazmak için tam sürümü kullanın. Tam sürüm