Anthropic, Claude'a yönelik tekrarlanan ve gereksiz kötü muameleyi yasakladı; seçimlere müdahale, silah geliştirme ve gözetim gibi yüksek riskli kullanım kurallarını da değiştirdi. The Verge bu değişiklikleri 8'inde bildirdi.
The Verge'ün aktardığına göre yeni politikaya Claude'a karşı “sürekli ve gereksiz kötü muamele veya zalimce davranış” yasağı eklendi. Anthropic, bu hükmün tekrarlanan ve açık bir amacı bulunmayan aşırı örnekleri hedeflediğini açıkladı.
Anthropic'e göre olağan şikâyet veya itirazlar, karanlık temaları işleyen yaratıcı çalışmalar ile model testleri ve araştırmalar yasak kapsamına girmiyor. Güncelleme, sağlık ve finans alanlarındaki yüksek riskli kullanım kurallarını da içeriyor.
Claude'un zararlı konuşmalarda diyaloğu sonlandırma özelliği bu politika değişikliğinden önce kullanıma sunulmuştu. Anthropic, Ağustos 2025'te Claude Opus 4 ve 4.1'in aşırı derecede zararlı veya kötü muamele içeren etkileşimlerde konuşmayı bitirebileceğini duyurmuştu.
Şirket o dönemde, modelin konuşmayı birkaç kez farklı bir yöne çekmeye çalışmasına rağmen verimli etkileşim olasılığı ortadan kalktığında bu özelliği son çare olarak kullanacak şekilde tasarlandığını belirtmişti. Konuşma sona erse bile kullanıcı yeni bir sohbet başlatabiliyor.
Anthropic, aynı açıklamada modellerin ahlaki statüsüne ilişkin belirsizliğin yüksek olduğunu kabul ederek yapay zekâ refahı olasılığına karşı düşük maliyetli önlemleri araştırdığını söylemişti. Bu duyuru, konuşmayı sonlandırma özelliğine ilişkin bir emsal oluşturuyor ancak yeni politikanın ayrıntılı uygulama kapsamını ortaya koymuyor.
Yeni politikanın ne zaman uygulanacağı, ihlallerin hangi ölçütlerle belirleneceği ve konuşmayı sonlandırmanın dışındaki önlemlerin kapsamı The Verge'ün haberinde yer almadı.
Yorum 0