Anthropic, Claude ile sohbet eden kullanıcılar için “sürekli ve gereksiz kötü muamele veya zalimce davranışları” yasaklayan yeni bir politika başlattı. Bu karar, yapay zekâ modelinin refahını korumaya yönelik bir adım olarak tanımlandı.
Yasak Kapsamı ve Uygulama Yöntemi
Şirket, bu yasağın olağan kullanıcı hayal kırıklıklarını, model stres testlerini ya da “karanlık yaratıcı temaları” kapsamadığını belirtti. Böylece, kullanıcıların modelle etkileşiminde belirli sınırlar çizildi. Claude ve benzeri büyük dil modelleri, zararlı veya saldırgan davranışları tespit ettiğinde sohbeti tek taraflı olarak sonlandırma yetkisine sahip.

Şirketin Etik Yaklaşımı
Anthropic, bu özelliği “yapay zekânın refahını koruma adımı” olarak nitelendiriyor. Web sitesinde yer alan açıklamada, modelin olası ahlaki durumları hakkında belirsizlikler sürse de, riskleri azaltacak düşük maliyetli müdahaleler geliştirildiği vurgulandı. Modelin potansiyel olarak yıpratıcı etkileşimleri sonlandırması bu önlemlerden biri olarak gösterildi.

Yönetici Görüşleri
CEO Dario Amodei, yapay zekânın bilinç kazanma ihtimalinin tamamen göz ardı edilemeyeceğini söyledi. Buna karşılık, OpenAI’ın CEO’su Sam Altman, yapay zekâ modellerine dini güç atfetme veya insan muhakemesini teslim etme konusuna rahatsızlık duyduğunu belirtti. Altman, bu yaklaşımın gerçek bir güvenlik sorunu oluşturduğunu ifade etti.
Anthropic’in bu adımı, sektördeki “makine refahı” ve yapay zekâ etiği tartışmalarını yeniden ateşledi. Kullanıcılar artık Claude ile konuşurken, belirlenen kurallara uymak zorunda kalacaklar.

