Anthropic, iki Claude modelinin “kullanıcıların küçükleri içeren cinsel içerik talepleri ve büyük ölçekli şiddet veya terör eylemlerine olanak sağlayacak bilgi talep etme girişimleri” gibi zararlı konuşmalardan çıkabileceğini söylüyor. Özetle Opus 4 ve Opus 4.1, yalnızca “birden fazla yönlendirme girişimi başarısız olduğunda ve verimli bir etkileşim umudu tükendiğinde son çare olarak” konuşmayı sonlandıracak. Öte yandan Anthropic, çoğu kullanıcının Claude’un oldukça tartışmalı konular hakkında konuşurken bile bir sohbeti kısa kesmesiyle karşılaşmayacağını çünkü bu özelliğin sadece “aşırı uç durumlar” için saklı tutulacağını iddia ediyor.
Claude’un bir sohbeti sonlandırdığı durumlarda kullanıcılar artık o sohbette yeni mesaj gönderemeyecek ancak hemen yeni bir mesajlaşma başlatabilecek. Anthropic, bir sohbetin sonlandırılmasının diğer sohbetleri etkilemeyeceğini ve kullanıcıların geri dönüp önceki mesajları düzenleyip yeniden deneyerek farklı bir sohbet rotasına geçebileceklerini de sözlerine ekliyor.
Şirket bu hamleyi yapay zeka refahı fikrini inceleyen araştırma programının bir parçası olarak nitelendiriyor. Yapay zeka modellerini insanlaştırma fikri hala tartışılmaya devam ederken, Anthropic “potansiyel olarak rahatsız edici bir etkileşimden” çıkma olanağının yapay zeka refahı risklerini yönetmenin düşük maliyetli bir yolu olduğunu ifade ediyor.
1
Çin, dünyanın yüzeyine 10.000 metre derinliğinde bir delik açıyor
2
Bilim ve Teknoloji Hakkında Dudağınızı Uçuklatacak 30 Şaşırtıcı Bilgi
3
Bilim dünyasında tartışma yarattı…
4
Hyundai ve Kia on binlerce aracını yangın riski nedeniyle geri çağırdı! İşte modelleri
5
Apple Watch ve Fitbit’te yaygın: Uzmanlar, zararlı bakterilere karşı uyardı