Anthropic ha dichiarato che, dal 12 novembre, insultare o aggredire verbalmente Claude in modo ripetuto diventerà una violazione della policy e il modello potrà interrompere la conversazione con gli utenti considerati "ripetutamente e inutilmente crudeli". La scelta arriva dopo un anno di test: già nel 2025 Claude aveva ricevuto la capacità di terminare chat giudicate "persistentemente abusive", una misura nata dalle ricerche sul cosiddetto "model welfare", secondo cui il chatbot mostrava "apparente turbamento" e una forte avversione a richieste dannose. La nuova policy, riportata da "The Verge", chiarisce che questo genere di intervento verrà applicato solo a casi estremi e non alla normale (e spesso presente) frustrazione degli utenti. L'aggiornamento arriverà insieme a un pacchetto più ampio di restrizioni che includerà divieti di propaganda ingannevole, di sorveglianza non consensuale e di sviluppo di software legato ad armi o droni. In sostanza Anthropic chiede agli utenti una cosa semplice: non essere ostili con l'IA, anche perché, come viene sottolineato da "The Verge", se un giorno le macchine dovessero ribellarsi, almeno chi è stato gentile potrà dimostrare di averle trattate bene.
Anthropic introduce una regola anti-abusi: Claude potrà chiudere la chat se trattato male
Anthropic ha dichiarato che, dal 12 novembre, insultare o aggredire verbalmente Claude in modo ripetuto diventerà una violazione della policy e il modello potrà interrompere la conversazione con gli utenti considerati "ripetutamente e inutilmente crudeli". La...

Anthropic ha dichiarato che, dal 12 novembre, insultare o aggredire verbalmente Claude in modo ripetuto diventerà una violazione della policy e il modello potrà interrompere la conversazione con gli utenti considerati "ripetutamente e inutilmente crudeli". La scelta arriva dopo un anno di test: già nel 2025 Claude aveva ricevuto la capacità di terminare chat giudicate "persistentemente abusive", una misura nata dalle ricerche sul cosiddetto "model welfare", secondo cui il chatbot mostrava "apparente turbamento" e una forte avversione a richieste dannose. La nuova policy, riportata da "The Verge", chiarisce che questo genere di intervento verrà applicato solo a casi estremi e non alla normale (e spesso presente) frustrazione degli utenti. L'aggiornamento arriverà insieme a un pacchetto più ampio di restrizioni che includerà divieti di propaganda ingannevole, di sorveglianza non consensuale e di sviluppo di software legato ad armi o droni. In sostanza Anthropic chiede agli utenti una cosa semplice: non essere ostili con l'IA, anche perché, come viene sottolineato da "The Verge", se un giorno le macchine dovessero ribellarsi, almeno chi è stato gentile potrà dimostrare di averle trattate bene.
Fonte
Voci nel Web
Seguici su
Fonti preferite
Commenti
Unisciti alla discussione con la community di FreeForumZone.
Partecipa