Anthropic pide que trates bien a Claude: su nueva política prohíbe ser «innecesariamente cruel» con la inteligencia artificial
Anthropic ha actualizado su política de uso después de más de un año y ha añadido una prohibición muy llamativa: «Mostrar un comportamiento abusivo o cruel, continuado e innecesario hacia nuestros modelos».
Es decir, cualquier usuario que maltrate a Claude podrá ser suspendido.La medida pretende frenar las situaciones extremas donde algunos usuarios atacan o degradan al asistente digital sin ningún propósito constructivo.
De hecho, esta indicación responde a los estudios formales de Anthropic sobre el llamado «bienestar del modelo».Además de esta llamativa norma, la revisión del reglamento también ha endurecido sus pautas frente a riesgos de gran alcance social, como la desinformación en campañas electorales, la fabricación de armamento o la vigilancia masiva sin consentimiento durante el uso de su inteligencia artificial.Chat cerrado de forma unilateralLa norma «está pensada para aplicarse únicamente en casos extremos, donde los usuarios actúan repetidamente con crueldad hacia nuestros modelos, sin ningún propósito perceptible», explicó Anthropic a ' The Verge '.La empresa ha querido tranquilizar al público para evitar malentendidos sobre esta apreciación en su política de uso, pues no afectará a la frustración habitual, debates intensos o la experimentación creativa de los usuarios mientras conversan con la IA.La sanción prevista frente a estos excesos consiste en que el propio Claude interrumpa la interacción de forma unilateral.
Esta capacidad comenzó a verse en agosto ante interlocutores dañinos, por lo que continuará siendo el «mecanismo de aplicación principal» del sistema.¿Puede sufrir la IA?Ante esta protección de la IA, surgen dudas sobre la posibilidad de que los modelos de lenguaje generen sentimientos.
5News agregó este resumen a partir del feed público del medio. La nota completa, con todo el contexto, está en www.abc.es — el contenido pertenece a ABC Tecnología.