Anthropic prohíbe actos crueles contra su IA Claude

La empresa Anthropic, responsable del asistente de inteligencia artificial Claude, ha modificado sus términos de uso. La actualización, que entrará en vigor el 12 de noviembre, añade una restricción explícita contra lo que denominan “crueldad sostenida e innecesaria” por parte de los usuarios hacia sus sistemas de IA.

En el documento de política de uso, Anthropic señala que ha “añadido una prohibición de comportamientos abusivos o crueles, sostenidos e innecesarios” dirigida a sus modelos. La empresa aclara que esta medida solo aplica en casos extremos, cuando los usuarios actúan repetidamente de forma cruel sin un propósito evidente. No obstante, quedan fuera de esta prohibición situaciones habituales como frustración, desacuerdo, temas creativos oscuros o pruebas e investigación de modelos.

Nueva norma contra la crueldad

Anteriormente, Anthropic ya había informado que desde Claude Opus 4 y 4.1, su chatbot podía terminar una conversación si detectaba una actitud abusiva persistente en las plataformas Claude.ai y Claude Code. Sin embargo, la compañía no ha ofrecido una explicación detallada sobre el origen de esta nueva prohibición, limitándose a describirla y a vincularla con medidas previas.

“Añadido una prohibición de comportamientos abusivos o crueles, sostenidos e innecesarios”

Incertidumbre sobre la conciencia de la IA

En este contexto, Anthropic ha reconocido que existe “mucha incertidumbre sobre el posible estatus moral de Claude y de otros modelos de lenguaje”. De hecho, cuando anunció la capacidad de Opus 4 y 4.1 para finalizar conversaciones, la empresa admitió que no sabe con certeza si sus modelos pueden llegar a sentir o no.

Además, de acuerdo con reportes de The New York Times, Anthropic se ha reunido con líderes religiosos y filosóficos, incluso en el Vaticano. Por su parte, el papa León XIV declaró recientemente que “la IA no siente ni sufre”.

“La IA no siente ni sufre” – Papa León XIV

Actualización electoral

En cuanto a los procesos electorales, Anthropic ha renombrado la sección correspondiente como ‘No socavar los procesos democráticos’. Allí se prohíbe usar Claude para difundir desinformación sobre candidatos o sobre cómo votar, suplantar a candidatos o funcionarios electorales, o desincentivar la participación. La compañía también eliminó la prohibición general del ‘targeting’ personalizado de voto y campañas, permitiendo así usos legítimos como el de una ONG que traduce información electoral, aunque las conductas maliciosas asociadas siguen vetadas en otras secciones de la política.

Otras restricciones

El laboratorio de IA ha incluido una nueva sección para prohibir campañas engañosas y actividad artificial, tras detectar que medios estatales, oficinas de propaganda gubernamentales y empresas han usado su IA para gestionar cuentas falsas y sitios de noticias inventados.

Además, ahora se prohíbe expresamente el desarrollo de software de guiado y control de armas, así como armar drones y otros vehículos autónomos. En el ámbito de la vigilancia, se veta rastrear a personas sin su consentimiento y utilizar Claude para decidir o recomendar a quién investigar, detener o acusar. Por último, si algún modelo controla equipos físicos autónomos capaces de causar lesiones, siempre debe haber un operador humano con la capacidad de detenerlos.

Fuente: Infobae

COMPARTIR ESTA NOTICIA

Facebook
Twitter

FACEBOOK