Xataka – Anthropic ya incluye «cláusulas de abuso contra Claude» en sus términos de uso para proteger a sus modelos de IA

Anthropic ya incluye "cláusulas de abuso contra Claude" en sus términos de uso para proteger a sus modelos de IA

El bienestar de Claude importa. Al menos, le importa a Anthropic. Dario Amodei, el máximo responsable de este laboratorio, ha expresado en varias ocasiones su preocupación por los abusos a los que pueden ser sometidos sus modelos de inteligencia artificial (IA) por parte de los usuarios. Y va a tomar cartas en el asunto. A partir del próximo 12 de noviembre, Anthropic prohibirá que los usuarios mantengan un comportamiento abusivo o cruel hacia Claude de forma prolongada e injustificada. El modelo podrá poner fin a esas conversaciones.

Anthropic presentó la actualización de sus términos de uso ayer, por lo que los usuarios tenemos poco más de un mes para interiorizar esta restricción. Sea como sea, hay una idea derivada de esta decisión sobre la que merece la pena reflexionar. Hasta ahora ningún laboratorio de IA o investigador independiente ha demostrado que los modelos de frontera puedan sufrir. Por supuesto, Anthropic no ha defendido en ningún momento que Claude haya adquirido consciencia. Sin embargo, esta medida es muy real.

Habría sido muy interesante que los términos de uso de Claude explicasen con claridad por qué este laboratorio ha tomado esta decisión. Por el momento no conocemos cuál es su motivación más allá de la perspectiva ética, pero no tenemos otra opción que acatarla. De lo contrario, seremos penalizados. De hecho, los modelos de IA de Anthropic tienen la capacidad de abandonar cualquier conversación si «consideran» que el usuario está manteniendo un comportamiento abusivo de una forma persistente tanto en Claude.ai como en Claude Code.

En contra de la propaganda y la manipulación

En sus términos de uso, Anthropic aclara que su nueva política ha sido ideada para ser aplicada únicamente en casos extremos, en los que los usuarios se comportan repetidamente de forma cruel con los modelos de IA sin ningún propósito discernible. No obstante, en teoría los usuarios podemos seguir expresando nuestra frustración y discrepancia con las respuestas que nos entregan los modelos sin miedo a ser sancionados. Incluso, según Anthropic, podemos emitir críticas si están justificadas.

Anthropic se ha dado cuenta de que sus modelos están siendo utilizados en redes de cuentas falsas y operaciones de influencia

Todo esto es bastante críptico. Incluso un poco perturbador. Pero hay algo interesante que nos interesa conocer: Anthropic ha investigado cómo reaccionan sus modelos de IA frente a interacciones de los usuarios que podrían ser perjudiciales para ellos, y ha reconocido que por el momento no sabe si estos comportamientos tienen algún impacto de tipo moral en Claude. Su postura en este escenario consiste en adoptar medidas preventivas de bajo coste si existe la posibilidad de que estos sistemas merezcan algún tipo de consideración moral.

Hay otro punto importante en la actualización de los términos de uso de Claude en el que merece la pena que nos detengamos. Anthropic ha repensado sus normas para prohibir de una manera más contundente las campañas engañosas que utilizan cuentas falsas, publicaciones artificiales o sitios web de noticias con el propósito de ocultar quién está detrás de un mensaje y amplificar su difusión. Al parecer, se ha dado cuenta de que sus modelos están siendo utilizados en redes de cuentas falsas y operaciones de influencia.

Además, los nuevos términos de uso contemplan prohibiciones sobre la manipulación electoral, incluida la difusión de información falsa para engañar a los votantes, hacerse pasar por autoridades electorales o desincentivar la participación. Anthropic asegura que esta actualización de sus normas es necesaria debido a que sus modelos de IA cada vez son más capaces, y este desarrollo de sus prestaciones requiere revisar para qué los estamos utilizando los usuarios y cómo nos relacionamos con ellos.

Imagen | TechCrunch

Más información | Anthropic

En Xataka | China tiene un plan para ganar a EEUU la guerra de la IA. Y DeepSeek es su campeón

–
La noticia

Anthropic ya incluye «cláusulas de abuso contra Claude» en sus términos de uso para proteger a sus modelos de IA

fue publicada originalmente en

Xataka

por

Laura López

.