Anthropic prohíbe tratar con crueldad a Claude: estas son sus nuevas reglas

💻 ¡Ofertón Office! ¡Office 2024 Pro Plus desde 16,66 € por PC! [ Saber más ]

Claude tendrá nuevas reglas de uso a partir del 12 de noviembre de 2026, y una de ellas se sale de lo habitual: Anthropic prohibirá el comportamiento cruel o abusivo extremo, persistente y sin una finalidad reconocible contra sus modelos. La compañía aclara que esto no incluye enfadarse con una respuesta, llevarle la contraria al asistente o ponerlo a prueba.

La actualización, anunciada el 8 de octubre, también modifica el enfoque sobre las campañas electorales y detalla los límites en vigilancia, armas, asesoramiento de alto riesgo y equipos que pueden actuar físicamente por su cuenta. La mayoría de los cambios aclara restricciones que ya existían, aunque hay novedades relevantes tanto para quienes conversan con Claude como para quienes desarrollan productos basados en sus modelos.

Entrada Relacionada

El contexto ayuda a entender el movimiento: según Anthropic, Claude ya realiza trabajos más largos y con mayor autonomía que hace un año. Su informe de amenazas de septiembre de 2026 recoge usos indebidos relacionados con operaciones de influencia, desarrollo de armas y vigilancia, y esas experiencias han servido para concretar las nuevas normas.

 

La nueva regla contra el abuso de Claude tiene excepciones importantes

La novedad más llamativa es la prohibición de tratar a los modelos de forma cruel o abusiva de manera sostenida e innecesaria. Anthropic la presenta como una medida para situaciones extremas: usuarios que repiten ese comportamiento sin que se aprecie un propósito, más allá de mantener el abuso durante la conversación.

Eso no convierte una queja por una respuesta mala en una infracción. La empresa excluye expresamente las manifestaciones habituales de frustración, el desacuerdo y las críticas al modelo, así como los temas creativos oscuros y las actividades de prueba e investigación. La distinción entre protestar y sostener un comportamiento cruel es central para entender el alcance de esta regla.

La medida enlaza con una capacidad que Anthropic ya había incorporado: permitir que Claude termine determinadas conversaciones con usuarios persistentemente abusivos. Esa posibilidad se aplica tanto en Claude.ai como en Claude Code, y la compañía señala que cortar esas interacciones seguirá siendo el principal mecanismo para hacer cumplir esta parte de la política.

Por tanto, el anuncio no describe una sanción automática por utilizar una palabra malsonante ni afirma que el modelo vaya a abandonar cualquier intercambio tenso. El cambio formaliza una prohibición acotada a casos extremos y la conecta con una respuesta que ya existía: que Claude pueda poner fin a una conversación cuando el abuso persiste.

 

Las cuentas falsas y las campañas engañosas pasan a tener un apartado propio

Anthropic ha detectado intentos de utilizar Claude para gestionar redes de cuentas falsas y supuestos medios de comunicación fabricados. Entre los actores que menciona hay medios estatales, oficinas gubernamentales de propaganda y empresas comerciales, por lo que el problema abarca tanto la manipulación política como la comercial.

Esas prácticas ya estaban prohibidas, pero las restricciones aparecían repartidas entre las secciones sobre elecciones, fraude, privacidad y desinformación. La nueva versión las reúne en un apartado específico sobre campañas engañosas y actividad artificial, con el objetivo de que el límite resulte más fácil de identificar.

La prohibición alcanza los intentos de ocultar quién está detrás de un mensaje y la amplificación de contenidos mediante cuentas o publicaciones falsas. También cubre la creación de herramientas e infraestructura para ejecutar operaciones de influencia, de modo que la restricción abarca la preparación técnica de la campaña y su funcionamiento.

El criterio se aplica con independencia de que se intente favorecer una candidatura, promocionar un producto o fabricar una apariencia de apoyo público. Para Anthropic, el elemento relevante es el engaño sobre el origen o la autenticidad de la actividad, algo especialmente importante cuando una IA puede ayudar a producir y coordinar contenido a gran escala.

 

Anthropic retira el veto general a la segmentación electoral personalizada

En materia electoral, la compañía cambia el enfoque del apartado y lo centra en impedir el engaño a los votantes y la alteración de los procesos democráticos. La nueva denominación refleja esa prioridad: las restricciones buscan evitar que Claude se utilice para socavar el funcionamiento de unas elecciones.

Entre las conductas prohibidas figuran difundir información falsa sobre candidatos o sobre cómo votar, hacerse pasar por una candidatura o por una autoridad electoral y tratar de reducir la participación. Son ejemplos de interferencia que la empresa mantiene fuera de los usos permitidos de sus modelos.

Al mismo tiempo, Anthropic elimina la prohibición general de personalizar o segmentar mensajes de voto y de campaña. Explica que esa regla también afectaba a tareas cívicas legítimas, como organizaciones sin ánimo de lucro que preparan información electoral en distintos idiomas o autoridades que envían avisos para que un votante pueda subsanar un problema con su papeleta.

La retirada de ese veto general no autoriza cualquier forma de segmentación. Si la actividad se apoya en engaños o utiliza indebidamente los datos personales de los votantes, seguirá prohibida por los apartados de campañas engañosas, vigilancia y privacidad. El cambio abre espacio para esos usos legítimos sin eliminar las restricciones contra la manipulación.

 

Los límites sobre armas y vigilancia se hacen más explícitos

El desarrollo de armas ya estaba prohibido, pero Anthropic añade precisión sobre qué entra en esa categoría. La restricción incluye el software y los componentes que permiten que un arma funcione, una aclaración motivada por intentos de utilizar sus modelos para elaborar sistemas de guiado y control.

La compañía también menciona expresamente acciones como armar drones y otros vehículos autónomos. Según su explicación, esto refleja cómo venía aplicando la política anterior: la actualización concreta el alcance de la prohibición para que no se interprete que trabajar únicamente en el código o en un componente queda al margen.

En vigilancia, el nuevo texto deja claro que rastrear a personas sin su consentimiento está prohibido, tanto si el seguimiento ocurre en tiempo real como si se realiza analizando datos recopilados anteriormente. El informe de septiembre documentaba sistemas destinados a identificar y seguir a disidentes políticos, un ejemplo de los riesgos que la empresa quiere delimitar.

Claude tampoco puede utilizarse para decidir o recomendar a quién investigar, detener o acusar en procedimientos policiales o de justicia penal. La prohibición incluye además construir o mejorar herramientas diseñadas para vigilancia, y Anthropic insiste en que estas precisiones describen restricciones que ya aplicaba en la práctica.

El apartado también identifica usos que siguen permitidos, como el seguimiento consentido —con la monitorización antifraude como ejemplo—, la moderación de contenidos, el periodismo y la investigación jurídica. Es una distinción relevante para quienes emplean la IA en tareas de análisis: el propósito y las condiciones de uso determinan qué actividades admite la política.

 

Las recomendaciones de alto riesgo necesitan una persona cualificada

Cuando Claude se utiliza de una forma que puede afectar a la salud, los derechos legales, las finanzas, el sustento o el acceso a servicios esenciales de alguien, Anthropic exige supervisión humana cualificada. Además, la persona afectada debe saber que se ha utilizado inteligencia artificial en el proceso.

La expresión «humano en el circuito» implica que esa persona tenga autoridad para revisar las recomendaciones del modelo y modificarlas cuando sea necesario. El requisito va más allá de disponer de alguien cerca: la revisión debe quedar en manos de un profesional capaz de valorar el resultado dentro del ámbito correspondiente.

Estas obligaciones ya existían antes de la actualización, según Anthropic. Lo que cambia es la redacción de la sección, porque muchos usuarios habían preguntado si un caso concreto estaba sujeto a esos controles y la empresa quiere responder de forma más directa.

Para conseguirlo, la nueva política especifica qué clases de recomendaciones quedan cubiertas y cuáles quedan fuera. Quienes desarrollen servicios basados en Claude deberán consultar esa delimitación para su aplicación concreta, especialmente si el resultado se utiliza en decisiones o consejos con consecuencias importantes para una persona.

 

Si Claude controla equipos físicos, debe poder detenerse con seguridad

La autonomía de los modelos también plantea preguntas cuando sus acciones salen de la pantalla. Tras presentar su Model Hardware Standard, Anthropic incorpora requisitos para los casos en los que sus modelos se conectan a equipos capaces de realizar acciones físicas autónomas que podrían causar lesiones.

En esas situaciones, un operador cualificado debe poder observar el funcionamiento del equipo y detenerlo si hace falta. La supervisión tiene que permitir intervenir sobre lo que está sucediendo, algo especialmente relevante cuando el sistema ejecuta acciones por iniciativa propia.

Hay otra condición esencial: el equipo debe poder mantener un estado seguro si Claude se desconecta. Así, la seguridad no puede depender únicamente de que la conexión con el modelo siga disponible durante toda la operación.

Estos controles encajan en un debate que ya hemos tratado al informar sobre las advertencias de OpenAI y Anthropic sobre el control humano de la IA. En esta actualización, la compañía concreta ese principio para equipos físicos: observar, poder parar y conservar la seguridad ante una desconexión.

 

Las restricciones regionales se aclaran y la política seguirá evolucionando

La revisión también precisa cómo se aplica la política de regiones admitidas. El año pasado, Anthropic ya había restringido el acceso de empresas participadas mayoritariamente por entidades con sede en regiones no admitidas; ahora amplía la explicación de los criterios que utiliza para aplicar esas restricciones.

El texto aclara que Claude no puede ser utilizado por personas físicamente situadas en una región no admitida ni por entidades constituidas o con sede en una de ellas. También quedan excluidas las entidades controladas o participadas mayoritariamente por personas o entidades de esas regiones.

Por tanto, la evaluación del acceso considera tanto la ubicación del usuario como la constitución, la sede, la propiedad y el control de una organización. La compañía reúne estas precisiones en su página de países y regiones admitidos, donde se puede consultar la política correspondiente.

La actualización entrará en vigor el 12 de noviembre, y Anthropic anticipa nuevas revisiones conforme cambien las capacidades de Claude y los riesgos asociados. Dice que seguirá recogiendo aportaciones de sus equipos, responsables públicos, especialistas, sociedad civil y usuarios, un proceso que también acompaña al debate más amplio sobre qué riesgos aceptar al extender el uso de la inteligencia artificial.

Quienes quieran revisar los detalles pueden consultar el anuncio de Anthropic y su política de uso completa.

Dejar un comentario

Tu dirección de e-mail nunca será publicada Los campos requeridos están marcados*

Esta web usa cookies para elaborar información estadística y mostrar publicidad personalizada.

Saber más