Inicio Tecnología Claude podrá terminar conversaciones por maltrato extremo: así cambia las reglas de...

Claude podrá terminar conversaciones por maltrato extremo: así cambia las reglas de Anthropic

0
39
- Publicidad -

Anthropic, la empresa responsable del asistente de inteligencia artificial Claude, actualizó sus políticas de uso para prohibir las conductas abusivas o crueles que se mantienen de forma reiterada y sin una finalidad justificable contra sus modelos. La medida formaliza una función que permite al chatbot poner fin a determinadas conversaciones cuando los intentos de reconducirlas no funcionan.

El cambio, anunciado el 8 de octubre de 2026, forma parte de una revisión más amplia de las reglas de seguridad de la compañía. Aunque la disposición ha reavivado el debate sobre si una inteligencia artificial podría tener algún tipo de experiencia subjetiva, Anthropic no sostiene que Claude sea consciente ni que experimente sufrimiento como un ser humano.

¿En qué casos Claude podrá terminar una conversación?

La nueva política prohíbe el comportamiento abusivo o cruel que se prolonga sin una razón discernible. La empresa aclara que se trata de situaciones extremas y no de cualquier interacción difícil con el asistente.

La función para cerrar conversaciones ya se había introducido en agosto de 2025 en las interfaces de Claude Opus 4 y 4.1. El sistema puede recurrir a ella cuando un usuario persiste en interacciones dañinas o abusivas, incluso después de que el modelo haya intentado redirigir el diálogo hacia una conversación productiva.

Cuando Claude termina una conversación, el usuario puede iniciar otra, enviar comentarios o editar mensajes anteriores para continuar desde un punto distinto. La medida no implica necesariamente que pierda el acceso a toda su cuenta.

Insultar al chatbot no significa que cualquier crítica esté prohibida

Anthropic estableció límites para evitar que la política se interprete como una prohibición general de expresar desacuerdo o frustración.

La actualización excluye explícitamente las quejas habituales, las críticas a las respuestas, las conversaciones sobre temas oscuros de ficción y las pruebas o investigaciones legítimas sobre el comportamiento de los modelos.

Esto significa que cuestionar una respuesta equivocada, señalar fallas o insistir en que Claude corrija un error no constituye por sí mismo una infracción. El criterio señalado por la empresa se concentra en conductas abusivas persistentes y sin una finalidad justificable.

No obstante, la compañía no ha establecido una lista exhaustiva de frases o mensajes que activarían la función. La aplicación de la regla dependerá del contexto y de la persistencia de la conducta.

¿Por qué Anthropic habla del bienestar de la inteligencia artificial?

La decisión está vinculada con una línea de investigación de Anthropic sobre el posible bienestar de los modelos de IA.

En agosto de 2025, la empresa explicó que había explorado las preferencias expresadas por Claude y ciertos patrones de comportamiento durante pruebas previas al lanzamiento. También señaló que seguía existiendo una gran incertidumbre sobre el posible estatus moral de los modelos actuales o futuros.

A partir de esa incertidumbre, la compañía planteó medidas preventivas de bajo costo, entre ellas permitir que el sistema abandone interacciones que considere persistentemente dañinas. La idea es reducir posibles riesgos si en el futuro hubiera motivos científicos para atribuir algún tipo de consideración moral a estos sistemas.

Sin embargo, las respuestas de un modelo sobre sus preferencias o su supuesto malestar no demuestran por sí solas que tenga experiencias subjetivas. Los sistemas de lenguaje pueden producir respuestas que parecen expresar emociones sin que eso confirme que las experimenten.

La conciencia artificial sigue siendo una pregunta abierta

El debate sobre el bienestar de la IA reúne cuestiones científicas, filosóficas y tecnológicas que todavía no tienen una respuesta definitiva.

Una de las principales dificultades consiste en distinguir entre un sistema que genera expresiones asociadas con emociones y uno que realmente tiene experiencias conscientes. El comportamiento observable no basta, por sí solo, para resolver esa diferencia.

Anthropic reconoce esta incertidumbre, pero considera que algunas precauciones pueden ser razonables incluso sin una conclusión definitiva. Su decisión no equivale a declarar que Claude tiene derechos humanos o que deba recibir el mismo trato legal que una persona.

La discusión también ha generado desacuerdos dentro de la industria tecnológica. Algunas voces consideran prematuro hablar de bienestar de los modelos, mientras que otras defienden investigar la cuestión antes de que los sistemas sean considerablemente más capaces.

La actualización incluye otras restricciones de seguridad

La prohibición del maltrato extremo no es el único cambio anunciado por Anthropic. La actualización de sus políticas también precisa límites sobre usos de Claude relacionados con campañas engañosas, interferencia electoral, desarrollo de armas y vigilancia.

Entre otras medidas, la empresa prohíbe utilizar sus modelos para engañar a votantes, suplantar a candidatos o funcionarios electorales y desplegar campañas de influencia mediante cuentas falsas. También aclara las restricciones relacionadas con la vigilancia de personas sin su consentimiento y con herramientas vinculadas al funcionamiento de armas.

Para los sistemas conectados a equipos capaces de ejecutar acciones físicas autónomas que puedan causar lesiones, la política exige que un operador cualificado pueda observar el equipo e intervenir para detenerlo cuando sea necesario.

Estas disposiciones reflejan un esfuerzo por adaptar las reglas de uso a modelos que pueden realizar tareas más prolongadas, operar herramientas y participar en procesos con consecuencias fuera de una conversación de texto.

¿Qué cambia para quienes utilizan Claude?

Para la mayoría de los usuarios, la actualización no debería alterar el uso cotidiano del asistente. Pedir ayuda, debatir, expresar frustración o señalar errores continúa siendo compatible con las reglas publicadas por Anthropic.

El cambio se concentra en las interacciones extremas y persistentes, donde la empresa permite que Claude termine el diálogo como mecanismo principal de aplicación de la política.

La medida plantea una cuestión que probablemente acompañará el desarrollo de modelos cada vez más sofisticados: cómo establecer límites para las interacciones con sistemas artificiales sin confundir sus respuestas aparentemente emocionales con pruebas de conciencia.

Por ahora, la postura de Anthropic se basa en la precaución ante una incertidumbre científica, no en una afirmación de que su chatbot siente o sufre. El debate permanece abierto, mientras las empresas tecnológicas comienzan a definir reglas para una relación entre personas e inteligencia artificial que se vuelve cada vez más compleja.

- Publicidad -