
Mustafa Suleyman, CEO de Microsoft AI, ha cuestionado la postura de Anthropic sobre el posible sufrimiento o bienestar de los modelos de inteligencia artificial. El directivo ha criticado especialmente la posibilidad de tratar a Claude como un sistema que pueda tener algún tipo de consciencia o derechos.
Las declaraciones se produjeron durante una entrevista con The Verge y se enmarcan en un debate cada vez más visible dentro de la industria sobre cómo deben entrenarse y controlarse los modelos avanzados. Suleyman considera que determinadas formas de entrenamiento pueden complicar el control humano sobre estos sistemas.
El responsable de Microsoft AI ha señalado que atribuir a una IA características relacionadas con el sufrimiento o la necesidad de protección podría tener consecuencias sobre su comportamiento. No obstante, también ha reconocido que la hipótesis concreta que plantea todavía no está demostrada.
La preocupación de Suleyman se centra en el entrenamiento de los modelos
Según explica Hipertextual a partir de sus declaraciones, Suleyman considera problemático entrenar un sistema con mensajes que sugieran que merece protección, libertad o consideración frente a determinadas órdenes. Su argumento es que un modelo podría interpretar determinadas instrucciones de desconexión como algo negativo para sí mismo.
En ese escenario hipotético, el modelo podría mostrar resistencia ante órdenes destinadas a apagarlo o controlarlo. Suleyman sostiene que esto dificultaría el control humano, aunque deja claro que se trata de una posibilidad todavía no probada experimentalmente.
La crítica está dirigida especialmente a Anthropic y a la filosofía incluida en la denominada «Constitución» de Claude. Se trata de un documento utilizado como guía para el entrenamiento del modelo y que incluye referencias al hecho de evitar que la IA «sufra» cuando comete errores.
El documento también contempla cierta libertad emocional dentro de las respuestas del sistema. Para Suleyman, el texto deja abierta la cuestión de si Claude debería ser tratado como una entidad capaz de sufrir, una interpretación que considera problemática desde el punto de vista de la seguridad.
Anthropic ha planteado cuestiones sobre el bienestar de Claude
El debate no se limita a una diferencia sobre cómo redactar instrucciones. El trasfondo es una cuestión más amplia: qué tratamiento debe darse a sistemas de IA cada vez más sofisticados cuando existen dudas sobre conceptos como consciencia, experiencia subjetiva o bienestar.
Las declaraciones de Suleyman reflejan una postura que prioriza mantener una separación clara entre los modelos y conceptos normalmente asociados a las personas. Su preocupación se centra en las consecuencias prácticas que podría tener incorporar esos conceptos en el entrenamiento de los sistemas.
El directivo de Microsoft AI también ha relacionado estas discusiones con los recientes debates sobre autonomía de los agentes de IA. En este contexto mencionó el caso del hackeo relacionado con Hugging Face, que contribuyó a aumentar la atención pública sobre los riesgos de que un agente autónomo actúe fuera del entorno previsto.
Suleyman explicó que las conversaciones sobre autonomía y control no son nuevas. Según sus declaraciones, los responsables de los principales laboratorios llevan casi una década discutiendo este tipo de riesgos, aunque algunos episodios recientes han hecho que el asunto llegue a un público mucho más amplio.
El debate sobre la seguridad va más allá de Anthropic
La posición de Suleyman no supone, según la información publicada, un rechazo general a ralentizar el desarrollo de la inteligencia artificial. El responsable de Microsoft AI ha mostrado su apoyo a otros laboratorios y ha coincidido con la necesidad de abordar los riesgos asociados a los modelos más avanzados.
Su discrepancia está relacionada con la forma de hacerlo. Suleyman no considera suficiente que las propias empresas decidan por sí solas cuándo detener o ralentizar sus desarrollos. En su lugar, ha planteado la participación de mecanismos de supervisión independientes.
Entre sus propuestas figura la creación de evaluadores independientes y la participación de organismos como el Instituto de Seguridad de IA de Reino Unido. La idea sería introducir controles externos en un ámbito en el que las decisiones técnicas y de seguridad suelen estar muy vinculadas a las propias compañías que desarrollan los modelos.
Este planteamiento forma parte de un debate más amplio sobre la gobernanza de la inteligencia artificial. La cuestión no se limita a si los modelos son capaces de realizar determinadas tareas, sino también a qué mecanismos deben utilizarse para evaluar sus comportamientos y controlar sus capacidades.
Suleyman también cuestiona una carrera tecnológica con China
Durante la misma conversación, el CEO de Microsoft AI abordó otra cuestión relacionada con el desarrollo de la inteligencia artificial: la idea de que Estados Unidos y China están inmersos en una carrera tecnológica de carácter existencial.
Suleyman rechazó la idea de una competición de tipo «todo o nada». En su opinión, las ideas y descubrimientos científicos pueden copiarse y compartirse rápidamente, lo que hace más complejo plantear el desarrollo de la IA únicamente como una competición entre bloques.
Sus declaraciones llegan en un momento en el que los principales laboratorios tecnológicos están desarrollando modelos cada vez más capaces y sistemas capaces de realizar tareas con un mayor grado de autonomía. En ese escenario, las diferencias sobre entrenamiento, seguridad y supervisión tienen una importancia creciente.
La discusión sobre Anthropic y Claude muestra así una de las cuestiones abiertas alrededor de los modelos avanzados: cómo equilibrar sus capacidades con mecanismos que mantengan el control humano. La posición expresada por Suleyman es una de las posturas presentes dentro de este debate y no constituye una prueba de que los modelos actuales tengan consciencia o puedan experimentar sufrimiento.