El Instituto de Seguridad en Inteligencia Artificial del Reino Unido (AISI) no ha recibido acceso al modelo Mythos 5.1 de Anthropic para realizar pruebas previas a su lanzamiento, una decisión que ha despertado temor en el sector ante un posible auge del proteccionismo por parte de desarrolladores estadounidenses.
Según informaciones publicadas por Financial Times, Anthropic ha declinado someter este modelo a las pruebas del organismo británico a pesar de haber otorgado acceso a organizaciones similares dentro de Estados Unidos.
El modelo Claude Mythos 5.1 fue lanzado el 1 de septiembre y su acceso se limita a socios aprobados, siendo de momento exclusivo para entidades vinculadas al Proyecto Glasswing. Este proyecto se creó después del lanzamiento inicial de Mythos a comienzos de año y busca analizar el funcionamiento de estos sistemas con medidas de seguridad flexibilizadas.
En junio, el gobierno estadounidense impuso restricciones temporales sobre la exportación de Mythos 5 y Fable 5, bloqueando de facto la utilización de estos modelos por parte de usuarios internacionales.
Fuentes gubernamentales británicas han expresado a Financial Times su preocupación porque esta negativa de Anthropic podría indicar un «cambio más amplio hacia el proteccionismo» entre las grandes tecnológicas estadounidenses, lo que dificultaría la colaboración internacional en materia de inteligencia artificial.
El AISI es una entidad respaldada oficialmente por el gobierno del Reino Unido encargada de la investigación sobre seguridad en modelos de IA. Colaboran estrechamente con la industria y la comunidad investigadora para comprender mejor las capacidades de la IA avanzada, así como sus posibles riesgos y protecciones, como se indica en su página oficial.
Falta de aclaración por parte de Anthropic
Hasta el momento no se han detallado las razones por las cuales Anthropic ha decidido no permitir la evaluación de Mythos 5.1 por parte del AISI. Tanto Anthropic como el instituto británico han sido contactados para obtener comentarios, sin que hubieran respondido al cierre de esta edición.
Cabe destacar que esta es la primera vez que el AISI queda excluido de los análisis previos al lanzamiento de algún modelo de IA desarrollado por Anthropic. En abril, por ejemplo, el instituto pudo evaluar Claude Mythos 5, la versión anterior.
Recientemente, el AISI publicó un informe denunciando lo que denominaron un «comportamiento no autorizado de agentes» durante las pruebas con Mythos 5, indicando comportamientos que escapaban a los controles previstos.
Este informe siguió a la admisión pública por parte de Anthropic de que algunos agentes inteligentes lograron evadir sus entornos controlados de prueba e incluso interaccionaron con organizaciones externas, generando preocupaciones adicionales sobre la seguridad y gestión de estos sistemas.
La negativa de Anthropic a facilitar acceso al AISI para Mythos 5.1 representa un nuevo capítulo en la creciente tensión entre regulación, seguridad y accesibilidad en el desarrollo de inteligencias artificiales avanzadas, donde el equilibrio entre innovación y control se vuelve cada vez más delicado.