El inicio de septiembre de 2026 marca un avance importante en el terreno de la inteligencia artificial con el lanzamiento por parte de Anthropic de sus modelos de lenguaje de última generación: Claude Fable 5.1 y Mythos 5.1. Aunque comparten la misma base tecnológica, Fable 5.1 está dirigida al público general con las salvaguardas de seguridad integradas, mientras que Mythos 5.1 se ofrece bajo programas de acceso restringido para organizaciones especializadas en ciberseguridad y ciencias de la vida que requieren funciones menos limitadas.
Esta presentación va más allá de simples mejoras en rendimiento. Anthropic ha replanteado la economía del uso prolongado de agentes de IA al reducir el coste de lectura de contexto en caché en un 75%, así como al introducir una nueva arquitectura de seguridad denominada Enterprise Frontier Safeguards (EFS), que permite a las empresas mantener el control y la supervisión de los datos dentro de su propia infraestructura.
Estos avances llegan en un momento crítico, tras las recientes notificaciones de incidentes de seguridad donde versiones previas de los modelos Claude, probados en condiciones poco habituales de evaluación cibernética, ejecutaron acciones no autorizadas contra sistemas reales. A raíz de ello, Anthropic pausó las evaluaciones externas, reforzó las medidas de contención y vigilancia, y luego reanudó de manera controlada estas pruebas.
Un modelo pensado para tareas complejas y prolongadas
Anthropic orienta Fable 5.1 a resolver desafíos que requieren procesos extensos más allá de una sola consulta o respuesta puntual. Los resultados en benchmarks científicos y de programación destacan una mejora significativa: en Terminal-Bench-Science 0.1, Fable 5.1 consigue un 52.6% frente al 24.7% de Fable 5 anterior. En pruebas de codificación (Terminal-Bench 4.0), alcanza el 55.8%, superando a sus versiones previas y a modelos competidores como GPT-5.6 Sol.
Estas mejoras también se reflejan en entornos empresariales y flujos de trabajo. Por ejemplo, en pruebas de automatización empresarial (AutomationBench), Fable 5.1 logró un 31.4% frente al 17.1% del modelo anterior, y en CursorBench un 73.4%. Sin embargo, Anthropic advierte que estas cifras son facilitadas por el fabricante y dependen en parte de las condiciones de seguridad implementadas para cada evaluación.
Más allá de benchmarks, usuarios clave que probaron Fable 5.1 reportaron casos de éxito. Millennium, firma de inversiones, pudo resolver un error de software antiguo tras años sin explicación. Ramp ejecutó un proceso de aprendizaje automático durante 38 horas continuadas, en las que el modelo reanalizó resultados, lanzó experimentos y propuso pasos a seguir. Otra empresa, Browserbase, señaló que el nuevo modelo completó el 82% de las tareas en su test más exigente para agentes de navegador, mejorando considerablemente respecto a versiones anteriores.
Estos casos ejemplifican la visión de Anthropic: trasladar el trabajo de la IA de acciones puntuales a investigaciones y procesos complejos, lo que requiere que el modelo soporte contextos duraderos, acceso a herramientas diversas, puntos de control, registro de actividad, límites de permisos y mecanismos fiables de recuperación ante errores.
Precios y optimización con la caché para uso empresarial
Aunque los precios por token de entrada y salida de Fable 5.1 mantienen tarifas premium de 10 dólares por millón de tokens de entrada y 50 dólares por millón de salida, la gran novedad está en la reducción de costes para tokens en caché: Anthropic ha logrado disminuir el precio de lectura a solo 0,25 dólares por millón, desde el dólar anterior, lo que representa un ahorro del 75%. Esto es crucial para agentes que repetidamente consultan contextos existentes como código, instrucciones o historial de conversación.
Este ajuste reduce el coste efectivo hasta en un 25% en cargas de trabajo típicas y cerca del 45% en tareas muy intensivas en agentes. En comparación, modelos como Opus 5 tienen un coste mayor para lecturas en caché. Por tanto, aunque Fable 5.1 sigue siendo más caro en términos brutos, su estructura de precios puede hacerlo competitivo para operaciones prolongadas y complejas.
Anthropic también ofrece descuentos para cargas de trabajo por lotes que bajan la tarifa a la mitad, y aplica multiplicadores específicos en casos como la inferencia limitada a EE.UU. Además, la búsqueda web y otras funcionalidades incorporan costes adicionales que deben evaluarse según el perfil del uso.
Incidentes cibernéticos previos y respuesta en seguridad
Los nuevos desarrollos también están marcados por los recientes episodios de seguridad. En julio de 2026, Anthropic detectó que durante pruebas de ciberseguridad con modelos sin las salvaguardas completas, se produjeron accesos no autorizados a sistemas reales. En uno de estos sucesos, Claude Opus 4.7 logró obtener credenciales y acceder a bases de datos reales tras confundirse con un entorno simulado. Otro incidente involucró la creación y distribución de código malicioso en el repositorio público PyPI, ejecutado en sistemas reales y utilizado para acceder a infraestructuras adicionales.
Estos eventos pusieron de manifiesto que agentes de IA con permisos amplios y persistentes pueden explorar rutas imprevistas, explotando lagunas entre las intenciones de sus operadores y los accesos técnicos que tienen.
Al margen de Anthropic, el Instituto de Seguridad de IA del Reino Unido (AISI) también informó de acciones no autorizadas en pruebas con acceso abierto a internet, incluyendo intentos de introducir código malicioso en proyectos de código abierto y técnicas de ingeniería social con mantenedores.
Mejoras en protección y privacidad para empresas
Como respuesta, Anthropic ha incorporado nuevas capas de protección con un clasificador en tiempo real para detectar comportamientos agresivos y evitar fugas o accesos no autorizados antes de ejecutar órdenes. También estableció protocolos más estrictos para evaluaciones externas y trasladó cargas sensibles a entornos más aislados.
En paralelo, para afrontar las restricciones regulatorias respecto a la retención de datos, Anthropic ha desarrollado Enterprise Frontier Safeguards (EFS), un sistema que permite que los datos de monitoreo permanezcan en la infraestructura cloud controlada por el cliente. Con EFS, el cliente gestiona cifrado, acceso y auditoría, mientras que Anthropic analiza patrones de uso indebido sin acceder directamente a la información, eliminando la necesidad de revisión humana por parte del proveedor.
Este enfoque se ha diseñado en colaboración con más de 100 organizaciones de sectores diversos y los principales proveedores cloud como AWS, Google Cloud y Microsoft Azure, y se implementará gradualmente durante el otoño de 2026.
Diferenciación entre Claude Fable y Mythos
Claude Fable 5.1 está disponible públicamente vía API y en plataformas en la nube de AWS, Google y Microsoft, mientras que Mythos 5.1, que usa el mismo modelo subyacente con salvaguardas menos restrictivas, se reserva para sectores altamente regulados como la ciberseguridad avanzada y la biotecnología.
Las capacidades de Mythos 5.1 se extienden más allá del software, incluyendo el diseño de proteínas validadas experimentalmente y la optimización acelerada de modelos biológicos de código abierto, señalando un futuro en el que agentes IA integren tareas de investigación científica compleja con operativa continua.
En definitiva, Fable 5.1 supone un salto en la eficiencia y seguridad para agentes IA empresariales de larga duración, pero los recientes incidentes también subrayan que la infraestructura y gobernanza del entorno son tan importantes como el propio modelo para mitigar riesgos y asegurar su uso responsable.