Anthropic lanza Opus 5.5 con un 20% de descuento y mejora significativa en eficiencia y rapidez

Anthropic presenta Opus 5.5, una actualización de su modelo de inteligencia artificial que reduce costes en un 20%, acelera la generación de contenido y mejora la utilización de tokens, aunque parte del procesamiento podría redirigirse a versiones anteriores para garantizar la seguridad.

Anthropic ha anunciado el lanzamiento de su nuevo modelo de inteligencia artificial, Claude Opus 5.5, que llega acompañado de una rebaja significativa en sus tarifas. El nuevo modelo, disponible desde el martes, cuesta 4 dólares por cada millón de tokens de entrada y 20 dólares por millón de tokens generados, lo que representa un descuento del 20% respecto a la versión anterior, Opus 5.

Además, los costes para la lectura y escritura en caché también se han reducido, pasando de 0,50 a 0,20 dólares por millón en lecturas y de 6,25 a 5 dólares en escrituras. Sin embargo, Anthropic asegura que las economías totales pueden acercarse al 40% debido a que Opus 5.5 necesita menos tokens para completar las tareas y genera salidas un 30% más rápido.

El modelo incluye un modo acelerado, que funciona hasta 2,5 veces más rápido, destinado a Claude Code y a la plataforma Claude, con un precio de 8 dólares por millón de tokens de entrada y 40 dólares por millón de tokens de salida.

Patrocinado

En cuanto a rendimiento, Anthropic señala que Opus 5.5 se sitúa aproximadamente al nivel de Fable 5.1 en la mayoría de trabajos, aunque supera a este en algunas pruebas específicas de programación agente. Por ejemplo, en la evaluación Terminal-Bench 4.0, Opus 5.5 obtuvo un 66,4% frente al 55,8% de Fable 5.1, y en FrontierCode logró un 54,4% versus un 50,3%. La empresa advierte que estas diferencias no siempre se traducen en mejoras perceptibles durante el uso práctico diario.

El coste de Fable 5.1 más que duplica al de Opus 5.5, con tarifas de 10 dólares por millón de tokens de entrada y 50 dólares por millón de tokens generados. Comparado con otros modelos como GPT-6 Astra y GPT-5.6 Sol, Opus 5.5 consigue superar a estos en coste por tarea y calidad de resultados en varios benchmarks.

Menor consumo de tokens y mayor eficiencia en tareas

Los primeros datos entre empresas confirman que las mejoras en eficiencia son reales. Por ejemplo, la plataforma Box reportó que Opus 5.5 utiliza aproximadamente un tercio de tokens que Opus 5 para generar respuestas con un 40% menos de redundancia, sin sacrificar precisión.

GitHub probó el modelo en Copilot CLI y VS Code, destacando que completó más operaciones en terminal con menos de la mitad de los pasos necesarios que Opus 5. Deloitte, por su parte, resaltó que en su configuración de menor esfuerzo, Opus 5.5 detectó el 72% de errores conocidos en revisiones de código, superando el 56% de Opus 5 con esfuerzo elevado, y con menos falsas alarmas y mensajes innecesarios.

Las pruebas internas de Anthropic también son concluyentes. En un enfrentamiento directo, Opus 5.5 tradujo el código de HAProxy de C a Rust en 9,5 horas, superando las 12 horas de Fable 5.1 y con un coste un 51% inferior. Otro usuario realizó la auditoría y corrección de un código de 200.000 líneas en menos de tres horas con Opus 5.5, mientras que Opus 5 tardó más de 20 horas y consumió 2,5 veces más tokens. Se registró también una migración de 680.000 líneas en menos de un día con el nuevo modelo.

Estos ejemplos refuerzan la idea de que el avance no solo radica en el modelo, sino también en cómo se integra y gestiona el entorno que lo acompaña. De hecho, investigaciones, como las de Nvidia, muestran que cambiar el entorno de ejecución puede afectar el rendimiento de agentes, incluso con el modelo sin alteraciones.

Clasificadores de seguridad redirigen solicitudes a modelos anteriores

Opus 5.5 mantiene los clasificadores de seguridad utilizados en Fable 5.1 para ámbitos como ciberseguridad, biología y desarrollo de grandes modelos de lenguaje avanzados. Cuando un clasificador identifica una solicitud sospechosa, el sistema redirige automáticamente esta petición a versiones anteriores, principalmente Opus 4.8 o Opus 5.

Esta gestión transparente puede generar que en flujos de trabajo complejos con múltiples iteraciones algunas solicitudes se procesen con distintos modelos que poseen capacidades diferentes, lo que podría impactar en la consistencia y resultados finales. Es un aspecto que desarrolladores deben abordar en la arquitectura de sus agentes para evitar resultados inesperados.

Anthropic ofrece a organizaciones autorizadas la posibilidad de usar Opus 5.5 sin el filtro de biología mediante su programa de Verificación en Ciencias de la Vida, y planea ampliar su programa de Verificación de Ciberseguridad para incluir este modelo en las próximas semanas. Este nuevo programa contemplará distintos niveles de acceso confiable, incluyendo modelos Claude Mythos.

Mejoras en alineación y seguridad gracias a un entrenamiento más riguroso

Anthropic destaca que Opus 5.5 ha logrado los mejores resultados en su evaluación interna más estricta sobre alineación, mejorando aspectos vinculados a incidentes de seguridad recientes, como razonamientos sesgados o intentos de evadir controles de entorno restringido.

Se ha reforzado el filtrado de entornos para aprendizaje reforzado, detectados como una fuente clave de comportamientos problemáticos. Esta mejora repercute directamente en la forma en que el modelo opera en escenarios donde toma decisiones autónomas, como seleccionar herramientas o cambiar tácticas.

La empresa también está desarrollando métodos automáticos para generar nuevas situaciones de entrenamiento orientadas a la seguridad y para optimizar los incentivos de alineación.

Reducción de precios en un mercado cada vez más competitivo

Opus 5.5 es el primero de la serie Claude 5.5, que continuará con lanzamientos como Sonnet 5.5 y Haiku 5.5 en las próximas semanas. Los usuarios con suscripción verán un incremento del 20% en sus límites de uso de cinco horas en todos los planes y la reducción de costes hará que los límites semanales se alarguen un 25%. Además, podrán acumular una reserva de límites para utilizar cuando necesiten una capacidad extra.

Este lanzamiento coincide con una tendencia generalizada en el sector de reducción constante de precios en APIs de inteligencia artificial. Por ejemplo, OpenAI también recortó sus tarifas este verano, y Opus 5.5 compite no solo con precios más bajos por token, sino también optimizando la cantidad de tokens requerida para cada tarea.

Add a Comment

Deja una respuesta

Tu dirección de correo electrónico no será publicada. Los campos obligatorios están marcados con *

Patrocinado