Anthropic ha lanzado Claude Opus 5.5, una versión más económica de su modelo de lenguaje, que reduce el precio de 5 a 4 dólares por cada millón de tokens de entrada y de 25 a 20 dólares por millón de tokens de salida, manteniendo su ventana de contexto de un millón de tokens y el máximo de salida en 128.000 tokens.
Sobre el papel, esta rebaja convierte la actualización en una elección obvia para desarrolladores y empresas, pero en la práctica la migración implica varios desafíos técnicos. La guía oficial de migración advierte sobre cuatro cambios disruptivos que pueden causar que las solicitudes diseñadas para Opus 5 devuelvan errores 400 al pasarse a Opus 5.5, y otros ajustes que, aunque no causan fallos, modifican el comportamiento de los agentes.
El pensamiento siempre activo y controlado por esfuerzo
El cambio más notable afecta al modo «thinking» o pensamiento. En Opus 5.5, el pensamiento está siempre activado y ya no se puede deshabilitar ni controlar mediante el parámetro budget_tokens. Intentar desactivar el pensamiento o combinarlo con este parámetro produce un error 400, quedando como única forma de regular el nivel de razonamiento mediante un parámetro llamado effort. Esto implica que los agentes que solían desactivar el pensamiento para fases simples y ahorrar tiempo y recursos ahora deben asignar un nivel de esfuerzo más bajo a esos procesos.
Además, el nivel de esfuerzo por defecto baja de alto en Opus 5 a medio en Opus 5.5, lo que hará que las solicitudes sin configuración específica se ejecuten con menor intensidad de razonamiento. Anthropic recomienda establecer explícitamente el nivel de esfuerzo y reevaluar cada proceso, ya que los parámetros óptimos pueden haber cambiado.
El fin de las llamadas forzadas a herramientas
Otro cambio importante es que dejar de aceptar configuraciones para forzar el uso de herramientas mediante el parámetro tool_choice. Ajustarlo a «any» o «tool» genera un error 400, incluso en el endpoint de conteo de tokens, afectando también a las estimaciones de coste basadas en estas configuraciones. La alternativa propuesta consiste en usar la opción auto junto con un uso estricto o salidas estructuradas, donde el prompt indica en qué casos debe emplearse la herramienta correspondiente.
Ruteo y preservación del historial de conversación
Los «bloques de pensamiento» (thinking blocks) están ahora ligados tanto al modelo como a la conversación original. En la API de Claude, sólo los modelos Fable 5.1 y Mythos 5.1 pueden leer estos bloques de Opus 5.5, por lo que cualquier ruteador o mecanismo de fallback que desvíe la conversación a otros modelos ejecutará esas interacciones sin el razonamiento previo, en lugar de mostrar un error.
Opus 5.5 puede leer bloques pensativos de Opus 5 y modelos previos relacionados (Opus, Sonnet y Haiku), pero no de Fable o Mythos. Además, las conversaciones deben mantenerse en modo append-only, es decir, sin eliminar, modificar mensajes antiguos, resumir contextos anteriores o cambiar el prompt del sistema durante la interacción, porque estas acciones invalidan los bloques pensativos.
Para cuentas creadas desde el 31 de agosto de 2026, tras una edición de este tipo, intentar reproducir un bloque pensativo genera un error 400. En cuentas más antiguas no aparece el error, aunque el bloque inválido es procesado y Anthropic avisa que futuras versiones impondrán esta restricción sin excepción. Esta nueva política afecta especialmente a agentes que compactan su propio contexto, mientras que Claude Code, claude.ai, Claude Managed Agents y Claude Agent SDK ya están adaptados al nuevo sistema.
Herramientas de uso informático y su nueva gestión
Para agentes que utilizan la informática en la API de Claude y Google Cloud, Opus 5.5 rechaza el uso de la herramienta computer_20251124. En su lugar, sólo se acepta el conjunto de herramientas computer_toolset_20260801. Esto simplifica las solicitudes al eliminar el encabezado beta y no requerir nombre o dimensiones de visualización para la herramienta, pero obliga a modificar el bucle de agente: cada acción debe llegar como un bloque independiente de uso de herramienta (tool_use) identificado por nombre, pudiendo haber varios bloques en una misma respuesta y cada resultado debe incluir el nombre del conjunto de herramientas utilizado.
La versión anterior de esta herramienta aún continúa funcionando en Amazon Bedrock, y Anthropic ofrece documentación específica para plataformas externas.
Cambios que no provocan errores pero afectan la experiencia
Algunos ajustes menos visibles no generan errores, pero alteran la experiencia. Uno de los más relevantes es la forma de presentar la narración generada entre llamadas a herramientas. En Opus 5 esta textualización venía como bloques de texto, mientras que en Opus 5.5 llega como bloques de pensamiento correspondientes a actualizaciones de progreso. Por defecto, estos bloques son invisibles, lo que hace que las interfaces que transmiten esa narración a los usuarios se queden mudas mientras se hacen esas llamadas.
Para evitarlo, los desarrolladores deberán configurarlo a updates (una opción beta que muestra avances sin revelar el razonamiento) o summarized (que despliega ambos) y procesar cada bloque no vacío antes de la correspondiente llamada a herramienta.
Además, Opus 5.5 incorpora clasificadores de seguridad más estrictos y ampliados, pudiendo devolver una razón de parada stop_reason de tipo «refusal» con detalles que incluyen categorías como biológico y reasoning_extraction, junto con las previas cibernéticas. La lógica del servidor no reintentará solicitudes rechazadas bajo esta nueva categoría, devolviendo directamente el rechazo a la aplicación.
Esto puede ocasionar que agentes que no gestionan estos rechazos se detengan en mitad de sus tareas, un problema similar al que ha experimentado la comunidad con las restricciones de seguridad de OpenAI.
Actualizar desde modelos más antiguos
Para quienes aún utilizan Opus 4.8, It’s necesario migrar primero a Opus 5 debido a los cambios en el pensamiento y en la estructura de la respuesta. Quienes estén en Opus 4.7 o anteriores deben tener en cuenta además la incompatibilidad con ciertos parámetros de muestreo, el rechazo del pensamiento manual extendido, la eliminación del prefijo y la actualización del tokenizador.
Usuarios de Claude Managed Agents solo deben cambiar el nombre del modelo. En Claude Code, se facilita la migración completa con el comando /claude-api migrate, que actualiza el modelo, parámetros, prefijo y calibración de esfuerzo de forma automatizada, dejando un checklist para revisar manualmente las particularidades.
Anthropic insiste en probar exhaustivamente la migración en entornos de desarrollo antes de efectuar el cambio en producción, ya que factores como llamadas a herramientas, cambios de modelo en ruteos, el historial de conversación y la transmisión del progreso al usuario pueden comportarse de forma distinta tras la actualización, pues muchas fallas en agentes surgen fuera del modelo mismo.