Anthropic lanzó Opus 5.5 con precios de tokens más bajos, salida más rápida y resultados que afirma estar al nivel de Fable, elevando el listón de la IA empresarial eficiente.

Anthropic ha lanzado Claude Opus 5.5, un nuevo modelo insignia que, según la compañía, iguala o supera a su sistema más capaz Fable 5.1 en muchas tareas, a la vez que cuesta menos operarlo. El lanzamiento ofrece a los desarrolladores acceso a un modelo de gama alta más rápido y más barato en un momento en que los compradores de IA están sopesando la capacidad frente a los costes de inferencia.
Opus 5.5 está disponible de inmediato a través de los servicios de Anthropic y de las principales plataformas en la nube. La compañía también afirma que ha mejorado el estilo de escritura del modelo, reduciendo la jerga y situando la información importante al principio de las respuestas. Esos cambios apuntan a una queja recurrente sobre la salida formulista o demasiado elaborada de modelos Claude anteriores.
Anthropic sitúa Opus 5.5 en 4 dólares por millón de tokens de entrada y 20 dólares por millón de tokens de salida, frente a los 5 y 25 dólares de Opus 5. La compañía también afirma que los costes de lectura de caché han caído un 60 por ciento. TechCrunch informó del precio de salida como una reducción de 25 a 20 dólares por millón de tokens y señaló que el nuevo modelo requiere menos capacidad de cómputo para prestarse.
Anthropic estima que los costes operativos totales deberían ser aproximadamente un 40 por ciento inferiores a los de Opus 5 cuando se incluye el uso de tokens. Esa estimación más amplia refleja la supuesta capacidad del modelo para usar menos tokens, así como una salida generada más de un 30 por ciento más rápido. La distinción importa para los equipos de producción: unos precios de lista más bajos no garantizan automáticamente facturas más bajas si un modelo usa sustancialmente más tokens en tareas difíciles.
Los límites de uso de cinco horas para suscriptores aumentarán un 20 por ciento, según el relato de The Decoder sobre el anuncio de Anthropic. Anthropic dice que la combinación de límites más altos y menores costes de uso debería ampliar la capacidad práctica en alrededor de un 25 por ciento.
El modelo está disponible en la Claude Platform con el ID de modelo claude-opus-5-5, así como a través de Amazon Web Services, Google Cloud y Microsoft Azure. Esa distribución ofrece a los equipos empresariales más opciones para integrar el modelo en sistemas existentes de nube, cumplimiento normativo y compras.
Anthropic describe Opus 5.5 como su modelo con mejor rendimiento hasta la fecha y dice que iguala a Claude Fable 5.1 en la mayoría de las tareas. Sus comparaciones también sitúan al nuevo modelo por delante de GPT-6 Astra de OpenAI en varias evaluaciones, pese a un precio de lista más bajo. Se trata de afirmaciones comunicadas por el proveedor y no deben tomarse como una confirmación independiente de superioridad general.
The Decoder informó con más detalle sobre las comparaciones de programación de Anthropic. En FrontierCode, la compañía dice que Opus 5.5 supera a GPT-6 Astra con aproximadamente un 20 por ciento del coste por tarea. En Terminal-Bench 4.0, Anthropic afirma un rendimiento comparable al 40 por ciento del coste de Astra, mientras que en CursorBench informa de una ventaja de 11 puntos sobre GPT-5.6 Sol a un tercio del coste.
Existe cierto respaldo externo para la posición del modelo en los benchmarks. Artificial Analysis, una plataforma independiente citada por The Decoder, otorgó a Opus 5.5 una puntuación de 58 en su Intelligence Index con el máximo esfuerzo, la puntuación más alta registrada en ese índice en el momento del informe. También informó de resultados líderes en seis de diez evaluaciones, incluidas Humanity’s Last Exam y SciCode.
Sin embargo, el mismo análisis identificó una compensación en eficiencia. Con el máximo esfuerzo, Opus 5.5 habría generado alrededor de 119.000 tokens de salida por tarea, frente a 73.000 en Opus 5, 78.000 en Fable 5.1 y 27.000 en GPT-6 Astra. Los precios más bajos por token pueden compensar ese uso en algunas cargas de trabajo, pero el modelo no es necesariamente más barato en cada tarea individual.
Anthropic dice que Opus 5.5 es menos propenso a usar jerga, más propenso a comenzar con la información más importante y mejor siguiendo instrucciones de escritura. Los primeros evaluadores descritos por The Decoder encontraron la salida más clara, pero esas impresiones siguen siendo limitadas y no sustituyen una evaluación controlada en flujos de trabajo reales.
El lanzamiento también amplía los controles de seguridad aplicados a los modelos de mayor capacidad de Anthropic. Opus 5.5 recibe salvaguardas comparables a Fable 5.1 para ciberseguridad, biología y desarrollo de IA de frontera. Anthropic dice que las solicitudes que activen esos controles pueden redirigirse a otro modelo. Según se informa, la mayor parte del trabajo de ciberseguridad marcado se dirige a Opus 4.8, mientras que ciertas solicitudes de biología y desarrollo de frontera van a Opus 5.
Las organizaciones verificadas pueden solicitar acceso para investigación biológica a través del Life Sciences Verification Program de Anthropic. La compañía planea ampliar su Cyber Verification Program a Opus 5.5. El modelo también incluye “Preserved Thinking”, que restringe a los usuarios de API a editar el contexto previo para extraer razonamiento, y medidas de marcado de agua descritas como apoyo al cumplimiento de la EU AI Act.
Anthropic dice que Opus 5.5 fue evaluado antes de su lanzamiento por METR y Frontier Design. La compañía también se está preparando para un cribado más estricto de entornos de reinforcement learning, una supervisión más fuerte y escenarios automatizados de entrenamiento de seguridad. Estos planes son importantes, pero describen trabajo en curso y no prueban que todos los riesgos de alineación o uso indebido estén resueltos.
Para los equipos de software, la principal oportunidad no es solo el acceso a una puntuación de benchmark más alta. Un modelo que combine un buen rendimiento en programación y trabajo de conocimiento con precios publicados más bajos podría hacer más prácticos los agentes de IA de ejecución prolongada, especialmente para revisión de código, depuración, documentación, investigación y análisis interno.
La situación de costes dependerá en gran medida de los ajustes de esfuerzo, el diseño de prompts, la reutilización de contexto y la longitud de la salida. Las cifras de Artificial Analysis sugieren que Opus 5.5 con máximo esfuerzo puede consumir muchos más tokens que los sistemas rivales. Por tanto, los equipos deberían probar el coste por flujo de trabajo completado en lugar de comparar solo los precios de tokens.
Para los compradores empresariales, la disponibilidad en Claude Platform, Amazon Web Services, Google Cloud y Microsoft Azure puede reducir la fricción de despliegue. Pero los compradores seguirán necesitando validar la latencia, las opciones de retención de datos, el comportamiento de enrutamiento cuando se activan las salvaguardas y la fiabilidad del modelo con sus propios documentos y herramientas. Las afirmaciones de Anthropic sobre una escritura más clara podrían importar en sesiones largas, pero deben medirse frente a modelos existentes en lugar de darse por sentadas.
El lanzamiento de Anthropic también intensifica la competencia entre modelos premium. La compañía está posicionando Opus 5.5 frente a Fable 5.1 y GPT-6 Astra, al tiempo que responde a alternativas más baratas, incluidos modelos chinos que The Decoder describió como de menor rendimiento a precios mucho más bajos. La siguiente fase de competencia puede decidirse tanto por el coste por tarea exitosa y los controles de despliegue como por el liderazgo en benchmarks que acapara titulares.
La señal inmediata será si evaluaciones independientes reproducen las ganancias que Anthropic informa en programación, trabajo agéntico y tareas empresariales. Los costes reales para los clientes serán otra prueba importante, especialmente en cargas de trabajo de máximo esfuerzo que generan salidas grandes.
Anthropic dice que Sonnet 5.5 y Haiku 5.5 llegarán en las próximas semanas con mejoras similares en rendimiento, eficiencia y seguridad. Sus precios y capacidades mostrarán si los cambios de Opus representan un rediseño más amplio de la familia o principalmente una mejora del modelo insignia.
Los desarrolladores también deberían vigilar el despliegue del Cyber Verification Program, los cambios en el enrutamiento del modelo bajo controles de seguridad y más detalles sobre las medidas de supervisión y anti-destilación de Anthropic. Esas políticas podrían afectar qué flujos de trabajo de investigación y seguridad pueden ejecutarse directamente en Opus 5.5.
Opus 5.5 es importante porque Anthropic vende la eficiencia como parte de la capacidad, no como un compromiso frente a ella. Los resultados informados por la compañía sugieren que los productos premium de IA se están moviendo hacia una métrica más práctica: el coste y la fiabilidad de completar todo un flujo de trabajo.
La evidencia es prometedora, pero sigue estando muy condicionada por los propios benchmarks y decisiones de prueba de Anthropic. Para desarrolladores y compradores, la respuesta sensata es una evaluación dirigida: medir la finalización exitosa de tareas, el consumo de tokens, la latencia, el enrutamiento de seguridad y los requisitos de edición humana en trabajos representativos antes de tomar la supuesta reducción del 40 por ciento de los costes operativos como un hecho de producción.