Un modelo más barato en la cima de la gama
Anthropic publicó Claude Opus 5.5 el martes y afirmó que rinde a un nivel similar al de Claude Fable 5.1, su modelo mayor, en la mayor parte del trabajo. El precio se movió en dirección contraria: la entrada baja de 5 a 4 dólares por millón de tokens, y la salida de 25 a 20.
El recorte más pronunciado está en la entrada almacenada en caché, que cae de 0,50 a 0,20 dólares por millón de tokens. Es una reducción del 60 por ciento que importa sobre todo a los agentes que reproducen contextos largos en cada paso. Anthropic cifra el efecto combinado en torno al 40 por ciento menos en cargas de trabajo habituales, y dice que el modelo genera texto alrededor de un 30 por ciento más rápido que Opus 5.
Las cifras, y de quién son
Todas las cifras que siguen son de Anthropic, medidas en su propio banco de pruebas, y ninguna ha sido reproducida todavía de forma independiente.
La compañía informa de un 66,4 por ciento en Terminal-Bench 4.0, frente al 52,3 por ciento de Opus 5. En FrontierCode v1.1 da un 54,4 por ciento, frente al 48,0 anterior. OSWorld 2.0, que mide a un modelo manejando un escritorio, sube al 81,8 por ciento desde el 74,0. En GDPval-AA v2.1, una evaluación de trabajo de oficina puntuada por Elo, Anthropic sitúa a Opus 5.5 en 1846 frente a los 1708 de Opus 5.

Anthropic declaró a TechCrunch que es “el modelo con mejor rendimiento que hemos probado hasta la fecha”. Lo interesante no son las puntuaciones sueltas sino su forma: un lanzamiento de mitad de ciclo que se acerca al buque insignia en lugar de superar apenas a su antecesor.
El trabajo de seguridad que lo acompaña
Anthropic dice que Opus 5.5 obtuvo el mejor resultado de todos sus modelos en la auditoría automática de comportamiento de la empresa, y que los intentos de burlar los límites de contención cayeron un 85 por ciento respecto a Opus 5. También afirma haber mejorado la resistencia a la inyección de instrucciones, el fallo que está detrás de la mayoría de los incidentes con agentes de este año.
Las salvaguardas son inusualmente concretas. Las tareas de ciberseguridad se derivan al anterior Opus 4.8 salvo que el usuario haya superado un programa ampliado de verificación en ciberseguridad. La capacidad en biología se describe como comparable a la de Claude Mythos 5.1 y queda tras un nuevo programa de verificación en ciencias de la vida. El razonamiento extendido pasa a ser obligatorio, y se mantiene la protección que oculta las trazas de razonamiento frente a la destilación.

Dónde funciona
El modelo está disponible desde el lanzamiento en la plataforma de Anthropic como claude-opus-5-5, y en Amazon Web Services, Google Cloud y Microsoft Azure. GitHub lo incorporó a Copilot el mismo día. Anthropic dice que ofrece retención cero de datos y que la salida lleva el marcado de agua que exige el Reglamento de IA de la UE.
El lanzamiento llega tres días después de que el consejero delegado de Anthropic, Dario Amodei, defendiera públicamente frenar el ritmo del trabajo en capacidades para que la investigación en alineamiento pueda alcanzarlo, y el mismo día en que OpenAI bajó sus propios precios con GPT-6 Sol y Luna.
Qué vigilar
Claude Sonnet 5.5 y Claude Haiku 5.5 están prometidos para “las próximas semanas”, lo que llevaría los mismos cambios de precio y latencia al resto de la gama. Lo otro que hay que vigilar es la medición independiente: la tabla de Anthropic es el relato de un fabricante sobre su propio producto, y la posición real del modelo frente a Fable 5.1 y frente al nuevo escalón de OpenAI no quedará resuelta hasta que publiquen los evaluadores externos.