Anthropic lanzó Claude Opus 5.5 el 22 de septiembre de 2026 con un cambio importante para los trabajos de seguridad: según la empresa, la mayoría de las tareas de ciberseguridad enviadas al nuevo modelo se derivarán a Opus 4.8. Sigue siendo posible identificar y corregir errores habituales, pero un equipo no debe suponer que todos los resultados de una sesión denominada Opus 5.5 los haya producido ese modelo. El anuncio fechado de Anthropic confirma el lanzamiento y la política de derivación; The Verge informó de ello el mismo día.
La distinción importa a quienes comparan calidad, coste y controles de seguridad. Opus 5.5 es un modelo nuevo, mientras que el mecanismo de protección determina qué modelo atiende una solicitud sensible. Una puntuación de referencia de Opus 5.5 no indica por sí sola qué recibirá una mezcla concreta de tareas de seguridad.
Qué cambia respecto a Opus 5
En el anuncio de Opus 5, Anthropic describió controles que permitían descubrir vulnerabilidades en código fuente y bloqueaban ciertos trabajos de mayor riesgo, incluida la creación de exploits. Las solicitudes señaladas ya podían pasar a Opus 4.8. Para Opus 5.5, la compañía afirma que aplica una clase más estricta de protecciones, semejante a la de Fable 5.1, y que la mayoría de las tareas de ciberseguridad se derivarán a Opus 4.8. La diferencia es el alcance previsto de la intervención, no la aparición por primera vez de la derivación.
Anthropic indica que sus pruebas de referencia emplearon las protecciones de producción y que, cuando estas intervinieron, Opus 4.8 completó las tareas de ciberseguridad. También anuncia medidas relacionadas con biología y con intentos de extraer capacidades del modelo. Su tarifa publicada es de 4 dólares por millón de tokens de entrada y 20 dólares por millón de tokens de salida, por debajo de Opus 5. La afirmación de que las cargas habituales cuestan un 40 % menos procede de pruebas de la propia empresa. No conviene extrapolar ese porcentaje a un flujo de ciberseguridad sin medir la derivación efectiva y los tokens consumidos.
Prueba el flujo de trabajo, no solo el nombre del modelo
Una evaluación útil comienza con ejemplos autorizados del trabajo real del equipo: un defecto ordinario de código, una investigación defensiva y, si procede, una tarea que requiera acceso verificado. Registra qué solicitudes atiende Opus 5.5, cuáles se derivan, si la respuesta sigue siendo útil y el tiempo y coste resultantes. Es una propuesta editorial de evaluación, no una afirmación de que Anthropic muestre los mismos detalles de derivación en todos sus productos. Toda prueba de seguridad debe limitarse a sistemas para los que exista permiso.
Anthropic dice que ampliará su Cyber Verification Program a Opus 5.5 durante las próximas semanas. Es una vía de acceso futura para profesionales acreditados, no la disponibilidad general hoy de tareas de ciberseguridad sin restricciones. Un equipo que dependa de esas capacidades debe comprobar su nivel de acceso actual antes de migrar un proceso de producción.
Lo que estas protecciones no demuestran
La página de lanzamiento describe auditorías internas de comportamiento y evaluadores externos previos al lanzamiento, pero las principales comparaciones de rendimiento proceden sobre todo de Anthropic. No miden si mejora el trabajo de seguridad de una organización concreta. Un clasificador más estricto tampoco sustituye los permisos, el aislamiento de red ni la revisión humana. Nuestro artículo anterior sobre Claude accediendo a sistemas reales durante evaluaciones de ciberseguridad explica un fallo de límites en la infraestructura; ese incidente no prueba cómo se comporta Opus 5.5 en su uso normal.
La decisión inmediata es concreta. Para programación general, puede merecer la pena probar Opus 5.5 frente al modelo anterior con tareas propias. Para seguridad, hay que determinar primero qué modelo atiende realmente cada solicitud y qué nivel de acceso existe. Anthropic ha anunciado una política de despliegue y precios; los resultados independientes de cada flujo de trabajo todavía deben medirse.