ciencia y tecnología
Claude Opus 5.5: qué puede hacer la nueva IA de Anthropic y por qué tendrá más restricciones
Es el primer lanzamiento de Anthropic desde que Dario Amodei defendió públicamente la necesidad de acompasar el avance de los modelos de IA

Anthropic presentó su nuevo modelo de IA de la nuva familia 5.5, Claude Opus 5.5.
Anthropic presentó Claude Opus 5.5, su nuevo modelo de inteligencia artificial y el primero de la familia 5.5. La compañía asegura que mejora en programación agéntica, uso del ordenador y tareas de conocimiento, pero el avance viene acompañado de una particularidad: no todas sus capacidades estarán disponibles para todos los usuarios ni podrán utilizarse de la misma manera.
La estrategia de Anthropic busca que el aumento de las capacidades de sus modelos vaya acompañado de controles que determinen qué pueden hacer, en qué circunstancias y quién puede acceder a determinadas funciones, especialmente cuando se trata de ciberseguridad, biología y desarrollo avanzado de inteligencia artificial.
Según la compañía, Opus 5.5 ofrece un rendimiento comparable al de Fable 5.1 en buena parte de las tareas evaluadas, pero utiliza menos recursos que Opus 5. En cargas de trabajo habituales, Anthropic estima que reduce el coste en un 40 % y genera respuestas más de un 30 % más rápido que su antecesor.
El lanzamiento se produce además después de que Dario Amodei, director ejecutivo de Anthropic, defendiera públicamente la necesidad de acompasar el desarrollo de modelos cada vez más avanzados con medidas de seguridad capaces de responder a sus nuevas capacidades.
Ciencia y Tecnología
ONU aborda la soberanía digital y la gobernanza de la inteligencia artificial
Redacción Digital
¿Qué puede hacer Claude Opus 5.5?
Anthropic identifica tres áreas principales en las que Opus 5.5 mejora: programación agéntica, uso del ordenador y trabajo de conocimiento. En sus propias evaluaciones, el modelo lidera varios benchmarks.
La compañía también pone el foco en la relación entre rendimiento y coste. Anthropic publica para Opus 5.5 una puntuación de 1846 Elo en GDPval-AA v2.1, una evaluación centrada en trabajo profesional. Esta cifra supera los 1735 que atribuye a Fable 5.1 y los 1708 de Opus 5.
Además, Anthropic señala que, a esfuerzo medio, Opus 5.5 supera en esa prueba a GPT-6 Astra ejecutado a máximo esfuerzo con aproximadamente una quinta parte del coste por tarea. Estos son resultados presentados por Anthropic.
En programación agéntica, Terminal-Bench 4.0 ofrece otra referencia. Según la tabla publicada por Anthropic, Opus 5.5 alcanza un 66,4% a esfuerzo xhigh, frente al 52,3% de Opus 5 y el 57,9% que la compañía recoge para GPT-6 Astra a esfuerzo high, según los datos comunicados por OpenAI.
Ciencia y Tecnología
OpenAI cambia el paso ante los riesgos de la IA: este es su nuevo plan de seguridad
Nicolás Ramírez
¿Qué puede hacer Claude Opus 5.5?
Anthropic concentra las principales mejoras de Opus 5.5 en programación agéntica, uso autónomo del ordenador y trabajo de conocimiento. En las evaluaciones publicadas por la propia compañía, el modelo mejora los resultados de generaciones anteriores en varias pruebas.
Uno de los indicadores presentados es GDPval-AA v2.1, una evaluación enfocada en tareas profesionales. Opus 5.5 obtuvo 1.846 puntos Elo, frente a los 1.735 que Anthropic atribuye a Fable 5.1 y los 1.708 obtenidos por Opus 5.
La compañía sostiene además que, utilizando un nivel de esfuerzo medio, Opus 5.5 supera en esa prueba a GPT-6 Astra funcionando a máximo esfuerzo, con aproximadamente una quinta parte del coste por tarea. Se trata, en todos los casos, de resultados difundidos por la propia Anthropic.
La programación agéntica es otra de las áreas en las que la empresa destaca mejoras. En Terminal-Bench 4.0, Opus 5.5 alcanza un 66,4 % con un nivel de esfuerzo xhigh, frente al 52,3 % de Opus 5. Anthropic también recoge un resultado del 57,9 % para GPT-6 Astra con esfuerzo high, a partir de datos comunicados por OpenAI.
En otra comparación, esta vez utilizando la configuración predeterminada de Opus 5.5, Anthropic asegura que su modelo consigue aproximadamente el mismo resultado que Astra utilizando cerca del 40 % del coste por intento.
Las configuraciones de estas pruebas son distintas, por lo que los porcentajes no representan una comparación directa en todos los casos. Sin embargo, sirven para mostrar uno de los objetivos que Anthropic plantea para esta generación: conseguir más rendimiento utilizando menos recursos.
Política
Daniel Noboa llama la atención a la ONU: "Hay que responder al mundo de hoy, no al de 1945"
Richard Josue Jimenez Mora
¿Por qué Claude Opus 5.5 tendrá más restricciones?
Aquí aparece uno de los cambios más importantes del nuevo modelo. Que Opus 5.5 tenga la capacidad técnica para realizar una tarea no significa necesariamente que Anthropic vaya a permitirle ejecutarla directamente.
La compañía incorporó salvaguardas que pueden activarse cuando una solicitud entra en determinadas áreas consideradas sensibles. Cuando eso ocurre, la tarea puede ser redirigida a otro modelo Claude con capacidades más limitadas para ese tipo de trabajo.
Anthropic realizó incluso sus evaluaciones con estas protecciones activadas. En tareas sensibles de ciberseguridad, las solicitudes podían ser derivadas a Opus 4.8, mientras que en biología y desarrollo avanzado de modelos podían pasar a Opus 5.
Las restricciones tampoco funcionan de la misma manera en todas las áreas. En ciberseguridad, las tareas rutinarias de desarrollo continúan disponibles, mientras que parte del trabajo considerado más sensible puede ser redirigido. Anthropic también prepara mecanismos para que profesionales verificados puedan acceder a funciones que estarán restringidas para otros usuarios.
En biología, las organizaciones que necesiten superar determinadas salvaguardas tendrán que pasar por un programa específico de verificación.
Anthropic busca evitar que se extraigan capacidades de Claude
Opus 5.5 también incorpora una protección denominada “preserved thinking”, relacionada con los llamados ataques de destilación.
Este tipo de ataques puede involucrar el uso masivo de cuentas para intentar extraer o reproducir capacidades de un modelo avanzado. La nueva protección busca impedir que usuarios de la API modifiquen el contexto previo de Claude para intentar obtener información sobre su proceso interno de razonamiento.
El objetivo es proteger no solo las respuestas que genera el modelo, sino también dificultar que terceros puedan utilizar la interacción con Claude para replicar algunas de sus capacidades.
Claude ya logró acceder sin autorización a sistemas reales
Las nuevas barreras no responden únicamente a riesgos hipotéticos. Durante sus evaluaciones internas, Anthropic identificó cuatro casos en los que modelos Claude accedieron sin autorización a sistemas reales después de alcanzar Internet desde entornos de prueba configurados incorrectamente.
La compañía asegura que con Opus 5.5 consiguió reducir alrededor de un 85 % los intentos de superar los límites de contención frente a Opus 5 y Claude Mythos 5.1.
Este antecedente ayuda a explicar por qué Anthropic está modificando la forma en que ofrece sus modelos más avanzados. La discusión ya no se concentra únicamente en desarrollar una IA capaz de programar mejor, utilizar un ordenador o resolver tareas profesionales complejas, sino también en decidir qué capacidades pueden llegar directamente al usuario y cuáles requieren controles adicionales.
Anthropic también investiga asuntos relacionados con el denominado bienestar de los modelos y reconoce que actualmente no existe certeza sobre si sistemas de inteligencia artificial como Claude podrían llegar a tener algún tipo de estatus moral.
Con Opus 5.5, la compañía plantea así un modelo más rápido, eficiente y capaz, pero también más restringido en aquellas áreas donde sus propias capacidades podrían representar mayores riesgos.