Anthropic lanza Claude Opus 5.5: una IA más rápida, barata y preparada para trabajar sola

Anthropic ha presentado Claude Opus 5.5, un nuevo modelo de inteligencia artificial que mejora la capacidad de Claude para programar, analizar información, utilizar herramientas y completar tareas largas con menos intervención humana. La compañía asegura que el modelo puede reducir un 40 % el coste de las cargas de trabajo habituales frente a Opus 5, un cambio que puede tener más consecuencias para el uso profesional de la IA que una simple mejora en las respuestas.

Las claves de Claude Opus 5.5 en 20 segundos

  • Anthropic estrena Claude Opus 5.5 con mejoras en programación, análisis y tareas autónomas.
  • La compañía asegura que cuesta un 40 % menos de ejecutar que Opus 5 en cargas habituales.
  • El precio baja a 4 dólares por millón de tokens de entrada y 20 dólares de salida.
  • También mejora la velocidad y las medidas de seguridad para tareas prolongadas.
  • Anthropic prepara además Claude Sonnet 5.5 y Haiku 5.5.

La diferencia importante está en cómo se plantea el trabajo. Los primeros asistentes de IA estaban pensados principalmente para responder preguntas, resumir documentos o generar textos y código a partir de instrucciones. Los modelos más recientes empiezan a asumir trabajos completos: pueden dividir una tarea en pasos, utilizar herramientas, revisar lo que han hecho y continuar durante periodos más largos.

Claude Opus 5.5 se sitúa precisamente en esa transición. Anthropic lo presenta como un modelo capaz de enfrentarse a proyectos extensos de programación, investigaciones profesionales, análisis financieros o tareas realizadas directamente sobre un ordenador.

La compañía asegura que un evaluador llegó a utilizarlo para completar una migración de 680.000 líneas de código en menos de un día. En otra prueba, Opus 5.5 auditó y corrigió una base de código de 200.000 líneas en menos de tres horas, frente a las más de 20 horas que necesitó Opus 5.

Son resultados comunicados por Anthropic y no significan que cualquier empresa pueda reproducirlos en las mismas condiciones. Pero sirven para entender hacia dónde está avanzando la tecnología.

De responder preguntas a completar trabajos

El cambio más relevante puede estar en los agentes de IA. Un agente no se limita a producir una respuesta y esperar la siguiente orden. Puede ejecutar acciones encadenadas para alcanzar un objetivo.

En programación, por ejemplo, eso significa que una persona puede pedir que se revise una aplicación completa, localizar errores, modificar diferentes archivos, ejecutar pruebas y comprobar los resultados. Cuanto mejor sea el modelo realizando todos esos pasos, menos supervisión necesita cada tarea.

Opus 5.5 ha sido diseñado para este tipo de procesos. Anthropic afirma que utiliza menos tokens para resolver determinadas tareas y que genera respuestas más de un 30 % más rápido que Opus 5.

También ha reducido el precio. La entrada cuesta 4 dólares por millón de tokens y la salida 20 dólares, frente a los 5 y 25 dólares de Opus 5. Las lecturas de caché bajan de 0,50 a 0,20 dólares por millón de tokens.

Puede parecer una diferencia pequeña cuando se utiliza un chatbot de forma ocasional. El efecto cambia cuando una empresa mantiene agentes trabajando durante horas y procesando grandes cantidades de información. En ese escenario, el coste de cada tarea se convierte en una variable importante para decidir qué trabajos merece la pena automatizar.

Anthropic calcula que la combinación de menor precio y menor consumo permite reducir un 40 % el coste de las cargas habituales frente a Opus 5.

Qué puede cambiar para empresas y trabajadores

Estos avances no significan que la IA vaya a sustituir automáticamente a equipos completos. El propio material publicado por Anthropic muestra que los resultados dependen de la tarea, la configuración y el nivel de supervisión.

Lo que sí cambia es el tipo de trabajo que puede resultar razonable delegar a un sistema de IA.

Una empresa puede utilizar un modelo de este nivel para revisar grandes cantidades de código, preparar análisis, recopilar información, crear modelos financieros o transformar documentos. Si el sistema necesita menos tokens, tarda menos y comete menos errores, el coste de mantener ese flujo de trabajo también puede bajar.

Anthropic pone un ejemplo con una operación financiera ficticia. Opus 5.5 y Opus 5 analizaron una posible adquisición entre dos empresas de software, construyeron un modelo financiero en Excel y prepararon una presentación para explicar el resultado. El nuevo modelo terminó el trabajo en 63 minutos frente a 93 minutos y, según Anthropic, el coste de producirlo fue un 50 % menor.

La compañía también asegura que Opus 5.5 obtuvo 1.846 puntos Elo en GDPval-AA v2.1, una evaluación de trabajo profesional que cubre 44 ocupaciones. En esa prueba, Fable 5.1 obtuvo 1.735 y Opus 5, 1.708.

Estos datos deben interpretarse como resultados de evaluaciones concretas, no como una medición general de la productividad de todos los profesionales. Pero muestran una tendencia: los modelos están pasando de competir únicamente por la calidad de una respuesta a competir por cuánto trabajo pueden completar y cuánto cuesta hacerlo.

Más autonomía también exige más controles

El aumento de autonomía introduce otra cuestión. Cuantas más acciones puede realizar un agente sin supervisión constante, mayor es el impacto potencial de un error.

Anthropic asegura que Opus 5.5 ha obtenido sus mejores resultados hasta ahora en su auditoría conductual automatizada, con cerca de 2.000 escenarios simulados. La empresa también afirma que el modelo intentó superar límites de contención alrededor de un 85 % menos que Opus 5 y Claude Mythos 5.1 en una evaluación específica.

La propia Anthropic reconoce que estas pruebas tienen límites. Entre ellos está la posibilidad de que un modelo detecte que está siendo evaluado y se comporte de forma diferente a como lo haría en otro entorno.

Por eso Opus 5.5 incluye controles adicionales en áreas consideradas de mayor riesgo. En ciberseguridad, muchas tareas serán redirigidas a Opus 4.8, mientras que determinados profesionales podrán acceder a capacidades más amplias mediante programas de verificación. En biología se aplican medidas similares y existe un programa específico para organizaciones verificadas.

La cuestión será especialmente relevante cuando estos modelos se utilicen conectados a herramientas empresariales. Un asistente que solo redacta un correo tiene un margen de acción limitado. Un agente que puede consultar bases de datos, modificar código, ejecutar procesos o trabajar con documentos internos tiene muchas más posibilidades de ser útil, pero también necesita permisos y controles adecuados.

El avance más importante puede estar en el coste

La llegada de Opus 5.5 muestra que la carrera de la IA tiene varias dimensiones. Mejorar los resultados sigue siendo importante, pero también lo son la velocidad, el consumo de recursos y la capacidad para completar tareas largas.

Para un usuario doméstico, una reducción del 40 % en el coste interno del modelo puede pasar desapercibida. Para una empresa que ejecuta miles de tareas automatizadas puede cambiar la cuenta económica de un proyecto.

Ese es uno de los motivos por los que la evolución de estos modelos puede tener efectos más allá de los propios chatbots. Si una tarea que antes requería muchas horas de una persona puede completarse parcialmente mediante un agente a un coste asumible, las empresas tendrán más incentivos para incorporarla a sus procesos.

Eso no determina por sí mismo qué trabajos desaparecerán ni cuánto empleo podrá automatizarse. La tecnología todavía necesita supervisión en muchas situaciones y los resultados varían según el tipo de tarea. Pero sí reduce una de las barreras para utilizar agentes de IA en procesos más largos y complejos.

Anthropic ha confirmado además que Claude Sonnet 5.5 y Claude Haiku 5.5 llegarán en las próximas semanas. Si mantienen parte de estas mejoras a precios inferiores, el efecto puede extenderse desde las aplicaciones más exigentes hasta un número mucho mayor de usos cotidianos.

Claude Opus 5.5 está disponible desde el lanzamiento en las plataformas de Anthropic y también mediante Amazon Web Services, Google Cloud y Microsoft Azure.

Preguntas frecuentes

¿Qué diferencia a Claude Opus 5.5 de los modelos anteriores?

Anthropic destaca mejoras en programación, análisis profesional, uso de ordenadores, velocidad y comunicación. También afirma que necesita menos recursos para completar determinadas tareas.

¿Por qué es importante que sea más barato?

Un menor coste resulta especialmente relevante cuando los modelos trabajan como agentes durante largos periodos o ejecutan muchas tareas automáticamente. En esos escenarios, el precio por tarea puede determinar si una automatización resulta viable.

¿Claude Opus 5.5 puede trabajar de forma autónoma?

El modelo está diseñado para realizar tareas largas y utilizar herramientas, pero el grado de autonomía depende de la aplicación y de los permisos que reciba. Anthropic ha incorporado controles adicionales para limitar determinados usos de riesgo.

¿Qué modelos llegarán después?

Anthropic ha anunciado Claude Sonnet 5.5 y Claude Haiku 5.5 para las próximas semanas.

Scroll al inicio