Anthropic lanzó oficialmente la última versión de su modelo insignia de inteligencia artificial: Opus 4.5. Esta es la última versión de la serie Anthropic 4.5, después del lanzamiento de Sonnet 4.5 en septiembre de este año y de Haiku 4.5 en octubre.

Opus 4.5 tuvo un buen desempeño en múltiples pruebas, incluidas pruebas de codificación (SWE-Bench y Terminal-bench), uso de herramientas (tau2-bench y MCP Atlas) y capacidades generales de resolución de problemas (ARC-AGI 2, GPQA Diamond). Vale la pena señalar que Opus 4.5 se convirtió en el primer modelo en obtener una puntuación superior al 80 % en la prueba de referencia de codificación autorizada SWE-Bench Verified.
Además de las mejoras de rendimiento, Anthropic también destacó las nuevas capacidades de Opus 4.5 en operaciones informáticas y procesamiento de tablas, y simultáneamente lanzó una serie de productos relacionados para verificar la efectividad del modelo en aplicaciones prácticas. Al mismo tiempo que se lanza Opus 4.5, Claude para Chrome y Claude para Excel, dos productos que anteriormente se encontraban en la etapa piloto, estarán disponibles para una gama más amplia de usuarios. La extensión de Chrome estará disponible para todos los usuarios de Max, mientras que la versión de Excel cubre a los usuarios de Max, de equipo y empresariales.
La nueva versión también trae mejoras significativas en tareas de texto largo y contexto largo a través de importantes optimizaciones en la forma en que se administra la memoria del modelo. Dianne Na Penn, jefa de gestión de productos de Anthropic, dijo: "Hemos realizado mejoras en la calidad del contexto largo, pero simplemente alargar la ventana del contexto no es suficiente. Cómo recordar los detalles clave también es crucial".
Estas actualizaciones también habilitan nuevas funciones que muchos usuarios han solicitado durante mucho tiempo, como un modo de "conversaciones ilimitadas" para los usuarios de Claude que pagan. Esta característica permite que el modelo comprima la memoria automáticamente cuando la ventana de contexto alcanza su límite superior, sin interrumpir el flujo de chat ni avisar al usuario.
Parte de la actualización se centra en escenarios de casos de uso de agentes, específicamente cuando Opus se utiliza como modelo principal para comandar subagentes impulsados por Haiku. Estas tareas dependen de una memoria de trabajo sólida, y la optimización de la memoria de Opus 4.5 es particularmente valiosa en tales escenarios. Penn dijo: "La memoria es la base. Claude no solo necesita poder explorar la base del código y documentos grandes, sino que también sabe cuándo retroceder y revisar".
Opus 4.5 enfrentará una dura competencia de otros modelos de vanguardia en el mercado, incluido GPT 5.1 lanzado por OpenAI el 12 de noviembre y Gemini 3 lanzado por Google el 18 de noviembre.