Anthropic ha lanzado su último modelo de inteligencia artificial Claude Opus 5.5. Esta nueva versión se lanza aproximadamente dos meses después de la última actualización del modelo Opus, siguiendo el ritmo de actualizaciones habitual de Anthropic. Actualmente, Anthropic ofrece varios modelos de IA diferentes, que incluyen principalmente Haiku (el más pequeño y barato), Sonnet (de tamaño y precio intermedios) y Opus (el más grande y caro de los tres modelos). Además, hay Fable/Mythos, que es una opción de gama alta más capaz y costosa.
Esta publicación actualiza el modelo Opus de Claude de la versión 5 a la versión 5.5. Anthropic indica que Opus 5.5 es nuestro primer modelo tras un llamado a desarrollos de vanguardia. Al igual que los modelos anteriores, fue probado por evaluadores externos antes de su lanzamiento, incluidos METR y Frontier Design. En nuestras pruebas de alineación más exhaustivas, logró la puntuación más alta hasta la fecha.
Opus 5.5 presenta mejoras significativas en rendimiento
Anthropic afirma que el rendimiento de Opus 5.5 es un avance notable, mejorando mucho en comparación con Opus 5. Este es un nuevo modelo líder, y los primeros evaluadores han presenciado un gran salto en el rendimiento en sus trabajos más complejos. Un evaluador completó una migración de código de 680,000 líneas en menos de un día, un trabajo que normalmente requeriría semanas de un equipo de ingenieros. Destacó en la búsqueda y reparación de ineficiencias en el software: cuando le pedimos que redujera el tiempo de carga de cada página de una aplicación web, Opus 5.5 tuvo éxito en 39 de 40 intentos, mientras que las mejoras de Opus 5 fueron menores y alteraron el comportamiento de la aplicación.
Además, otro evaluador hizo que varios modelos de Claude crearan un juego a partir de un solo aviso; Opus 5.5 obtuvo puntuaciones más altas en gráficos y apariencia que todos los demás modelos.
En cuanto a la codificación, Anthropic señala que Opus 5.5 es especialmente competente en tareas a largo plazo y complejas, como la migración y auditoría de bibliotecas de código completas. Un evaluador temprano utilizó Opus 5.5 para auditar y reparar una biblioteca de código de 200,000 líneas en menos de tres horas, mientras que Opus 5 necesitó más de 20 horas y utilizó 2.5 veces más tokens. En una prueba interna, pedimos a Opus 5.5 y Fable 5.1 que tradujeran el software ampliamente utilizado HAProxy del lenguaje C a Rust.
Las reescrituras de ambos casi pasaron las pruebas de regresión de HAProxy, pero Opus 5.5 tardó 9.5 horas, mientras que Fable 5.1 tardó 12 horas, lo que representó un costo 51% menor. Opus 5.5 ofrece resultados de vanguardia a un costo más bajo en la codificación autónoma.
Opus 5.5 ofrece una mejor relación costo-beneficio que su predecesor
En su nivel de esfuerzo por defecto, Opus 5.5 tiene un costo de aproximadamente el 20% del de GPT-6 Astra por tarea. En las pruebas de Terminal Bench 4.0, su rendimiento es comparable al de Astra, pero su costo es aproximadamente del 40%, mientras que en las pruebas de CursorBench, supera a GPT-5.6 Sol por 11 puntos, con un costo de aproximadamente un tercio. Además, los precios de Opus 5.5 son más competitivos que los de Opus 5 ajustados: Opus 5.5 requiere menos recursos computacionales que Opus 5, y su precio refleja esto.
Nuestras pruebas muestran que, con la configuración predeterminada, Opus 5.5 tiene un costo un 40% menor en cargas de trabajo típicas en comparación con Opus 5. Los costos de las etiquetas de entrada y salida son de $4 y $20 por millón, respectivamente, un 20% menos que Opus 5. La lectura de caché (que representa la mayor parte del costo de trabajo autónomo y de codificación) es de $0.20 por millón, un 60% menos que Opus 5. La velocidad de generación de salida de Opus 5.5 también es más de un 30% más rápida que la de Opus 5.
Aparte de la reducción de precios, aumentaremos el límite de uso en cinco horas en los planes Pro, Max y Team. También hemos proporcionado un restablecimiento de límites de tasa para los usuarios suscritos, que ahora pueden guardar y utilizar en cualquier momento. El nuevo modelo Claude Opus 5.5 ya está disponible. Mirando hacia el futuro, Anthropic ha indicado que los modelos Claude Sonnet 5.5 y Claude Haiku 5.5 se lanzarán en las próximas semanas, y contarán con muchas de las mismas mejoras en rendimiento, eficiencia y seguridad.
Elemento Especificaciones Capacidad de migración de código 680,000 líneas de código completadas en menos de un día Tiempo de auditoría de código 200,000 líneas de código completadas en menos de tres horas Tiempo de traducción de HAProxy 9.5 horas (menos que las 12 horas de Fable 5.1)
Leer el artículo original en techritual.com (chino tradicional) →
The TechRitual editorial desk in Hong Kong. Articles on TechRitual World are translated from the Traditional Chinese originals on techritual.com.

