Anthropic presenta Claude Opus 5: rendimiento de élite a mitad de precio
Anthropic ha lanzado oficialmente Claude Opus 5, un nuevo modelo insignia diseñado para revolucionar el mercado de los LLM de gama alta al ofrecer una paridad casi total con el modelo premium Claude Fable 5 a un precio significativamente menor. Este movimiento estratégico tiene como objetivo neutralizar la presión de precios de competidores como GPT-5.6 Sol, al tiempo que proporciona a los desarrolladores una herramienta más eficiente para la programación y el trabajo de conocimiento complejo.
Revolucionando la frontera entre precio y rendimiento
La característica más sorprendente de Claude Opus 5 es su agresiva estructura de precios. Mientras que el modelo de nivel superior Claude Fable 5 cuesta 10 $ por millón de tokens de entrada y 50 $ por millón de tokens de salida, Opus 5 reduce estas tarifas a la mitad, con un precio de 5 $ por millón de tokens de entrada y 25 $ por millón de tokens de salida.
Para abordar los requisitos de latencia, Anthropic también ha introducido un "Fast Mode", que aumenta la velocidad de procesamiento en 2,5 veces, aunque a costa de duplicar el precio del token. Este sistema de precios por niveles, combinado con una enorme ventana de contexto de 1 millón de tokens, posiciona a Opus 5 como el nuevo modelo predeterminado para Claude Max y la opción más capaz para los usuarios de Claude Pro.
Supremacía en benchmarks de programación y razonamiento
Opus 5 no es simplemente una alternativa económica; es una potencia de rendimiento en dominios específicos. En la programación de terminal agéntica a través de Frontier-Bench v0.1, Opus 5 alcanzó una puntuación del 43,3 %, superando significativamente tanto a Fable 5 (33,7 %) como a GPT-5.6 Sol (34,4 %). También demostró su dominio en el trabajo de conocimiento, liderando el benchmark GDPval-AA v2 con una puntuación Elo de 1.861.
Quizás la estadística más asombrosa proviene del benchmark ARC-AGI-3, que mide la resolución de problemas novedosos. Opus 5 obtuvo un 30,2 %, casi cuadruplicando el 7,8 % alcanzado por GPT-5.6 Sol. Esto sugiere un salto masivo en la capacidad del modelo para manejar tareas que se encuentran fuera de los patrones de sus datos de entrenamiento.
Escalamiento de esfuerzo e inteligencia y eficiencia
Anthropic ha introducido un sofisticado sistema de "effort" (esfuerzo), que permite a los usuarios alternar entre cinco configuraciones: low, medium, high, xhigh y max. Esto permite un equilibrio granular entre el consumo de tokens y la profundidad del razonamiento.
Aunque Anthropic recomienda las configuraciones low y medium para tareas generales con el fin de optimizar los costes, aconseja utilizar xhigh para la programación agéntica compleja. Curiosamente, la empresa observó un rendimiento decreciente en la configuración max; tanto en Frontier-Bench v0.1 como en el Artificial Analysis Coding Agent Index, Opus 5 experimentó en realidad una ligera caída en el rendimiento con el esfuerzo máximo a pesar del mayor coste, lo que sugiere que la configuración xhigh podría ser el punto óptimo actual de eficiencia.
Seguridad y autonomía mejoradas
En respuesta directa a los comentarios de los usuarios, Anthropic ha ajustado los clasificadores de seguridad para Opus 5. Los filtros cibernéticos del modelo se activan aproximadamente un 85 % menos que los de Fable 5, abordando las críticas anteriores sobre el bloqueo excesivo de investigaciones legítimas. Aunque todavía evita la generación de exploits y el escaneo basado en binarios, es mucho más permisivo para la investigación de vulnerabilidades en el código fuente.
Además, Opus 5 muestra capacidades de autocorrección mejoradas. En pruebas del mundo real, el modelo construyó con éxito un modelo 3D en FreeCAD escribiendo su propio pipeline de visión artificial para interpretar la geometría, una tarea que dejó perplejos a todos los demás modelos de la competencia.
Conclusiones clave
- Reducción drástica de costes: Opus 5 ofrece un rendimiento de nivel insignia al 50 % del coste de tokens de Claude Fable 5.
- Avance en razonamiento: El modelo mostró una ventaja masiva de 4 veces sobre sus competidores en el benchmark ARC-AGI-3 para la resolución de problemas novedosos.
- Flujo de trabajo de desarrollador optimizado: Con clasificadores de seguridad mejorados y configuraciones de
effortespecializadas, Opus 5 proporciona una experiencia más fluida para la programación agéntica y la investigación.
