Anthropic continúa acelerando el desarrollo de sus modelos de inteligencia artificial. Apenas un mes después del lanzamiento de Claude Fable 5, la compañía presentó Claude Opus 5, un modelo que busca destacar no por romper récords absolutos de capacidad, sino por ofrecer una de las mejores relaciones entre rendimiento y costo del mercado.
Disponible desde el 24 de julio, Claude Opus 5 ya puede utilizarse tanto en Claude.ai como a través de la API de Anthropic, convirtiéndose en el modelo predeterminado para los usuarios de Claude Max y en la opción más potente para los suscriptores de Claude Pro.
Un modelo más económico sin sacrificar rendimiento
Uno de los aspectos más llamativos de Claude Opus 5 es su estrategia de precios.
Mientras que Claude Fable 5 cuesta:
- 10 dólares por millón de tokens de entrada.
- 50 dólares por millón de tokens de salida.
Claude Opus 5 mantiene el precio del anterior Opus 4.8:
- 5 dólares por millón de tokens de entrada.
- 25 dólares por millón de tokens de salida.
En la práctica, esto significa que ofrece un rendimiento muy cercano al de Fable 5 por aproximadamente la mitad del costo, algo especialmente atractivo para desarrolladores y empresas que ejecutan miles de consultas diariamente.
Ventana de contexto de un millón de tokens
Anthropic mantiene una de las mayores ventanas de contexto disponibles actualmente.
Claude Opus 5 puede procesar hasta:
- 1 millón de tokens
Esto permite analizar documentos extensos, bases de conocimiento, libros completos o grandes repositorios de código sin necesidad de fragmentarlos.
Cinco niveles de razonamiento
Una de las novedades más interesantes es la posibilidad de elegir el esfuerzo computacional que empleará el modelo.
Los usuarios pueden seleccionar cinco niveles:
- Low
- Medium
- High
- XHigh
- Max
Esta configuración permite equilibrar:
- velocidad;
- costo;
- consumo de tokens;
- calidad de las respuestas.
Según Artificial Analysis, la diferencia entre el modo Low y Max puede representar hasta ocho veces más consumo de tokens, aunque también supone una mejora considerable en tareas complejas.
Claude Opus 5 lidera el índice de inteligencia
La consultora independiente Artificial Analysis ubicó a Claude Opus 5 como el modelo con mayor puntuación en su Intelligence Index v4.1.
| Modelo | Intelligence Index |
|---|---|
| Claude Opus 5 (Max) | 61 |
| Claude Fable 5 | 60 |
| GPT-5.6 Sol | 59 |
| Kimi K3 | 57 |
| Claude Opus 4.8 | 56 |
Aunque la ventaja es pequeña, Opus 5 logra colocarse en la primera posición.
Este índice combina nueve pruebas distintas que evalúan capacidades como:
- programación;
- razonamiento científico;
- resolución de problemas;
- comprensión del lenguaje;
- tareas empresariales.
Destaca especialmente en tareas con agentes de IA
Donde Claude Opus 5 realmente marca diferencias es en los llamados agentes inteligentes, es decir, sistemas capaces de realizar trabajos completos de manera autónoma.
Entre sus mejores resultados destacan:
- liderazgo en GDPval-AA v2;
- liderazgo en AA-Briefcase para generación de informes, hojas de cálculo y presentaciones;
- empate con GPT-5.6 Sol + Codex en el Coding Agent Index;
- rendimiento cercano al máximo en Terminal-Bench v2.1.
Estos resultados lo convierten en una alternativa muy atractiva para automatización empresarial y asistentes de programación.
Más eficiente en costo por tarea
Aunque el precio por token sigue siendo elevado frente a otros modelos del mercado, Anthropic apuesta por otra métrica: el costo por tarea completada.
Según Artificial Analysis:
| Modelo | Costo promedio por tarea |
|---|---|
| Claude Opus 5 | 2,03 dólares |
| Claude Fable 5 | 2,75 dólares |
| Claude Opus 4.8 | 1,80 dólares |
| Claude Sonnet 5 | 1,53 dólares |
Esto significa que, aun utilizando más recursos en determinadas situaciones, Opus 5 consigue resolver trabajos complejos de forma más eficiente que Fable 5.
También mejora en investigación científica
Anthropic afirma haber conseguido avances importantes en áreas científicas.
Las pruebas internas muestran mejoras respecto a Opus 4.8 en:
- química orgánica;
- investigación sobre proteínas;
- razonamiento científico.
No obstante, estos resultados todavía no han sido replicados por laboratorios independientes.
Menor retención de datos
Otro cambio importante afecta a la privacidad.
A diferencia de Claude Fable 5, que conserva los prompts durante 30 días en algunos escenarios, Claude Opus 5 no requiere retención de datos para el acceso general, algo que puede resultar atractivo para organizaciones con políticas estrictas de confidencialidad.
Sus principales limitaciones
A pesar de sus avances, Claude Opus 5 no supera a todos sus competidores en todas las categorías.
Entre sus principales puntos débiles destacan:
Velocidad inferior
Produce alrededor de:
- 53 tokens por segundo
Mientras que la media de otros modelos evaluados ronda los 77 tokens por segundo.
Para aplicaciones donde la rapidez es prioritaria, otros modelos pueden ofrecer una mejor experiencia.
Respuestas más extensas
En el modo Max genera una cantidad considerablemente mayor de texto que la mayoría de modelos comparables.
Esto incrementa el consumo de tokens y, por tanto, el costo final en determinados proyectos.
Conocimiento factual
En pruebas de conocimiento general, Claude Fable 5 continúa obteniendo mejores resultados.
Aunque Opus 5 mejora respecto a Opus 4.8, todavía queda por detrás en algunas evaluaciones de precisión factual.
Razonamiento científico extremo
En pruebas muy especializadas, como CritPt para física avanzada, modelos como GPT-5.6 Sol, GPT-5.5 Pro y GPT-5.6 Terra mantienen una ventaja.
Un enfoque centrado en la seguridad
Anthropic también introdujo limitaciones deliberadas para evitar usos potencialmente peligrosos.
Claude Opus 5 reduce sus capacidades en tareas relacionadas con:
- generación de exploits;
- pruebas avanzadas de penetración;
- búsqueda automática de vulnerabilidades.
Cuando detecta solicitudes consideradas de alto riesgo dentro de Claude.ai o Claude Code, el sistema puede redirigir automáticamente la petición hacia Claude Opus 4.8.
En cambio, para determinadas investigaciones científicas relacionadas con biología, Anthropic indica que Opus 5 pasa a ser el modelo disponible más potente para usuarios generales.
¿Vale la pena Claude Opus 5?
La estrategia de Anthropic parece clara.
En lugar de competir únicamente por ofrecer el modelo más inteligente del mercado, la empresa busca convencer a desarrolladores y compañías mediante una mejor relación entre rendimiento y costo.
Claude Opus 5 consigue resultados prácticamente equivalentes a Fable 5 en numerosos benchmarks, pero cuesta aproximadamente un 50 % menos, lo que puede representar un ahorro significativo para organizaciones que procesan millones de tokens al día.
Sin embargo, todavía existen algunas incógnitas. Gran parte de los resultados publicados provienen de pruebas internas de Anthropic o de evaluaciones encargadas por la propia empresa antes del lanzamiento. Además, plataformas de comparación basadas en preferencias de usuarios, como LMArena, aún no han incorporado suficientes evaluaciones para determinar cómo perciben los usuarios el nuevo modelo frente a sus competidores.
Claude Opus 5 representa un cambio en la competencia entre modelos de inteligencia artificial. En lugar de centrarse exclusivamente en obtener la puntuación más alta en los benchmarks, Anthropic apuesta por ofrecer un modelo potente, con una enorme ventana de contexto, múltiples niveles de razonamiento y un costo significativamente menor que su propio modelo insignia.
Si las futuras evaluaciones independientes confirman los resultados anunciados, Claude Opus 5 podría consolidarse como una de las opciones más atractivas para empresas, desarrolladores y organizaciones que buscan maximizar el rendimiento de sus aplicaciones de IA sin disparar los costos operativos.
