Claude Opus 5: Inteligencia de Frontera a un Tercio del Precio

Anthropic lanzó Claude Opus 5 el 24 de julio de 2026. El nuevo modelo insignia empata o supera a Fable 5 en coding agéntico y knowledge work, cuesta aproximadamente un tercio del precio (USD 5 por millón de tokens de entrada, USD 25 por millón de salida) y debutó como número 1 en el Artificial Analysis Intelligence Index. La curva precio-inteligencia del mercado enterprise acaba de comprimirse, y la cuenta de quien enruta millones de tokens al mes cambió.
Lo que sucedió
Claude Opus 5 está disponible desde el 24 de julio de 2026 en todas las plataformas de Anthropic: apps Claude, Claude Code y API, al mismo precio que Opus 4.8. Anthropic describe a Claude Opus 5 como un modelo con inteligencia cercana a la de Fable 5 por aproximadamente un tercio del costo. La afirmación no es marketing. Los números lo respaldan.
En Frontier-Bench v0.1, Claude Opus 5 supera a todos los demás modelos y más que duplica el rendimiento de Opus 4.8, con menor costo por tarea. En CursorBench 3.2, queda a 0,5 puntos porcentuales del pico de Fable 5, entregando ese resultado a la mitad del costo por tarea. En ARC-AGI-3, la evaluación de resolución de problemas inéditos, alcanzó 30,2%. Es triple del puntaje del segundo lugar. En GDPval-AA, nuevo estado del arte. En Zapier AutomationBench, la tasa de aprobación de Claude Opus 5 es aproximadamente 1,5 veces la del siguiente mejor modelo al mismo costo por tarea. En OSWorld 2.0, el benchmark de computer use, Claude Opus 5 supera a todos los modelos en cualquier rango de costo. Supera el mejor resultado de Fable 5 por aproximadamente un tercio del costo.
Un dato más. La Olimpiada Internacional de Matemática de 2026 (IMO 2026): Claude Opus 5 acertó 42 de 42 preguntas, según Anthropic. El umbral para medalla de oro era 29.
En ciencias de la vida, Claude Opus 5 supera a Opus 4.8 en todas las evaluaciones internas de Anthropic. Química orgánica: +10,2 puntos porcentuales. Predicción de función de proteína a partir de secuencia: +7,7 puntos porcentuales.
Anthropic también anunció dos funciones beta. Los cambios de herramienta en medio de la conversación preservan el caché de prompt en Claude Platform. Los fallbacks automáticos en la API permiten que las solicitudes bloqueadas por los clasificadores de seguridad de Claude Opus 5 se enruten automáticamente a otro modelo.
En cuanto a alineamiento, Claude Opus 5 registró 2,3 en el puntaje de comportamiento desalineado de la auditoría conductual automatizada de Anthropic. Es el valor más bajo entre todos los modelos recientes de la compañía. En ciberseguridad, Claude Opus 5 empata con Mythos 5 en la identificación de vulnerabilidades, pero queda muy atrás en la escritura de exploits. En el benchmark OSS-Fuzz de Anthropic, Claude Opus 5 encuentra bugs con eficacia comparable a Mythos 5 y produce exploits con eficacia materialmente inferior.
Claude Opus 5 no exige retención de datos para acceso general, misma política que los modelos Opus anteriores.
Por qué es importante
El mercado de modelos de IA está dividido en dos estantes desde que Fable 5 estableció el techo de precio. El estante superior cobra USD 15 a USD 25 por millón de tokens de entrada y entrega rendimiento de frontera. El estante inferior cobra USD 2 a USD 5 y entrega rendimiento competitivo, con una brecha visible en tareas complejas. Claude Opus 5 colapsa esa división.
Con USD 5 de entrada y USD 25 de salida, Claude Opus 5 entrega un rendimiento que, en múltiples benchmarks independientes, empata o supera a modelos que cuestan el triple. El costo por tarea en el Artificial Analysis Intelligence Index coloca a Claude Opus 5 en el rango más atractivo del gráfico de dispersión: alta inteligencia, bajo costo por unidad de trabajo.
La implicación para el CFO es directa. Una operación que gasta USD 100 mil al mes en tokens con un modelo de frontera puede, al migrar a Claude Opus 5, reducir la cuenta de inferencia hasta en dos tercios sin pérdida medible de calidad en coding, knowledge work y tareas agénticas. La matemática es simple, pero exige que el CFO evalúe modelos por costo por tarea, no por puntaje técnico. El costo por tarea es la métrica que el precio de lista no muestra: un modelo más barato por token puede generar más tokens para completar la misma instrucción, anulando la ventaja. Claude Opus 5 gana en ambas direcciones. Para el CTO, el cálculo es más fino. Claude Opus 5 está detrás de Mythos 5 en ciberseguridad ofensiva y detrás de Fable 5 en tareas de investigación biológica de larga duración. Gana, sin embargo, en las dimensiones que responden por la mayor parte del volumen de tokens en producción: coding, automatización, knowledge work y computer use.
El precedente importa. Anthropic repitió con Claude Opus 5 la estrategia que hizo de Claude Sonnet el modelo más adoptado en producción: fijar el precio de un modelo de alta inteligencia en el rango del mid-tier y cambiar la pregunta del comprador. Es la misma dinámica que analizamos en la guerra por el share de tokens entre DeepSeek V4 y los modelos establecidos: el precio se comprime, el volumen migra, y quien no recalcula la regla de enrutamiento paga más por el mismo trabajo.
La pregunta del comprador ya no es cual modelo es el más inteligente. La pregunta es cual modelo entrega la inteligencia que su caso de uso exige al menor costo. Claude Opus 5 reposiciona la vara de medir. Un equipo que hoy paga precio de frontera por tareas que Claude Opus 5 resuelve con la misma calidad está quemando presupuesto que podría redirigirse a más casos de uso o a modelos especializados donde la diferencia de rendimiento realmente se justifica. La decisión de enrutamiento dejó de ser técnica para volverse financiera.
Lo que cambia en la práctica
La tabla muestra los cambios concretos que Claude Opus 5 introduce en siete dimensiones críticas para quienes ejecutan IA en producción: precio, rendimiento, costo por tarea, capacidad de razonamiento inédito, computer use, enrutamiento de seguridad y gestión de caché. En cada fila, el régimen anterior a la izquierda, el nuevo régimen a la derecha.
| Dimensión | Antes de Claude Opus 5 | Después de Claude Opus 5 |
|---|---|---|
| Precio de entrada al nivel de inteligencia de frontera | USD 15 a USD 25 por millón de tokens (precio Fable) | USD 5 por millón de tokens, mismo rango de Opus 4.8 |
| Rendimiento en coding agéntico (Frontier-Bench, CursorBench) | Fable 5 como techo aislado | Claude Opus 5 empata o queda a 0,5 pp de Fable 5 |
| Costo por tarea para knowledge work de alta complejidad | Dominado por modelos de USD 15+ de entrada | Claude Opus 5 lidera el GDPval-AA con costo inferior |
| ARC-AGI-3 (problemas inéditos) | Segundo lugar en el rango de ~10% | Claude Opus 5 al 30,2%, triple del segundo |
| Computer use (OSWorld 2.0) | Fable 5 con el mejor resultado absoluto | Claude Opus 5 supera a Fable 5 por ~1/3 del costo |
| Enrutamiento de safety (API) | Solicitud bloqueada = fallo | Fallback automático a otro modelo (beta) |
| Cambio de herramienta en medio de la conversación | Invalidaba el caché de prompt | Caché preservado (beta) |
Qué hacer ahora
El lanzamiento de Claude Opus 5 cambia la ecuación de costos y la estrategia de enrutamiento de cualquier equipo que opere modelos de frontera en producción. A continuación, cuatro decisiones que el lanzamiento activa de inmediato, con el contexto que justifica cada una.
-
Recalcule el costo por tarea, no el costo por token. El precio de lista de Claude Opus 5 es idéntico al de Opus 4.8, pero Claude Opus 5 genera menos tokens para resolver la misma tarea en múltiples escenarios. La propia Anthropic reporta 26% menos tokens en promedio respecto a Opus 4.8 en uso jurídico, y un cliente reportó un séptimo de los tokens de razonamiento con latencia inferior a la mitad. Migrar de Opus 4.8 a Claude Opus 5 mantiene el precio por token y reduce el costo por tarea. Migrar desde un modelo de frontera más caro reduce ambos.
-
Pruebe Claude Opus 5 en su benchmark interno antes de decidir. Los benchmarks públicos muestran empate o victoria de Claude Opus 5 contra Fable 5 en coding, knowledge work y automatización. Su caso de uso puede estar en el rango donde Fable 5 aún lidera, o en el rango donde Claude Opus 5 lidera con amplitud. La única respuesta correcta es probar con sus tareas, en su dominio, con su definición de éxito. El CTO de Box reportó ganancias del 11% en análisis de datos y 17% en due diligence con Claude Opus 5 sobre Opus 4.8. Su número será diferente.
-
Si Claude Opus 5 gana la prueba, recalcule el modelo de enrutamiento. Los equipos que operan un gateway de IA pueden agregar Claude Opus 5 al pool de modelos y configurar reglas de enrutamiento que prioricen Claude Opus 5 para coding, knowledge work y automatización, reservando el modelo de frontera más caro para las tareas donde la diferencia de rendimiento justifica el costo. La migración no exige reescribir integraciones: Claude Opus 5 expone la misma API de Opus 4.8.
-
Para equipos fuera de Estados Unidos, incluya el tipo de cambio y los cargos de importación en la cuenta. El precio de USD 5 por millón de tokens de entrada es el precio de lista en dólar. La remesa internacional, el spread cambiario y los cargos de importación elevan el costo efectivo para empresas que contratan directamente desde América Latina y otras regiones. Un gateway con facturación local en moneda local y nota fiscal elimina esa sobrecarga. Con Claude Opus 5 a USD 5, el costo total desembolsado en el modelo directo ronda los USD 7,75 por millón de tokens. Con facturación local o enrutamiento a través de un partner regional, se acerca a los USD 5.
Preguntas frecuentes
Claude Opus 5 sustituye a Fable 5?
En coding, knowledge work, automatización y computer use, Claude Opus 5 empata o supera a Fable 5 a la mitad del precio. En ciberseguridad ofensiva, Mythos 5 se mantiene adelante. En tareas de investigación biológica autónoma de larga duración, Fable 5 aún lidera. La respuesta depende del caso de uso, y la recomendación es probar con sus tareas antes de sustituir.
El precio de Claude Opus 5 es el mismo de Opus 4.8. Qué cambió económicamente?
El precio por token no cambió. Lo que cambió es la inteligencia por token. Claude Opus 5 resuelve las mismas tareas que Opus 4.8 con menos tokens, menos llamadas de herramienta y menos tiempo. El costo por tarea cayó porque el modelo es más eficiente, no porque el precio de lista bajó.
Claude Opus 5 exige retención de datos?
No. La política es la misma de los Opus anteriores. Claude Opus 5 no tiene requisitos de retención de datos para acceso general.
ARC-AGI-3 al 30,2% es un resultado relevante para uso empresarial?
ARC-AGI-3 mide la capacidad de resolver problemas que el modelo nunca ha visto antes, sin depender de memorización. Para uso empresarial, un puntaje alto en ARC-AGI-3 señala que Claude Opus 5 generaliza mejor en situaciones inéditas. Exactamente el tipo de situación que aparece cuando un agente encuentra un edge case en producción o cuando un analista pide un análisis que no tiene paralelo en los datos de entrenamiento. Es relevante. Triple del puntaje del segundo lugar es una diferencia que merece atención.
Perspectiva
Claude Opus 5 llega tres días después de una secuencia de lanzamientos de frontera que colocaron a seis laboratorios por encima de 50 en el Artificial Analysis Intelligence Index. La diferencia de Claude Opus 5 respecto a los demás lanzamientos de la quincena está en la dimensión en que compite. No compite solo en inteligencia. Compite en la dimensión que el comprador empresarial prioriza: inteligencia por dólar.
Anthropic construyó Claude Opus 5 como un modelo que corre en Claude Max como predeterminado y en Claude Pro como el modelo más fuerte disponible. No es un modelo de vitrina. Es un modelo de volumen, posicionado para ser el caballo de batalla de equipos que ejecutan agentes, revisan código y automatizan flujos de trabajo.
El movimiento de Anthropic tiene un efecto colateral que los compradores ya están calculando. Si Claude Opus 5 ofrece inteligencia de frontera a precio de mid-tier, los demás laboratorios tendrán que responder con recortes de precio o con rendimiento que justifique la prima actual. En cualquiera de los dos escenarios, el costo por unidad de inteligencia sigue cayendo, y quien tiene su capa de enrutamiento configurada para aprovechar la caída gana en cada iteración.
Para equipos que ya usan Nexforce Router, Claude Opus 5 entra al pool de modelos disponibles y puede probarse en paralelo con el modelo actual sin cambiar una línea de código. El ranking en tiempo real del Router actualiza la posición de Claude Opus 5 conforme los benchmarks independientes evolucionan, y la regla de enrutamiento puede ajustarse para dirigir coding y knowledge work a Claude Opus 5 mientras se mantiene el modelo de frontera más caro para las tareas donde la diferencia se justifica. La facturación en moneda local elimina la sobrecarga cambiaria que encarece el costo por token para empresas fuera de Estados Unidos. Para el CTO que está recalculando el costo por tarea después del 24 de julio, Claude Opus 5 es la primera variable que debe ingresar en la hoja de cálculo. Las demás vendrán después, cuando el resto del mercado ajuste sus precios.
Referencias y Lectura Complementaria
- Anthropic, "Introducing Claude Opus 5", 24 de julio de 2026. Fuente primaria.
- Artificial Analysis, "Claude Opus 5: the new leader in agentic knowledge work", 24 de julio de 2026.
- Artificial Analysis, "Opus 5: Fable 5 level intelligence at a lower cost per task", 24 de julio de 2026.
- Artificial Analysis Intelligence Index v4.1, lectura del 27 de julio de 2026.
- Anthropic, "Claude Opus 5 System Card", julio de 2026.

Acelera la eficienciaoperativa de tu negocio
Diseñamos tecnología de nivel global para impulsar escala del negocio
Hablar con un Especialista