Claude Opus 5: rinde como el modelo más caro de Anthropic, cuesta la mitad
Anthropic lanzó Claude Opus 5 el 24 de julio de 2026. Supera a Fable 5 en 8 de 13 benchmarks a mitad de precio ($5/$25 por millón de tokens). Incluye un dial de esfuerzo para controlar costos. Qué cambia para empresas que usan IA.
El 24 de julio de 2026, Anthropic lanzó Claude Opus 5. Sin evento, sin keynote, sin cuenta regresiva. Un viernes a la tarde, el modelo apareció disponible en la API, en Claude Code, en Bedrock, en Google Cloud y en claude.ai. Y los benchmarks que vinieron con él cambian las cuentas para cualquier empresa que use IA en sus operaciones.
Los números: Fable 5 en 8 de 13 benchmarks, a mitad de precio
Opus 5 supera a Fable 5 (el modelo más caro de Anthropic, a $10/$50 por millón de tokens) en 8 de 13 benchmarks públicos. En Frontier-Bench, Opus 5 sacó 43.3% vs 33.7% de Fable 5 y 34.4% de GPT-5.6 Sol. En ARC-AGI-3 (razonamiento general), marcó 30.2% contra 7.8% de GPT-5.6 Sol. Fable 5 sigue liderando en coding puro (SWE-Bench Pro: 80.3% vs 69.2% de Opus 5), pero para el resto de los casos de uso empresarial, Opus 5 rinde igual o mejor.
- $5 / Mtok — Input: Mismo precio que Opus 4.8. Exactamente la mitad de Fable 5 ($10/Mtok). Comparable a GPT-5.6 Sol ($5/Mtok).
- $25 / Mtok — Output: Mitad de Fable 5 ($50/Mtok). GPT-5.6 Sol cobra $30/Mtok, así que Opus 5 es más barato también en output.
- 1M tokens — Contexto: Ventana de contexto de 1 millón de tokens por defecto y como máximo. Output máximo de 128K tokens.
- 43.3% — Frontier-Bench: Supera a Fable 5 (33.7%) y a GPT-5.6 Sol (34.4%) en el benchmark de razonamiento general más exigente.
El dial de esfuerzo: pagá solo por lo que necesitás
La novedad más práctica de Opus 5 es el "effort ladder": un dial con 5 niveles (low, medium, high, xhigh, max) que controla cuánto razona el modelo antes de responder. El default es high. ¿Un mail de seguimiento o una clasificación simple? Bajalo a low y ahorrás tokens. ¿Una decisión de arquitectura o un análisis legal complejo? Subilo a max.
Esto cambia la ecuación de costos. Hasta ahora, elegir modelo era todo o nada: Fable 5 para lo difícil, Haiku para lo barato. Con Opus 5 podés usar UN modelo para todo y ajustar el esfuerzo según la tarea. Anthropic dice que Opus 5 convierte esfuerzo adicional en mejores resultados de forma más confiable que cualquier Opus anterior.
Para equipos que usan Claude Code: Opus 5 ya es el modelo por defecto en Claude Code. Si usás Claude Code para programar, ya estás en Opus 5. El effort ladder se configura por sesión o por agente, así que podés tener un agente en "low" para tareas de búsqueda y otro en "max" para debugging complejo.
Comparación directa: Opus 5 vs Fable 5 vs GPT-5.6 Sol
- $5 / $25 — Opus 5: Frontier-Bench: 43.3%. SWE-Bench Pro: 69.2%. ARC-AGI-3: 30.2%. Esfuerzo configurable. 1M contexto.
- $10 / $50 — Fable 5: Frontier-Bench: 33.7%. SWE-Bench Pro: 80.3% (líder en coding). ARC-AGI-3: no reportado. 1M contexto.
- $5 / $30 — GPT-5.6 Sol: Frontier-Bench: 34.4%. SWE-Bench Pro: no comparable. ARC-AGI-3: 7.8%. Terminal-Bench: 88.8% (líder en coding agentico).
Qué significa para tu empresa
- Si usás Fable 5 para tareas generales (análisis, emails, documentos, clasificación), Opus 5 te da resultados iguales o mejores a la mitad del costo. Migrá y medí.
- Si usás la API para automatizaciones, el dial de esfuerzo te permite optimizar costo por tarea sin cambiar de modelo. Low para lo simple, high para lo complejo.
- Si tu equipo programa con Claude Code, ya están en Opus 5. Revisá que los flujos sigan funcionando igual (deberían funcionar mejor).
- Si necesitás coding puro de alto nivel (refactoring pesado, debugging de sistemas complejos), Fable 5 sigue siendo el mejor. No migres todo ciegamente.
- Si comparás con GPT-5.6 Sol: Opus 5 es más barato en output ($25 vs $30) y gana en razonamiento general. GPT-5.6 Sol gana en coding agentico (Terminal-Bench).
Disponibilidad
Opus 5 está disponible desde el 24 de julio en la API de Anthropic (model ID: claude-opus-5), Amazon Bedrock, Google Cloud, Microsoft Foundry, claude.ai, Claude Code y Cowork. El thinking está habilitado por defecto. Knowledge cutoff: mayo 2026.
Conclusión
Opus 5 no es un modelo nuevo que reemplaza al anterior. Es un modelo que hace que el más caro sea innecesario para la mayoría de los casos. Si tu empresa usa IA para operar (no solo para experimentar), la combinación de rendimiento + precio + dial de esfuerzo es la más competitiva del mercado hoy. Los benchmarks son claros, y el ahorro también.