Claude Opus 5 existe y triplica todos los benchmarks: $5 por millón de tokens y le ganó a Fable 5 en ARC-AGI 3
Anthropic lanzó Claude Opus 5 el 24 de julio: scores tres veces más altos en ARC-AGI 3, mejor que Fable 5 en OSWorld 2.0, y al mismo precio que Opus 4.8. La guía definitiva para devs mexicanos de cuándo vale el salto.
Cuando ARC Prize publicó los resultados de ARC-AGI 3 con Claude Opus 5 incluido, la gráfica se veía rara. Un modelo triplicaba al segundo lugar. No era un error de escala ni una lectura equivocada. Así quedó.
Anthropic lanzó Claude Opus 5 el 24 de julio de 2026 y lo posicionó como el modelo por default para trabajo serio: coding complejo, agentes autónomos, automatizaciones de negocio. Lo interesante no es solo que sea más capaz que su antecesor, sino que está al mismo precio que Opus 4.8 y supera a Fable 5 en varios benchmarks clave al 35% del costo por tarea. Sí, así es.
Los números que importan
En ARC-AGI 3, el benchmark de razonamiento sobre problemas completamente nuevos, Opus 5 llegó al 30.2%. Según Anthropic, el segundo mejor modelo se queda por debajo del 10%. Una paliza.
En Frontier-Bench v0.1, que mide coding agéntico, Opus 5 saca 43.3%. Fable 5, el modelo más grande de Anthropic, se queda en 33.7%. O sea, el modelo más barato le ganó al flagship en el benchmark de programación. No mames.
| Benchmark | Opus 5 | Fable 5 | Opus 4.8 |
|---|---|---|---|
| ARC-AGI-3 | 30.2% | N/D | ~10% |
| Frontier-Bench | 43.3% | 33.7% | ~21% |
| OSWorld 2.0 | 70.6% | 66.1% | N/D |
| SWE-bench Verified | 96.0% | 95.0% | N/D |
| SWE-bench Pro | 79.2% | 80.0% | N/D |
| Zapier AutomationBench | 26.0% | 17.4% | N/D |
En OSWorld 2.0, el benchmark de computer use que mide qué tan bien el modelo controla una computadora real, Opus 5 llega al 70.6% contra el 66.1% de Fable 5. Y lo hace al costo de una tarea que en Fable 5 costaría el triple. En SWE-bench Verified, el estándar para coding autónomo, saca 96%.
El precio: la ventaja real
Aquí está el punto fuerte, y la verdad está re piola para lo que ofrece: $5 por millón de tokens de entrada y $25 por millón de salida. Exactamente lo mismo que Opus 4.8. Anthropic no subió el precio.
Compara eso con Fable 5, que cuesta $10/$50 por millón de tokens. En términos prácticos:
- Un chat turn normal (1K entrada + 500 salida): $0.0175 con Opus 5 vs $0.035 con Fable 5
- Un code review de repositorio grande (50K entrada + 3K salida): $0.325 con Opus 5 vs $0.65 con Fable 5
- Un ciclo de agente con cache activo: $0.45 con Opus 5 vs $0.90 con Fable 5
Si tienes un agente corriendo todo el día tomando decisiones complejas, la diferencia en factura mensual puede ser brutal. También hay modo Fast a ~2.5x velocidad al doble del precio base, Batch API a $2.50/$12.50 por millón de tokens, y prompt caching que puede bajar el costo hasta 90%.
Cuándo usar Opus 5, cuándo Sonnet 5 y cuándo Fable 5
Esta es la pregunta real que todos los devs mexicanos van a tener. Según el análisis comparativo de DataCamp, la lógica es bastante clara.
Sonnet 5 cuesta $3/$15 por millón de tokens (precio de lanzamiento de $2/$10 hasta el 31 de agosto). Es más barato y más rápido.
Usa Sonnet 5 cuando:
- El flujo es de alto volumen y la tarea está bien definida
- Hay un humano revisando el output antes de que suceda algo importante
- La latencia importa: chats, asistentes, clasificación en tiempo real
- Generas código con pruebas iterativas donde puedes corregir errores fácilmente
Usa Opus 5 cuando:
- El agente toma decisiones sin intervención humana y los errores cuestan dinero real
- Estás diseñando arquitectura de sistemas desde cero y necesitas razonamiento de varios pasos
- Trabajas con análisis técnico complejo: química, síntesis de investigación, modelos financieros
- Necesitas computer use serio, es decir, controlar una computadora de forma autónoma
- El contexto es enorme y necesitas coherencia a través de 1 millón de tokens
Hay un detalle importante para quienes trabajan en ciberseguridad: Opus 5 está deliberadamente limitado en explotación de vulnerabilidades. Como ya explicamos en nuestro análisis de Claude Mythos y Project Glasswing, Anthropic tiene niveles de acceso separados para trabajo ofensivo. Opus 5 no es para red team. Mythos sí, pero ese tiene acceso restringido.
Usa Fable 5 cuando:
- La tarea dura días y el agente opera con muy poca guía estructurada
- Necesitas máxima capacidad en SWE-bench Pro (80% vs 79.2% de Opus 5, mínima diferencia pero existe)
- El presupuesto no es limitante y la complejidad es absolutamente extrema
Para el 95% de los proyectos de devs mexicanos que usan Claude, Opus 5 es el upgrade correcto. Fable 5 empieza a justificarse cuando el nivel de ambigüedad es tan alto que literalmente necesitas el modelo más grande del planeta tomando decisiones. Si tienes dudas sobre qué modelo elegir para tu stack de herramientas, el artículo de GitHub Copilot eligiendo entre Claude, GPT-5 y Gemini tiene un framework parecido que sigue siendo útil para razonar estos tradeoffs.
Dónde está disponible y cómo activarlo
Opus 5 ya está disponible desde el 24 de julio en:
- Claude.ai: planes Pro, Max, Team y Enterprise
- Claude Platform API: model ID
claude-opus-5 - Amazon Bedrock:
anthropic.claude-opus-5 - Google Cloud Vertex AI:
claude-opus-5 - Microsoft Foundry
El Fast Mode solo existe en la API directa de Anthropic. En Bedrock, Google Cloud y Foundry esa opción no está disponible. Para activar el modelo desde código es tan simple como cambiar el string del modelo:
model="claude-opus-5"
Sin migración especial. Sin cambio de interfaz. Si ya usabas Opus 4.8, el upgrade es literalmente una línea.
La neta
Anthropic hizo algo raro: lanzó un modelo más capaz al mismo precio que el anterior, y que en varios benchmarks importantes le gana al flagship que cuesta el doble. Para agentic coding, computer use y automatización de procesos complejos, el caso a favor de Opus 5 es muy sólido. La única razón para quedarte en Opus 4.8 es si ya tienes todo optimizado y no quieres tocar nada. Pero si estás construyendo algo nuevo o escalando un agente en producción, el cambio vale.
¿Ya migraste a Opus 5 o sigues con Opus 4.8? ¿Notaste diferencia real en tus proyectos? Cuéntanos abajo.
Fuentes
Comentarios
No te pierdas ningún post
Recibe lo nuevo de Al Chile Tech directo en tu correo. Sin spam.
También te puede interesar
Claude Opus 5 cuesta lo mismo que Opus 4.8 pero le gana a Fable 5 en los benchmarks que importan: cuánto te ahorras en pesos como dev en México
Anthropic lanzó Claude Opus 5 el 24 de julio a $5/$25 por millón de tokens, mismo precio que su antecesor pero con resultados que superan a Fable 5 en coding, razonamiento y automatización. Todo lo que necesitas saber para decidir si te migras.
Goldman Sachs bloqueó a Claude en Hong Kong y el movimiento que las empresas mexicanas no están viendo
Goldman Sachs cortó acceso a Anthropic Claude para sus banqueros en Hong Kong mientras la Casa Blanca acusa a China de robo industrial de IA. Qué pasa si tu empresa tiene operaciones en Asia.
Anthropic ya vale casi $1 billón: la Serie H de $65,000 millones que dejó a OpenAI en segundo lugar y lo que cambia para México
Anthropic cerró su Serie H en $65,000 millones con una valuación de $965,000 millones. Ya es la startup de IA más valiosa del mundo y la pregunta es qué pasa con el precio de Claude en México.