Claude Opus 5 cuesta lo mismo que Opus 4.8 pero le gana a Fable 5 en los benchmarks que importan: cuánto te ahorras en pesos como dev en México
Anthropic lanzó Claude Opus 5 el 24 de julio a $5/$25 por millón de tokens, mismo precio que su antecesor pero con resultados que superan a Fable 5 en coding, razonamiento y automatización. Todo lo que necesitas saber para decidir si te migras.
Hace 13 días Anthropic soltó Claude Opus 5 sin hacer demasiado ruido, y sin embargo es probablemente el movimiento más inteligente que han hecho como empresa: mismos precios que Opus 4.8, ventana de contexto de 1 millón de tokens, y benchmarks que le pasan por encima a Fable 5 en la mayoría de las pruebas que a un dev le importan. Si estás usando Fable 5 en producción y gastando el doble, este artículo es para ti.
Qué es Claude Opus 5 y por qué importa ahora
Según el anuncio oficial de Anthropic, Opus 5 es el cuarto modelo que lanzan en menos de dos meses (después de Mythos 5, Fable 5 y Sonnet 5), y el que completa la nueva familia. No es un update menor: es un modelo híbrido con razonamiento extendido activado por defecto, contexto de 1 millón de tokens sin costo adicional, y una diferencia de precio respecto a Fable 5 que en el mundo real se siente muy fuerte.
El punto central: $5 dólares por millón de tokens de entrada, $25 por millón de tokens de salida. Exactamente igual que Opus 4.8, su antecesor. Pero con capacidades que en varios benchmarks clave superan a Fable 5, que cuesta el doble ($10/$50).
A tipo de cambio de hoy (17.23 pesos por dólar), estamos hablando de:
- Entrada: $86 MXN por millón de tokens
- Salida: $431 MXN por millón de tokens
Los benchmarks que importan de verdad
No te voy a dar el dump completo de todas las pruebas. Estas son las que tienen relevancia práctica:
| Benchmark | Opus 5 | Fable 5 | Diferencia |
|---|---|---|---|
| Frontier-Bench v0.1 | 43.3% | 33.7% | +9.6 pp |
| OSWorld 2.0 | 70.6% | 66.1% | +4.5 pp |
| SWE-bench Verified | 97.0% | 95.0% | +2 pp |
| SWE-bench Pro | 79.2% | 80.3% | -1.1 pp |
| ARC-AGI-3 | 30.2% | N/D | 3x mejor que GPT-5.6 Sol |
En Frontier-Bench, que mide coding agéntico en escenarios reales (no toy problems), Opus 5 le saca casi 10 puntos porcentuales a Fable 5. Más del doble de lo que marcaba Opus 4.8. En OSWorld 2.0, la prueba de automatización de computadoras, también va adelante.
La única área donde Fable 5 se mantiene es SWE-bench Pro, y por menos de un punto. Para la mayoría de los casos de uso de un dev mexicano, eso no cambia la ecuación.
Según el análisis de DataCamp, Opus 5 lidera en 7 de 12 benchmarks compartidos. No es dominancia total, pero considerando que cuesta la mitad, la relación calidad-precio está al tiro.
El parámetro de esfuerzo: la feature más útil para controlar costos
Esta es la feature que más me llama la atención para uso en producción. Opus 5 trae cinco niveles de esfuerzo por request: low, medium, high, xhigh y max. El default es high.
Esto significa que puedes definir cuánto compute gasta el modelo en cada solicitud según lo que necesites:
- Low o medium: para tareas rutinarias, clasificaciones, resúmenes rápidos. Más barato y más veloz.
- High (default): para coding, análisis, razonamiento general.
- Xhigh o max: para problemas complejos donde necesitas lo mejor que puede dar.
En términos prácticos para un dev: si tienes un pipeline donde el 80% de las requests son tareas simples y el 20% son complejas, puedes usar low/medium para las simples y high para las que lo requieren, sin cambiar de modelo. Eso te ahorra lana sin comprometer calidad donde importa.
Como ya revisamos en nuestro comparativo entre Grok 4.20, GPT-5.4 y Claude Opus 4.6, el ajuste fino de costos es lo que realmente diferencia a los equipos que usan IA de manera sostenible de los que queman presupuesto en el primer mes.
El contexto de 1 millón de tokens: qué cambia
Un millón de tokens es aproximadamente 750,000 palabras, o un codebase mediano completo. Y lo importante aquí es que no hay surcharge por contexto largo, viene incluido al precio base.
Antes, para meter contexto largo con otros modelos tenías que pagar extra o lidiar con ventanas más pequeñas y chunking complicado. Con Opus 5 puedes meter documentación completa, repositorios enteros, o conversaciones largas sin calcular si te vas a pasar.
Esto es lo mismo que hizo popular a Gemini 3.1 Pro con su millón de tokens de contexto, pero Anthropic lo trae en el modelo más fuerte de su catálogo sin subir el precio.
La calculadora en pesos: cuánto te ahorras sobre Fable 5
Seamos prácticos. Si tienes un proyecto con consumo mensual de:
Startup pequeña (app con 1,000 usuarios activos, ~5M input / 1M output tokens/mes):
- Opus 5: (5 × $5) + (1 × $25) = $50 USD = $861 MXN
- Fable 5: (5 × $10) + (1 × $50) = $100 USD = $1,723 MXN
- Ahorro: $862 MXN mensuales
Startup en crecimiento (50M input / 10M output tokens/mes):
- Opus 5: (50 × $5) + (10 × $25) = $500 USD = $8,615 MXN
- Fable 5: (50 × $10) + (10 × $50) = $1,000 USD = $17,230 MXN
- Ahorro: $8,615 MXN mensuales
Carga pesada (100M input / 25M output tokens/mes):
- Opus 5: $1,125 USD = $19,384 MXN
- Fable 5: $2,250 USD = $38,768 MXN
- Ahorro: $19,384 MXN al mes
Con el peso mexicano en ~17.23 por dólar y sin señales de que la brecha de precios entre Opus 5 y Fable 5 se cierre pronto, el ahorro se acumula rápido.
¿Cuándo sí conviene quedarte con Fable 5?
La neta, hay casos donde Fable 5 todavía tiene sentido. Si tu flujo de trabajo requiere los clasificadores de seguridad más amplios en ciberseguridad o biología de frontera, Fable 5 tiene mejor cobertura ahí. También si llevas workflows autónomos de investigación científica de largo plazo donde esa fracción de diferencia en SWE-bench Pro importa.
Para el 90% de los devs mexicanos: coding, agentes, chatbots, automatizaciones de negocio, análisis de documentos, coding assistants internos, Opus 5 es la opción más inteligente ahorita mismo.
Cómo acceder desde México
Según TechCrunch, está disponible desde el día del lanzamiento en:
- Claude Platform API directamente (con tu API key de Anthropic)
- Amazon Web Services Bedrock
- Google Cloud Vertex AI
- Microsoft Azure AI Foundry
El identificador del modelo en la API es claude-opus-5. Migrar desde Opus 4.8 o desde Fable 5 es cambiar una sola línea en tu código. No hay breaking changes en el SDK.
Otro detalle que importa para empresas en México: Opus 5 no tiene política de retención de datos de 30 días que sí aplica para Fable 5 y Mythos 5. Eso simplifica el compliance para quien maneja datos sensibles.
Hay también un modo Fast para quienes necesitan velocidad: corre aproximadamente 2.5 veces más rápido al doble del precio base ($10/$50 por millón de tokens). Sigue siendo el mismo precio que el estándar de Fable 5, pero más veloz.
El dato que lo resume todo
Anthropic lanzó un modelo más capaz que su flagship anterior, al mismo precio que el modelo que ese flagship reemplazó. Si tu empresa o proyecto usa IA de manera seria y está pagando por Fable 5, vale la pena hacer la prueba con Opus 5 esta semana. El contexto de 1 millón de tokens, los cinco niveles de esfuerzo configurables y la mejora en coding agéntico hacen que el cambio tenga sentido para casi cualquier caso de uso.
¿Ya migraron o están evaluando? Cuenten qué tal les fue con los benchmarks en producción, porque los números de laboratorio y los números reales no siempre cuadran igual.
Fuentes
Comentarios
No te pierdas ningún post
Recibe lo nuevo de Al Chile Tech directo en tu correo. Sin spam.
También te puede interesar
Claude Opus 4.7 ya llegó: 67% más barato, visión 3x mejorada y 3 cambios de API que te van a tronar el código
Anthropic lanzó hoy Claude Opus 4.7: input a $5/MTok (era $15), resolución de imagen triplicada y un nuevo nivel xhigh de razonamiento. Pero el tokenizador nuevo puede comerte el ahorro. Todo lo que necesitas saber antes de migrar.
Claude Managed Agents: Anthropic quiere hospedar, escalar y correr tus agentes de IA para que tú solo escribas el prompt
Anthropic lanzó su plataforma de agentes gestionados el 8 de abril: infraestructura lista para producción a $0.08 USD por hora de sesión activa. Notion, Rakuten y Asana ya la usan. Esto es lo que debes saber si eres dev o startup en México.
Tu app de DeepSeek ya está tronada: guía de emergencia para migrar a V4 (el deadline pasó hace 10 días)
El corte de la API legacy de DeepSeek fue el 24 de julio y si no migraste, ya tienes errores en producción. Guía técnica para devs en México: qué cambiar, cómo migrarlo en 10 minutos y por qué V4-Flash sale más barato que V3.