Radar · 24/07/2026 · modelos

Claude Opus 5: rendimiento de Fable 5 a mitad de precio, Anthropic reorganiza su catálogo

Anthropic ha lanzado Claude Opus 5, el nuevo modelo frontier que se posiciona entre Opus 4.8 y Fable 5 en inteligencia, pero a mitad del precio de Fable 5. Está disponible desde hoy en Claude Max como modelo predeterminado y en Claude Pro como modelo más potente.

Por qué te importa. Si usas Claude para trabajar, el cálculo cambia. Opus 5 cuesta lo mismo que el predecesor Opus 4.8 pero más que duplica el rendimiento en Frontier-Bench, y en CursorBench llega a 0,5 puntos porcentuales de Fable 5 gastando la mitad. Para quienes ejecutaban tareas complejas en Fable 5 porque era el único que las aguantaba, ahora hay una alternativa que cuesta la mitad con resultados equivalentes.

El modelo también tiene un parámetro effort que te permite elegir si apuntar a máxima inteligencia o conservar tokens para resultados más rápidos y económicos. Incluso en el nivel más bajo, Opus 5 supera más tareas que cualquier otro modelo, según datos de Anthropic del 24 de julio de 2026.

El segundo punto es la autonomía. Anthropic reporta que Opus 5 verifica mejor su propio trabajo e itera hasta lograrlo. El ejemplo más claro: le proporcionaron el plano de una pieza mecánica sin permitirle verla directamente, y el modelo escribió por sí solo un pipeline de visión por computadora para extraer la geometría de los píxeles y reconstruir el modelo 3D. Ningún modelo competidor con la misma configuración lo logró en cinco intentos.

Los límites persisten: en ciberseguridad Opus 5 está por detrás de Mythos 5, y los benchmarks provienen del laboratorio que construyó el modelo. Pero los 799 puntos y 451 comentarios en Hacker News en pocas horas indican que la comunidad técnica lo está probando de verdad.

En detalle

Qué había antes. Hasta ayer el catálogo Claude tenía Opus 4.8 como modelo intermedio y Fable 5 en la cúspide. Fable 5 había sido ampliado varias veces en los planes Max y Team Premium con capacidad reducida (como contábamos el 18 de julio), señal de que la demanda superaba la oferta y de que Anthropic tenía un solo modelo realmente frontier. Opus 5 cambia esta geometría: aporta rendimiento cercano a Fable 5 a mitad de precio, y se convierte en el predeterminado en Claude Max.

Los números en contexto. Los benchmarks citados se miden al 24 de julio de 2026 según el anuncio oficial. En Frontier-Bench v0.1, Opus 5 más que duplica el rendimiento de Opus 4.8 a costo por tarea inferior. En CursorBench 3.2 con máximo effort, llega a 0,5 puntos porcentuales del pico de Fable 5, pero a mitad del costo por tarea. En ARC-AGI 3, una prueba de resolución de problemas con problemas nuevos, la puntuación es triple respecto al segundo modelo. En OSWorld 2.0, el benchmark de computer use, supera a Fable 5 gastando aproximadamente un tercio del costo. En Zapier AutomationBench, que mide la capacidad de completar tareas empresariales de extremo a extremo, la tasa de éxito es 1,5 veces la del modelo siguiente al mismo costo.

La historia que cuentan los números es eficiencia a igual gasto, más que potencia bruta. Es un mensaje directo a quienes pagan APIs por consumo y necesitan optimizar el ratio costo-resultado en cada llamada.

El parámetro effort. Opus 5 introduce un parámetro que te permite elegir el nivel de gasto para cada paso: máximo esfuerzo para tareas difíciles, ahorro de tokens para las más sencillas. Para quienes construyen agentes, esto significa poder calibrar el costo en cada etapa de un flujo, en lugar de usar el mismo modelo para todo.

La autonomía en las pruebas. Los ejemplos de los testers early-access son la señal más interesante. Un ingeniero de una trading firm usó Opus 5 para construir un data feed de mercado para un nuevo exchange en una única sesión: los modelos anteriores no completaban la tarea ni con planes detallados. Sin encontrar un feed en vivo para validar el código, el modelo construyó por sí solo un test harness para verificar que el parsing de datos fuera correcto. En un bug real en un package manager open source, Opus 5 encontró la causa raíz y solucionó un edge case que el parche de la comunidad había pasado por alto; un modelo competidor había solucionado solo el síntoma superficial y declarado el bug resuelto.

Los límites a tener en cuenta. En ciberseguridad Opus 5 sigue por detrás de Mythos 5. Los testers citados son socios comerciales de Anthropic (CEO de Cursor, Zapier, Lovable, Devin), así que tienen interés en hablar bien del producto. Los números del campo llegarán en las próximas semanas, cuando los profesionales comiencen a usarlo en tareas reales.

Para orientarte en la elección del modelo, la guía actualizada ayer por Mollick sigue siendo un buen punto de partida. Si estabas esperando a que la relación calidad-precio de Claude mejorara antes de construir agentes serios, este lanzamiento cambia las condiciones iniciales.

Escribe para buscar en curso, playbooks, skills, papers…