Claude Opus 5
El modelo Opus insignia de Anthropic, publicado el 24 de julio de 2026: inteligencia cercana a la frontera a la mitad del precio de Claude Fable 5, con razonamiento activado por defecto y toda la escala de effort, de low a max.
1M tokens · Text / Vision / Code · Prompt cache
Claude Opus 5 es el modelo Opus insignia actual de Anthropic, publicado el 24 de julio de 2026 como sucesor de Opus 4.8. Se acerca a la inteligencia de frontera de Claude Fable 5 a la mitad de precio y, en varias evaluaciones de codificación y trabajo de conocimiento —Frontier-Bench v0.1 y GDPval-AA v2 entre ellas—, lo supera directamente. El precio no cambia respecto a Opus 4.8: $5 de entrada y $25 de salida por millón de tokens, así que es una sustitución directa para los agentes que ya funcionan en el nivel Opus.
Conviene conocer los cambios de comportamiento antes de migrar. El razonamiento está activado por defecto, mientras que Opus 4.8 no razonaba salvo que se lo pidieras; el effort cubre toda la escala de low a max; y la cadena de pensamiento en bruto nunca se devuelve. En VM0 tiene un multiplicador de créditos de ×2, el mismo que Opus 4.8, y forma parte del catálogo de modelos integrados para las organizaciones nuevas.
¿Qué es Claude Opus 5?
Publicado el 24 de julio de 2026 · El nivel insignia Opus de Anthropic: por debajo de Fable 5 en techo absoluto, por encima en varias evaluaciones agénticas y de trabajo de conocimiento, y a mitad de precio por token. La opción por defecto en VM0 para el trabajo agéntico exigente.
Anthropic publicó Claude Opus 5 el 24 de julio de 2026 en la API de Claude, las apps de Claude, Amazon Bedrock, Google Cloud y Microsoft Foundry; VM0 lo incorporó como modelo integrado el 25 de julio de 2026. Sucede a Opus 4.8 con un precio idéntico y casi duplica su puntuación en Frontier-Bench v0.1, que es la afirmación principal: bastante más capacidad por el mismo coste por token.
Está posicionado como el caballo de batalla para la codificación agéntica y el trabajo de conocimiento empresarial —funcionalidades que tocan varios archivos, refactorizaciones grandes, ejecuciones autónomas largas y entregables de principio a fin— más que como el techo absoluto de capacidad. Fable 5 sigue liderando el conjunto más duro de SWE-bench Pro y la amplitud factual; Opus 5 gana en coste por tarea completada, que es el número que aparece en la factura cuando el tráfico de agentes crece.
Dos comportamientos de la API cambian respecto a Opus 4.8. El razonamiento está activado por defecto, de modo que una petición sin configuración ahora razona antes de responder, y solo se puede desactivar con un effort de high o inferior. Además, el prompt mínimo cacheable baja a 512 tokens, así que los prompts de sistema cortos que antes no se podían cachear ahora sí. Opus 5 también incorpora salvaguardas de ciberseguridad reforzadas: las peticiones en áreas prohibidas o de alto riesgo pueden devolver un rechazo.
Qué destaca de Claude Opus 5
Características principales de arquitectura y capacidades.
Opus 5 tiene una ventana de contexto de 1M de tokens —el máximo es también el valor por defecto— y hasta 128K tokens de salida, con corte de conocimiento en mayo de 2026. El razonamiento está activado por defecto y su profundidad se ajusta con los niveles de effort low, medium, high, xhigh y max; la cadena de pensamiento en bruto nunca se expone, solo un resumen legible. No admite prefill del mensaje del asistente y rechaza los parámetros de muestreo (temperature, top_p, top_k): el comportamiento se dirige con el prompt. Las entradas abarcan texto, visión de alta resolución y código.
Especificaciones rápidas
Benchmarks de Claude Opus 5
Puntuaciones informadas por el proveedor a partir del material de lanzamiento de Anthropic. Los medidores independientes publican cifras distintas para los mismos benchmarks según el conjunto de datos, el nivel de effort y el andamiaje del agente, así que trata los titulares como dependientes de la configuración.
Precios de Claude Opus 5
Precio de lista del proveedor, por 1M de tokens.
Cómo se comporta Claude Opus 5 en la práctica
Comportamiento observado en ejecuciones de agentes en producción.
Coste por tarea completada
La razón más clara para elegir Opus 5 en lugar de Fable 5: resultados comparables en trabajo agéntico a aproximadamente la mitad del precio por token. En AutomationBench de Zapier su tasa de aciertos ronda 1,5 veces la del siguiente mejor modelo con el mismo coste por tarea, y hasta en su nivel de effort más bajo completa más tareas que cualquier otro modelo.
Razonamiento activado por defecto
A diferencia de Opus 4.8, una petición que omite el parámetro de razonamiento piensa antes de responder. Tenlo en cuenta en el presupuesto: max_tokens limita el razonamiento y la respuesta en conjunto, así que un límite ajustado para cargas sin razonamiento puede truncar la salida. Desactivar el razonamiento solo se permite con un effort de high o inferior.
El effort es la palanca principal de coste
low y medium son inusualmente buenos en este modelo y a menudo igualan lo que los modelos insignia anteriores producían en sus ajustes máximos. Empieza en high —xhigh para las ejecuciones de codificación y agénticas más duras— y luego baja hasta el nivel más barato que tus evaluaciones sigan aceptando.
Verifica su propio trabajo
Opus 5 revisa su salida sin que se lo pidas, así que las instrucciones de verificación heredadas de modelos anteriores tienden a generar pasadas redundantes. También escribe respuestas más largas por defecto: una instrucción breve de concisión funciona mejor que bajar el effort.
Mejores tareas para Claude Opus 5
La funcionalidad multiarchivo que sale en una sola ejecución
Dale la especificación completa por adelantado y déjalo trabajar. Las mejoras de Opus 5 sobre Opus 4.8 son mayores en ingeniería difícil y de varios pasos —refactorizaciones grandes, funcionalidades de principio a fin— y menores en ediciones de un solo turno, así que apúntalo a la parte alta de tu rango de dificultad.
El agente nocturno que puedes permitirte dejar corriendo
En las ejecuciones autónomas largas es donde se acumula la diferencia de precio. Con calidad cercana a Fable y la mitad del coste por token, un agente nocturno de triaje, migración o investigación cuesta aproximadamente la mitad por tarea completada.
El flujo de trabajo que tiene que terminar, no solo responder
Tareas de varios pasos con herramientas y un estado final real: abrir tickets, actualizar hojas de cálculo, conciliar registros. Los resultados de AutomationBench y OSWorld de Anthropic apuntan a lo mismo: termina tareas de principio a fin que otros modelos abandonan a medio camino.
Cuándo evitar Claude Opus 5
Evita Opus 5 en trabajo de alto volumen, sensible a la latencia o sencillo: Sonnet 5 cubre los bucles de agente rutinarios con la mitad del multiplicador y GPT 5.6 Luna sale aún más barato. Recurre a Fable 5 cuando una tarea esté en el techo de tu rango de dificultad o dependa de codificación dura al estilo de SWE-bench Pro y de una amplia memoria factual. La investigación en seguridad y otros dominios de alto riesgo pueden activar las salvaguardas de Opus 5 y devolver un rechazo.
Claude Opus 5 vs otros modelos
Claude Opus 5 vs Claude Fable 5
Fable 5 tiene el techo más alto; Opus 5 es la mejor relación calidad-precio. Opus 5 lidera en Frontier-Bench (43,3 % frente a 33,7 %), GDPval-AA v2 y SWE-bench Verified, mientras que Fable 5 conserva SWE-bench Pro y la amplitud factual. Opus 5 cuesta la mitad ($5/$25 frente a $10/$50) y tiene un multiplicador ×2 en VM0 frente al ×4 de Fable 5: envía los pasos más duros a Fable 5 y todo lo demás aquí.
Claude Opus 5 vs Claude Opus 4.8
Mismo precio, mismo nivel y bastante más capacidad: Opus 5 casi duplica la puntuación de Opus 4.8 en Frontier-Bench y añade siete puntos en SWE-bench Verified. Migrar es cambiar el ID del modelo y reajustar los prompts: ahora el razonamiento está activado por defecto, así que revisa max_tokens y elimina las instrucciones de tipo «verifica tu trabajo», que hoy solo provocan pasadas redundantes.
Claude Opus 5 vs Claude Sonnet 5
Sonnet 5 (×1) es el valor por defecto eficiente para los bucles de agente rutinarios; a Opus 5 (×2) promocionas una tarea cuando deja de completarse de forma fiable. El patrón habitual es Opus 5 orquestando y Sonnet 5 ejecutando el trabajo en paralelo.
Claude Opus 5 vs GPT 5.6 Sol
Ambos son modelos agénticos de primer nivel. Opus 5 supera a Sol en Frontier-Bench (43,3 % frente a 34,4 %); Sol lidera en DeepSWE v1.1 (72,7 % frente a 68,8 %). En VM0 eso es una decisión de enrutamiento y no de compra: ejecuta el mismo agente en ambos y compara.
Conclusión: ¿deberías usar Claude Opus 5?
El modelo insignia por defecto en VM0. Opus 5 se acerca lo suficiente al techo de Fable 5 como para que el precio decida en la mayoría del trabajo agéntico, y sustituye sin fricción a cualquier carga que ya corra en Opus 4.8. Deja Sonnet 5 para los bucles rutinarios y reserva Fable 5 para las pocas tareas que realmente necesitan la parte más alta del rango.
Preguntas frecuentes
¿Cuándo se publicó Claude Opus 5?
Anthropic publicó Opus 5 el 24 de julio de 2026 en la API de Claude y las apps de Claude, además de Amazon Bedrock, Google Cloud y Microsoft Foundry. VM0 lo incorporó como modelo integrado el 25 de julio de 2026 (ID de modelo claude-opus-5).
¿Cuánto cuesta Claude Opus 5?
$5 por millón de tokens de entrada y $25 por millón de salida, sin cambios respecto a Opus 4.8 y exactamente la mitad de los $10/$50 de Claude Fable 5. Las lecturas de caché cuestan $0,50 por millón. En VM0 tiene un multiplicador de créditos de ×2.
¿Es Claude Opus 5 mejor que Claude Fable 5?
En varias evaluaciones, sí: Opus 5 supera a Fable 5 en Frontier-Bench v0.1, GDPval-AA v2 y SWE-bench Verified. Fable 5 sigue liderando el conjunto más duro de SWE-bench Pro y la amplitud factual, y mantiene el techo más alto para el razonamiento más difícil. Para la mayoría del trabajo agéntico, Opus 5 gana en coste por tarea completada.
¿El razonamiento está activado por defecto en Claude Opus 5?
Sí. Una petición que omite el parámetro de razonamiento piensa antes de responder, un cambio respecto a Opus 4.8, donde el razonamiento estaba desactivado salvo petición expresa. La profundidad se controla con el effort (low a max) y solo se puede desactivar con un effort de high o inferior. La cadena de pensamiento en bruto nunca se devuelve, solo un resumen legible.
¿Qué cambia al migrar desde Opus 4.8?
El ID del modelo y, después, el ajuste de prompts. Con el razonamiento activado por defecto, max_tokens cubre ahora el razonamiento además de la respuesta; las instrucciones de verificación conviene eliminarlas en lugar de reescribirlas, porque Opus 5 se verifica solo; y las respuestas salen más largas por defecto, así que añade una instrucción explícita de concisión si la longitud importa.
Alternativas
Usar Claude Opus 5 en VM0
Dos formas de acceder a Claude Opus 5 en VM0
VM0 admite Claude Opus 5 como modelo Built-in facturado en créditos VM0, y mediante bring-your-own con una Anthropic API key. La ruta Built-in usa enrutamiento gestionado de VM0 y el multiplicador de créditos explicado abajo; la ruta bring-your-own te factura directamente con el proveedor upstream y omite la conversión de créditos VM0.
Recomendación de VM0
VM0 posiciona Claude Opus 5 como modelo principal de agente, recomendado junto a Claude Opus 4.7, Claude Opus 4.6 y Claude Sonnet 4.6 para los pasos que determinan el resultado real de una ejecución. Estos son los modelos que elegimos para el rol de orquestador, para agentes que trabajan con código y para cualquier paso donde una respuesta incorrecta sea costosa.
Créditos y el multiplicador ×2
Cada modelo Built-in en VM0 se valora como un múltiplo de Claude Sonnet 4.6, que establece la base de ×1 crédito. Claude Opus 5 factura a ×2 créditos. El multiplicador es lo que aparece en tu factura de VM0; el precio de lista del proveedor en la tabla de arriba es lo que cobra el proveedor upstream antes de que VM0 lo convierta en créditos.
Claude Opus 5 factura a ×2, lo que significa que un paso aquí cuesta 2× los créditos de un paso equivalente en Sonnet 4.6 (la base ×1). Es un nivel premium en VM0, por lo que el patrón rentable es usar por defecto un modelo más barato y enrutar solo los pasos que realmente necesitan la profundidad de razonamiento adicional a Claude Opus 5.
Disponible en VM0 desde July 25, 2026.