Claude Opus 5
2026년 7월 24일에 출시된 Anthropic의 주력 Opus 모델. Claude Fable 5의 절반 가격으로 프런티어에 근접한 지능을 제공하며, 사고가 기본으로 켜져 있고 effort는 low부터 max까지 전 구간을 지원합니다.
1M tokens · Text / Vision / Code · Prompt cache
Claude Opus 5는 Anthropic의 현행 주력 Opus 모델로, Opus 4.8의 후속으로 2026년 7월 24일에 출시되었습니다. Claude Fable 5의 프런티어급 지능에 절반 가격으로 근접하며, Frontier-Bench v0.1과 GDPval-AA v2를 포함한 여러 코딩·지식 노동 평가에서는 Fable 5를 앞섭니다. 가격은 Opus 4.8과 동일하게 100만 토큰당 입력 $5, 출력 $25이므로 이미 Opus 등급에서 돌아가는 에이전트라면 그대로 교체할 수 있습니다.
전환하기 전에 알아둘 동작 변화가 있습니다. Opus 4.8은 요청하지 않으면 사고하지 않았지만 Opus 5는 사고가 기본으로 켜져 있고, effort는 low부터 max까지 전 구간을 쓸 수 있으며, 원문 사고 과정은 반환되지 않습니다. VM0에서의 크레딧 배수는 Opus 4.8과 동일한 ×2이며, 신규 조직의 기본 내장 모델 목록에도 포함됩니다.
Claude Opus 5란?
2026년 7월 24일 출시 · Anthropic의 주력 Opus 등급. 절대 상한은 Fable 5보다 낮지만 여러 에이전트·지식 노동 평가에서는 앞서며, 토큰 단가는 절반입니다. VM0에서 난도 높은 에이전트 작업에 가장 먼저 고려할 모델입니다.
Anthropic은 2026년 7월 24일 Claude API, Claude 앱, Amazon Bedrock, Google Cloud, Microsoft Foundry에서 Claude Opus 5를 출시했고, VM0는 2026년 7월 25일에 내장 모델로 추가했습니다. 가격은 Opus 4.8과 같은데 Frontier-Bench v0.1 점수는 약 두 배입니다. 핵심 메시지는 명확합니다. 같은 토큰 단가로 훨씬 높은 성능입니다.
포지션은 성능의 절대 상한이 아니라, 에이전트 코딩과 기업 지식 노동을 떠받치는 주력 모델입니다. 여러 파일에 걸친 기능 추가, 대규모 리팩터링, 장시간 자율 실행, 처음부터 끝까지 완성하는 산출물이 여기에 해당합니다. 더 어려운 SWE-bench Pro 세트와 지식의 폭에서는 여전히 Fable 5가 앞서지만, 완료 작업당 비용에서는 Opus 5가 이깁니다. 에이전트 트래픽이 늘어날 때 청구서에 그대로 드러나는 숫자입니다.
Opus 4.8과 비교해 API 동작이 두 가지 바뀌었습니다. 사고가 기본으로 켜져 있어 아무것도 설정하지 않은 요청도 답변 전에 추론하며, 사고를 끄는 것은 effort가 high 이하일 때만 허용됩니다. 캐시 가능한 최소 프롬프트도 512토큰으로 낮아져 그동안 캐시되지 않던 짧은 시스템 프롬프트도 캐시됩니다. Opus 5에는 강화된 사이버 보안 보호 장치도 적용되어, 금지 영역이나 고위험 영역의 요청은 거부로 돌아올 수 있습니다.
Claude Opus 5의 주목할 점
대표적인 아키텍처 및 기능 특징.
Opus 5의 컨텍스트 창은 100만 토큰이며 최댓값이 곧 기본값입니다. 출력은 최대 128K 토큰이고 지식 컷오프는 2026년 5월입니다. 사고는 기본으로 켜져 있고 추론 깊이는 effort 단계(low, medium, high, xhigh, max)로 조절합니다. 원문 사고 과정은 공개되지 않고 읽기 쉬운 요약만 제공됩니다. 어시스턴트 메시지 프리필은 지원하지 않으며 샘플링 파라미터(temperature, top_p, top_k)는 거부되므로 동작은 프롬프트로 유도해야 합니다. 입력은 텍스트, 고해상도 비전, 코드를 지원합니다.
한눈에 보는 사양
Claude Opus 5 벤치마크
Anthropic 출시 자료에 근거한 공급사 발표 점수입니다. 같은 벤치마크라도 데이터셋, effort 설정, 에이전트 스캐폴드에 따라 제3자 측정치가 달라지므로 대표 수치는 구성에 좌우되는 값으로 보는 것이 좋습니다.
Claude Opus 5 가격
공급사 정가, 100만 토큰당.
Claude Opus 5는 실제로 어떻게 작동하는가
프로덕션 에이전트 실행에서 관찰된 동작.
완료 작업당 비용
Fable 5 대신 Opus 5를 고르는 가장 분명한 이유입니다. 에이전트 작업에서 비슷한 결과를 토큰 단가 약 절반으로 얻을 수 있습니다. Zapier의 AutomationBench에서는 같은 작업당 비용 기준으로 차순위 모델의 약 1.5배 통과율을 보였고, 가장 낮은 effort 설정에서도 다른 어떤 모델보다 많은 작업을 완료했습니다.
기본으로 켜진 사고
Opus 4.8과 달리 thinking 파라미터를 생략한 요청도 답변 전에 추론합니다. 이를 감안해 예산을 잡으세요. max_tokens는 사고와 답변을 합쳐 제한하므로, 사고를 끄는 전제로 맞춰 둔 값이면 출력이 잘릴 수 있습니다. 사고를 끄는 것은 effort가 high 이하일 때만 가능합니다.
비용 조절의 핵심은 effort
이 모델에서는 low와 medium이 유난히 강해, 이전 주력 모델들이 최상위 설정에서 내던 수준에 맞먹는 경우가 많습니다. high(가장 어려운 코딩·에이전트 실행은 xhigh)에서 시작해 단계를 낮춰 가며, 평가가 허용하는 가장 저렴한 설정을 채택하세요.
스스로 검증
Opus 5는 지시하지 않아도 자기 출력을 점검합니다. 그래서 예전 모델용 검증 지시를 그대로 가져오면 중복 작업만 늘어납니다. 답변도 기본적으로 길어지므로 effort를 낮추기보다 간결하게 쓰라는 짧은 지시를 추가하는 편이 효과적입니다.
Claude Opus 5에 가장 적합한 에이전트 작업
한 번의 실행으로 끝나는 다중 파일 기능
명세를 처음에 모두 주고 실행시키세요. Opus 4.8 대비 Opus 5의 향상 폭은 대규모 리팩터링이나 처음부터 끝까지 완성하는 기능 같은 어렵고 여러 단계의 엔지니어링 작업에서 가장 크고, 단발성 수정에서는 가장 작습니다. 난도 상단의 일을 맡기세요.
밤새 돌려도 부담 없는 에이전트
긴 자율 실행일수록 가격 차이가 누적됩니다. Fable에 가까운 품질에 토큰 비용은 절반이므로, 야간 트리아지·마이그레이션·리서치 에이전트의 완료 작업당 비용은 대략 절반입니다.
응답이 아니라 완료가 필요한 업무 흐름
티켓 생성, 스프레드시트 갱신, 기록 대조처럼 도구를 쓰고 명확한 종료 상태가 있는 다단계 작업입니다. Anthropic의 AutomationBench와 OSWorld 결과가 같은 지점을 가리킵니다. 다른 모델이 중간에 놓아버리는 작업을 끝까지 마무리한다는 것입니다.
Claude Opus 5를 건너뛰어야 할 때
대량 처리, 지연 시간에 민감한 작업, 단순한 작업에는 Opus 5가 필요하지 않습니다. 정형적인 에이전트 루프는 배수가 절반인 Sonnet 5로 충분하고, GPT 5.6 Luna는 더 저렴합니다. 작업이 난도 상한에 있거나 SWE-bench Pro 스타일의 어려운 코딩과 폭넓은 사실 지식에 의존한다면 Fable 5를 선택하세요. 보안 연구를 비롯한 고위험 영역에서는 Opus 5의 보호 장치가 작동해 거부가 반환될 수 있습니다.
Claude Opus 5 vs 다른 모델
Claude Opus 5 vs Claude Fable 5
상한이 높은 쪽은 Fable 5, 가성비가 좋은 쪽은 Opus 5입니다. Opus 5는 Frontier-Bench(43.3% 대 33.7%), GDPval-AA v2, SWE-bench Verified에서 앞서고, Fable 5는 SWE-bench Pro와 지식의 폭을 지킵니다. Opus 5는 가격이 절반($5/$25 대 $10/$50)이고 VM0 배수도 Fable 5의 ×4 대비 ×2입니다. 가장 어려운 단계만 Fable 5로 보내고 나머지는 여기서 처리하세요.
Claude Opus 5 vs Claude Opus 4.8
가격도 등급도 같은데 성능은 확실히 높습니다. Opus 5는 Opus 4.8의 Frontier-Bench 점수를 약 두 배로 끌어올렸고 SWE-bench Verified에서도 7포인트를 더했습니다. 마이그레이션은 모델 ID 교체와 프롬프트 재조정이 전부입니다. 사고가 기본으로 켜졌으니 max_tokens를 다시 확인하고, “작업을 검증하라” 같은 지시는 삭제하세요. 지금은 중복 실행만 유발합니다.
Claude Opus 5 vs Claude Sonnet 5
정형적인 에이전트 루프의 비용 효율적인 기본값은 Sonnet 5(×1)이고, 작업이 안정적으로 끝나지 않을 때 승격시키는 대상이 Opus 5(×2)입니다. Opus 5가 오케스트레이션을 맡고 Sonnet 5가 병렬 작업을 처리하는 구성이 일반적입니다.
Claude Opus 5 vs GPT 5.6 Sol
둘 다 최상위 에이전트 모델입니다. Frontier-Bench에서는 Opus 5가 Sol을 앞서고(43.3% 대 34.4%), DeepSWE v1.1에서는 Sol이 앞섭니다(72.7% 대 68.8%). VM0에서는 조달이 아니라 라우팅 결정이므로, 같은 에이전트를 양쪽에서 돌려 비교해 보세요.
결론: Claude Opus 5를 사용해야 할까?
VM0의 기본 주력 모델입니다. Opus 5는 Fable 5의 상한에 충분히 근접해 있어 대부분의 에이전트 작업에서는 가격이 결정 요인이 되며, Opus 4.8에서 돌아가던 것은 그대로 교체할 수 있습니다. 정형적인 루프는 Sonnet 5에 맡기고, Fable 5는 정말 최상단이 필요한 소수의 작업에 남겨 두세요.
자주 묻는 질문
Claude Opus 5는 언제 출시되었나요?
Anthropic은 2026년 7월 24일 Claude API와 Claude 앱은 물론 Amazon Bedrock, Google Cloud, Microsoft Foundry에서 Opus 5를 출시했습니다. VM0는 2026년 7월 25일에 내장 모델로 추가했습니다(모델 ID claude-opus-5).
Claude Opus 5의 가격은 얼마인가요?
입력 100만 토큰당 $5, 출력 100만 토큰당 $25로 Opus 4.8과 동일하며 Claude Fable 5의 $10/$50의 정확히 절반입니다. 캐시 읽기는 100만 토큰당 $0.50입니다. VM0에서의 크레딧 배수는 ×2입니다.
Claude Opus 5가 Claude Fable 5보다 좋나요?
여러 평가에서는 그렇습니다. Opus 5는 Frontier-Bench v0.1, GDPval-AA v2, SWE-bench Verified에서 Fable 5를 앞섭니다. 다만 Fable 5는 더 어려운 SWE-bench Pro 세트와 지식의 폭에서 여전히 앞서며, 가장 어려운 추론에서는 더 높은 상한을 유지합니다. 대부분의 에이전트 작업에서는 완료 작업당 비용으로 Opus 5가 이깁니다.
Claude Opus 5는 사고가 기본으로 켜져 있나요?
네. thinking 파라미터를 생략한 요청도 답변 전에 추론합니다. 요청하지 않으면 사고하지 않던 Opus 4.8과 달라진 점입니다. 깊이는 effort(low부터 max)로 제어하며, 사고를 끄는 것은 effort가 high 이하일 때만 가능합니다. 원문 사고 과정은 반환되지 않고 읽기 쉬운 요약만 제공됩니다.
Opus 4.8에서 옮길 때 무엇이 달라지나요?
모델 ID 변경, 그다음은 프롬프트 조정입니다. 사고가 기본으로 켜지면서 max_tokens가 추론과 답변을 함께 포함하게 됩니다. Opus 5는 스스로 검증하므로 검증 지시는 고쳐 쓰기보다 삭제하는 편이 좋고, 답변이 기본적으로 길어지므로 길이가 중요하다면 간결하게 쓰라고 명시하세요.
대안
VM0에서 Claude Opus 5 사용하기
VM0에서 Claude Opus 5에 접근하는 두 가지 방법
VM0는 Claude Opus 5를 VM0 크레딧으로 과금되는 Built-in 모델로 지원하며, Anthropic API key를 사용하는 BYO(직접 키 사용) 방식으로도 지원합니다. Built-in 경로는 VM0 Managed 라우팅과 아래에서 설명하는 크레딧 배수를 사용하고, BYO 경로는 상위 공급사가 직접 과금하며 VM0 크레딧 변환을 완전히 건너뜁니다.
VM0의 추천
VM0는 Claude Opus 5를 핵심 에이전트 모델로 자리매김하며, 에이전트 실행의 실제 결과를 좌우하는 단계에서 Claude Opus 4.7, Claude Opus 4.6, Claude Sonnet 4.6와 함께 추천합니다. 이 모델들은 오케스트레이터 역할, 코드를 다루는 에이전트, 그리고 오답의 대가가 큰 모든 단계에 우리가 선택할 모델입니다.
크레딧과 ×2 배수
VM0의 모든 Built-in 모델은 ×1 크레딧 기준점에 위치한 Claude Sonnet 4.6의 배수로 가격이 책정됩니다. Claude Opus 5는 ×2 크레딧으로 과금됩니다. 이 배수는 VM0 청구서에 표시되는 값이며, 위 가격표의 공급사 정가는 VM0가 이를 크레딧으로 변환하기 전에 상위 공급사가 부과하는 금액입니다.
Claude Opus 5는 ×2로 과금되며, 이는 여기서의 한 단계가 Sonnet 4.6(×1 기준점)에서의 동일한 단계 대비 2배의 크레딧이 든다는 뜻입니다. VM0에서 프리미엄 등급이므로, 비용 효율적인 패턴은 더 저렴한 모델을 기본으로 사용하고 추가적인 추론 깊이가 정말로 필요한 단계만 Claude Opus 5로 라우팅하는 것입니다.
July 25, 2026부터 VM0에서 사용 가능.