무슨 일이 있었나
2026년 7월 24일, Anthropic이 Claude Opus 5를 출시했습니다. 같은 날 Claude API(모델 ID claude-opus-5), Claude.ai, Claude Code, Claude Cowork에서 바로 쓸 수 있게 됐고, Claude Max 구독의 기본 모델이자 Claude Pro에서 제공하는 최상위 옵션이 됐습니다. 더 빠른 모드는 기본가의 두 배 요금으로 약 2.5배 빠르게 동작합니다.
가격은 입력 100만 토큰당 5달러, 출력 100만 토큰당 25달러로, 이전 모델 Opus 4.8과 같은 요금입니다. Anthropic은 Opus 5가 지난 6월 나온 더 비싼 플래그십 Claude Fable 5의 프론티어급 성능에 근접하면서도 가격은 절반이라고 설명하지만, 이는 자체 설명이며 고르게 성립하지도 않습니다. CursorBench 3.2, OSWorld 2.0 등 일부 벤치마크에서는 더 낮은 비용으로 Fable 5 결과에 근접하거나 앞선다고 하지만, 다른 벤치마크에서는 Fable 5 비교 자체를 제시하지 않습니다. Anthropic은 또 Opus 5가 이전에 다룬 별도의 접근 제한 모델 Mythos 5에는, 특히 취약점 공격 코드 작성 같은 사이버보안 과제에서 여전히 못 미친다고 밝혔습니다. 셋은 서로 다른 성능 특성을 지닌 별개의 모델이지, 서로 바꿔 부를 수 있는 버전이 아닙니다.
Anthropic이 밝힌 다른 수치들, 모두 자체 보고이며 독립 검증되지 않았습니다. Frontier-Bench v0.1 점수는 더 낮은 과제당 비용으로 Opus 4.8의 두 배가 넘고, ARC-AGI 3 점수는 차순위 모델의 세 배이며, 생명과학 평가에서도 유기화학·단백질 예측 과제에서 두 자릿수 퍼센트포인트만큼 Opus 4.8을 앞선다고 밝혔습니다. 안전성 관련해서는 자체 감사에서 부정합 행동 점수가 2.3으로 최근 모델 중 가장 낮았고 Opus 4.8·Sonnet 5·Fable 5보다 Claude 헌장을 더 잘 지킨다면서도, 사이버보안 평가에서는 여전히 Mythos 5에 못 미친다고 덧붙였습니다. TechCrunch는 Fable 5·Mythos 5에 적용되는 30일 데이터 보관 정책이 Opus 5에는 적용되지 않고, 안전 분류기 작동 빈도가 Fable 5보다 약 85% 낮을 것으로 예상된다고 보도했습니다.
왜 중요한가
Anthropic은 이제 플래그십 모델 하나를 하나의 가격으로 파는 회사가 아닙니다. Opus, Fable, 별도로 접근이 제한된 Mythos가 각기 다른 가격·성능대에 자리 잡아, 어떤 모델을 쓸지는 최신 여부가 아니라 작업과 예산에 맞는 등급의 문제가 됐습니다. Opus 5 가격을 Opus 4.8 수준으로 유지하며 더 나은 성능을 주장한다는 점이 사실이라면, 추가 비용 없이 에이전트형 코딩이나 긴 작업을 더 싸게 돌릴 수 있습니다. 다만 이 수치들은 모두 외부 평가기관이 아닌 Anthropic 자체 테스트에서 나온 것이며, 스스로도 한 영역에서는 Mythos 5에 못 미친다고 밝힌 만큼 '거의 Fable 5'라는 표현을 일반적 동등함으로 받아들이기는 어렵습니다.
다음에 무엇을 하면 좋은가
- Opus 5가 Fable 5나 Mythos 5를 대체한다고 단정하지 마세요. 비교는 벤치마크별로 다르고, 사이버보안 과제에서는 여전히 Mythos 5에 못 미친다고 스스로 밝혔습니다.
- 이미 Opus 4.8을 쓰고 있다면 가격은 그대로이므로, 성능 향상을 직접 확인한 뒤라면 추가 비용 없이 이득을 볼 수 있습니다.
- 자체 보고 점수만으로 결정하지 말고 독립 벤치마크 결과를 기다리세요.
- 보안 연구나 취약점 분석 작업이라면 Opus 5가 Mythos 5와 같은 수준이라고 가정하지 마세요.
- 사용 중인 모델·요금제의 데이터 보관 약관을 확인하세요. 모델별로 보관 방식이 다르다고 알려져 있습니다.
이 브리핑은 Anthropic의 2026년 7월 24일 발표와 TechCrunch의 같은 날 보도를 요약하고, The Verge의 같은 날 보도를 세 번째 출처로 인용합니다. 벤치마크, 안전성, 가격, 효율성 관련 수치는 모두 Anthropic이 밝힌 주장이며 LumoMate가 독립적으로 검증하지 않았습니다.