발생한 일
앤트로픽은 2026년 7월 24일 클로드 오퍼스 5(Claude Opus 5)를 출시했다. 가격은 입력 토큰 100만 개당 5달러, 출력 토큰 100만 개당 25달러로, 이 모델이 대체하는 오퍼스 4.8(Opus 4.8)의 가격과 정확히 동일하다.
이 동결된 가격이 이번 소식의 핵심이다. 앤트로픽이 널리 제공하는 가장 강력한 모델인 클로드 페이블 5(Claude Fable 5)는 입력 토큰 100만 개당 10달러, 출력 토큰 100만 개당 50달러다. 오퍼스 5는 그 절반 가격이면서, 앤트로픽 자체 벤치마크 차트상으로는 페이블 5와의 격차가 소수점 이하 퍼센트 단위로 좁혀져 있다.
API 요금이 아니라 구독료를 내는 사용자에게는 이 변화가 물어볼 필요도 없이 이미 적용되었다. 오퍼스 5는 “클로드 맥스(Claude Max)의 새로운 기본 모델이며, 클로드 프로(Claude Pro)에서 가장 강력한 모델”이다.
주요 세부사항
- 가격: 입력 토큰 100만 개당 5달러, 출력 토큰 100만 개당 25달러로 오퍼스 4.8과 동일.
- 컨텍스트 윈도우: 100만 토큰, 최대 출력은 128,000토큰.
- 모델 ID: 클로드 API(Claude API)에서
claude-opus-5. - 패스트 모드(Fast mode): 오퍼스 5 기본 가격의 두 배로 이용 가능.
가격을 결정하는 다이얼
이번 발표의 핵심 기능은 성능이 아니라 하나의 조절 장치다.
오퍼스 5에는 “모델이 작업 수행이나 프롬프트 응답에 들이는 노력의 정도를 낮음, 중간, 높음으로 조절할 수 있게 해주는” 기능이 탑재되어 있다. 앤트로픽은 이를 “고객이 지능을 최적화하거나, 더 빠르고 저렴한 결과를 위해 토큰을 절약하는 데 사용할 수 있는” 조절 장치라고 설명한다.
이는 겉보기보다 중요한 대목이다. 토큰은 과금의 기본 단위이므로, 모델이 소모하는 토큰 수를 바꾸는 설정은 곧 작업 비용을 바꾸는 설정이다. 벤치마크 결과가 특정 노력 수준을 명시해 인용되는 것도 같은 이유에서다. 커서벤치(CursorBench) 3.2에서 오퍼스 5는 페이블 5의 최고 점수 대비 0.5퍼센트포인트 이내로 근접하면서 작업당 비용은 대략 절반에 그치지만, 이는 최대 노력 수준에서만 그렇다. 노력 수준을 낮추면 점수와 비용 둘 다 함께 내려간다.
프런티어벤치(Frontier-Bench) v0.1에서 앤트로픽은 오퍼스 5가 오퍼스 4.8의 점수를 두 배 이상 뛰어넘으면서도 작업당 비용은 더 낮다고 밝혔다. 다만 이는 어디까지나 자사 발표 수치로 받아들여야 한다. 앤트로픽은 벤치마크 결과를 구체적인 수치 표가 아닌 차트 이미지 형태로만 공개했기 때문에, 지금 유통되는 점수들은 표에서 가져온 것이 아니라 그래프를 눈대중으로 읽어낸 값이다. 독립적인 재현 검증은 아직 이루어지지 않았다.
앤트로픽이 스스로 밝힌 한계
더 흥미로운 대목은 안전성 관련 항목에 담겨 있으며, 자칫 잘못 읽기 쉽다.
앤트로픽은 “오퍼스 5는 위험한 이중용도 능력 면에서 프런티어를 확장하지 않는다”고 밝히며, “생물학 연구와 공격적 사이버보안 두 영역 모두에서 미토스 5(Mythos 5)에 뒤처져 있다”고 명시했다. 이 대목은 주의 깊게 읽어야 한다. 예상과 달리 비교 대상이 플래그십 모델이 아니기 때문이다. 미토스 5는 플래그십 모델이 아니라, 앤트로픽의 초청 전용 프로젝트 글래스윙(Project Glasswing)을 통해 방어적 사이버보안 작업용으로 제공되는 별도 모델로, 자율 가입은 불가능하다.
바로 이 구분이 핵심이다. 앤트로픽은 자사의 대중용 모델의 해킹 능력을 플래그십 모델이 아니라 전문 보안 모델과 비교한 것이다. 앤트로픽 자체의 취약점 벤치마크인 OSS-Fuzz에서 공개된 차트를 보면, 오퍼스 5는 취약점 발견 능력에서는 미토스 5와 근접한 수준을 보이지만, 실제로 작동하는 익스플로잇을 만드는 능력에서는 훨씬 낮은 점수를 기록했다. 버그는 찾아낼 수 있지만, 이를 무기화하는 데는 눈에 띄게 서툴다는 뜻이다. 이 계열의 이전 모델인 미토스 프리뷰(Mythos Preview)는 본 사이트가 27년 묵은 버그를 3주 만에 찾아낸 사례로 다룬 바로 그 모델이다.
모두가 이런 절제를 미덕으로 받아들이는 것은 아니다. 허깅페이스(Hugging Face) 최고경영자 클레망 들랑그(Clem Delangue)는 “폐쇄형 모델 API에는 정당한 보안 작업까지 걸러내고 거부하는 가드레일이 있는데, 공격을 분석하는 작업이 공격을 준비하는 작업과 겉보기에 매우 비슷하기 때문”이라고 지적했다.
그리고 오퍼스 5는 최상위 모델이 아니다. 앤트로픽은 “며칠에 걸쳐 자율적으로 처리해야 할 수도 있는 더 고난도 프로젝트에는 여전히 페이블 5를 추천한다”고 밝혔다. 6월 미국 수출 통제 지침으로 인해 앤트로픽이 모든 고객에 대해 일시적으로 비활성화해야 했다가 7월 1일 복귀하고 7월 12일 사용량 기반 크레딧 방식으로 전환된 페이블 5는 여전히 그 자리를 지키고 있다.
관전 포인트
한 세대 동안 가격을 동결한 것은 겉으로 드러나지 않는 사실상의 가격 인하다. 앤트로픽은 오퍼스 4.8의 가격표를 낮춘 것이 아니라, 같은 금액으로 살 수 있는 것을 늘렸다. 100만 토큰당 달러가 아니라 작업당 달러로 예산을 세우는 구매자들에게는 이것이 유일하게 중요한 비교 기준이며, 여기에 더해 노력 조절 다이얼이라는 두 번째 지렛대까지 얹어져 비용을 한층 더 낮출 여지를 준다.
다만 함정은, 위에 언급된 모든 성능 주장이 결국 앤트로픽 자체 평가 결과로 거슬러 올라간다는 점이다. 그중 여러 개는 라벨조차 없는 차트에서 읽어낸 값이다. 가격은 누구나 검증할 수 있지만, 지능에 대해서는 아직 회사 밖의 그 누구도 검증하지 못했다.
결론
앤트로픽은 정가는 그대로 둔 채 성능만 끌어올렸다. 클로드 맥스나 프로 요금제를 이용 중이라면 이미 이 변화를 사용하고 있는 셈이다. 토큰 단위로 요금을 내는 경우라면, 노력 설정이 이제 청구액을 좌우하는 지렛대가 된다. 그리고 공격적 보안과 조금이라도 관련된 작업이라면, 앤트로픽은 이 모델이 적합하지 않다고 분명히 밝혔다.
출처 (5)
- anthropic.com Introducing Claude Opus 5
- platform.claude.com Anthropic Docs: Models Overview
- fortune.com Anthropic debuts Claude Opus 5
- officechai.com Claude Opus 5 Benchmarks
- trendytechtribe.com Fable 5 Back in Your Plan
🦋 Bluesky 토론
Bluesky에서 토론하기