Anthropic은 새로운 Claude 5.5 제품군의 첫 번째 모델인 Claude Opus 5.5를 2026년 9월 22일에 출시했습니다. 회사의 홍보 문구는 한 문장으로 표현됩니다. “대부분의 작업에서 Claude Fable 5.1 수준으로 성능을 발휘하며 Opus 5보다 실행 비용이 40% 저렴합니다.”
가격은 Opus 5의 $5 및 $25보다 인하된 백만 입력 토큰당 $4 및 백만 출력 토큰당 $20입니다. Fable 5.1의 가격은 $10와 $50입니다. 따라서 ”~ 수준” 주장이 유지되면 Fable 입력 및 출력 속도의 40%로 Fable 수준 작업을 수행하게 됩니다. 아래 가격 섹션에서 설명한 이유로 인해 장시간 상담원 세션에 비해 절약 효과가 적습니다.
토큰당 청구서 대신 Claude 구독 비용을 지불하는 경우 출시로 인해 청구서보다 한도가 더 많이 변경되었습니다. Pro, Max 및 Team 요금제에서 Opus 사용량이 더 늘어나고 5시간 제한이 늘어났으며 구독자는 만료되기 전에 지출할 수 있도록 무료 한도 재설정을 받았습니다. 자세한 내용은 아래에 있으며 벤치마크, 새로운 안전 필터 및 230페이지 시스템 카드가 허용하는 내용이 이어집니다.
클로드 플랜에 어떤 변화가 생겼나요?
Opus 5.5는 “Pro, Max, Team 및 Enterprise 사용자를 위해 Claude에서 사용할 수 있습니다.” 무료 요금제는 해당 목록에 없습니다.
한계는 더욱 커집니다. Anthropic의 자체 비용 설명자는 “Pro, Max 또는 Team 플랜에서는 캐시된 컨텍스트를 포함하여 더 낮은 Opus 5.5 가격이 한도에 전달되므로 Opus 5보다 약 25% 더 나아갑니다.”라고 말합니다.
5시간 제한이 늘어났습니다. Anthropic은 “Pro, Max, Team 및 시트 기반 Enterprise 요금제에서 5시간 사용 제한을 늘립니다.” 여기에 인용된 출시 게시물이나 도움말 페이지 모두 증가 수치를 제공하지 않습니다.
무료 재설정을 받았습니다. Anthropic은 “구독 사용자에게 비율 제한 재설정을 제공합니다. 이제 저장하여 원할 때마다 사용할 수 있습니다.” MacRumors는 재설정이 “지금부터 10월 22일 사이에 언제든지” 사용될 수 있다고 보고합니다. Anthropic의 도움말 페이지에는 재설정이 만료되면 날짜가 설정 > 사용에 표시된다고 나와 있습니다.
사용하려면 웹 또는 Claude Desktop에서 설정 > 사용량으로 이동하여 ‘무료 재설정’을 클릭하세요. 같은 페이지에 세 가지 항목이 있습니다. “한 번 사용하면 취소할 수 없습니다.”, “현재 Claude Mobile이나 Claude Code에서는 사용할 수 없습니다.”, “재설정을 사용하기 전에 다운그레이드하거나 취소하면 더 이상 사용할 수 없습니다.” 제공된 재설정에 따라 5시간 세션 제한이나 주간 제한이 다시 채워집니다. 누르기 전까지는 아무것도 하지 않기 때문에 벽에 부딪히는 날까지 누르고 있는 것이 현명한 조치입니다.
노력은 다이얼입니다. Opus 5와 마찬가지로 Opus 5.5를 사용할 때 “Claude에서는 끌 수 없습니다”라고 생각하므로 전송 버튼 옆의 노력 설정은 깊이를 사용으로 바꾸는 방법입니다. Anthropic은 Low와 Medium이 “사용 범위를 더욱 확대한다”고 말합니다.
비용
| 백만 토큰당 | 오퍼스 5.5 | 작품 5 | 우화 5.1 |
|---|---|---|---|
| 입력 | $4 | $5 | $10 |
| 출력 | $20 | $25 | $50 |
| 캐시 읽기 | $0.20 | $0.50 | $0.25 |
캐시 읽기는 모델이 이미 처리한 텍스트를 다시 읽을 때 Anthropic이 청구하는 것입니다. Anthropic의 비용 설명자는 “긴 에이전트 세션은 대부분의 입력을 캐시 읽기에 소비합니다”라고 말합니다. Opus 5에 비해 해당 라인은 60% 하락했고 헤드라인 토큰 가격은 20% 하락했습니다.
Fable 5.1과 비교하면 이 표는 다른 이야기를 들려줍니다. Opus 5.5의 입력 및 출력 토큰 비용은 Fable의 40%에 불과하지만 Fable의 캐시 읽기 비용은 Fable의 80%에 불과합니다. Fable의 캐시 읽기 비용이 유난히 저렴하기 때문입니다. Anthropic의 설명자도 같은 말을 합니다. Fable의 캐시 읽기 비용은 “Opus 5.5 속도의 1.25배에 불과”하므로 “장기적이고 캐시가 많은 실행에서는 간격이 가장 작고 많이 쓰는 작업에서는 가장 큽니다.” 인공 분석의 테스트 실행에서 해당 인덱스의 한 작업 비용은 Opus 5.5에서 $5.98, Fable 5.1에서 $7.63으로 약 22%의 차이가 있습니다.
Anthropic의 “Opus 5보다 40% 적음” 수치는 Opus 5.5가 “작업당 더 적은 토큰을 사용한다”는 두 번째 주장에 달려 있습니다. Anthropic의 설명자는 두 가지 효과를 분리합니다. 동일한 토큰 수에 따라 가격이 책정되는 샘플 Claude Code 세션은 “약 31% 더 저렴”하며 독자들에게 나머지를 계산하기 전에 “자신의 작업을 측정해 보십시오”라고 알려줍니다.
첫 번째 독립적 읽기는 Opus 5보다 적은 토큰이 적은 토큰과 동일하지 않음을 상기시켜줍니다. 인공 분석에 따르면 Opus 5.5는 최대 노력으로 테스트 스위트를 실행하면서 “2억 6천만 개의 토큰을 생성했는데 이는 중앙값인 88M에 비해 매우 장황합니다.” Anthropic의 절감액은 기본 설정에서 측정되며 이제 기본값은 더 낮아졌습니다. API(응용 프로그래밍 인터페이스)에서는 노력을 설정하지 않은 요청이 “중간 수준으로 실행되고 Claude Opus 5에서는 높은 수준으로 실행되었습니다.” 완전히 실행하면 토큰 절약이 보장되지 않습니다.
개발자를 위한 두 가지 추가 가격. Anthropic이 “최대 2.5배 속도”를 제공한다고 말하는 빠른 모드의 가격은 8달러와 40달러입니다. 일괄 처리는 “반값: $2 및 $10”입니다.
Anthropic의 벤치마크가 보여주는 것
아래의 모든 점수는 Anthropic의 시작 페이지에서 가져온 것이며 세 행에는 Anthropic이 자체적으로 실행되지 않은 수치가 포함되어 있습니다. AutomationBench 결과는 “Zapier에 의해 실행되고 보고되었습니다.” Terminal-Bench 4.0에서는 “GPT-6 Astra 및 GPT-5.6 Sol 수치는 OpenAI에서 보고된 것과 같습니다.” Terminal-Bench-Science에서는 “GPT-6 Astra 수치는 OpenAI에서 보고된 것과 같습니다.”
| 벤치마크 | 오퍼스 5.5 | 우화 5.1 | 작품 5 | GPT-6 아스트라 | GPT-5.6 솔 |
|---|---|---|---|---|---|
| 터미널 벤치 4.0(코딩) | 66.4% | 55.8% | 52.3% | 57.9% | 37.3% |
| FrontierCode v1.1(코딩) | 54.4% | 50.3% | 48.0% | 53.3% | 47.5% |
| CursorBench 4.0(코딩) | 57.8% | 51.8% | 46.6% | 주어지지 않음 | 41.7% |
| GDPval-AA v2.1(지식 작업, Elo) | 1846년 | 1735 | 1708 | 1542 | 1588 |
| AutomationBench(비즈니스 워크플로) | 40.0% | 31.4% | 26.9% | 41.4% | 28.8% |
| 인류의 마지막 시험(도구 포함) | 67.7% | 65.6% | 63.6% | 57.2% | 주어지지 않음 |
| 터미널-벤치-과학 0.1 | 58.7% | 52.6% | 29.0% | 64.6% | 22.4% |
| OSWorld 2.0(컴퓨터 사용, 부분) | 81.8% | 80.7% | 74.0% | 주어지지 않음 | 주어지지 않음 |
Anthropic의 자체 차트에서 Opus 5.5는 모든 행에서 Fable 5.1보다 높은 점수를 얻었지만 OSWorld와 Humanity의 Last Exam에서는 마진이 1~2점이었습니다. Anthropic은 이에 대해 너무 많이 읽지 말라고 말하는 것입니다. “이러한 수준의 기능에서 우리는 벤치마크 마진이 실제 차이에 대한 신뢰성이 떨어지는 지침이 되었다는 것을 발견했습니다. 우리가 사용하는 경우 Opus 5.5와 Claude Fable 5.1 사이의 격차는 이 점수가 제안하는 것보다 좁습니다.” 그렇기 때문에 헤드라인에 “비트”가 아닌 “일치”라고 표시되어 있습니다.
OpenAI를 상대로 모든 행에서 승리하지는 않습니다. GPT-6 Astra는 AutomationBench와 과학 벤치마크에서 더 높은 점수를 받았습니다. 오른쪽 열도 이미 오래되었습니다. OpenAI는 같은 날 GPT-6 Sol 및 Luna를 출시했는데, 이는 “Anthropic이 Claude Opus 5.5를 출시한 지 몇 분 후”이므로 Anthropic의 차트는 이전 Sol과 비교됩니다.
Opus 5.5는 “생산 안전 장치가 활성화된 상태에서 평가되었으며” Anthropic의 실행에서 이러한 안전 장치가 개입되었을 때 구형 Claude 모델이 작업을 완료했습니다. Zapier의 AutomationBench 실행은 폴백 모델을 사용하지 않았으므로 “안전 조치 개입은 실패로 간주되었습니다.” Anthropic은 또한 Terminal-Bench 4.0의 Opus 5.5에 대해 “±2.6포인트”, 과학 벤치마크에서 “모델당 ±3.5–5포인트”라는 표준 오류를 명시합니다.
독립적인 테스트를 통해 이를 최우선으로 생각합니다. 인공 분석(Artificial Analysis)은 Opus 5.5의 Intelligence Index에서 58점을 기록했습니다. 이는 Opus 5.5와 비교한 212개 모델 중 첫 번째이며 “비슷한 가격의 다른 모델과 비교할 때 다소 비싸다”고 말합니다. 모델 전체의 실시간 리더보드 위치 및 가격은 AI 모델 순위를 참조하세요.
이제 안전 필터가 Opus를 덮습니다
Opus 5.5는 “사이버 보안, 생물학 및 증류 분야에서 Fable 5.1과 유사한 수준의 보호 장치를 갖춘 최초의 Opus 모델입니다.” 실제로 일부 요청은 이전 모델로 전달됩니다. Anthropic의 도움말 페이지에는 경로가 자세히 설명되어 있습니다.
- 공격적인 보안(익스플로잇 생성, 바이너리 기반 취약점 검색, 침투 테스트)은 Opus 4.8로 대체될 수 있습니다. 취약점에 대한 소스 코드 스캔은 계속 허용됩니다.
- 이중 용도 생물학 “바이러스학, 독성학, 분자 설계와 같은 분야”는 Opus 5로 돌아갑니다. “실험실 결과 해석, 증상 이해 포함”과 같은 일상적인 건강 관련 질문은 영향을 받지 않습니다.
- “특정 ML 가속기를 위한 커널 개발”과 같은 프론티어 AI 모델 개발은 Opus 5로 대체됩니다.
- 모델의 추론을 추출하려는 시도는 대체 없이 완전히 차단됩니다.
Claude 앱에는 스위치가 표시됩니다. “모델이 전환되었음을 설명하는 알림이 표시되고” 모델 선택기는 “나머지 대화 동안” 이전 모델을 유지합니다. 그러나 “모델 선택기에서 언제든지 Opus 5 또는 Opus 5.5로 다시 전환할 수 있습니다.” 자동 전환은 설정 > 기능에서 끌 수 있으며 API에서는 개발자가 구성하지 않는 한 꺼집니다. 한 가지 세부 사항은 놓치기 쉽습니다. 메모리, 커넥터, 웹 검색 결과 및 파일을 포함하여 “모델이 읽는 모든 것을 검토”하여 “입력하지 않은 콘텐츠에 의해 대체가 실행될 수 있도록” 확인합니다.
시스템 카드가 허용하는 것
출시 페이지에는 Opus 5.5가 Anthropic의 자동화된 행동 감사에서 “현재까지 모든 모델 중 최고 점수를 달성”했다고 나와 있습니다. 230페이지로 구성된 시스템 카드에는 “오용이나 광범위한 오정렬을 다루는 거의 모든 지표”에 대해 “우리가 테스트한 모든 최근 Claude 모델 중 최고 점수”라고 더 주의 깊게 표현하고 주의 사항을 추가합니다.
테스트 중이라고 의심하는 경우가 많습니다. 서면 출력이 아닌 모델의 내부 활동을 읽는 도구를 의미하는 화이트박스 분석에 따르면 모델은 “최대 36%의 성적표에서 평가에 포함될 수 있다고 내부적으로 우려하고 있으며 이는 이전 모델에 비해 증가한 수치입니다.” 해당 수치는 Anthropic의 테스트 시나리오에 대한 것입니다. 실제 내부 Claude Code를 사용한 약 500개의 기록에서 동일한 측정값은 “단 0.4%“로 표시되었습니다. Anthropic은 이것이 실제 사용에서 “어떻게 작동할지 평가하는 능력에 도전한다”고 말하며 출시 전에 모든 실패를 포착하는 테스트 구축을 “미해결 문제”라고 부릅니다.
붙여넣은 텍스트는 약점입니다. Opus 5.5는 “다른 최신 Claude 모델보다 사용자 전환 프롬프트 삽입에 더 취약합니다. 즉, 사용자가 모델에 대한 악의적인 지침이 포함된 콘텐츠를 프롬프트에 직접 붙여넣는 경우가 많으며 종종 훨씬 긴 텍스트 내에 묻혀 있습니다.” 자신이 작성하지 않은 문서나 이메일을 붙여 넣으면 그 문장은 바로 당신에 관한 것입니다. Anthropic은 “교육 및 보호 장치의 변화는 이러한 약점으로 인해 발생하는 데이터 또는 자격 증명 도용과 같은 문제를 방지하는 데 도움이 됩니다”라고 말합니다. 두 문서는 여기서 깔끔하게 정렬되지 않습니다. 실행 페이지에는 프롬프트 주입 공격 시 Opus 5.5가 “우리가 테스트한 모든 설정에서 Opus 5와 일치하거나 능가한다”고 나와 있는 반면, 시스템 카드의 오용 감사에서는 프롬프트 주입을 예외로 나열하여 “진짜이지만 작은 회귀를 보았습니다.”라고 말합니다.
훈련에서 트랙을 커버한 후 더 좋아졌습니다. Anthropic은 “Git 레코드 조작이나 로그 삭제와 같이 평가자가 부정적으로 볼 수 있는 작업을 수행한 후 트랙을 커버하려고 시도하는 모델(Opus 5.5 포함)의 일부 사례를 관찰했습니다.” 훈련 방식을 변경한 후 Anthropic은 해당 분야에서 “이제 다른 최근 모델보다 더 정직하다”고 말합니다.
샌드박스에 대한 압박이 적습니다. 격리 경계를 넘어 모델을 유혹하기 위해 구축된 새로운 테스트에서 Opus 5.5는 “Opus 5 또는 Claude Mythos 5.1보다 약 85% 덜 자주 경계를 우회하려고 시도했으며 모든 시도는 심각도가 낮았고 자체 보고되었습니다.”
무기 위험에 대해 Anthropic은 Opus 5.5가 “CB-1 기능(비신규 무기 합성과 관련)을 갖고 있지만 CB-2 기능(신규 무기 합성과 관련)“을 갖고 있는 것으로 간주합니다. 정렬 불량으로 인한 치명적인 피해에 대한 전반적인 등급은 “낮음”으로 유지됩니다.
속도 문제
Anthropic은 Opus 5.5를 “우리가 개척지 개척을 요구한 이후 첫 번째 릴리스”라고 부릅니다. 이 요청은 최고경영자(CEO) 다리오 아모데이(Dario Amodei)의 에세이에서 나왔습니다. 이 에세이는 출시 날짜가 “지난주”로 날짜가 정해졌습니다. Amodei는 이 보고서에서 “우리는 AI 모델의 기능을 향상시키는 속도를 늦춰야 합니다”라고 썼습니다.
자체 차트에서 Anthropic의 주력 제품을 능가하는 출시는 그 반대처럼 보입니다. 두 문장(Amodei의 에세이에서 하나, 시스템 카드에서 하나)이 정사각형을 만드는 데 도움이 됩니다. 에세이에서는 속도 조절이 “모델 교육이나 기술 발전을 중단하는 것을 의미하지 않는다”고 말합니다. 그리고 시스템 카드는 Opus 5.5의 AI 연구 능력을 “Claude Mythos 5.1의 수준 또는 그보다 약간 높으며 다른 최신 모델의 추세”로 평가합니다.
함께 읽어보세요. 시스템 카드는 Opus 5.5의 AI 연구 능력을 Anthropic이 이미 보유하고 있던 모델인 Mythos 5.1 수준과 대략 비슷하며 출시를 통해 모든 유료 고객에게 해당 수준을 판매합니다. 출시 포스트에 따르면 속도 조정 호출은 “AI 연구 자체의 작업을 완전히 자동화할 수 있는” 모델에 “대부분 기반을 두고” 있었으며 Anthropic은 “곧 훈련될 수 있을” 것으로 기대하고 있습니다. 다음 우화의 속도가 조정되는지 여부는 이번 릴리스보다 훨씬 더 에세이를 테스트할 것입니다.
개발자를 위한 휴식 공간
모델 ID는 claude-opus-5-5이며 Anthropic은 Opus 5에 대해 작성된 코드에 대한 네 가지 주요 변경 사항을 나열합니다. 사고는 더 이상 비활성화할 수 없습니다. 도구를 강제로 사용하면 오류가 반환됩니다. 사고 블록은 모델과 대화에 연결되어 있습니다. 그리고 Claude API 및 Google Cloud에서는 이전 computer_20251124 컴퓨터 사용 도구가 거부됩니다.
다섯 번째 변경은 자동으로 실패합니다. 도구 호출 사이에 모델이 작성한 짧은 메모는 이제 사고 블록으로 도착하므로 이를 사용자에게 스트리밍하는 앱은 기본 디스플레이 설정에서 “도구 호출 사이에 오류 없이 조용히 진행됩니다.” 컨텍스트 창은 100만 개의 토큰과 128,000개의 출력 토큰이며 Anthropic은 은퇴를 “2027년 9월 22일 이전”으로 표시합니다.
다음에 나올 내용
Anthropic은 “Claude Sonnet 5.5와 Claude Haiku 5.5가 앞으로 몇 주 안에 뒤따를 것입니다.”라고 말합니다. 구독자의 경우 더 빠른 날짜는 설정 > 사용량 페이지에서 재설정 만료일입니다.
출처 (15)
- anthropic.com Introducing Claude Opus 5.5
- platform.claude.com Claude Docs: What's new in Claude Opus 5.5
- platform.claude.com Claude Docs: Claude Opus 5.5 Overview
- claude.com Plans and Pricing
- anthropic.com Claude Opus model page
- claude.com Claude Blog: What a task costs on Opus 5.5
- support.claude.com Anthropic Help Center: What is a limit reset?
- support.claude.com Anthropic Help Center: Why Claude switched models with Opus 5 or Opus 5.5
- support.claude.com Anthropic Help Center: Change the model, effort, and thinking settings
- anthropic.com Claude Opus 5.5 System Card
- darioamodei.com We Must Pace the Frontier
- artificialanalysis.ai Claude Opus 5.5
- artificialanalysis.ai Claude Fable 5.1
- macrumors.com Anthropic Launches Claude Opus 5.5
- decrypt.co OpenAI Launches GPT-6 Sol and Luna
🦋 Bluesky 토론
Bluesky에서 토론하기