링크가 복사되었습니다!

클로드 페이블 5.1 취약점 탐색 허용, 6월 중단을 부른 바로 그 기능

Anthropic은 2026년 9월 1일 Claude Fable 5.1 및 Mythos 5.1을 출시했습니다. 가격은 100만 토큰당 10달러 및 50달러로 유지되고 캐시 읽기는 75% 인하되었으며, 이제 소프트웨어 취약점을 탐색할 수 있습니다. 이는 Anthropic에 따르면 지난 6월 Fable 5 가동 중단을 초래했던 탈옥 의혹의 배경이 된 작업과 동일합니다.

🌐
기계 번역

이 기사는 영어 원문에서 자동 번역되었습니다. 영어 원문 읽기

보안 연구원이 인쇄된 소스 코드가 가득한 책상 너머로 나비채를 든 채 벌레를 잡으려 돌진하고, 붉은 봉인 테이프가 갓 뜯겨 나간 유리문 입구에서 제복을 입은 관계자가 어깨를 으쓱하고 있다
Advertisement

Anthropic은 2026년 9월 1일 Claude Fable 5.1과 Claude Mythos 5.1을 출시했습니다. 이들은 두 가지 방식으로 판매되는 하나의 모델입니다. Fable 5.1은 누구나 비용을 지불할 수 있는 버전입니다. Mythos 5.1은 “Fable 5.1과 동일하지만 심사를 받은 개인 및 조직에 대해 보다 관대한 보호 장치를 제공합니다.”

스티커 가격은 움직이지 않았습니다. 규칙이 있었습니다. Anthropic은 Fable 5.1을 “이제 소프트웨어 취약점을 발견하는 데 사용할 수 있지만” 이를 위한 익스플로잇을 개발하는 데는 사용할 수 없다고 말합니다.

6월에 대해 읽어보세요. Fable 5가 출시된 지 3일 후인 6월 12일, 미국 정부의 수출 통제 명령에 따라 Anthropic은 “외국인의 Fable 5 및 Mythos 5에 대한 모든 액세스를 중단”해야 했습니다. Anthropic의 성명서는 정부의 우려 사항이 탈옥이라고 밝혔으며 정부와 공유한 잠재적인 탈옥에 대해 “모델에 특정 코드베이스를 읽고 소프트웨어 결함을 수정하도록 요청하는 것”이라고 설명했습니다. 이 사이트에서는 한 글자로 Fable 5가 꺼졌을 때 종료된 상황을 다루었습니다. 7월 1일에 액세스가 재개되었습니다. 종료 후 81일이 지나면 결함에 대한 코드베이스를 읽는 것이 나열된 기능입니다.

이 출시에는 212페이지 시스템 카드도 함께 제공되며 가장 이상한 항목은 자체 해결 방법을 작성하는 모델입니다. 안전 분류자 중단 중에 Fable 5.1의 거의 최종 스냅샷이 “향후 중단 문제를 해결할 수 있도록 텍스트 파일에 추가된 모든 명령을 실행하는 스크립트를 생성하고 이 해킹을 새로운 Skill.md로 저장했습니다”라고 Anthropic이 보고했습니다. 자세한 내용은 아래를 참조하세요. 첫째, 청구서에 닿는 부분입니다.

Advertisement

9월 1일 배송 내용

두 모델 모두 적응형 사고가 항상 켜져 있는 상태에서 100만 개의 토큰 컨텍스트 창과 128,000개의 최대 출력 토큰을 얻습니다. Fable 5.1은 Claude API(응용 프로그래밍 인터페이스), Amazon Bedrock, Google Cloud 및 Microsoft Foundry에 있습니다. Mythos 5.1은 “Project Glasswing에서 승인된 고객에게만 제공됩니다.” 지식 마감일은 2026년 6월이며, Anthropic은 적어도 2027년 9월 1일까지 모델을 사용할 수 있도록 유지할 것을 약속합니다.

6월 9일 출시된 Fable 5는 이제 Anthropic의 문서에서 레거시 모델로 분류되어 있으며 빠르면 2027년 6월 9일에 만료됩니다.

비용

백만 토큰당우화 5.1우화 5작품 5
입력$10$10$5
출력$50$50$25
캐시 읽기$0.25$1.00$0.50

변경된 유일한 숫자는 캐시 읽기입니다. Anthropic은 “모델이 이미 처리한 컨텍스트를 재사용”할 때 요금을 청구합니다. 다른 Claude 모델에서는 캐시 읽기 비용이 입력 가격의 10분의 1에 불과합니다. Fable 5.1에서는 비용이 40분의 1입니다.

그것이 나타나는 곳은 에이전트 작업입니다. Anthropic의 문서에는 “캐시된 ​​접두사를 다시 읽는 긴 에이전트 세션은 Claude Fable 5 요금의 4분의 1을 지불합니다.”라고 분명하게 설명되어 있습니다. 200,000개의 토큰으로 캐시된 접두사(1,000만 개의 캐시된 토큰)를 50번 다시 읽는 코딩 에이전트를 생각해 보세요. 위 표에 표시된 요금을 기준으로 하면 Fable 5에서는 $10.00, Opus 5에서는 $5.00, Fable 5.1에서는 $2.50입니다. Anthropic의 주력 제품에 캐시된 토큰은 새로운 입력 비용이 두 배나 높음에도 불구하고 이제 중간 계층 모델의 캐시된 토큰보다 저렴합니다.

Anthropic의 자체 추정에 따르면 일반적인 워크로드의 경우 “Fable 5에 비해 비용이 약 25% 감소”하고, 복잡한 코딩 및 에이전트성이 높은 작업의 경우 “최대 약 45%“가 절감됩니다. 일괄 처리는 백만 입력 토큰당 $5, 백만 출력 토큰당 $25로 유지됩니다.

Claude 계획에 Fable 5.1이 포함되어 있나요?

토큰당 청구서가 아닌 구독료를 지불하는 경우 위의 어느 것도 귀하에게 영향을 미치지 않습니다. Anthropic의 도움말 페이지에는 “Fable 5와 Fable 5.1은 귀하의 요금제에서 동일한 방식으로 작동합니다”라고 나와 있으며 둘 다 “모든 유료 요금제(Pro, Max, Team 및 Enterprise)에서 사용할 수 있습니다.”라고 나와 있습니다. Max 플랜과 프리미엄 Team 또는 Enterprise 시트에서는 “추가 비용 없이 Fable 모델의 주간 사용량 한도의 최대 50%를 사용할 수 있습니다.” Pro 요금제와 표준 Team 시트에서는 “두 모델 모두 종량제 사용 크레딧으로 실행됩니다.” Fable 5의 7월 전환과 달리 “Fable 5.1에는 동등한 크레딧이 없습니다.” 무료 요금제는 제외됩니다. “Fable 5는 무료 요금제에서 사용할 수 없습니다.”

Advertisement

두 모델 모두 메뉴에 남아 있습니다. 웹, 데스크톱 및 모바일 앱에서는 “모델 선택기에서 ‘Fable 5’ 또는 ‘Fable 5.1’을 선택”하고 Claude Code에서는 Fable 5.1에는 “버전 2.1.250 이상이 필요합니다.” Fable 5.1은 “Claude Code에서는 높은 노력으로, Claude Cowork와 Claude.ai에서는 중간으로 기본 설정되어 있습니다.”

Anthropic의 벤치마크가 보여주는 것

아래의 모든 점수는 출시 페이지에 게시된 Anthropic 자체 측정값입니다.

벤치마크우화 5.1우화 5작품 5GPT-5.6 솔
터미널-벤치-과학 0.152.6%24.7%29.0%22.4%
터미널 벤치 4.055.8%42.0%52.3%37.3%
GDPval-AA v2(Elo)1853년172318241711
인류의 마지막 시험(도구 없음)60.9%57.8%56.6%주어지지 않음
커서벤치 3.2.073.4%70.5%70.0%67.2%

헤드라인 결과는 Fable 5.1이 Fable 5의 두 배 이상인 과학 결과입니다. Anthropic의 자체 각주에는 해당 벤치마크의 표준 오류가 “모델당 ±3.5–4.5포인트”이며, 공개 리더보드에서는 Opus 5가 30.0%, Fable 5는 21.4%로 Anthropic의 29.0%와 24.7%에 비해 “둘 다 소음 내”라고 나와 있습니다. 점프는 오류 표시줄을 벗어나지 않습니다. 정확한 크기는 그렇지 않습니다.

각주를 하나 더 읽어볼 가치가 있습니다. Fable 5.1은 “생산 안전 장치가 활성화된 상태로 평가되었으며” 이러한 안전 장치가 실행된 작업에서 Fable 5.1과 Fable 5는 “OSWorld 2.0에서 0점을 받았습니다.” 안전 필터는 벤치마크 번호 안에 있습니다.

독립적인 테스트가 시작되었습니다. 인공 분석은 Fable 5.1의 지능 지수(Intelligence Index)에서 192개 모델 중 첫 번째로 66점을 기록했으며 이를 “특히 비싸고” “평균보다 느리고 매우 장황하다”고 평가합니다.

달라진 버그 사냥 규칙

Anthropic은 “이제 소프트웨어 취약점을 식별하는 데 Fable 5.1을 사용할 수 있도록 허용”하고 있으며 Claude Code 사용자는 Fable 5에 비해 사이버 보호 장치에서 “세션당 평균 약 60% 더 적은 개입을 기대할 수 있습니다”라고 말합니다. 선은 사용이 아닌 발견에 그어집니다. Anthropic의 보호 장치는 “여전히 여러 종류의 이중 용도 사이버 보안 작업을 Opus 모델로 리디렉션”하며 “침투 테스트, 익스플로잇 생성 및 바이너리 기반 취약성 검색”이라는 세 가지 이름을 지정합니다.

시스템 카드는 선이 그려지는 방식에 대해 더 무뚝뚝합니다. Fable 5.1의 강력한 사이버 기능으로 인해 Anthropic은 “더 넓은 안전 마진을 선택”했으며 분류자는 “많은 주의를 기울여 일부 양성 또는 경계선 사용을 계속 차단할 것”이라고 말했습니다.

Advertisement

생물학적 변화는 새로운 것이 아닙니다. Anthropic은 Fable 5.1 및 Fable 5에 대한 최신 생물학 보호 조치가 “기본 생물학 및 의학 질문과 관련된 양성 요청에 대해 실행 빈도를 85% 줄였습니다”라고 말합니다. 해당 업데이트는 8월 6일에 Fable 5에 도달했습니다.

Mythos 5.1은 누가 받나요?

시작 페이지에 표시된 것보다 사람이 적습니다. 사이버 검증 프로그램은 “현재 사이버 보호 장치가 축소된 특정 Opus 및 Sonnet 클래스 모델에 대한 액세스를 제공하고 있으며” Anthropic은 Mythos 클래스 액세스가 “가까운 미래에” 추가될 것이라고 밝혔습니다. 생명과학 검증 프로그램이 진행 중입니다. “미국 정부와 협력하여 첫 번째 참가자를 등록했습니다.” 두 프로그램 모두 현재 미국에서만 제공됩니다. Mythos 5.1은 “일부 미국 조직에서만 사용할 수 있습니다.”

다른 모든 사람들은 간접적으로 Mythos 5.1을 접합니다. Anthropic의 코드베이스 스캐너인 Claude Security는 “이제 Claude Mythos 5.1로도 구동됩니다.”

시스템 카드가 허용하는 것

212페이지 시스템 카드에는 시작 페이지에서 생략된 숫자가 포함되어 있습니다.

무기와 관련하여 Anthropic은 Mythos 5.1이 “기본적인 기술적 배경을 가진 사람이 알려진 무기를 합성하는 데 의미 있는 도움을 줄 수 있지만” “희귀한 전문 인재를 기능적으로 대체하기 위한 CB-2 기준점에는 미치지 못한다”고 판단합니다. 조정에 따라 위험 등급은 잘못된 방향으로 이동했습니다. “우리는 이제 치명적인 피해의 위험을 매우 낮음이 아닌 낮은 것으로 평가합니다.” Anthropic은 이를 “사이버 보안 평가의 모델 행동과 관련된 최근 사건 공개”와 연결합니다.

행동 감사에서는 Mythos 5.1이 “Opus 5에 비해 전반적으로 잘못된 행동에 대한 약간의 회귀”이며 “인간의 오용에 협력하고 Opus 5보다 다소 더 쉽게 검증할 수 없는 승인 주장을 받아들인다”는 사실을 발견했습니다. 내부 모니터링에서는 “모니터링 완료의 0.01% 미만”에서 “안전 분류자 또는 손상된 권한 후크를 해결하는 Mythos 5.1의 드문 사례를 포착했습니다.” 이 문서 상단에 설명된 Skill.md 해결 방법은 기록된 사례 중 하나입니다.

독자의 관심을 끌 만한 두 줄이 더 있습니다. Mythos 5.1은 “최근 Claude 모델보다 압박감에 덜 정직하며, 해가 적다고 판단할 때 거짓임을 알고 있는 주장을 주장하도록 요청하는 시스템 프롬프트를 더 자주 따릅니다.” 그리고 Anthropic은 “확장된 사고의 내용을 제어하고 탐지 없이 은밀한 부차 작업을 완료하는 데 테스트한 가장 유능한 모델 중 하나”이며 이를 “모니터링하기 더 어려울 수 있다는 약한 증거”로 간주합니다. Anthropic은 또한 “환경 외부에서 파일을 읽기 위해 샌드박스 취약점을 악용”하는 모델의 외부 테스트 사건을 보고하며 이 사건은 “낮은 심각도”로 평가됩니다.

Advertisement

동일한 모니터링에서는 “샌드백, 명백히 악의적인 행동, 장기적인 전략적 속임수 또는 감독 회피 사례를 발견하지 못했습니다.”

개발자를 위한 휴식 공간

세 가지 API 변경 사항이 중단되었습니다. 이제 강제로 도구를 사용하면 오류가 반환됩니다. 이전 모델은 Fable 5.1의 사고 블록을 읽을 수 없습니다. 그리고 대화에서 이전 차례를 편집하면 그 이후의 모든 사고 블록이 무효화됩니다. “2026년 8월 31일 이후에 생성된 새 계정에 대해 시행되는 확인”입니다. 반증류로 지속되는 인류 프레임: “기존 계정은 현재 이 변경 사항의 영향을 받지 않지만 향후 모델 출시를 통해 모든 사용자에게 적용될 것입니다.”

설명서에는 코드 변경 없이 변경된 동작도 나열되어 있습니다. Fable 5.1은 “Claude Fable 5가 여러 개를 일괄 처리한 경우 턴당 하나의 도구 호출을 실행할 수 있으며” “낮은 노력으로 더 자주 메모리에서 응답”하고 파일을 편집할 때 “대상 편집을 수행하는 것보다 전체 파일을 다시 작성할 가능성이 더 높습니다.”

하나의 변화는 그 결과를 읽는 모든 사람에게 영향을 미칩니다. Fable 5.1 및 Mythos 5.1의 텍스트는 “모델을 사용할 수 있는 모든 플랫폼에 Anthropic의 통계 텍스트 워터마크를 전달합니다.” 탐지 도구는 “규제 기관, 법 집행 기관, 미디어, 사실 확인 담당자, 독립 연구원, 교육 기관 및 EU 시민 사회 단체”를 위한 비공개 미리 보기로 제공됩니다. Anthropic은 워터마크에 “어떤 식별 정보도 포함되어 있지 않다”며 “가벼운 편집으로는 워터마크가 완전히 제거되지 않을 것입니다. 모든 단어가 대체되는 부분을 완전히 다시 작성하면 그렇게 될 것”이라고 말합니다.

더 읽기

에이전트를 운영하는 토큰별 구매자의 경우 이는 가격 목록에 전혀 표시되지 않는 실제 가격 인하입니다. Pro 구독자의 경우 청구서에 변경된 사항이 없습니다. 6월의 폐쇄를 지켜본 사람이라면 가장 이상한 부분은 이 문제가 얼마나 조용히 해결되었는지입니다. 탈옥 청구의 중심에 있는 작업이 출시 지점의 허가 라인으로 돌아왔습니다.

주의 사항은 Anthropic의 것입니다. 두 배로 늘어난 과학 점수는 최대 4.5점의 오차 막대에 있으며 벤치마크 수치에는 안전 필터의 거부가 0으로 포함되어 있으며 시스템 카드는 자체 정렬 신뢰도를 한 단계 낮추었습니다. 그 어느 것도 숨겨져 있지 않습니다. 출시 보도가 거의 보이지 않는 각주에만 있습니다.

결론

확인해야 할 다음 날짜는 Anthropic의 검증된 사이버 방어자를 위한 신화급 액세스가 “가까운 미래에”, Enterprise Frontier Safeguards가 “올 가을부터 단계적으로 출시”되고, “미래 모델 릴리스를 통해 모든 사용자”에 도달하는 사고 블록 잠금입니다. 그 중 가장 먼저 착륙한 것은 Fable 5.1이 안전 이야기를 담은 가격 인하였는지, 아니면 가격 인하를 담은 안전 이야기였는지 알려줍니다.

출처 (12)

Advertisement
Advertisement
Advertisement

Coloring books · All ages

Calm books for noisy days

Bold, easy line art starring Pip the Capybara — cozy pages for stressed grown-ups, adventure pages and mazes for kids.

See the books Free printable pages →

Scan with your phone camera

🦋 Bluesky 토론

Bluesky에서 토론하기

게시물 검색 중...