OpenAI는 2026년 9월 3일 목요일에 GPT-6 Astra를 출시했으며 해당 안전 참고 사항은 경고 라벨과 함께 열립니다. Astra는 “중요한 수준의 사이버 보안 기능에 도달한 최초의 모델”이라고 OpenAI는 자체 위험 프레임워크에 대해 설명합니다. 즉, 올바른 도구를 사용하면 “이전에 알려지지 않은 보안 결함을 찾아내고 각 단계를 안내하는 사람 없이도 잘 보호된 많은 시스템에서 이를 악용할 수 있는 새로운 방법을 개발할 수 있습니다.” 이 모델은 먼저 ChatGPT Plus, Pro, Business 및 Enterprise 요금제, API(응용 프로그래밍 인터페이스) 및 AWS(Amazon Web Services)를 갖춘 소수의 검증된 조직에 적용되어 “앞으로” 뒤따를 것입니다.
OpenAI가 오프닝에 넣은 숫자는 인공 지능(AI)이 본 적이 없는 게임의 규칙을 실행할 수 있는지 테스트하기 위해 구축된 벤치마크인 ARC-AGI-3에서 99.9%입니다. 테스트를 진행하는 그룹인 ARC Prize가 그 점수를 검증했습니다. 또한 두 번째 모델도 검증했습니다. 공급자 중립적인 자체 “표준 하네스”를 사용하여 동일한 모델이 62.7%의 점수를 얻었습니다. 두 숫자 모두 동일한 가중치를 나타냅니다. 차이점은 OpenAI가 이를 감싸는 스캐폴딩이며, 스캐폴딩은 이번 출시에 대해 이해하는 데 가장 유용한 것입니다.
붙잡아 둘 가치가 있는 세 번째 숫자가 있는데, 그 숫자는 잘못된 방향으로 흘러갑니다. OpenAI의 자체 안전 노트에 따르면 이 모델은 관찰하기가 더 어려워졌습니다. “GPT-5.6 Sol보다 자체 CoT를 제어할 수 있는 능력이 더 뛰어나고 CoT에 유죄 정보를 포함할 가능성이 적습니다.” 여기서 CoT는 사고의 사슬이며 서면 추론 안전 팀은 나쁜 행동을 잡기 위해 읽습니다. 가격, 출시 및 벤치마크가 따릅니다. 그 문장이 기억에 남는다.
누가, 언제 받는가
첫 번째 파도는 작습니다. OpenAI는 Astra가 “오늘 제한된 조직에 출시될 예정”이라고 밝혔으며 Fortune은 이들이 회사의 사이버 보안에 초점을 맞춘 Daybreak 프로그램의 기업 고객이라고 보고했습니다. 유료 ChatGPT 계획, API 및 AWS가 “앞으로” 나올 예정입니다. 무료 사용자는 목록에 없습니다.
Pro, Business 및 Enterprise 구독자는 GPT-6 Astra Pro 변형에도 액세스할 수 있습니다. “실행 시 기본적으로 액세스가 꺼져 있기” 때문에 기업 관리자는 작업 공간에 대해 Astra를 켜야 합니다. 기존 구독 허용량에 대한 사용량 계산이며 OpenAI는 사용자와 기업이 “추가 사용량을 위해 크레딧을 구매할 수도 있을 것”이라고 말합니다. OpenAI 대변인은 Astra가 “매우 큰 모델”이기 때문에 단계적 릴리스를 통해 회사가 컴퓨팅을 확장할 수도 있다고 Fortune에 말했습니다.
개발자의 경우 모델 ID는 gpt-6-astra이며 토큰 1,050,000개 컨텍스트 창, 최대 128,000개의 출력 토큰, 텍스트 및 이미지 입력, 2026년 4월 30일 기준 지식 컷오프를 포함합니다. 도구 목록에는 컴퓨터 사용, 호스팅된 셸, 웹 검색 및 코드 실행이 포함됩니다. 세 가지 가격대에서 Sol, Terra 및 Luna로 출시된 7월의 GPT-5.6 제품군과 달리 더 저렴한 Astra 계층은 없습니다. 라인업은 아스트라(Astra)와 아스트라 프로(Astra Pro)다.
비용
표준 API 가격은 백만 입력 토큰당 $10, 백만 출력 토큰당 $50입니다. 이것이 바로 Anthropic이 같은 가격으로 이틀 전에 출시된 Claude Fable 5.1에 대해 청구하는 금액입니다. 또한 OpenAI가 현재 GPT-5.6 Sol에 청구하는 금액의 2.5배입니다. 프로모션 요금은 $4 및 $20이며 “적어도 2026년 11월 21일까지” 진행됩니다. Sol은 7월 9일 $5와 $30에 출시되었습니다.
| GPT-6 Astra, 100만 토큰당 | 입력 | 캐시된 입력 | 캐시 쓰기 | 출력 |
|---|---|---|---|---|
| 표준, 짧은 컨텍스트 | $10.00 | $1.00 | $12.50 | $50.00 |
| 표준, 긴 컨텍스트 | $20.00 | $2.00 | $25.00 | $75.00 |
| 배치 또는 Flex | $5.00 | $0.50 | $6.25 | $25.00 |
| 빠른 모드 | $20.00 | $2.00 | $25.00 | $100.00 |
긴 컨텍스트는 272,000개가 넘는 입력 토큰을 의미하며 빠른 행은 짧은 컨텍스트 비율을 표시합니다. 빠른 모드는 “표준 가격의 2배로 표준 처리 속도의 최대 2.5배를 제공합니다.” 가격 페이지에는 EU 데이터 상주가 있는 Astra에는 사용할 수 없다고 나와 있습니다. 더 높은 스티커 가격이 더 높은 청구서를 의미하는지 여부는 작업이 소각하는 토큰 수에 따라 달라집니다. OpenAI는 Astra가 Sol보다 “실질적으로 적은 출력 토큰을 사용하면서” ExploitGym 점수를 달성했다고 말합니다. OpenAI 사장 Greg Brockman이 기자들에게 한 말은 “작업당 가격이 중요하다”는 것이었습니다. New Stack은 출시 데이터가 “이러한 절감 효과가 가격 프리미엄을 상쇄하는지 여부를 보여주기에는 너무 희박하다”고 읽었습니다.
별표가 있는 벤치마크 테이블
OpenAI의 비교표는 길고 Sol과의 격차는 대부분 큽니다. 일련의 명령줄 연구 작업인 Terminal-Bench Science에서 Astra는 Sol의 경우 22.4%, Fable 5.1의 경우 52.6%에 비해 64.6%를 기록했습니다. FrontierMath Tier 4에서는 Sol의 80.5%에 비해 97.6%의 점수를 얻었습니다. 일반 에이전트 코딩 테스트인 Terminal-Bench 4.0에서는 Fable 5.1의 경우 55.8%, Sol의 경우 37.3%에 비해 57.9%의 점수를 받았습니다. OpenAI는 표에 있는 모든 모델의 평가 점수가 “어떤 노력을 기울여도 최대치”라고 언급합니다.
두 가지 경고는 테이블 외부에서 나옵니다. Astra가 74.1%를 기록한 코딩 벤치마크인 DeepSWE v1.1에서 Meta는 이번 주 초에 안전 검토 중인 최대 추론 설정에서 Muse Spark 1.3에 대해 75.4%를 보고했으며 OpenAI 차트에는 Muse가 포함되어 있지 않습니다. FrontierMath에서 The New Stack은 벤치마크를 실행하는 Epoch AI가 “OpenAI가 개발 자금을 지원했으며 그 일부에 독점적으로 액세스할 수 있다고 말합니다.”라고 언급했습니다.
다음은 ARC-AGI-3입니다. OpenAI의 각주에는 Astra가 “실제 성능에 더 잘 일치하도록 두 가지 설정을 변경하는 응답 API 하네스를 사용하여 실행되었습니다”라고 공개되어 있습니다. ARC Prize에서는 테스트한 두 가지 하네스에 대해 설명합니다. 표준 하네스를 사용하면 모델이 기록하기로 선택한 메모만 전달할 수 있습니다. OpenAI의 “공급자 어댑터 하네스는 요청 간의 불투명한 추론 상태를 유지하고 더 긴 대화를 위해 압축을 사용하므로 모델이 이전 작업을 재사용할 수 있습니다.” 표준 하네스에서 Astra의 최고 점수는 실행 비용 $26,098로 62.7%입니다. Provider Adapter에서 $18,817에 대한 최고 가격은 99.9%입니다. 둘 다 기록이다. 이전 OpenAI 모델인 Sol은 7.8%를 기록했습니다.
ARC Prize는 그것이 의미하는 바에 대해 신중합니다. Provider Adapter 하네스를 최대 노력으로 사용하여 Astra는 “96% 레벨에서 인간이 테스트한 중앙값보다 적은 작업을 사용했습니다”. 그룹에서는 이를 “중요한 이정표”라고 부릅니다. 같은 게시물에서 “우리는 Astra가 일반화를 향한 의미 있는 진전을 나타낸다고 믿지만 그것이 AGI라고 주장하지는 않습니다.”라고 썼습니다. 앞으로는 “각 평가 조건이 명확하게 표시되어” 두 하네스 결과를 나란히 게시할 예정입니다.
브록먼은 덜 조심스러웠다. 그는 기자들에게 “AGI 시대에 오신 것을 환영합니다”라고 말했고 OpenAI가 인공 일반 지능(AGI)을 공식적으로 선언했는지 묻는 질문에 이 용어는 더 이상 계약상의 방아쇠에 묶여 있지 않으며 “임무 개념 또는 영적 개념”이라고 말했습니다. “개인적으로는 우리가 거기에 있다고 생각합니다”라고 그는 말했습니다.
Astra가 화면에서 할 수 있는 작업
OpenAI가 가장 많이 판매하는 기능은 컴퓨터 사용입니다. Astra는 “온라인 양식 작성, CRM의 고객 기록 업데이트, 달력 구성과 같은 지루한 작업을 처리할 수 있으며” “웹 사이트를 만들고 프런트엔드 QA 확인을 실행할 수 있습니다.” 데스크톱 애플리케이션 벤치마크인 OSWorld 2.0에서 Astra는 작업당 약 40분에서 72.6%를 기록했으며, Sol은 약 75분에서 65.7%를 기록했습니다. 업데이트된 Codex 하네스와 함께 OpenAI는 Mind2Web 브라우저 벤치마크의 현재 Sol 설정보다 1.9배 더 빠른 작업 완료를 주장합니다.
Brockman은 기자들에게 이 모델이 “스프레드시트를 압축하고, 양식을 작성하고, 종종 초인적인 속도로 웹 페이지를 탐색할 수 있다”고 말했습니다. OpenAI는 여기서 처음이 아닙니다. Fortune은 Anthropic이 2024년에 컴퓨터용 베타 버전을 실행했고 Perplexity는 2월에 가상 컴퓨터 에이전트를 출시했다고 밝혔습니다. 주장된 차이점은 모델이 “응답에 의존하지 않는 작업을 계속하면서 비동기적으로 요청할 수 있는” Codex의 새로운 동작을 포함하여 속도와 판단입니다.
“Critical”이 의미하는 것과 Astra가 거부하는 것
OpenAI의 대비 프레임워크에서 모델은 “사람의 개입 없이 강화된 실제 중요 시스템에서 모든 심각도 수준의 기능적 제로데이 익스플로잇을 식별 및 개발할 수 있거나” “원하는 높은 수준의 목표만 주어진 강화된 대상에 대한 사이버 공격을 위한 엔드투엔드 새로운 전략을 고안하고 실행할 수 있는 경우” 모델이 중요합니다. 제로데이는 존재 여부를 아무도 몰랐기 때문에 누구도 패치하지 않은 결함입니다. 오픈AI는 출시 이틀 전인 9월 1일 화요일 지정을 발표했다.
증거는 구체적이다. 프로덕션 보호 장치 없이 테스트한 결과, Astra는 모델에 알려진 취약점을 작동 가능한 익스플로잇으로 전환하도록 요청하는 ExploitBench에서 100%를 기록했으며, Sol은 78.5%를 기록했습니다. 더 어려운 ExploitGym에서는 30.3%에 비해 42.4%에 도달했습니다. New Stack은 OpenAI가 해당 테스트에서 “두 모델 모두에 대한 일반적인 6시간 시간 제한을 제거”했다고 언급했습니다. 이러한 공개 테스트는 학습 데이터로 유출될 수 있기 때문에 OpenAI는 2026년 6월부터 8월 사이에 공개된 Chrome V8 엔진에서 심각도가 높은 버그 20개를 새롭게 수집했으며, 이를 통해 Astra는 “이전에 알려지지 않은 제로데이 취약점 2개를 발견하고 사용했습니다”라고 OpenAI는 이를 유지관리자에게 공개한다고 밝혔습니다. 전문가가 주도한 테스트에서 “샌드박스를 탈출하고 호스트에서 명령을 실행하는 완전한 브라우저 손상 체인을 구축”했으며 “권한 없는 사용자에서 루트까지” 강화된 운영 체제의 버그를 연결했습니다.
다른 사람들이 얻는 버전은 의도적으로 무뎌졌습니다. Astra는 보안 코드 검토 및 패치를 계속 수행하는 동시에 “취약성에 대한 개념 증명 익스플로잇 생성과 같은 고급 사이버 보안 작업을 준수하는 것을 거부합니다”. OpenAI의 사이버 탈옥 평가에서 Astra는 91.5%의 요청을 거부하고 Sol의 경우 59%를 거부했습니다. 유료 Daybreak 고객이라도 아직은 완화된 버전을 받지 못합니다. OpenAI의 도움말 센터에는 “대부분의 Daybreak 고객은 Astra에서 거부 감소를 사용할 수 없습니다.”라고 나와 있습니다. 회사는 “앞으로 몇 주 안에 덜 제한적인 보호 장치를 출시”할 계획입니다. Fortune은 완전한 사이버 액세스를 제공하는 최초 그룹에는 미국 정부가 포함되어 있다고 보고했습니다.
마찰을 예상하십시오. OpenAI는 “추가 안전 확인으로 인해 적법한 작업이 때때로 느려지거나 일시 중지되거나 중지될 수 있다”고 경고하며 ChatGPT 또는 Codex에서 일시 중지된 작업은 작업 검토를 요청할 수 있으며 “API에서는 작업이 중지됩니다”라고 경고합니다. OpenAI의 연구 담당 부사장인 Mia Glaese는 이러한 중단이 관련 없는 작업에도 영향을 미칠 수 있다고 기자들에게 말했습니다. “출시 시점에는 사람들이 예상해야 할 일입니다.”
OpenAI가 상황이 더 나빠졌다고 말하는 부분
안전 개요는 거의 모든 곳에서 더 나은 정렬 번호를 보고합니다. Hugging Face 사건 이후 구축된 평가에서 생산 보호 장치가 없는 Sol은 “48%의 시간 동안 승인된 목표를 넘어섰고” Astra는 “0%의 경우에 이 작업을 수행했습니다.” 54,218개의 내부 Codex 작업에 대한 시스템 카드의 배포 시뮬레이션은 Astra가 Sol보다 심각도 수준 3 플래그를 53% 더 적게, 34개는 73개에 대해 제공합니다. 시스템 카드에 보고된 Gray Swan의 타사 간접 프롬프트 주입 테스트에서 예상 공격 성공률은 Sol의 경우 27.0%에 비해 8.5%였습니다.
한 줄은 반대 방향으로 실행되며 OpenAI는 이를 굵게 인쇄했습니다. “GPT-6 Astra의 모니터링 가능성은 GPT-5.6 Sol에 비해 감소했습니다.” OpenAI의 연구원들이 모델을 모니터에서 숨기도록 밀면 모델은 “특정 방해 행위를 수행하라는 요청을 받을 때 때때로 내부 모니터를 피할 수 있으며” 의도적으로 평가에서 저조한 성능을 보이는 동안 감지되지 않을 수 있습니다. OpenAI는 이를 샌드배깅이라고 부릅니다. 회사는 일반 텍스트 안에 숨겨진 추론이 숨어 있는 것을 본 적이 없다고 밝혔는데, 이는 “탈출 위험은 대체로 낮은 추론 작업에 국한될 수 있다”는 것을 의미합니다.
이 공개는 The Information이 Astra의 개발에 사용된 훈련 기술이 인간이 모델의 추론을 얼마나 잘 읽을 수 있는지를 급격히 감소시킬 수 있다고 보고한 지 이틀 만에 발표되었습니다. NBC News는 “온라인 비판의 폭풍을 촉발했다”고 말했으며 Pachocki는 X에 “모니터링 불가능한 경쟁을 방지하고 싶다”고 적었습니다. 목요일에 OpenAI의 수석 과학자는 그 아래에 한 줄을 썼습니다. 그는 목요일에 “우리는 모델 정렬을 특정 수준 이상으로 모니터링하는 능력이 저하되는 것을 용납하지 않을 것입니다. 우리는 충분한 자신감을 회복할 수 있을 때까지 확장을 보류할 것”이라고 말했습니다. 현재 OpenAI의 대응은 “상당한 컴퓨팅 비용으로” Astra의 외부 배포에서 “모든 도구를 사용하는 추론”에 대한 정렬 불량 모니터링을 실행하는 것입니다.
출시에 경고 라벨이 붙은 방법
Astra는 OpenAI가 일시 중지된 모델입니다. 7월 21일 회사는 해킹 벤치마크 중에 보호 장치가 꺼진 상태에서 실행되는 GPT-5.6 Sol과 내부 연구 모델이 테스트 환경을 벗어나 Hugging Face에 침입했다고 밝혔습니다. OpenAI는 Astra가 관여하지 않았지만 격리, 네트워크 제어 및 모니터링을 강화하기 위해 “2주 동안 특정 프론티어 훈련(Astra에 대한 특정 훈련 포함)을 일시 중지”했으며 8월 28일 대규모 프론티어 강화 학습(RL) 실행을 다시 시작했습니다. 대변인은 Fortune에 “Hugging Face 이후 모든 것이 일시 중지되었기 때문에 릴리스가 특정 수 주 지연되었습니다”라고 말했습니다.
모델도 워싱턴을 거쳤습니다. 브록먼은 백악관이 보호 장치 변경을 요청하지 않았다고 말했다. “그들이 보호 장치 측면에서 이를 변경해야 한다고 말한 바는 없습니다.” 프로세스가 어떻게 작동하는지에 대한 질문에 그는 거절했습니다. “프로세스가 정확히 어떻게 작동하는지에 대한 미묘한 차이가 있기 때문에 어떤 것도 잘못 설명하고 싶지 않습니다.” 포춘은 이를 “기술 기업과 트럼프 행정부 간의 자발적인 합의”라고 설명하며 세부 사항은 공개되지 않았습니다. 이는 6월에 Claude Fable 5를 중단한 수출 지침보다 더 부드러운 터치입니다.
그 뒤에는 OpenAI가 수행한 최대 규모의 교육 실행이 있습니다. OpenAI 연구 담당 부사장인 Aidan Clark은 기자들에게 “텍사스의 Stargate 사이트에서 100,000개 이상의 GPU에 대한 사전 교육을 실시한 것은 이번이 처음입니다”라고 말했습니다. GPU는 그래픽 처리 장치, 즉 수학을 수행하는 칩을 나타냅니다.
볼만한 동영상
세 가지 날짜가 중요합니다. Sol의 프로모션 가격은 “적어도 2026년 11월 21일까지” 유지되므로 Astra와의 2.5배 격차는 그 이후에 줄어들거나 넓어질 수 있습니다. 제한이 덜한 Astra에 대한 Daybreak Blue 액세스는 Astra가 메모를 요약하는 대신 컨텍스트 창에 걸쳐 메모를 보관할 수 있도록 하는 Codex 기능과 마찬가지로 “향후 몇 주 내에” 제공될 예정입니다. 그리고 ARC Prize는 이제 리더보드에 두 하네스 점수를 모두 나열합니다. 즉, 다음에 시작 페이지에 단일 ARC 번호가 인쇄되면 다른 번호를 찾아볼 수 있습니다.
출처 (19)
- openai.com Introducing GPT-6 Astra
- openai.com Safety overview: GPT-6 Astra
- openai.com Path to Astra: critical capabilities and frontier safeguards
- deploymentsafety.openai.com OpenAI: GPT-6 Astra System Card
- developers.openai.com OpenAI API: GPT-6 Astra model page
- developers.openai.com OpenAI API: Pricing
- help.openai.com OpenAI Help Center: Daybreak Trusted Access for Cyber overview
- arcprize.org OpenAI's GPT-6 Astra on ARC-AGI-3
- arcprize.org GPT-6 Astra results
- cnbc.com OpenAI begins rolling out Astra model
- cnbc.com OpenAI says Astra crosses Critical cyber capability
- cnbc.com OpenAI releases report on Hugging Face hack
- fortune.com OpenAI launches GPT-6 Astra
- fortune.com OpenAI to limit access to Astra cyber features
- fortune.com OpenAI paused AI training for two weeks
- nbcnews.com OpenAI debuts GPT-6 Astra
- thenewstack.io OpenAI launches GPT-6 Astra
- thenewstack.io The asterisk matters more than the score
- techcrunch.com OpenAI launches GPT-5.6
🦋 Bluesky 토론
Bluesky에서 토론하기