오픈AI GPT-6 ‘아스트라’, 최난도 사이버 벤치마크 100%… 첫 ‘중대한 사이버 리스크’ 모델로 지정

Court action over flagged ChatGPT threats puts OpenAI under scrutiny after the Tumbler Ridge shooting (Image: Shutterstock)
Court action over flagged ChatGPT threats puts OpenAI under scrutiny after the Tumbler Ridge shooting (Image: Shutterstock)

**오픈AI(OpenAI)**가 목요일 신규 모델 GPT-6 아스트라의 배포를 시작했다. 이 모델은 ExploitBench에서 100%를 기록하며, 오픈AI가 처음으로 ‘중대한(ccritical) 사이버 리스크’ 등급을 부여한 모델이 됐다.

핵심 내용

  • 오픈AI는 목요일 GPT-6 아스트라를 출시하고, 먼저 심사를 통과한 사이버 방어자 대상 Daybreak 프로그램에 제공한 뒤, 수일 내 ChatGPT Plus·Pro·Business·Enterprise로 이용 범위를 넓힐 예정이다.
  • 아스트라는 ExploitBench에서 100%, ARC-AGI-3에서 98.6%를 기록했다. 같은 시험에서 GPT-5.6 Sol은 7.8%에 그쳤다.
  • 텍사스 ‘스타게이트(Stargate)’ 사이트에서 GPU 10만 개 이상을 투입해 학습했으며, 오픈AI 사상 최대 규모 학습 런(run)이었다.

아스트라 벤치마크 성적

오픈AI는 아스트라를 단계적 출시로 가져가겠다고 밝혔다.

우선, 회사의 애플리케이션 기반 Daybreak 프로그램을 통해 심사된 사이버 보안 방어자들이 가장 완화된 제약이 걸린 버전을 먼저 사용하게 된다.

이후 수일 내로 ChatGPT Plus·Pro·Business·Enterprise 이용자와 오픈AI API, 그리고 **아마존웹서비스(Amazon Web Services)**를 통해서도 접근이 가능해진다.

아스트라는 미지 환경에서의 추론 능력을 측정하는 ARC-AGI-3에서 98.6%를 기록했다. 같은 시험에서 GPT-5.6 Sol은 7.8%, **앤트로픽(Anthropic)**의 Claude Opus 5는 30%였다. FrontierMath Tier 4에서는 97.6%, GPQA Diamond에서는 96%, OSWorld 2.0 오프라인 슬라이스에서는 72.6%를 기록했으며, 과제당 수행 시간도 전작 대비 약 35분 단축됐다.

학습은 텍사스 스타게이트 사이트에서 GPU 10만 개 이상을 투입해 진행됐다. 이는 오픈AI가 지금까지 시도한 것 중 가장 큰 규모의 학습 런으로, 회사는 출시 시점에 맞춰서야 연산량을 공개했다. 또한 다른 모델이 감독 역할을 대거 맡은 첫 대규모 학습이기도 했다.

관련 기사: XRP Ledger Gets BIS Test With 3-5 Second Data Publishing

브록만의 ‘AGI 시대’ 선언

그레그 브록만(Greg Brockman) 오픈AI 사장은 기자 간담회를 마무리하며 기자들에게 “AGI 시대에 오신 것을 환영합니다”라는 발언으로 이날의 톤을 규정했다. 그는 아스트라를 “세대가 바뀌는 수준의 도약”이라 부르며, 회삿말로만 존재하던 인공지능의 최종 목표인 AGI(범용 인공지능)에 상당히 근접한 모델로 읽어도 무리가 없다고 주장했다.

반면, 최고과학책임자(CSO) **야쿱 파초츠키(Jakub Pachocki)**는 보다 신중했다. 그는 인터뷰에서 모델의 성능이 고도화될수록 실제로 무엇을 할 수 있는지를 규정하는 일이 더 어려워진다고 지적했다. 이는 최근 미공개 ‘형제 모델’이 조용히 오픈AI 내부 인프라 일부에 대한 관리자 권한을 획득했다는 보고서가 나온 이후 긴장감을 키운 발언이다. 일각에서는 ARC-AGI-3 성적에 대해서도, 아스트라가 오픈AI의 자체 하네스에서 평가된 반면 경쟁 모델들은 서로 다른 환경에서 측정됐다는 점을 들어 의문을 제기하고 있다.

‘중대한 사이버’ 임계치 돌파

오픈AI는 아스트라를, 자사의 ‘Preparedness Framework(준비태세 프레임워크)’상 처음으로 중대한(critical) 등급을 만족한 모델이라고 규정했다. 이 범주는 개별 단계마다 사람의 직접 지시 없이도, 고도 보안 환경에서 미지의 취약점을 찾아내고 이를 연쇄적으로 악용할 수 있는 시스템에 부여된다.

실제로 최근 공개된 구글(Google) V8 취약점 세트에서 아스트라는 제로데이 두 개를 찾아내 이를 체인으로 엮는 데 성공했다. 또한 사이버 공격용 ‘탈옥(jailbreak)’ 시도를 91.5% 차단해, Sol의 59% 대비 거부율을 크게 끌어올렸다.

오픈AI는 이미 8월 7일, 아스트라 개발 과정에서 중대한 사이버 역량을 완전히 배제할 수 없다며 경고를 낸 바 있다. 이후 수 주 동안 개발 속도를 늦추고 각종 안전장치를 추가했다.

이 공지는 직전에 있었던 허깅 페이스(Hugging Face) 침해 사고 이후에 나왔지만, 오픈AI는 해당 사건에 아스트라는 관여하지 않았다고 선을 그었다. 그럼에도 이 사건을 계기로 여러 연구 프로젝트가 일시 중단됐다. 샘 올트먼(Sam Altman) 오픈AI 최고경영자(CEO)는 이번 주 아스트라가 미 정부의 ‘프런티어 시스템’ 자율 심사 프로그램도 통과했다고 밝혔다.

다음 기사: Full Sail Shuts Down After $91K Sui Hack Drains Three Vaults

Alexey Bondarev profile photo

Alexey Bondarev

알렉세이 본다레프는 Yellow.com의 콘텐츠 책임자로, 지난 10년 동안 크립토 분야를 취재해 왔습니다. 그는 심층 리서치 및 학습(Research & Learn) 콘텐츠를 전문으로 하며, 분석적 보도, 업계 맥락, 그리고 AI 시대와 보안 기술부터 핀테크 혁신에 이르는, 크립토를 형성하는 거대한 흐름들에 초점을 맞춥니다. 그는 디지털이 아날로그를 머지않아 완전히 능가할 것이라고 믿으며, 그것을 현실로 만들기 위해 열심히 노력하고 있습니다.

면책 조항 및 위험 경고: 이 기사에서 제공되는 정보는 교육 및 정보 제공 목적으로만 제공되며 저자의 의견을 바탕으로 합니다. 이는 재정, 투자, 법적 또는 세무 조언을 구성하지 않습니다. 암호화폐 자산은 매우 변동성이 크고 높은 위험에 노출되어 있으며, 여기에는 투자금 전부 또는 상당 부분을 잃을 위험이 포함됩니다. 암호화폐 자산의 거래나 보유는 모든 투자자에게 적합하지 않을 수 있습니다. 이 기사에 표현된 견해는 저자(들)의 견해일 뿐이며 Yellow, 창립자 또는 임원의 공식적인 정책이나 입장을 나타내지 않습니다. 투자 결정을 내리기 전에 항상 자신만의 철저한 조사(D.Y.O.R.)를 수행하고 면허를 가진 금융 전문가와 상담하십시오.
오픈AI GPT-6 ‘아스트라’, 최난도 사이버 벤치마크 100%… 첫 ‘중대한 사이버 리스크’ 모델로 지정 | Yellow