과학·기술

OpenAI, 첫 '사이버 임계 능력' AI 모델 Astra 공개 예고… GPT-6 맞나요?

OpenAI, 첫 '사이버 임계 능력' AI 모델 Astra 공개 예고… GPT-6 맞나요?

AI로 생성된 이미지입니다.

OpenAI가 곧 공개할 예정인 AI 모델 'Astra'가 꽤 주목받을 만한 이유가 생겼어요. WIRED 보도(2026년 9월 1일)에 따르면, OpenAI는 Astra가 자사의 '준비 프레임워크(preparedness framework)'에서 정의한 '사이버 분야 핵심 능력(critical cyber capabilities)' 임계치에 도달한 첫 번째 모델이라고 공식 발표했어요. 이 임계치는 AI 모델이 실제 소프트웨어에서 알려지지 않은 취약점을 스스로 찾아내고 악용할 수 있는 수준을 뜻해요.

OpenAI 안전·보안 담당 임원들은 기자 브리핑에서, 이 기준에 도달하면 추가 개발을 일시 중단하고 적절한 안전 조치를 마련한 뒤에야 재개하는 절차를 따른다고 설명했어요. 실제로 Astra 관련 일부 학습 작업이 수 주간 멈춰 있었고, 추가 안전·보안 조치를 마련한 뒤 재개했다고 해요. OpenAI는 이 중단 기간이 생산적이었으며, 이제 Astra를 안전하게 광범위하게 배포할 수 있다고 밝혔어요.

한편, ARC Prize 측 보고에 따르면 GPT-6 Astra는 ARC-AGI-3 세미 프라이빗 벤치마크에서 스탠더드 하네스 기준 62.7%(비용 약 2만 6천 달러), 프로바이더 어댑터 하네스 기준 99.9%(비용 약 1만 9천 달러)를 기록했어요. ARC-AGI-3는 에이전트가 명시적인 지시 없이 환경을 탐색하고 목표를 추론하며 행동 계획을 세우는 능력을 측정하는 벤치마크예요. 사람은 이 환경을 100% 풀 수 있어요.

주목할 만한 점은 행동 효율성이에요. GPT-6 Astra는 테스트에 참여한 중위 인간보다 96%의 레벨에서 더 적은 행동 수로 문제를 해결했어요. 또 낯선 환경을 마주쳤을 때, 게임 메커니즘을 논리 규칙으로 표현하고 자체적인 도메인 특화 언어 약어를 만들어 상태를 추적하고 행동을 계획하는 모습이 관찰됐어요.

공개 방식도 단계적이에요. OpenAI는 고급 사이버 능력은 초기에 '데이브레이크 블루(Daybreak Blue)' 조기 접근 프로그램에 참여한 일부 파트너에게만 제공할 계획이에요. 파트너들이 방어를 강화할 시간을 확보하기 위한 조치라고 해요. 한편 이번 발표는 AI 업계 전반의 흐름과도 맞닿아 있어요. Anthropic과 Meta도 최근 몇 주 사이 유사한 사고를 공개했고, Anthropic 역시 일부 AI 학습 작업을 일시 중단했다고 발표했어요.

이 기사는 AI의 도움을 받아 편집된 기사입니다.

관련 기사