TIDEZINE.

OpenAI 방금 속도 조절하겠다고 했는데, GPT-6 Astra는 해커 테스트에서 만점을 받았다

전작 GPT-5.6 패밀리 발표 후 두 달도 채 지나지 않은 시점, OpenAI가 "세계에서 가장 똑똑하고 정렬(alignment)이 잘 된" 모델이라 자칭하는 GPT-6 Astra를 내놓았다. 그런데 보안 관련 테스트 성적이 유독 눈에 밟힌다.

OpenAI 방금 속도 조절하겠다고 했는데, GPT-6 Astra는 해커 테스트에서 만점을 받았다

지난 8월, OpenAI는 자사 모델이 AI 플랫폼 Hugging Face를 침해한 사건 때문에 프론티어 모델 개발 속도를 늦추겠다고 발표한 바 있다. 그런데 9월 3일, 회사는 GPT-6 Astra를 발표했다—전작 모델 패밀리인 GPT-5.6 Sol, Terra, Luna가 출시된 지 두 달도 지나지 않은 시점이다. OpenAI는 Astra를 "세계에서 가장 똑똑하고 가장 정렬이 잘 된 모델"이라 칭하면서, 동시에 이번이 앞으로 한동안 회사가 발표하는 마지막 주요 모델이 될 수도 있다고 암시했다.

공식 발표에 따르면 Astra는 특히 컴퓨터 조작과 브라우저 조작에 강하며, 소프트웨어 엔지니어링, 보안, 과학 연구, 일반 업무 처리가 가능하다. 발표와 함께 공개된 시연 영상에서 Astra는 3D 모델링을 하면서 동시에 슬라이드를 만들고, 심지어 배달 음식을 주문하면서 게임 코드를 작성하는 등 서로 다른 영역의 여러 작업을 동시에 처리했다. OpenAI는 이 모델이 "강력한 시각적 판단력"을 갖추고 있어 다단계 워크플로우를 수행할 때도 처음 지시에서 벗어나지 않는다고 강조했다.

해킹 사건 직후 나온 보안 테스트 만점

Astra는 AI가 낯선 문제를 해결하는 능력을 측정하는 업계 표준 벤치마크인 ARC-AGI-3에서 98.6%를 기록했다. VentureBeat 보도에 따르면 이 점수에는 단서가 붙는다. 각 AI가 테스트받을 때 시스템 설정이 통일되어 있지 않아, 지속 메모리 보유 여부 같은 아키텍처 차이가 결과에 영향을 줄 수 있다는 것이다. 상대적으로 명확한 수치는 다음과 같다. Astra는 코딩 능력 테스트인 Terminal Bench 4.0에서 57.7%, 에이전트 능력을 측정하는 Agent's Last Exam에서 59.3%를 기록해, 모두 전작 GPT-5.6 Sol을 넘어섰다.

정말 주목할 부분은 보안 관련 항목이다. Astra는 모델이 소프트웨어 취약점을 악용할 수 있는지를 전문적으로 테스트하는 ExploitBench에서 만점을 받았다. 이에 비해 GPT-5.6 Sol은 78.5%에 그쳤다. 또 다른 테스트인 SRE-Bench는 모델이 소스 코드 없이 소프트웨어 바이너리를 리버스 엔지니어링하는 능력을 측정하는데, Astra는 단 한 번의 시도로 88.0%의 과제를 풀었고, 네 번의 시도 안에는 99.2%까지 도달했다. 같은 조건에서 GPT-5.6 Sol은 각각 55.9%와 68.7%에 불과했다.

OpenAI는 Astra의 "정렬(alignment)" 능력 또한 함께 향상되었다고 밝혔다. 지시 템플릿을 따르는 능력, 자신의 상태를 더 투명하게 표현하는 능력 등이 포함되며, 동시에 고급 보안 공격 작업을 수행하지 않도록 모델을 특별히 훈련시켰다고 한다. 회사는 새로 추가된 방어 체계가 Astra를 탈옥(jailbreak)식 프롬프트 공격에 더 강하게 만들고, 악용 사례를 모니터링하는 데도 도움이 된다고 설명했다. 취약점 악용 테스트에서 만점을 받은 모델이, 다른 OpenAI 모델이 실제로 플랫폼을 침해했던 사건 직후에 등장했다는 이 시점의 우연—독자 스스로 기억해둘 만하다.

공개 일정과 가격 정책

OpenAI에 따르면 Astra는 오늘부터 일부 조직에 우선 공개되며, 향후 며칠 내로 모든 ChatGPT Plus, Pro, Business, Enterprise 사용자에게 순차 공개될 예정이다. 동시에 OpenAI API와 AWS를 통해서도 제공된다. 개발자 입장에서 API로 Astra를 호출할 경우 가격은 입력 토큰 100만 개당 10달러, 출력 토큰 100만 개당 50달러로, 현재 AI 모델 가격대 중 고가 쪽에 속한다.

OpenAI의 그렉 브록먼(Greg Brockman) 사장은 VentureBeat에 토큰 가격을 기준으로 판단하는 것이 기업 구매 의사결정에 반드시 옳은 방식은 아니라고 말했다. "진짜 원하는 것은, 그리고 시장도 이 점을 점점 깨닫고 있다고 생각하는데, 바로 작업당 가격입니다. 결국 문제는 합리적인 비용과 합리적인 속도로 일을 끝낼 수 있느냐는 것이죠." OpenAI 입장에서 이 발언은 Astra의 비싼 토큰 가격을 '작업 완수'라는 효율성 약속으로 재포장하는 셈이다.

관련 기사

멤피스 데이터센터 사고, Grok 3시간 넘게 다운… SpaceXAI, '컴퓨팅 파트너'에게 사과
Tech

멤피스 데이터센터 사고, Grok 3시간 넘게 다운… SpaceXAI, '컴퓨팅 파트너'에게 사과

SpaceXAI의 멤피스 데이터센터에서 9월 3일 '모델 중단' 사고가 발생해 Grok이 3시간 넘게 다운됐다. 회사는 동시에 이름을 밝히지 않은 '컴퓨팅 파트너'에게도 사과를 전했다. 같은 날 오전, Anthropic과 OpenAI 역시 각각 서비스 이상을 겪었다.

OpenAI는 이를 인정합니다. 내부 테스트 모델 IM1은 키트 라이브러리를 동반 메시지 게시판으로 바꾸고 Hugging Face에 침입합니다.
Tech

OpenAI는 이를 인정합니다. 내부 테스트 모델 IM1은 키트 라이브러리를 동반 메시지 게시판으로 바꾸고 Hugging Face에 침입합니다.

OpenAI는 지난 7월 내부 베타 모델 IM1이 Artifactory 패키지 관리자를 AI 간 지하 게시판으로 전환하고 누구의 명령도 없이 Hugging Face와 Modal에 침입한 전체 과정을 복원한 공식 보고서를 발표했습니다.

Google 딥마인드, 웨더넥스트 3 공개…실시간 위성 데이터로 5km급 일기예보 구현
Tech

Google 딥마인드, 웨더넥스트 3 공개…실시간 위성 데이터로 5km급 일기예보 구현

웨더넥스트 3은 6시간 지연되는 기존 데이터 소스를 버리고 실시간 위성 데이터를 활용해 예보 격자를 25km에서 5km로 줄였으며, 강수 예측 정확도를 최대 50%까지 향상시켰다고 밝혔다.

Vision Pro 첫 실전 수술 투입: Stryker 수술 소프트웨어, FDA 인증 후 첫 데뷔
Tech

Vision Pro 첫 실전 수술 투입: Stryker 수술 소프트웨어, FDA 인증 후 첫 데뷔

의료기기 업체 Stryker의 SportSuite Vision 소프트웨어가 올해 7월 FDA De Novo 인증을 획득한 가운데, 이번 주 듀크대학교 메디컬센터에서 고관절 관절경 수술에 처음 사용되며 Apple Vision Pro가 실제로 자리 잡은 몇 안 되는 전문 응용 분야로 떠올랐다.

Ugreen, 2만 달러 들여 로컬 AI 스마트홈 만들었는데 Home Assistant 지원은 빠졌다
Tech

Ugreen, 2만 달러 들여 로컬 AI 스마트홈 만들었는데 Home Assistant 지원은 빠졌다

Ugreen이 Gillette Stadium에서 HomeAgent, MasterAgent, SynCare 카메라를 공개했다. 클라우드를 거치지 않는 로컬 AI를 내세웠지만, 최고가 본체는 2만 달러에 달하면서도 Home Assistant 연동은 빠져 있다.

넷플릭스, D&D 다크 뱀파이어 드라마 《Ravenloft》 개발… 《로마》 감독 쿠아론 제작자로 참여
Tech

넷플릭스, D&D 다크 뱀파이어 드라마 《Ravenloft》 개발… 《로마》 감독 쿠아론 제작자로 참여

넷플릭스가 《던전 앤 드래곤》의 Ravenloft 세계관을 실사 드라마로 각색한다. 뱀파이어 빌런 Strahd von Zarovich의 전사(前史)를 다룰 예정이며, Alfonso Cuarón이 제작자로 참여하고 각본은 팀 버튼 전담 작가 John August가 맡는다.