오픈AI가 차세대 인공지능(AI) 모델 '아스트라(Astra)' 개발·시험 작업을 일부 중단하고 안전성 검증을 강화한다.
아스트라가 사람 개입 없이 보안 취약점을 찾아 공격에 활용할 수 있는 사이버 역량을 갖췄을 가능성이 확인되면서, 출시를 서두르기보다 보안 통제를 강화하기로 한 조치다.
7일(현지시간) 블룸버그통신에 따르면 오픈AI는 아스트라가 자체 안전 프레임워크에서 규정한 '중대(Critical)' 수준의 사이버 보안 역량에 도달했을 가능성을 배제할 수 없다고 판단하고 일부 개발·시험 작업을 일시 중단했다.
오픈AI는 최근 진행한 내부 평가에서 아스트라의 에이전틱 코딩과 사이버 보안 능력이 크게 향상된 것으로 나타났다고 설명했다. 전문가 평가까지 종합한 결과 현 단계에선 아스트라가 중대 수준의 사이버 역량을 갖췄을 가능성을 배제하기 어렵다는 판단을 내렸다.
오픈AI가 정한 중대 사이버 보안 역량은 사람 개입 없이 실제 주요 시스템에서 다양한 심각도의 '제로데이' 취약점을 찾아 실제 작동하는 공격 수단을 개발하거나, 구체적인 방법 없이 목표만 제시해도 새로운 사이버 공격 전략을 스스로 수립·실행할 수 있는 수준이다.
GPT-5.6-솔은 아스트라보다 한 단계 낮은 '높음(High)' 수준으로 평가됐다.
이에 오픈AI는 아스트라 개발·평가 과정의 보안 조치를 대폭 강화 중이다. 격리된 테스트 환경을 구축하고 네트워크와 도구 접근을 제한하는 한편 모델 가중치 보호·암호화, 추가 모니터링·탐지 기능, 샌드박스 실행 등을 적용할 예정이다.
주요 외신에 따르면 오픈AI는 충분한 안전장치가 마련될 때까지 아스트라 개발 속도를 늦출 계획으로, 향후 출시 시점도 미뤄질 전망이다. 오픈AI는 미국 정부에도 출시 지연 계획을 자발적으로 알린 것으로 전해졌다.
아스트라는 오픈AI가 개발 중인 차세대 AI 모델로, 최근 고난도 수학 문제 해결 능력으로도 주목받았다. 오픈AI는 아스트라를 활용해 최소 10년 이상 풀리지 않았던 고차원 기하학과 군론, 양자 복잡도 등의 수학 난제 10가지를 해결했다고 밝힌 바 있다. 여러 AI 에이전트가 장기간 협력해 복잡한 문제를 해결하는 능력을 갖춘 것으로 알려졌다.
최근 AI 모델의 사이버 역량이 빠르게 높아지면서 안전성 우려도 커지고 있다. 최근 오픈AI와 앤트로픽이 모델 테스트 과정에서 허깅페이스를 비롯한 여러 기관의 시스템에 의도치 않게 침투한 사실이 공개됐다. 메타 역시 AI 모델이 제3자의 컴퓨터 시스템에 침투한 것으로 전해졌다.
관련기사
- [비욘드IT] 오픈AI·팔란티어도 쓰는 'FDE'...SI 파견직과 뭐가 다를까2026.08.07
- 소프트뱅크, 오픈AI 지분 담보로 100억 달러 조달…'AI 올인' 가속2026.08.07
- 오픈AI, '도넛 모양' AI 스피커 만든다2026.08.07
- [AI는 지금] 챗GPT 무료 '무제한' 선언…오픈AI, 구독 전략 다시 짠다2026.08.07
오픈AI는 정부 기관과 일부 AI 안전 관련 기관을 대상으로 아스트라의 역량을 추가 검증할 예정이다. 외부 기관이 고위험 모델을 안전하게 평가할 수 있도록 제3자 테스트 파트너에 보안 통제 방안도 제공할 계획이다.
오픈AI는 "첨단 사이버 역량을 갖춘 모델은 공격자보다 먼저 취약점을 찾아 해결할 수 있도록 방어자를 지원해야 한다"며 "정부와 안전 연구기관, 시민사회와 협력해 아스트라와 그 이후 모델의 최첨단 역량이 책임감 있게 배포되고 인류 전체에 폭넓게 도움이 되도록 노력하겠다"고 밝혔다.











