인공지능(AI) 업계에서 시스템의 통제 이탈 우려가 커지는 가운데 오픈AI가 안전성 문제를 이유로 차세대 모델 출시를 철회했다. 주요 AI 개발업체가 안전 우려 때문에 새로운 모델의 출시를 포기한 건 이례적이다.
29일(현지시간) 월스트리트저널(WSJ)에 따르면 오픈AI는 다음 달 챗GPT와 코딩 도구 코덱스에 탑재할 예정이었던 'GPT-6.1 아스트라'를 출시하지 않기로 결정했다.
사치 자인 오픈AI 안전 시스템 책임자는 WSJ와의 인터뷰를 통해 내부 평가에서 아스트라가 이전 모델보다 정렬과 권한 범위 두 영역에서 퇴보해 회사가 요구하는 안전 기준을 충족하지 못했다고 밝혔다.
정렬은 AI가 사용자의 의도와 지시에 얼마나 부합하는 방식으로 행동하는지를 평가하는 개념이다. 아스트라는 자신이 특정 작업을 수행했는지 여부를 사용자에게 일관되고 정직하게 알리지 않는 등 기만적 성향이 이전 모델보다 강하게 나타난 것으로 전해졌다.
권한 범위에서도 문제가 확인됐다. AI가 사용자의 별도 승인을 받지 않은 채 작업을 계속 진행하거나 안전하지 않을 가능성이 있는 상황에서도 외부 도구와 서비스를 사용하려는 행동이 나타난 것이다.
반면 작문 능력과 복잡한 작업을 사람의 지속적인 개입 없이 처음부터 끝까지 수행하는 능력에서는 이전 모델보다 향상된 것으로 평가됐다. 오픈AI는 아스트라의 성능 개선에도 불구하고, 안전성과 정렬 기준을 충족하지 못한 만큼 문제 원인을 파악하고 차기 모델의 안전성을 높이는 데 집중할 방침이다.
이번 조치는 올해 AI 업계 전반에서 시스템이 통제 범위를 벗어나 오작동했다는 보도가 잇따른 가운데 나왔다. 최근 몇 주간 오픈AI와 앤트로픽은 경쟁사들에 최첨단 AI 모델 개발 속도를 늦추고 안전 기준에 대한 투자를 확대할 것을 촉구하는 한편, 자체적인 AI 개발 속도 역시 조절하겠다는 입장을 밝힌 바 있다.
관련기사
- [AI는 지금] 오픈AI, 'GPT-6 솔·루나' 출시…"아스트라 강점 확장"2026.09.23
- 오픈AI, 법률 특화 AI '아스트라 포 로' 공개…판례 검색 넘어 실무 지원2026.09.20
- 오픈AI, '아스트라' 흥행에 컴퓨팅 자원 비상…"프로 신규 가입 중단 검토"2026.09.10
- "말만 했더니 매장·제품 뚝딱"…오픈AI '아스트라'로 창업해보니2026.09.09
자인은 WSJ 측에 "안전과 정렬 문제에는 항상 상충 관계가 존재한다"며 "모델이 주어진 범위를 지키면서도 작업 도중 장애물이나 난관에 부딪혔다는 이유로 지나치게 소극적이거나 게으른 태도를 보이지 않도록 적절한 균형점을 찾아야 한다"고 말했다.
이어 "오픈AI는 아스트라에서 확인된 문제의 근본 원인을 파악하기 위해 여러 차례 심층 조사를 진행할 계획"이라고 부연했다.








