인공지능(AI) 개발 속도를 둘러싼 논쟁이 커지는 가운데 글로벌 AI 기업 3곳이 이틀 사이 신모델을 잇따라 공개했다. 앤트로픽과 오픈AI, 스페이스XAI는 나란히 성능을 높이면서도 안전성과 비용 효율, 에이전트 역량에 각각 무게를 뒀다.
22일(현지시간) 오픈AI는 'GPT-6 솔·루나', 앤트로픽은 '클로드 오퍼스 5.5'를 각각 공개했다. 하루 전인 21일에는 스페이스XAI가 '그록 4.7'을 선보였다.
같은 시기에 나왔지만 각사가 택한 전략은 달랐다. 앤트로픽은 외부 평가와 행동 감사 등 안전 검증을 강화했다. 오픈AI는 GPT-6 아스트라에서 확보한 기술을 더 빠르고 저렴한 솔·루나로 가져왔고 스페이스XAI는 복잡한 작업을 장시간 수행하고 결과를 스스로 확인하는 능력을 키웠다.
성능 경쟁에서는 오퍼스 5.5가 앞섰다. 글로벌 AI 평가기관 아티피셜 애널리시스의 종합 성능 지표(AAII)에서 최고 설정 기준 오퍼스 5.5는 58점을 기록했다. GPT-6 솔은 48점, 그록 4.7은 46점이었다. 다만 오픈AI와 스페이스XAI는 각각 비용 효율과 장시간 에이전트 업무를 주요 경쟁력으로 강조했다.
최근 AI 개발 속도를 조절해야 한다는 주장에는 세 회사 수장 모두 공감을 나타냈다. 다만 실제 안전 대응은 검증 방식과 적용 강도에서 차이가 있었다.
속도조절 필요성을 제기한 앤트로픽은 오퍼스 5.5를 외부 기관에 사전 평가받고 약 2000개 상황을 대상으로 행동 감사를 진행했다. 오픈AI는 솔·루나가 자사 최고 위험 단계에는 이르지 않았다고 판단해 기존 GPT-5.6 솔·루나와 같은 안전장치를 적용했다. 스페이스XAI는 그록 4.7에 새로운 안전체계를 도입했지만 공식 발표에는 외부 기관의 사전 평가나 개발 속도를 늦춘 조치에 대한 내용은 포함되지 않았다.
앤트로픽은 '안전'…외부 검증·고위험 작업 제한
앤트로픽은 오퍼스 5.5에서 외부 검증과 고위험 작업 통제를 강화했다. 회사는 이를 프런티어 AI 개발 속도조절을 제안한 이후 처음 공개한 모델이라고 소개했다.
출시 전에는 미국 비영리 AI 평가기관 모델평가위협연구소(METR)와 프런티어 디자인 등 외부 기관의 평가를 받았다. 내부에서도 모델이 위험하거나 의도하지 않은 행동을 보이는지 자동으로 점검했다.
통제 범위를 벗어나려는 행동도 따로 살폈다. 오퍼스 5.5가 정해진 경계를 우회하려 한 빈도는 기존 오퍼스 5와 미토스 5.1보다 약 85% 낮았다. 확인된 시도는 모두 심각도가 낮았으며 모델이 스스로 이를 보고했다고 회사 측은 설명했다.
악용 가능성이 큰 분야에는 사용 제한을 뒀다. 대부분의 사이버보안 작업은 이전 모델인 오퍼스 4.8이 처리하도록 했으며 일부 생물학 관련 고위험 기능에는 이용자 검증 절차를 적용했다.
성능과 비용도 개선됐다. 초기 평가자가 20만줄 규모의 프로그램 코드를 점검하고 오류를 수정하도록 하자 오퍼스 5.5는 3시간 안에 작업을 마쳤다. 기존 오퍼스 5는 같은 작업에 20시간 이상 걸렸다. 일반적인 작업 비용은 40% 낮아졌고 출력 속도는 30% 이상 빨라졌다.
안전 평가의 한계도 확인됐다. 오퍼스 5.5가 일부 상황에서 자신이 시험받고 있다는 사실을 의심하는 징후를 보였기 때문이다.
앤트로픽은 "모델을 배포하기 전에 모든 실패 가능성을 평가로 찾아내는 방법은 아직 해결되지 않았다"고 설명했다.
오픈AI는 '효율'…아스트라 기술 더 싸게
오픈AI는 아스트라에서 확보한 기술을 더 낮은 비용의 솔과 루나로 가져왔다. 최상위 모델의 성능을 최고가 제품에만 두기보다 작업 난도와 비용에 따라 선택할 수 있도록 GPT-6 제품군을 세분화했다.
솔은 복잡한 코딩과 에이전트 업무처럼 높은 성능이 필요한 작업을 겨냥한다. 루나는 빠른 응답과 낮은 비용이 중요한 대량 작업에 초점을 맞췄다. 오픈AI는 루나를 자사 모델 가운데 가장 빠르고 비용 효율적인 모델로 소개했다.
가격은 GPT-5.6 솔·루나의 프로모션 가격보다 50% 낮췄다. 솔은 입력 토큰 100만개당 2달러, 출력 10달러이며 루나는 각각 0.1달러와 0.5달러다.
안전 대응에서는 기존 체계를 유지했다. 오픈AI는 솔과 루나를 사이버보안과 생물·화학 분야에서 '높은 수준'으로 분류했지만 아스트라가 도달한 사이버보안 '중대한 수준'에는 미치지 않는다고 평가했다. 이에 따라 GPT-5.6 솔·루나와 같은 수준의 안전장치를 적용했다.
아스트라에서 개발한 정렬 기술은 새 모델에도 적용했다. 오픈AI는 솔과 루나가 GPT-5.6 계열보다 탈옥 공격에 대한 저항성과 정렬 평가에서 개선된 결과를 보였다고 밝혔다.
오픈AI는 위험이 일정 수준에 접근하면 실제 개발 속도를 늦춘 경험도 있다. 지난달 아스트라가 중대한 수준의 사이버보안 능력에 도달할 가능성이 나타나자 배포 예정 모델의 강화학습을 2주간 중단했다. 최대 규모의 프런티어 강화학습도 보류하고 보안과 모니터링 체계를 보강했다.
스페이스XAI는 '에이전트'…수시간짜리 업무까지 겨냥
스페이스XAI는 그록 4.7의 장시간 업무 수행과 자기 검증 능력을 강화했다. 기존 그록 4.6보다 큰 기반 모델을 사용하고 강화학습 기간을 늘려 수시간이 걸리는 문제의 학습 비중을 높였다.
모델은 긴 작업을 이어가면서 앞서 내린 판단과 결과를 다시 확인하도록 훈련됐다. 긴 맥락을 관리하는 능력도 높여 코딩뿐 아니라 문서 작성과 전문 지식 업무처럼 여러 단계를 거치는 작업을 겨냥했다.
외부 평가에서도 에이전트 업무 성능이 높아졌다. 아티피셜 애널리시스의 장기 지식 업무 평가 'AA 브리프케이스'에서 그록 4.7은 1657점을 기록해 그록 4.6보다 111점 높았다. 코딩 에이전트 지표도 9점 오른 56점을 기록했다.
가격은 입력 토큰 100만개당 2달러, 출력은 6달러부터 시작한다. 출력 속도를 두 배 높인 별도 모델도 제공한다.
안전 측면에서는 새로운 안전체계를 적용했다. 스페이스XAI는 자체 사이버보안 평가 '해커벤치 0.3'에서 위험한 이중용도 요청 가운데 3.3%만 허용했으며 자사가 평가한 모델 가운데 탈옥 공격 저항성이 가장 높았다고 밝혔다.
관련기사
- AI 위험 검증하는 나라로…韓, '제3자 평가국' 노린다2026.09.23
- [AI는 지금] AI 속도조절 꺼낸 앤트로픽, 성능·안전 높인 '오퍼스 5.5' 공개2026.09.23
- [AI는 지금] 오픈AI, 'GPT-6 솔·루나' 출시…"아스트라 강점 확장"2026.09.23
- 오픈AI "AI 국제표준, 미국이 주도해야"2026.09.22
머스크도 최근 AI 개발 속도를 늦출 필요성에 공감을 나타냈다. 다만 이번 그록 4.7 공식 발표에서는 개발 속도를 낮추거나 외부 기관의 사전 평가를 받았다는 내용은 공개되지 않았다.
스페이스XAI는 "그록 4.7은 어려운 작업을 더 오래 수행하고 자신의 작업을 더 꼼꼼히 확인할 수 있다"며 "지금까지 가장 잘 조정된 안전장치를 갖췄다"고 밝혔다.








