스페이스XAI가 코딩과 전문 지식 업무 성능을 강화한 새 인공지능(AI) 모델을 내놨다. 장시간 작업 수행과 결과 검증 능력을 높이면서도 기존 모델과 같은 가격을 유지한 것이 특징이다.
스페이스XAI는 코딩과 지식 업무에 특화한 최신 AI 모델 그록 4.7을 출시했다고 공식 홈페이지를 통해 22일 밝혔다. 그록 4.7은 커서와 그록 빌드를 비롯해 그록 API와 외부 코딩 하네스, 모델 라우터, 클라우드 플랫폼에서 이용할 수 있다.
그록 4.7에는 기존 버전인 그록 4.6보다 큰 새로운 기반 모델이 적용됐다. 수 시간 동안 수행해야 하는 고난도 작업 비중을 높여 강화학습을 진행하면서 결과물을 스스로 검증하고 긴 컨텍스트를 처리하는 능력을 개선했다.
모델 코딩 성능도 전작보다 높아진 것으로 전해졌다. 장시간 코딩 작업을 평가하는 커서벤치 4.0에서 그록 4.7은 46.3%를 기록했다. 이는 그록 4.6의 40.4%와 GPT-5.6 솔의 41.7%를 웃돈 수치다. 페이블 5.1은 51.8%다.
그록 4.7은 딥SWE v1.1에서 높은 추론 강도 기준 71.0%를 기록했다. GPT-5.6 솔은 72.7%였으며 페이블 5.1은 70.0%를 기록했다. 전기공학 성능을 평가하는 EE벤치에서는 그록 4.7이 64.0%로 비교 대상 가운데 가장 높은 점수를 냈다.
신규 모델은 전문 업무 수행 능력도 개선됐다. 수 시간 규모 사무 업무를 평가하는 AA 브리프케이스 v1.1에서 그록 4.7은 1657점을 기록해 그록 4.6의 1546점과 GPT-5.6 솔의 1487점을 넘어섰다. 법률 업무를 평가하는 하비 리걸 에이전트 벤치마크에서도 19.6%로 비교 모델 가운데 가장 높은 점수를 기록했다.
그록 4.7은 문서와 프레젠테이션 제작 성능도 강화됐다. 회사는 변호사와 간호사, 금융 분석가 등 전문직이 수행하는 업무를 평가하는 GDP밸과 AA 브리프케이스에서 그록 4.7이 전작보다 높은 성능을 냈으며 다른 최상위 모델과 비슷한 수준을 보였다고 설명했다.
스페이스XAI는 그록 4.7 안전성도 강화했다고 밝혔다. 그록 4.7에는 새로운 안전장치 체계가 적용됐으며 내부 평가에서 위험한 요청 거부와 탈옥 공격 저항 성능이 지금까지 테스트한 모델 가운데 가장 높았다. 래치바이오의 바이오안전성 벤치마크에서는 62.4%를 기록했다.
사이버보안 분야에서는 정상적인 보안 업무를 과도하게 차단하지 않으면서 위험한 요청을 걸러내는 데 초점을 맞췄다. 해커벤치 v0.3에서는 위험한 이중용도 프롬프트 가운데 허용된 비율이 3.3%로 나타났다. 일부 사이버보안 파트너에게는 방어 연구를 위한 레드팀 기능도 초대 방식으로 제공한다.
관련기사
- 스페이스XAI, 음성 인식 모델 2.0 공개…정확도 두 배 높이고 가격은 그대로2026.09.21
- 아마존, 외부 AI 에이전트에 빗장…메타 '뮤즈' 상품 구매 차단2026.09.22
- [AI는 지금] 영국, AI 규제·육성 사이 균형 찾는다…"중재자 역할 할 것"2026.09.22
- 오픈AI, 수학 연구 논란에 외부 자문단 출범…학자 9명 참여2026.09.22
그록 4.7 가격은 입력 토큰 100만개당 2달러부터 시작한다. 출력 토큰은 100만개당 6달러다. 이는 그록 4.6과 같은 수준이다. 출력 속도를 2배 높인 고속 버전은 기본 모델보다 2배 높은 가격으로 제공된다.
스페이스XAI는 "그록 4.7은 코딩과 지식 업무를 위한 가장 강력한 모델"이라며 "어려운 작업을 더 오래 수행하고 자신의 결과물을 더 꼼꼼하게 검토하며 지금까지 가장 정교하게 조정된 안전장치를 갖췄다"고 밝혔다.








