앤트로픽이 인공지능(AI) 개발 속도조절론을 제안한 뒤 처음으로 새로운 모델을 선보였다. 성능을 높이면서 외부 평가와 통제 장치를 강화해 안전성도 함께 끌어올렸다.
앤트로픽은 22일(현지시간) 자사 블로그를 통해 '클로드 오퍼스 5.5'를 공개했다. 코딩과 컴퓨터 사용, 지식 업무 능력을 강화하면서 기존 오퍼스 5보다 일반적인 작업 비용은 40% 낮추고 출력 속도는 30% 이상 높였다.
성능 개선은 실제 작업에서도 확인됐다. 앤트로픽에 따르면 초기 평가자가 20만 줄 규모 프로그램 코드를 점검하고 오류를 수정하도록 하자 오퍼스 5.5는 3시간 안에 작업을 마쳤다. 기존 오퍼스 5는 같은 작업에 20시간 이상이 걸렸다.
전문적인 코딩 평가에서도 성능 향상이 나타났다. AI가 컴퓨터에서 직접 명령을 실행하며 문제를 해결하는 능력을 평가하는 '터미널-벤치 4.0'에서 오퍼스 5.5는 66.4%를 기록했다. 앤트로픽이 공개한 자료에서 오픈AI 'GPT-6 아스트라'는 57.9%, 기존 오퍼스 5는 52.3%였다.
앤트로픽은 다만 이런 점수만으로 모델의 우열을 판단하기는 어렵다고 설명했다. 모델 성능이 높아질수록 벤치마크의 작은 점수 차이가 실제 사용 환경에서 그대로 나타나지 않을 수 있어서다.
비용도 낮췄다. 기업이나 개발자가 오퍼스 5.5를 사용할 때 내는 가격은 입력 토큰 100만개당 4달러, 출력 토큰 100만개당 20달러다. 기존 오퍼스 5보다 각각 20% 저렴하다.
앤트로픽은 성능과 비용을 개선하면서 안전장치도 강화했다고 밝혔다. 이번 모델은 출시 전 AI 평가기관인 모델평가위협연구소(METR)와 프런티어 디자인 등 외부 기관의 평가를 거쳤다. 내부에서는 약 2000개 상황을 대상으로 모델이 위험하거나 의도하지 않은 행동을 보이는지 확인하는 자동화 행동 감사도 진행했다.
회사 측은 오퍼스 5.5가 지금까지 평가한 모델 가운데 가장 높은 수준의 안전성을 보였다고 평가했다. 별도 평가에서는 모델이 정해진 통제 경계를 우회하려 한 빈도가 기존 오퍼스 5와 클로드 미토스 5.1보다 약 85% 낮았다. 확인된 우회 시도는 모두 심각도가 낮았으며 모델이 스스로 이를 보고했다.
사이버보안과 생물학처럼 악용 위험이 큰 분야에는 별도 안전장치를 적용했다. 사이버보안 작업 대부분은 이전 모델인 오퍼스 4.8이 처리하도록 했으며 일부 생물학 관련 기능은 검증된 이용자에게만 제공한다.
관련기사
- [AI는 지금] 오픈AI 추격에 속도 내는 앤트로픽…'페이블 5.2' 곧 내놓나2026.09.22
- [AI는 지금] '속도조절' 앞세운 오픈AI·앤트로픽, 소송 불똥…"서로 AI도 시험"2026.09.22
- "AI 연구, 실제 실험으로"…앤트로픽, 자체 생물학 연구실 운영2026.09.20
- AI 속도 조절 제안한 앤트로픽, 모델 개발 전 과정 외부 검증2026.09.20
다만 안전 평가 과정에서는 한계도 드러났다. 오퍼스 5.5는 일부 상황에서 자신이 시험받고 있다는 사실을 눈치챈 듯한 반응을 보였다. 앤트로픽은 평가 환경을 인식한 모델이 실제 사용 환경에서는 다르게 행동할 가능성이 있어 출시 전 평가만으로 모든 문제를 찾아내기는 어렵다고 설명했다.
앤트로픽은 "현재 모델은 기존 안전 관행으로 관리할 수 있는 수준"이라며 "AI 연구를 완전히 자동화할 수 있는 미래 모델에는 더 높은 기준과 공공정책의 더 큰 역할이 필요하다"고 밝혔다.








