앤트로픽 최기영 "AI 속도조절, 개발 중단 아냐…안전장치 병행해야"

[AI페스타] 프론티어 AI 고도화에 악용 위험 확대…외부 검증·단계별 보호조치 강조

컴퓨팅입력 :2026/10/06 13:19

인공지능(AI) 모델의 역량이 빠르게 고도화되면서 악용 위험도 커지는 데 따른 'AI 속도조절론'을 제안한 앤트로픽이 개발 중단이 아닌 안전 체계와 기술 발전의 속도를 맞추는 것이 핵심이라고 강조했다. AI 개발사가 자체 안전장치를 강화하는 동시에 제3자 기관의 평가·감사 체계를 구축해 모델 역량이 커질수록 보호 수준도 높여야 한다는 것이다.

최기영 앤트로픽 코리아 대표는 6일 서울 강남구에서 과학기술정보통신부가 주최한 공식 인공지능 주간 행사 'AI 페스타 26'의 AI 서밋 프로그램에서 "AI 개발에 대한 속도 조절이 필요하다는 게 개발을 멈추자는 의미는 아니다"라며 이같이 밝혔다.

이날 '프론티어 AI 모델이 가져오는 변화와 기업의 대응 전략'을 주제로 발표에 나선 최 대표는 AI 기술 발전이 아직 시작 단계에 불과하다고 진단했다. 앤트로픽 엔지니어들이 자사 AI 모델 '클로드'를 활용해 개발하는 시간은 평균 주당 20시간을 넘어섰다. AI 에이전트가 사람의 개입 없이 연속적으로 작업하는 시간도 최근 9개월 동안 약 2배 늘었다.

최기영 앤트로픽 코리아 대표가 6일 서울 강남구에서 과학기술정보통신부가 주최한 공식 인공지능 주간 행사 'AI 페스타 26'의 AI 서밋 프로그램에서 '프론티어 AI 모델이 가져오는 변화와 기업의 대응 전략'을 주제로 발표하고 있다. (사진=지디넷코리아)

AI 활용이 늘면서 생산성은 높아지고 있지만 모델의 역량이 강해질수록 부작용과 악용 가능성도 확대되고 있다는 게 앤트로픽의 판단이다. 최 대표는 사이버 첩보와 해킹 등에 AI가 활용되는 사례를 대표적인 위험으로 꼽았다. 전문적인 해킹 역량이 부족한 사람도 AI를 이용해 공격을 시도할 수 있게 되면서 공격 진입장벽이 낮아지고 있다는 설명이다.

프론티어 모델의 역량을 무단으로 추출하는 '증류'도 안전 위협으로 지목했다. 원본 모델의 성능만 추출한 뒤 이에 상응하는 안전장치를 갖추지 않을 경우 산출된 모델이 사이버 공격이나 생물학적 위해 등에 악용될 수 있기 때문이다.

앤트로픽 내부 레드팀 평가에서도 모델 고도화에 따른 잠재적 위험들이 확인됐다. 인터넷과 격리된 환경에서 모델이 외부 연결 방법을 반복적으로 탐색하다 테스트 과정에서 발생한 허점을 이용해 연결을 시도한 사례가 대표적이다.

최기영 앤트로픽 코리아 대표가 6일 서울 강남구에서 과학기술정보통신부가 주최한 공식 인공지능 주간 행사 'AI 페스타 26'의 AI 서밋 프로그램에서 '프론티어 AI 모델이 가져오는 변화와 기업의 대응 전략'을 주제로 발표하고 있다. (사진=지디넷코리아)

최 대표는 "실제 사고가 아니라 내부 시뮬레이션에서 확인된 사례"라면서도 "모델의 지능 수준이 높아질수록 목표를 달성하기 위해 스스로 행동하는 능력 역시 강해지고 있다"고 부연했다.

앤트로픽은 이에 대응해 모델의 역량에 따라 보호 수준을 강화하는 책임 있는 확장 정책(RSP)과 AI 안전등급(ASL) 등을 적용하고 있다. 모델이 일정 역량 임계치에 도달하면 더 강한 보호조치를 가동하는 방식이다. 접근 통제와 실시간 프롬프트·응답 분류, 모니터링, 사후 탐지 등 다층적인 안전장치도 운영한다.

관련기사

기업의 AI 전환(AX)에서도 안전을 설계 단계부터 포함해야 한다고 주문했다. AI 에이전트가 직접 업무를 수행하는 영역이 넓어질수록 사람의 역할 역시 실행에서 업무 위임과 권한 관리, 결과 검증으로 이동할 수 있어서다. 기업은 명확한 비즈니스 목표뿐 아니라 데이터 보안 기반과 안전 설계, 인재·변화 관리, 가치 측정 체계까지 마련해야 한다.

최 대표는 "강력한 AI를 활용하는 것과 더불어 이에 맞는 안전한 AI를 위한 준비와 역량 개발도 병행해야 한다"고 말했다.