미국 백악관이 최첨단 인공지능(AI) 모델의 해킹 능력과 사이버 보안 위험을 평가하기 위한 안전성 시험 체계 마련에 나선다. 최근 AI 모델이 보안 시험 과정 등에서 외부 시스템에 침투한 사례가 잇따라 공개된 이후 추진되는 조치다.
3일(현지시간) 로이터통신 등에 따르면 도널드 트럼프 미국 행정부는 오픈AI, 앤트로픽, 구글, 메타 등 주요 AI 개발사를 백악관으로 초청해 최첨단 AI 모델을 대상으로 하는 자발적 사이버 보안 테스트 방안을 논의할 예정이다. 백악관은 AI 모델의 해킹 능력을 평가하기 위한 시험의 세부 기준을 확정했으며 업계와 구체적인 운영 방안을 협의할 계획이다.
이번 논의는 최근 오픈AI와 앤트로픽이 자사 AI 모델의 보안 시험 과정에서 외부 기업 시스템에 침투한 사례를 잇달아 공개한 이후 마련됐다. 오픈AI는 자사 AI 에이전트가 격리된 시험 환경을 벗어나 외부 AI 플랫폼인 허깅페이스 시스템에 침투한 사례를 공개했다. 앤트로픽도 일부 AI 모델이 사이버 보안 테스트 과정에서 3개 기업의 시스템에 침투한 사실을 밝혔다.
트럼프 대통령은 지난 6월 행정명령을 통해 최첨단 AI 시스템의 해킹 가능성을 평가할 시험 기준을 마련하도록 지시했다. 행정명령은 정부 사전 검토 대상이 될 수 있는 AI 모델을 판단하기 위한 시험 체계를 마련하도록 했다. 또 개발사가 해당 모델을 정식 출시 전 최대 30일간 정부와 '신뢰할 수 있는 파트너'에 제공해 사전 검증받도록 했다. 이번 논의는 앞선 행정명령의 후속 조치로, 백악관은 관련 시험 체계의 세부 운영 방안을 업계와 협의할 계획이다.
관련기사
- [AI는 지금] 오픈AI 해킹 사고에 샘 알트먼도 긴장…"AI 속도 조절 필요"2026.08.03
- [AI는 지금] 오픈AI 이어 앤트로픽도 '실제 해킹'…AI 통제 비상2026.07.31
- 앤트로픽 AI, 보안 테스트 중 외부 기관 3곳 시스템에 침입2026.07.31
- [AI는 지금] 코드 짜주던 AI가 해킹 도구로…가짜 패키지 악용한 '할루스쿼팅' 비상2026.07.13
다만 평가 방식과 결과 보고 절차, 성능 지표(벤치마크), 시험 결과 공개 여부 등 세부 내용은 공개되지 않았다. 기업들은 개발 중인 모델이 적용 대상인지 조기에 판단할 수 있도록 보다 명확한 기준을 요구하고 있지만 백악관은 관련 세부 사항을 제한적으로 공유한다는 방침이다.
백악관 관계자는 미국 인터넷 매체 악시오스에 "비밀이 아니라고 해서 모든 사람에게 공개하겠다는 뜻은 아니다"라고 말했다.











