인공지능(AI) 경쟁이 모델 성능을 넘어 누가 위험을 판단할 것인지로 번지고 있다. 미국과 중국이 프런티어 AI 경쟁을 주도하면서 양국이 서로의 시스템을 직접 검증하기 어려울 경우 제3국이나 국제기구가 평가를 맡는 방안도 거론되고 있다.
김명주 AI안전연구소장은 23일 지디넷코리아와의 통화에서 "미국과 중국 사이에서 제3국의 평가가 필요해지는 상황이 온다면 우리가 나서겠다는 생각을 갖고 있다"며 "다만 아직은 앞서가는 시나리오이자 희망 사항일 뿐 실제 역할을 맡으려면 프런티어 AI 기술과 평가 역량을 갖춰야 한다"고 강조했다.
국제적으로도 프런티어 AI를 공동 평가하고 위험 정보를 공유하려는 움직임이 이어지고 있다. 오픈AI는 21일(현지시간) 한국 등 각국 AI안전연구소가 참여하는 협력망을 활용해 평가 결과를 공유하고 공통 기준을 마련하는 방안을 제안했다.
미중 AI 안전 협의 시작…검증은 누가
최근 AI 개발 속도와 안전을 둘러싼 논쟁이 커지면서 미국과 중국 사이에서도 AI 안전 문제가 의제로 떠올랐다. 양국은 정상회담을 앞두고 관련 논의를 시작했다. 미국은 중대한 AI 사고가 발생할 경우 서로 알리는 통보 체계를 중국 측에 제안했지만 중국은 아직 구체적인 입장을 밝히지 않은 것으로 알려졌다.
김 소장은 "위협의 신호가 보이면 서로 핫라인을 개설해 이야기하고 협의하자는 논의까지 나오고 있다"고 말했다.
통보 체계가 만들어져도 상대국 AI 위험을 누가 확인할지는 남는다. 미국이 중국의 핵심 AI 시스템을 직접 들여다보거나 중국이 미국의 모델을 검사하기는 쉽지 않아서다.
김 소장은 장기적으로 핵확산금지조약(NPT)과 비슷한 국제 통제체제가 AI에서도 등장할 가능성을 거론했다. 실제로 미국과 중국의 안보 전문가 사이에서도 핵 군축과 유사한 안전장치와 위기 소통 채널을 AI에 적용하자는 제안이 나왔다.
한국은 국제 평가체계가 만들어질 경우 참여하겠다는 뜻도 전달했다. 김 소장은 지난 8월 국제 AI 평가 협력망을 조정하는 영국 측과 의견을 나눴고 각국 AI안전연구소가 함께 참여하는 방식이라면 한국도 적극 참여하겠다는 입장을 밝혔다.
이 분야에서 가장 앞서 있다는 평가를 받는 곳은 영국이다. 영국 AI안전연구소는 2023년 11월부터 프런티어 AI를 직접 평가해왔다. 사이버와 생물안보 등 국가안보·공공안전 분야에서 첨단 모델을 반복적으로 시험하면서 평가 방법과 데이터를 축적했다.
김 소장은 영국이 현재 프런티어 AI 평가 기술에서 가장 앞서 있다고 진단했다. 김 소장은 AI안전연구소도 지난 2년간 영국의 평가 기술을 따라잡기 위해 관련 역량을 쌓아왔다고 설명했다.
그는 "한국은 AI 제재국이 되지 말고 제재를 논의하는 나라가 돼야 한다"고 강조했다.
국제 논의 발언권, 결국 '경험'에서 나온다
AI 안전 논의에서 한국의 발언권을 키우려면 기술력과 함께 실제 현장에서 쌓은 경험도 중요하다는 지적이 나온다.
박지환 씽크포비엘 대표는 "아직 AI가 실제 현장에서 어떤 문제를 얼마나 자주 일으키는지 충분히 축적되지 않았는데 머릿속에서 만든 기준이 처음부터 정확할 것이라고 기대하기는 어렵다"고 말했다.
그는 혈압 기준을 예로 들었다. 어느 수준부터 치료에 개입할지를 수많은 임상 경험과 데이터를 거쳐 정해온 것처럼 AI도 실제 적용과 실증을 반복하면서 기준을 다듬어야 한다는 설명이다.
박 대표는 "한국이 표준에 대한 현장 실증을 많이 하는 나라가 되는 것이 중요하다"며 "국제기준을 실제 산업과 공공현장에 적용해 무엇이 맞고 무엇이 부족한지를 지속적으로 제시해야 한다"고 강조했다.
관련기사
- [AI는 지금] AI 속도조절 꺼낸 앤트로픽, 성능·안전 높인 '오퍼스 5.5' 공개2026.09.23
- AI 안전, 선언보단 검증으로…국제표준도 달라진다2026.09.22
- 오픈AI "AI 국제표준, 미국이 주도해야"2026.09.22
- 미·중, 'AI 사고' 국가 간 충돌 막는다…미국, 중대 사고 상호 통보 제안2026.09.21
현장 경험과 별개로 국제적으로 통용될 표준은 공적인 절차와 합의를 거쳐야 한다. 전종홍 한국전자통신연구원(ETRI) 표준연구본부 책임연구원은 "오픈AI나 앤트로픽이 '표준'이라는 용어를 많이 쓰지만 그렇게 쓴다고 그냥 표준이 되는 것은 아니다"라며 "문서를 만드는 것과 권위를 만드는 것은 다르다"고 밝혔다.
박 대표는 "이런 경험과 데이터가 축적되면 한국의 의견에 무게가 생기고 더 많은 국제 실증과 표준화 논의의 중심에 설 기회가 생긴다"며 "기준을 받아들이는 나라보다 기준이 현실에서 작동하는지를 증명하고 개선하는 나라가 AI 안전 논의의 중심에 설 것"이라고 말했다.








