플래티어 "AI 에이전트 전사 확산하려면 DX 운영 방식 버려야"

"기업 AX, 파일럿 성공해도 업무 적용서 제동…용도별 KPI·단계별 검증 체계 필요"

컴퓨팅입력 :2026/09/15 10:41

"기업 인공지능 전환(AX)이 파일럿 단계를 넘어 실제 업무로 확산하려면 기존 디지털 전환(DX)과 완전히 다른 평가·운영 체계를 갖춰야 합니다. AI 결과 정확성뿐 아니라 오류를 감지하고 통제할 수 있는 체계를 구축해야 할 것입니다."

이상훈 플래티어 대표는 15일 한국인공지능산업협회(AIIA) 정기 조찬포럼에서 기업 AX 도입 전략을 이같이 밝혔다. 

이 대표는 AX가 기존 DX와 달리 확률적 소프트웨어(SW)라고 주장했다. 기존 SW는 같은 입력에 같은 결과를 내지만 AI는 동일한 입력에도 다른 결과를 생성할 수 있다는 이유에서다. 이에 기존 SW와 같은 방식으로 성능과 안정성을 판단하기 어렵다는 설명이다.

이상훈 플래티어 대표는 기업 AX가 기존 디지털 전환과 다른 평가 체계로 이뤄져야 한다고 강조했다. (사진=지디넷코리아DB)

이 대표는 이런 문제가 여러 AI 에이전트를 기업 내부 시스템과 연결할수록 커진다고 봤다. 에이전트가 전사적자원관리(ERP)나 고객관계관리(CRM) 등 기존 시스템을 호출하는 과정에서 비용과 지연이 누적되고 오류가 다른 업무로 전파되거나 결과의 일관성이 떨어질 수 있다고 지적했다. 

그는 특히 에이전트와 기존 시스템을 연결하는 도구 호출 과정을 주요 AX 실패 이유로 꼽았다. 존재하지 않는 필드나 형식으로 응용프로그램인터페이스(API)를 호출하는 파라미터 환각부터 응답 지연에 따른 타임아웃 누적과 권한 범위 오류, 잘못된 도구 선택 등이 발생할 수 있을 것으로 내다봤다. 

실제 플래티어가 구축한 고객사 품질보증(QA) 판독 에이전트도 품질 문제로 실제 업무 적용이 보류된 바 있다. 해당 에이전트는 케어라벨과 시험성적서, 상품기술서와 수입신고필증을 비교해 자동 판독하도록 개발됐지만 확률적으로 결과를 생성하는 AI를 기존 SW처럼 적용한 것이 근본적인 문제로 분석됐다.

이 대표는 이를 해결하려면 에이전트 용도에 따라 목표와 핵심성과지표(KPI)를 별도로 설정해야 한다고 제안했다. 판독·분류형과 생성형·실행·자동화형과 대화·상담형을 구분하고 정확도 하나가 아닌 업무 특성에 맞는 평가 기준을 적용해야 한다는 것이다.

그는 사람 개입이 필요한 기준도 사전에 정해야 한다고 주장했다. 플래티어는 QA 판독 에이전트 사례에서 정확도가 일정 기준을 충족하더라도 신뢰도가 80% 미만인 결과는 사람이 다시 검토하도록 하는 방식인 '휴먼 인 더 루프' 체계를 예시로 제시했다.

이 대표는 AI 에이전트를 실제 업무에 적용하기 전 단계별 검증 절차도 필요하다고 봤다. 이는 에이전트의 목적과 책임자를 정하는 등록·범위 설정부터 보안·규제 심사와 성능·비용·안전성 테스트, 운영 준비·롤백까지 4단계 게이트를 거쳐 실제 배포 여부를 판단하는 방식이다.

관련기사

그는 거버넌스가 AI를 구축한 뒤 추가하는 기능이 아니라 설계 단계부터 포함해야 한다고 강조했다. 에이전트 권한을 정책으로 제한하고 민감정보를 차단하는 필터와 모든 판단·도구 호출을 기록하는 감사 로그, 이상 발생 시 시스템을 중단하는 '킬 스위치' 등을 갖춰야 한다는 설명이다.

이 대표는 "기업은 AI 모델이 아니라 아키텍처로 오케스트레이션을 설계해야할 것"이라며 "반복성·재현성을 숫자로 증명하는 평가체계를 갖추는 것이 필요하다"고 강조했다.