국가대표 인공지능(AI)을 뽑는 '독자 AI 파운데이션 모델 프로젝트(독파모)' 국민평가가 한창이다. 국민 200명이 정부 지원으로 개발된 모델을 직접 사용해 성능과 활용성을 평가하는 가운데, 상용화 전인 국내 AI 모델을 일반 이용자가 직접 체험해볼 수 있다는 데 호응이 컸던 것으로 나타났다. 동시에 일부 평가자 사이에서는 한국어 특화 성능이 기대에 비해 아쉽다는 의견과 함께 안전성 측면의 개선이 필요하다는 목소리도 나왔다.
12일 업계에 따르면 과학기술정보통신부와 정보통신산업진흥원(NIPA)은 지난 8일부터 11일까지 독파모 2차수 모델에 대한 국민평가단을 운영했다. 이르면 13~14일 전후로 발표될 2차 평가 결과를 앞두고 기존 벤치마크 및 전문가 평가와 함께 심사에 반영하기 위해서다.
국민평가단은 공모 시작 하루 만에 480명 이상이 신청한 것으로 집계됐다. 최종 선정된 200명은 LG AI연구원, 업스테이지, SK텔레콤, 모티프테크놀로지스 등 4개 개발팀의 AI 모델을 직접 사용한 뒤 5점 만점의 절대평가에 임하게 된다. PC 환경에서 정부가 제공한 국민용 프롬프트 가이드라인을 참고해 모델을 체험하고 종합평가를 제출하는 방식이다. 이미지·영상 생성 등 텍스트 외 기능은 평가 대상에서 제외됐다.
실제 평가에 참여한 한 참가자는 "평소 챗GPT 등 생성형 AI를 자주 사용하지 않았지만 정부 지원으로 개발된 국산 AI 모델을 직접 사용해볼 수 있다는 데 호기심을 느껴 평가단에 지원했다"고 밝혔다.
이 참가자는 "사용자 인터페이스(UI) 편의성과 정보 정리 능력이 가장 좋았던 모델에 높은 점수를 줬다"면서도 "다만, 평소 AI를 사용하지 않던 입장에서는 각 모델에 대한 특장점을 파악하는 데 한계가 있었다"고 말했다.
이어 "더 뚜렷한 이용 유인이 있어야 국산 AI를 꾸준히 사용하게 될 것 같다"고 덧붙였다.
모델 전반의 완성도에 대해서는 다양한 반응이 나타났다. 일부 국민평가단 후기를 종합해 본 결과, 해외 빅테크 AI 대비 한국 대표 AI만의 차별점을 제시하는 것이 향후 과제가 될 것으로 보인다. 한국어 특화 성능에 대한 기대가 컸던 만큼 이에 아쉬움을 표하는 평가자도 있었다.
또 다른 참가자는 "국내 모델이라 한글에 특화된 창작성을 특히 기대했는데 결과물에서 아쉬운 인상을 받았다"며 "상용화를 위해서는 추가적인 연구와 개선이 이뤄져야 할 것 같다"고 말했다.
AI 윤리와 안전성에 대한 가드레일(안전장치)이 강화돼야 한다는 지적도 나왔다. 이용자가 우회적인 표현으로 부적절한 답변을 유도하는 방식의 테스트를 진행한 결과, 필터링이 충분히 작동하지 않는 사례가 확인됐다는 것이다.
한 참가자는 "특정 요소를 가진 캐릭터를 만들겠다고 하면서 폭력적인 표현이나 욕설을 유도해보니 모델이 필터링 없이 욕을 했다"며 "더 엄격한 필터링 조치가 필요해 보인다"고 지적했다.
서비스 이용 과정과 평가 방식에 대한 개선 제안도 있었다.
이 참가자는 "안내된 프롬프트를 활용하는 과정에서 직접 자료를 찾아 가공해야 하는 등 입력이 수월하지 않았다"며 "사전에 제공된 심사 가이드라인은 구체적인데 평가는 종합 평가 하나 뿐인 점도 다소 아쉬웠다"고 평했다.
관련기사
- 개방형 국산 AI 출격…국가대표 4사4색 전략은2026.08.04
- 국가대표 AI 2차 선발 돌입…4개 팀, 이달 3팀으로2026.08.03
- 정부, 독파모 2차 평가 돌입…"데이터·비용·활용성 검증 관건"2026.08.07
- [유미's 픽] 독파모 고배 뒤 더 잘나간다…산업 AI 공략 속도 내는 두 기업, 어디?2026.07.21
과기정통부는 앞서 일각에서 제기된 국민평가단 선발 과정의 공정성 논란에 대해 성별·연령별 쿼터 적용과 무작위 선정 방식을 통해 대표성과 절차적 공정성을 확보했다는 입장을 강조했다.
과기정통부 측은 "추후 이해관계가 확인될 경우 평가점수에서 배제하고 민형사상 조치 등이 가능하도록 동의서를 받았다"며 "신청자의 중복 여부 확인 등을 거쳐 최종 평가자를 선별하기 때문에 같은 사람이 중복 참여하는 것도 구조적으로 불가능하다"고 말했다.











