"애플·삼성·아마존도 난리"…감정 읽는 AI 비서, 누가 더 잘 할까

생성형 AI 덕에 기술 고도화, 자연어 처리도 거뜬…오픈AI·아마존·애플 등 각축

컴퓨팅입력 :2024/08/31 12:00    수정: 2024/09/01 18:11

생성형 인공지능(AI)을 탑재한 'AI 비서'가 최근 우후죽순 쏟아지면서 글로벌 빅테크의 새로운 격전지가 되고 있다. AI의 휴대형, 개인화 현상이 짙어진 탓에 'AI 비서'와 관련된 기술들이 빠른 속도로 개발되며 시장의 새로운 성장동력이 되고 있다는 평가다.

31일 업계에 따르면 아마존은 올해로 출시 10년이 된 AI 음성 비서 '알렉사'를 오는 10월 중순께 전면 개편해 선보인다. 알렉사의 업그레이드는 2014년 출시 후 처음으로, 지난해 9월 대규모 개편을 발표한 지 13개월 만이다.

아르테미스1호에 적용되는 아마존의 AI비서 알렉사 (이미지=아마존)

새로운 알렉사는 월 최대 10달러의 구독 서비스를 가입해야 이용할 수 있다. 기존에는 날씨 등 사용자의 간단한 질문에 음성으로 답하는 것에 그쳤으나, 앞으로는 대규모 언어 모델(LLM)을 기반으로 생성형 AI를 통합해 복잡한 질문에도 답할 수 있게 된다. 특히 이용자의 선호도에 따라 생성한 뉴스 요약이 매일 제공되는 '스마트 브리핑' 기능이 탑재될 것으로 보여 기대감을 키우고 있다. 

삼성전자도 AI 비서 '빅스비'의 활용도를 높이기 위해 지난 26일 업데이트를 실시했다. 자연어 기반으로 맥락을 이해하는 음성 명령으로 가전 제품을 쉽게 제어할 수 있도록 한 것이다.

이를 통해 ▲한 문장에 여러가지 명령을 담아 말해도 가전제품이 각 의도를 이해할 수 있고 ▲앞의 대화를 기억해 다음 명령까지 연결해 수행할 수 있으며 ▲기기 관련 궁금증과 답변을 말로 묻고 바로 확인할 수 있다.

구글도 지난 13일 '메이드 바이 구글 2024'를 통해 자연스러운 대화가 가능한 AI 음성 비서 '제미나이 라이브'를 공개했다. 제미나이 라이브를 활용하면 개인 트레이너가 보낸 이메일을 바탕으로 운동 계획을 세워달라고 요청하거나, 유튜브 콘텐츠 내용과 관련해 궁금한 것을 옆사람과 대화하듯 물어볼 수 있다. 목소리도 10가지로 선택 가능하다.

월 구독료는 19.99달러(약 2만7천원)로, 구글 픽셀폰뿐 아니라 삼성전자 갤럭시폰에서도 이용할 수 있다. 구글은 수 주 안에 '아이폰'에도 이를 사용할 수 있도록 지원할 계획이다.

애플은 첫 AI폰 '아이폰16' 시리즈에 오픈AI의 'GPT-4o'를 적용한 AI 음성비서 '시리'를 탑재할 것으로 알려졌다. '시리'는 애플이 지난 2011년 선보인 서비스로, 이용자 요청에 타이머나 알람 설정, 날씨 등을 음성으로 알려준다. 오픈AI의 GPT-4o처럼 깊이 있는 양방향 소통은 그간 불가능했다.

오픈AI는 지난 5월 보고 듣고 대화할 수 있는 'GPT-4o'를 공개한 후 시장을 이끌고 있다는 평가를 받고 있다. 

GPT-4o는 텍스트를 통해 대화했던 기존 챗GPT와 달리 이용자와 실시간 음성 대화를 통해 질문을 받고 답변을 내놓는다. 텍스트·음성뿐 아니라 이미지 인식 기능까지 갖춘 멀티모달(Multimodal) 모델로, 사람이 말하는 내용이나 보여주는 이미지를 즉각 이해하고 이에 걸맞은 답을 할 수 있다.

업계 관계자는 "알렉사, 시리, 빅스비 등 기존 음성 비서 서비스들은 음성을 텍스트로 바꿔서 인식하고 답변도 텍스트로 먼저 만든 다음 음성으로 합성하는 식이었다"며 "이제는 음성을 음성 그 자체로 인식해 처리 과정이 빨라진 데다 목소리에 담긴 감정이나 배경이 섞인 소리도 알아차릴 수 있게 됐다는 점에서 상당한 기술 차이가 있다"고 설명했다.  

갤럭시폰에서 빅스비를 실행하는 모습 (사진=씨넷)

이처럼 생성형 AI를 활용한 음성 AI 비서 시장에서 빅테크들의 경쟁이 치열해지면서 관련 시장에 대한 전망도 긍정적이다. 실제 일본 시장조사기관 글로벌 인포메이션에 따르면 AI와 머신러닝(ML)을 사용하는 지능형 가상비서(IVA)의 올해 시장 규모는 147억7천만 달러(약 20조1천억원)로 추정된다. 2023~2030년 연평균 성장률(CAGR)은 26.2%로, 2030년 시장 규모는 474억 달러(약 64조6천억원)에 달할 것으로 전망된다.

관련기사

업계 관계자는 "생성형 AI 음성 비서가 앞으로 돈이 될 것으로 보고 빅테크들을 중심으로 앞 다퉈 서비스를 내놓고 있는 분위기"라며 "듣고 말하는 AI가 전 산업에 걸쳐 가져올 변화는 가늠하기 어려울 정도"라고 밝혔다.

그러면서 "다만 AI 비서 개발을 위해서는 개인정보와 편향성, 윤리적인 문제도 함께 고려돼야 할 것"이라고 덧붙였다.