알리바바, 10조 파라미터 AI 만든다…자체 칩·20GW 데이터센터도 확장

압사라 컨퍼런스서 풀스택 AI 로드맵 공개…차세대 큐원·자체 AI 칩 전략 선보여

컴퓨팅입력 :2026/09/22 15:15    수정: 2026/09/22 16:05

알리바바가 인공지능(AI) 칩부터 클라우드 인프라, 대규모언어모델(LLM), AI 에이전트까지 자체 기술로 연결하는 풀스택 AI 전략을 강화한다. 차세대 큐원(Qwen) 모델을 최대 10조개 파라미터 규모로 확대하고 글로벌 데이터센터 용량을 2032년 20기가와트(GW) 이상으로 늘리는 등 AI 인프라와 모델에 대한 대규모 투자를 이어간다는 구상이다.

알리바바 그룹은 알리바바 클라우드의 연례 기술 행사 '압사라 컨퍼런스'에서 칩과 클라우드 인프라, 모델, 에이전트를 아우르는 풀스택 AI 전략 로드맵과 관련 기술을 공개했다고 22일 밝혔다.

이번 행사에선 차세대 큐원 파운데이션 모델과 멀티모달 모델, 자체 개발 AI 칩, AI 에이전트 구동에 특화된 에이전틱 클라우드, 스마트폰용 AI 에이전트 플랫폼 등이 공개됐다.

에디 우 알리바바 그룹 CEO가 압사라 컨퍼런스에서 머신 인텔리전스 시대 전망과 향후 전략 로드맵을 소개하고 있다. (사진=알리바바 클라우드)

큐원 최대 10조 파라미터로…AI가 스스로 모델·칩 개선

알리바바는 현재 차세대 모델 '큐원4'를 학습 중이다. 후속 모델인 큐원4.5와 큐원5 시리즈까지 로드맵을 제시했으며 향후 모델 규모를 5조~10조개 파라미터까지 확대할 것으로 전망했다.

AI가 스스로 학습 과정을 개선하는 '재귀적 자기 개선(RSI)' 기술 성과도 공개했다. 회사 측에 따르면 큐원3.8-맥스는 한 달 동안 파이프라인 설계와 데이터 검증, 반복 실험, 오류 진단을 자동으로 수행하며 33차례 개선 과정을 거쳤다. 그 결과 AI 모델 평가기관 아티피셜 애널리시스 점수가 40점에서 45점으로 상승했다.

칩 설계에도 AI를 활용했다. 큐원3.8-맥스는 60시간 이상 스스로 개선하는 과정을 거치면서 전자설계자동화(EDA) 도구를 1만회 이상 호출해 칩 버스 모듈을 설계했다. 이를 통해 성능 저하 없이 칩 면적을 42% 줄였다는 설명이다.

음성과 이미지 등 멀티모달 AI 모델도 확대한다. 실시간 통역 모델 '큐원3.8-라이브 트랜슬레이트'는 지연 시간을 2.8초에서 2.3초로 약 20% 줄였다. 오디오 생성 모델 '큐원-오디오-3.1-TTS-넥스트'를 비롯해 자동 음성 인식과 음성 변환, 실시간 상호작용을 지원하는 모델도 선보였다.

이미지 생성 모델 '큐원-이미지 3.1'은 올해 출시할 예정이다. 크리에이티브 디자인과 이커머스 마케팅에 초점을 맞춰 이미지 제작 시간을 수 시간에서 수 초로 단축하고 투명 배경 이미지 생성과 이미지 편집 등을 지원한다. 인터랙티브 월드 모델 '해피오이스터 2.0 프리뷰'와 월드 모델 벤치마킹 플랫폼 '해피월드 아레나'도 공개했다.

스마트폰에서 AI 에이전트를 활용하기 위한 기업용 풀스택 솔루션 '큐원 인텔리전스'도 선보였다. 스마트폰 제조사가 큐원 기반 에이전트 플랫폼을 활용해 여러 애플리케이션에 걸친 복잡한 작업을 처리하는 AI 스마트폰을 구현하도록 지원하는 솔루션이다.

자체 AI 칩 '전우' 공개…CPU까지 풀스택 내재화

AI 연산을 뒷받침할 자체 반도체도 공개했다. 알리바바의 반도체 설계 부문 티헤드는 AI 학습·추론 프로세서 '전우(Zhenwu) V900'을 선보였다. 지난 5월 출시한 전우 M890 대비 3배 성능을 제공하며 216기가바이트(GB) 메모리와 초당 1200GB의 칩 간 대역폭을 갖췄다. FP8과 FP4 등 다양한 수치 정밀도를 지원하며 양산과 상용 출시는 내년 1분기로 예정됐다.

알리바바는 전우 V900과 네트워크·스토리지 관련 자체 칩을 통합한 차세대 슈퍼노드 서버도 공개했다. 최대 50만장의 카드로 구성된 슈퍼노드 클러스터를 지원한다.

중앙처리장치(CPU) 개발 로드맵도 제시했다. 내년 출시를 목표로 개발 중인 '이톈(Yitian) 720'과 '이톈 730', 2029년 출시 예정인 '이톈 750' 등이다. 이톈 750은 자체 코어를 기반으로 이톈 CPU와 전우 AI 칩을 직접 연결하도록 설계된다.

에이전틱 클라우드 구축…2032년 데이터센터 20GW로

알리바바 클라우드는 AI 에이전트 시대에 대응한 에이전틱 클라우드 전략도 공개했다. 모델과 에이전트 실행·관리 환경인 하니스, 컨텍스트 등 세 계층으로 나눠 기업의 AI 에이전트 구축과 운영을 지원한다.

모델 계층의 AI 네이티브 클라우드는 대규모 모델 학습과 추론을 담당한다. AI 플랫폼 PAI는 추론과 캐싱, 샘플 리플레이, 학습 서비스를 연계하고 클라우드 병렬 파일 스토리지(CPFS)는 초당 100테라바이트(TB) 수준의 처리량과 초당 1억회의 입출력 작업(IOPS)을 제공한다. 회사 측은 이를 통해 AI 스토리지 비용을 69% 절감할 수 있다고 설명했다.

자체 AI 네트워킹 아키텍처 'HPN 8.0 Pro'는 100페타비트(Pb) 대역폭을 지원한다. 단일 클러스터에서 800G급 네트워크 포트를 13만개 이상 지원하고 네트워크 장애 등에 따른 영향을 이전 세대의 50%에서 25%로 줄였다.

에이전트 계층에선 '에이전트코어'와 '에이전트 시큐리티 센터'를 공개했다. 에이전트코어는 AI 에이전트 구축부터 실행·관리까지 전체 생애주기를 지원하고 에이전트 시큐리티 센터는 실시간 위협 탐지를 기반으로 에이전트의 보안과 규정 준수를 관리한다.

데이터 영역에선 '에이전트 컨텍스트'와 '오픈레이크'를 강화했다. 에이전트 컨텍스트는 기업의 문서와 업무 시스템, 채팅 기록, 멀티모달 데이터를 통합해 AI 에이전트에 실시간 맥락과 장기 기억을 제공한다. 회사 측은 고객 서비스와 AI 코딩, 데이터 분석 등에서 토큰 사용량을 최대 67% 줄일 수 있다고 설명했다.

오픈레이크는 정형·반정형·비정형·벡터·스트리밍 데이터 등을 하나의 사본으로 관리하는 멀티모달 데이터 레이크하우스로 고도화했다. 기존 아키텍처 대비 총비용을 38% 줄이고 쿼리 응답 시간을 40% 단축했다는 설명이다.

알리바바는 이러한 AI 수요 확대에 맞춰 클라우드 인프라도 대폭 확충할 계획이다. 현재 운영하는 글로벌 데이터센터 용량을 2032년까지 20GW 이상으로 확대해 증가하는 AI 연산 수요를 뒷받침한다는 목표다.

에디 우 알리바바 그룹 최고경영자(CEO)는 "현재 기계의 사고 총량은 인간 전체 사고량의 3%에도 못 미친다"며 "향후 기계의 사고량이 인간의 1000배에 이른다고 가정하면, 간단한 계산만으로도 기계의 사고량이 얼마나 크게 늘어날 수 있는지 알 수 있다"고 설명했다.

관련기사

이어 "기계가 사고의 핵심 주체로 자리 잡으면서 지능은 대규모로 공급되는 상품으로 바뀌고 있지만, 기계 지능 시대의 진정한 혁신 제품은 아직 등장하지 않았다"고 덧붙였다.

그러면서 "이러한 인식을 바탕으로 우리가 운영하는 글로벌 데이터센터 용량을 2032년까지 20GW가 넘는 규모로 확대해 업계에서 기하급수적으로 증가하는 AI 수요를 뒷받침하는 것을 목표로 한다"고 강조했다.