[AI는 지금] IPO 나선 딥시크, 초대형·고효율 'V4.1 플래시' 공개

토큰당 활성 파라미터 80억·160억 개로 효율성 강화…연내 상장 절차 개시 목표

컴퓨팅입력 :2026/09/10 16:39    수정: 2026/09/10 17:02

상하이 증시 기업공개(IPO)를 추진 중인 중국 인공지능(AI) 스타트업 딥시크가 5520억 개 파라미터 규모 신규 AI 모델을 공개했다. 대규모 멀티모달 모델을 앞세워 AI 기술 경쟁력을 강화하는 동시에 상장을 통한 자금 조달에도 속도를 낸다.

딥시크는 10일(현지시간) 오픈소스 AI 플랫폼 허깅페이스에 '딥시크 V4.1 플래시'를 공개했다. 딥시크 V4.1 플래시는 5520억 개 백본 파라미터를 갖춘 혼합전문가(MoE) 기반 멀티모달 모델이다. 이미지와 텍스트를 네이티브 방식으로 처리하며 최대 100만 토큰 컨텍스트를 지원한다.

모델 규모를 키우면서도 실제 연산 과정에서 활성화되는 파라미터는 제한했다. 딥시크는 딥시크 V4.1 플래시에 인과적 인코더-디코더(CED) 구조를 적용해 토큰당 프리필 단계에서는 80억 개, 디코드 단계에서는 160억 개 파라미터만 활성화하도록 설계했다. 이를 통해 입력량이 많은 에이전틱 AI 작업에서 비용 효율성을 높일 수 있도록 했다.

딥시크 V4.1 플래시 (사진=허깅페이스 갈무리)

추론 과정에서 발생하는 메모리 부담도 줄였다. 압축 희소 어텐션(CSA2)과 FP4 기반 메인 키밸류(KV) 캐싱 등을 적용해 글로벌 KV 캐시 규모를 토큰당 890바이트까지 낮췄다. 이는 전작인 딥시크 V4 플래시 대비 약 4분의 1 수준이다.

멀티모달 학습에도 대규모 데이터가 투입됐다. 딥시크 V4.1 플래시는 이미지와 텍스트를 포함한 45조 토큰 규모 데이터로 처음부터 학습됐으며, 이 과정에서 최대 100만 토큰까지 컨텍스트를 확장했다. 또 추론 노력 수준을 1부터 100까지 연속적으로 조절할 수 있어 정확도와 추론 비용 사이에서 사용자가 원하는 수준을 선택하도록 했다.

응용 프로그램 인터페이스(API) 비용 경쟁력도 강화했다. 딥시크 공식 API 문서에 따르면 V4.1 플래시의 비첨두 시간 기준 가격은 100만 토큰당 입력 캐시 적중 0.003달러, 캐시 미적중 0.15달러, 출력 0.6달러다. 첨두 시간에는 각각 비첨두 가격의 두 배가 적용된다. 기존 V4 플래시 계열 모델에 대한 요청도 V4.1 플래시가 처리하도록 변경됐다.

또 딥시크는 V4.1 프로 출시 전까지 기존 V4 프로 요청을 V4.1 플래시로 라우팅하고 플래시 가격을 적용할 예정이다. 공식 API 문서에 따르면 이 조치는 14일 정오(베이징 시간)부터 적용된다.

(사진=딥시크)

이같은 기술 경쟁력 강화와 함께 딥시크의 IPO 준비 작업도 구체화되고 있다. 로이터는 9일(현지시간) 딥시크가 상하이증권거래소 기술기업 중심 시장인 과창판 상장을 위해 중신증권을 주관사로 선정했다고 보도했다. 딥시크는 올해 안에 IPO 절차를 시작하는 것을 목표로 하는 것으로 전해졌다.

구체적인 상장 시점과 공모 규모, 목표 기업가치는 아직 결정되지 않았다. 로이터에 따르면 딥시크는 지난 6월 약 74억 달러를 조달했으며 당시 투자 후 기업가치는 500억 달러 이상으로 평가됐다. 5000억 위안(약 100조 원) 수준의 기업가치를 전제로 한 추가 자금 조달도 추진 중인 것으로 알려졌다. 

관련기사

로이터는 딥시크의 IPO 관련해 "중국과 미국 AI 기업 간 경쟁이 격화하는 가운데 컴퓨팅 인프라와 AI 모델 개발, 인재 확보 등에 필요한 자금을 마련하기 위한 움직임"이라고 진단했다.

이어 "중국 AI 기업들이 미국 경쟁업체보다 상대적으로 낮은 기업가치를 평가받는 것은 경쟁력 있는 기술을 실제 수익으로 전환하는 데 어려움을 겪기 때문"이라고 부연했다.