인공지능
알리바바, 중국산 실리콘으로 10조 파라미터 모델을 학습하겠다고 밝혔다. 그 실리콘의 양산은 2027년이다
항저우에서 열린 윈치 대회(Apsara Conference)에서 알리바바는 AI 가속기 Zhenwu V900과 5조~10조 파라미터 규모의 Qwen 모델 계획을 공개했다. 그러나 이 칩의 양산은 2027년 1분기에야 시작되며, 그 시간 간격이 이번 발표의 실질적인 내용이다.
MAI
알리바바는 화요일 항저우에서 개막한 윈치 대회에서 두 가지를 발표했다. 따로 떼어놓으면 의미가 반쯤 사라지고, 함께 읽어야 뜻이 통하는 발표다. 하나는 새 AI 가속기 Zhenwu V900이고, 다른 하나는 5조~10조 파라미터 규모의 모델을 학습시키겠다는 계획이다. 에디 우(우융밍) 최고경영자는 V900을 현재 중국에서 가장 강력한 AI 칩이라고 말했다. 로이터에 따르면 이 칩의 양산은 2027년 1분기에 시작된다.
이 두 사실 사이의 간격이 실제 뉴스다. 알리바바는 엔비디아 하드웨어에 대한 미국의 수출 통제에서 이미 벗어났다고 선언한 것이 아니다. 벗어나겠다는 일정표를 제시한 것이다.
발표된 내용
| 항목 | 내용 |
|---|---|
| Zhenwu V900 | 이전 세대 M890 대비 3배 성능 |
| 클러스터 규모 | 학습과 추론을 위해 최대 50만 개 칩 연결 |
| 설계 | 알리바바 반도체 부문 T-Head, 중국 내 생산 |
| 양산 시점 | 2027년 1분기 |
| 현행 플래그십 모델 | Qwen 3.8 Max, 2.4조 파라미터 |
| 학습 중 | Qwen 4 |
| 계획 | Qwen 4.5와 Qwen 5, 5조~10조 파라미터 목표 |
| 알리바바 클라우드 | 2032년까지 글로벌 데이터센터 용량 20GW 이상 |
여기 실린 성능 수치는 모두 알리바바가 자체적으로 공개한 것이다. 회사는 독립적인 벤치마크도, 엔비디아 제품과의 직접 비교도 내놓지 않았고, V900을 생산하는 파운드리에 대해서도 "국내 제조"라고만 밝혔다.
파라미터 수는 발표할 수 있는 숫자다
5조~10조 파라미터라는 목표는 Qwen 3.8 Max 대비 대략 두 배에서 네 배에 해당한다. 그리고 이것은 아무것도 양보하지 않고 공개할 수 있는 유일한 사양이기도 하다. 이 숫자는 학습 토큰 규모에 대해서도, 전문가 혼합(MoE) 구조에서 한 번의 순전파에 실제로 활성화되는 파라미터 비중에 대해서도, 50만 개 칩 클러스터가 작동하는 기계인지 보도자료인지를 가르는 가속기당 메모리 대역폭에 대해서도 아무 말을 하지 않는다.
알리바바가 실제로 드러낸 것은 순서다. Qwen 4는 이미 보유한 하드웨어 위에서 지금 학습 중이다. 조 단위 파라미터 숫자가 등장하는 것은 Qwen 4.5와 Qwen 5이며, 이들은 2027년에야 양산이 시작되는 칩 뒤에 놓여 있다. 이 로드맵은 자신의 의존 관계에 솔직하며, 그 점에서 대부분의 컴퓨팅 발표보다 낫다.
우 CEO는 목적지를 분명히 말했다.
기계가 사고의 주된 주체가 되고 있으며, 지능은 대규모로 공급되는 상품으로 바뀌고 있다.
그는 또한 이 시대의 진정으로 획기적인 제품은 아직 등장하지 않았다고 말했고, AI 코딩을 "기계 지능 시대의 전구에 불과하다"고 표현했다. 초기 응용일 뿐 목적지는 아니라는 뜻이다.
알리바바가 인정한 제약
우 CEO는 AI 수요에 대응하기 위해 모든 자원을 동원하고 있다고 밝히면서도, AI 데이터센터 공급망 전반의 글로벌 부족이 확장 속도를 제약하고 있다고 인정했다. 역량을 과시하기 위해 설계된 기조연설에서 나온 발언치고는 눈여겨볼 만한 시인이다. 중국 기업이 배급받는 것은 첨단 로직만이 아니다. 고대역폭 메모리, 첨단 패키징, 전력 설비, 전력망 접속을 두고 다른 모든 기업과 같은 빡빡한 시장에서 경쟁한다. 경쟁력 있는 가속기를 설계하는 일은 알리바바가 통제할 수 있는 영역이다. 그것을 충분히 많이 만들고 전력을 공급하는 일은 그렇지 않다.
진짜 주장은 풀스택이다
칩은 이번 기조연설에서 쌓아 올린 포트폴리오의 한 조각일 뿐이다. T-Head의 Zhenwu 가속기, Yitian CPU, Panmai 스마트 네트워크 카드와 자체 인터커넥트 실리콘, Qwen 모델을 떠받치는 알리바바 클라우드, 그리고 회사가 Qwen Intelligence라고 이름 붙인 온디바이스 계층이다. 조지프 차이 부회장은 이를 직접적으로 표현했다.
알리바바는 풀스택 AI 구축에 확고하게 투자하고 있으며, AI를 기술적 돌파구에서 가치 창출로 옮기고자 한다.
중국 밖에서 실리콘부터 소비자용 모델까지 비슷한 스택을 운영하는 곳은 구글뿐이다. 이 구조는 과시가 아니라 헤지다. 자체 가속기를 설계하고, 자체 클라우드를 운영하며, 자체 프런티어 모델을 학습시키는 기업은 각 계층이 개별적으로는 서방 최고 수준에 미치지 못하더라도 다음 수출 규제 강화를 견디는 경로를 갖는다. 알리바바 연구 조직은 모델이 스스로 한계를 찾아 실험을 설계하는 '재귀적 자기 개선'이라는 방향도 밀고 있다. 이는 연구 방향이지 출시된 역량은 아니다.
시장의 해석
발표 이후 알리바바 주가는 약 5% 올라 한 달 만의 최고치를 기록했다. 같은 날 아침 텐센트는 새로운 훈위안(Hunyuan) 이미지 모델의 프리뷰를 공개하며 6% 넘게 상승했고, 홍콩의 AI 관련주가 전반적으로 올랐다. 투자자들은 미국의 수출 허가 없이도 작동하는 중국의 컴퓨팅 스택을 가격에 반영하기 시작했다. V900의 양산 시점이 그 가격이 옳았는지를 가리는 시험대다.
Sources: Alizila(알리바바) · 로이터, Daily Sabah 경유 · 로이터, Investing.com 경유 · AP 통신 · South China Morning Post · Bloomberg · Investing.com 분석