알리바바의 큐원3.8-맥스, 2.4조 파라미터로 중국 국가 연산망에 등재
2026-08-03 12:00:40.857+00
알리바바(Alibaba)는 자사의 대형 언어 모델인 큐원3.8-맥스(Qwen3.8-Max)를 중국 국가초산인터넷의 API 서비스에 새롭게 추가했다고 발표했다. 큐원3.8-맥스는 총 2.4조 개의 파라미터를 갖고 있어, 대용량 데이터 처리와 고급 자연어 처리 기능이 기대된다.
지난 3일, 알리바바는 큐원3.8-맥스를 공식 발표하였으며, 같은 날 국가초산인터넷은 API 호출 서비스를 시작했다고 PANews는 보도했다. 이를 통해 개발자들은 국가초산인터넷 공식 사이트에서 해당 API에 접근할 수 있게 되었다. 특히 큐원클라우드(QwenCloud)에서는 ‘qwen3.8-max-preview’라는 이름의 프리뷰 모델이 제공되며, 이는 100만 토큰의 컨텍스트를 지원하고, 사고 모드, 함수 호출 및 내장 도구 기능을 제공한다.
알리바바 클라우드의 백련(Model Studio)에서는 공식 모델로 qwen3-max 계열이 올라와 있으며, 이 모델의 컨텍스트 길이는 26만2144토큰에 달한다. 중국 베이징 지역에서의 가격은 입력 100만 토큰당 2.5위안, 출력 100만 토큰당 10위안으로 설정되어 있어 저렴한 비용으로 사용이 가능하다.
국가초산인터넷은 고성능 컴퓨팅과 AI 연산 자원을 통합하여 제공하는 중국의 국가급 플랫폼으로, 고성능 컴퓨팅 서비스, AI 서비스, 컨테이너, 베어메탈 서버, 산력시장, 앱 마켓 등 다양한 기능을 지원한다. 또한, QwQ-32B 및 딥시크(DeepSeek) 모델도 API 형태로 지원되고 있어 개발자들이 별도의 배포 없이 모델을 호출할 수 있도록 하고 있다.
이번 API 서비스 추가는 대형 언어 모델이 민간 클라우드에서 국가급 연산망으로 확대되는 경향을 보여준다. 이전에 보도된 바에 따르면, 큐원은 2.4조 파라미터 규모의 새로운 모델을 공개한 바 있다.
이와 함께 반도체 공급망과의 연관성도 주목을 받을 만하다. 국가초산인터넷의 정저우 핵심 노드는 중커수광(Sugon)의 scaleX 만카 초집군 시스템을 기반으로 하여, 중국산 GPGPU 가속 카드 3만 장 이상의 설치와 반정밀도 15EFlops 이상의 계산 성능을 제공한다. 다만 큐원3.8-맥스 API에 사용되는 가속 카드의 종류와 요청당 활성화된 파라미터의 규모에 대해서는 아직 확인되지 않았다.
마지막으로, 2.4조 파라미터는 모델의 규모에 대한 수치일 뿐 실제 성능을 나타내지는 않음을 유의해야 한다. 독립적인 벤치마크와 활성화된 파라미터, 추론 비용 등을 함께 고려해야만 성능과 효율에 대한 정확한 비교가 가능하다. 또한 현재까지 크립토 및 블록체인과의 직접적인 연관성은 명확히 드러나지 않고 있다.
