2.4조 파라미터의 알리바바 큐원, 중국 국가 초산 인터넷 API에 등록

[email protected]



알리바바의 새로운 대형 언어 모델인 큐원3.8-맥스(Qwen3.8-Max)가 2.4조 개의 파라미터를 지원하며, 중국의 국가 초산 인터넷 API 서비스에 추가되었습니다. 이 모델은 3일 발표되었으며, 같은 날 국가 초산 인터넷도 API 호출 서비스를 시작했다고 PANews가 보도했습니다. 지금부터 개발자들은 국가 초산 인터넷의 공식 사이트를 통해 이 API에 접근할 수 있게 되었습니다.

큐원클라우드(QwenCloud)에서는 ‘qwen3.8-max-preview’라는 토큰 플랜 전용의 프리뷰 모델을 제공하며, 이 모델은 최대 100만 토큰의 컨텍스트와 사고 모드, 함수 호출 및 내장 도구를 지원합니다. 또한, 알리바바 클라우드의 백련(Model Studio)에는 정식 모델로 ‘qwen3-max’ 계열이 등록되어 있으며, 이 모델의 컨텍스트 길이는 26만2144토큰입니다. 베이징 지역에서의 가격은 입력 100만 토큰당 2.5위안, 출력 100만 토큰당 10위안입니다.

국가 초산 인터넷은 중국의 고성능 컴퓨팅 및 AI 연산 자원을 연결하는 국가급 플랫폼으로, 고성능 컴퓨팅 및 AI 서비스, 컨테이너, 베어메탈 서버, 클라우드 마켓 등을 제공합니다. 이번 서비스에는 QwQ-32B와 딥시크(DeepSeek) 계열의 모델도 API 형태로 지원되어 개발자들이 별도의 모델 배포 없이도 쉽게 호출할 수 있게 하였습니다.

이번 API 서비스의 추가는 대형 언어 모델의 접근 경로가 민간 클라우드에서 국가급 연산망으로 확대되고 있다는 점에서 큰 의미를 갖습니다. 이전에 보도된 바와 같이, 큐원은 총 2.4조 개의 파라미터를 갖춘 신규 모델을 발표했던 바 있습니다. 이로 인해 연구 및 개발 환경이 더욱 풍부해지는 기회가 마련될 것으로 기대됩니다.

또한, 국가 초산 인터넷의 정저우 핵심 노드는 중커수광(Sugon)의 scaleX 만카 초집군 시스템을 기반으로, 중국산 GPGPU 가속 카드 3만 장 이상과 반정밀도 15EFlops 이상의 연산 성능을 제공하므로, 이런 인프라는 큐원3.8-맥스 API의 원활한 운영에 기여할 것으로 보입니다. 그러나 큐원3.8-맥스 API에 사용되는 가속 카드와 요청당 활성 파라미터 규모는 확인되지 않았습니다.

2.4조 개의 파라미터는 해당 모델의 전체 규모를 나타내는 지표에 불과하며, 실제 성능을 나타내지는 않습니다. 모델의 성능과 효율을 체계적으로 비교하기 위해서는 독립적인 벤치마크 데이터와 활성 파라미터, 추론 비용 등을 함께 고려해야 합니다. 현재로서는 크립토·블록체인과의 연관성에 대한 언급은 없습니다. 이러한 점들을 종합적으로 고려할 때, 큐원3.8-맥스 모델은 AI와 고성능 컴퓨팅의 융합을 통해 전 세계적으로 중요한 기술로 자리잡을 가능성이 있습니다.

Leave a Comment