中国Alibabaは、同社の生成AIモデル「Qwen」シリーズの最上位モデル「Qwen3.8-Max」をベースにした、2.4兆パラメータのオープンウェイトモデル「Qwen3.8-2.4T-A95B」の重みを公開しました。Qwenシリーズの中で最上位クラス(Max)のモデル重みが公開されるのは今回が初めてで、7月末に中国Moonshot AIが「Kimi K3」を公開したのに続き、中国企業として2例目となる兆パラメータ級のオープンウェイトモデル公開です。
モデルは、512個のエキスパートから10個を選んで処理を割り振る「Mixture of Experts(MoE)」構成で、総パラメータ2.4兆のうち実際の計算で使われるのは約950億パラメータにとどまります。最大100万トークンのコンテキスト長に対応するクラウド版に対し、公開されたオープン版はテキストのみの入力で思考モードに固定、コンテキスト長も26.2万トークンに制限されるなど、機能面では一部制約があります。
Hugging Face上で即座に利用可能となっており、推論エンジンのvLLMやSGLangなどが公開初日から対応、NVIDIA・AMD両陣営のハードウェア向けに4bit量子化済みのチェックポイントも用意されています。コーディングやデータ分析、オフィス業務など長時間タスクでの性能向上を訴えており、米国発の主要モデルに迫る性能を無償で入手できる選択肢として注目されています。
出典: The Decoder



