ホームへ戻る

模型發布

Qwen3.8-Max、2.4Tの疎なMoEへ拡大——27Bおよびフラッグシップモデルの重みを来週公開予定

AlibabaはQwen3.8-Maxを正式APIとして提供し、ソフトウェア開発と長時間にわたる知識作業を主な用途に据えるとともに、フラッグシップ版と27Bモデルの重みを同時公開すると予告した。同モデルはコミュニティのコーディングArenaで上位に入ったが、アーキテクチャ、活性化パラメータ数、セルフホスティングのコストについては、依然として完全な技術文書が不足している。

猫猫的日记本 · CC BY-SA 4.0 · Image source
zh-Hant

AlibabaのQwenチームはQwen3.8-Maxを正式に発表し、これまで限定提供していたプレビューモデルを次世代フラッグシップへと昇格させた。公式発表によると、同モデルは総パラメータ数2.4兆の疎なMixture-of-Experts(MoE)アーキテクチャを採用している。製品の位置付けも一般的な対話から、ソフトウェア開発、文書処理、長時間実行可能な「cowork」作業へと移った。オープンソースコミュニティにとってさらに注目すべき点は、Qwen3.8-Maxと、ローカル環境への導入により適したQwen3.8-27Bの重みを来週公開するとチームが予告したことだ。

この計画が予定どおり実現すれば、その技術的意義は単に大型checkpointが一つ増えることにとどまらない。2.4T MoEを実際にデプロイできるかどうかは、tokenごとに実際に活性化されるパラメータ数、Expertの割り当て方法、KV cacheの規模、さらにvLLM、SGLang、Transformers、量子化ツールが新しいアーキテクチャを直ちに認識できるかに左右される。活性化パラメータ数が総パラメータ数を大幅に下回る場合でも、完全な重みのロードにはラック規模のメモリが必要になる可能性がある。一方、27B版は開発者がワークステーションや単一サーバーで現実的に評価できる主力モデルになる可能性が高い。

現時点での独立したシグナルは、主にArenaのブラインドテストから得られている。Qwen3.8-MaxはFrontend Code Arenaで一時約1,668 Eloを記録し、上位に入り、より高価格なモデルに迫った。ただし、Arenaが測定するのは生成されたWebサイトに対するユーザーの選好であり、スコアはエージェントフレームワーク、サンプリング設定、モデルのバージョンに左右される。そのため、大規模なコードベースを保守する能力や、ツールを正しく呼び出す能力を、この結果から直接判断することはできない。

エンジニアリングチームは現段階で、リリース時のチャートだけを根拠に本番モデルを切り替えるべきではない。次のステップとして、正式なmodel card、ライセンス条項、活性化パラメータ数、contextおよび量子化の仕様を待ち、固定したharnessを用いてAPIとセルフホストした重みを比較する必要がある。特に、長時間タスクでの反復ループ、ツール引数の安定性、中国語で記述されたプログラミング要件の理解力、さらに推論フレームワークの違いによって観測可能な品質差が生じるかを検証すべきだ。

出典

  1. Qwen3.8 官方發布頁
  2. Code Arena WebDev Leaderboard
  3. Qwen3.8-Max 社群發布討論