模型發布
Qwen3.8-Max 擴至 2.4T 稀疏 MoE,27B 與旗艦權重預告下週開放
阿里巴巴將 Qwen3.8-Max 推向正式 API,主攻程式開發與長流程知識工作,並預告同步開放旗艦版及 27B 模型權重。模型在社群程式競技場取得前段排名,但架構、啟用參數量與自架成本仍缺乏完整技術文件。

阿里巴巴 Qwen 團隊正式推出 Qwen3.8-Max,把先前有限度提供的預覽模型升格為新一代旗艦。官方稱模型採用總規模 2.4 兆參數的稀疏 Mixture-of-Experts 架構,產品定位由一般對話轉向程式開發、文件處理及可長時間執行的「cowork」工作。更值得開源社群注意的是,團隊預告 Qwen3.8-Max 與較適合本地部署的 Qwen3.8-27B 權重將於下週釋出。
這項安排若如期落地,技術意義不只是再多一個大型 checkpoint。2.4T MoE 的可部署性取決於每個 token 實際啟用多少參數、專家如何分配、KV cache 規模,以及 vLLM、SGLang、Transformers 與量化工具能否立即辨識新架構。即使活躍參數遠少於總參數,載入完整權重仍可能需要機架級記憶體;27B 版本反而可能成為開發者真正能在工作站或單機伺服器評估的主力。
獨立訊號目前主要來自 Arena 的盲測。Qwen3.8-Max 在 Frontend Code Arena 一度取得約 1,668 Elo,進入前列且接近價格更高的模型。不過 Arena 衡量的是使用者對生成網站的偏好,成績會受到代理框架、採樣設定及模型版本影響,不能直接推出其維護大型程式庫或正確呼叫工具的能力。
工程團隊現階段不宜只依發布圖表更換生產模型。下一步應等待正式模型卡、授權條款、活躍參數量、上下文與量化規格,並用固定 harness 比較 API 與自架權重。尤其要檢查長任務中的重複迴圈、工具參數穩定度、中文程式需求理解,以及不同推論框架是否產生可觀察的品質落差。