返回首頁

生成式 AI 工具

ComfyUI 0.33.1 原生接入 MiniMax Music 3 與 CUDA Graph,非動態 VRAM 模式同步修補

ComfyUI 0.33.1 把 MiniMax Music 3 的模型載入及推理節點納入核心,並加入可供後端使用的 CUDA Graph 支援。版本亦修正固定 VRAM 配置無法執行 Music 3,以及部分 MiniMax 權重 QKV 版型辨識問題。

Oronbb · CC BY-SA 4.0 · Image source
zh-Hant

ComfyUI 0.33.1 的重點不是新增一個遠端 API 節點,而是把 MiniMax Music 3 的本機模型路徑與 CUDA Graph 基礎支援直接合入核心。使用者可配合社群已上架的文字編碼器、VAE 與 GGUF 權重建立音樂生成 workflow;核心同時加入 QKV 合併權重與分離 Q、K、V 權重的早期辨識,降低不同轉換版本在載入階段才因張量版型不符而失敗的機率。

CUDA Graph 的價值在於先錄製一串 GPU kernel 呼叫,再以較低 CPU dispatch 成本重播。對擴散或音訊生成這類反覆執行相近運算圖的工作負載,它有機會減少大量細碎 kernel launch 的空檔。不過本次 changelog 只確認「核心支援」,沒有公布 Music 3 的端到端延遲、顯存或吞吐比較;動態 shape、自訂節點及會改變控制流的 workflow 是否能穩定捕捉,也需逐一測試,不能把功能合併直接解讀成固定加速幅度。

版本還修正 MiniMax Music 3 在非 dynamic-VRAM 模式不能運作,以及 WSL 不應被自動停用 dynamic VRAM 的問題;這對固定顯存策略、Windows/WSL 部署及顯存緊張的本機工作站較實際。同一版另修補 nested latent、LTX diffusion decoder 的 `float64` 裝置問題,以及 Gemma 4 E2B/E4B 忽略 `thinking=false`。社群在發布後亦迅速補上 Music 3 GGUF 資產,顯示工作流已開始成形。生產環境升級前仍應鎖定0.33.1、保存舊 workflow,並分別驗證模型權重版型、音訊長度、顯存峰值與 CUDA Graph fallback;官方尚未提供完整相容性矩陣。

來源

  1. ComfyUI v0.33.1 release notes
  2. MiniMax Music 3 model assets for ComfyUI
  3. Community roundup of MiniMax additions in ComfyUI