推論系統
Uno 以離散擴散輔助自回歸模型,無需獨立草稿模型即可並行解碼
Uno 將輕量擴散權重附加至自回歸 LLM,再以 Ψ-Spec 一次提出多個 token 並維持原模型的取樣分布。作者報告最高三倍加速,但目前數字仍來自研究團隊的特定模型、硬體與推論引擎。
Archive
共 937 篇技術新聞
推論系統
Uno 將輕量擴散權重附加至自回歸 LLM,再以 Ψ-Spec 一次提出多個 token 並維持原模型的取樣分布。作者報告最高三倍加速,但目前數字仍來自研究團隊的特定模型、硬體與推論引擎。
開源模型工具鏈
新版加入 Parity-aware BPE,讓分詞器在每次合併時優先改善壓縮最差的語言,而非只追求全體最高頻率。這項功能可用於訓練新詞彙表,卻不會自動修正既有模型的中文 token 成本。
世界模型與生成式影音
GWM Worlds 2 將自回歸擴散、因果影音解碼器與結構化 WorldPrompt 結合,能以文字動作和鏡頭訊號即時控制連續世界。系統仍是封閉研究預覽,快速運鏡、長期一致性與可重現評測都是明顯缺口。
AI 搜尋與安全
研究者在 760 次 Sonar 查詢中收集 7,534 筆引用,發現長尾網站大量進入推薦系統的檢索證據。三個疑似同一營運者的網站只占引用量 2.4%,研究也未證明這些頁面實際改變了推薦結果。
AI 代理與研究自動化
新研究把原始碼、文件與測試轉成按需載入的操作知識,讓固定模型及代理框架在四項研究基準全面提升。技能建置成本另行計算,成果仍是作者評測,不能直接視為低成本取代模型訓練。
AI 開發工具
Claude Platform CLI 新增 `ant apply`,可由儲存庫內的 Markdown、YAML 或 JSON 同步受管代理資源。它補上預覽、相依排序與漂移偵測,但狀態檔仍含組織識別資訊,且目前只管理 Anthropic 平台。
AI 安全工具
開源 AI 滲透測試工具 Shannon 3.0 新增多階段程式碼分析、候選漏洞調和及原生 SARIF。新版只讓成功重現的漏洞觸發流水線門檻,但會實際修改目標狀態,且 2.x 工作區不能續跑。
代理資料集與評測
Cohere Labs 公開 Agentic Task Ecosystem,彙整七個目錄的 696,291 個工具,再與美國 O*NET 工作任務對照。結果顯示大量 MCP 只完成流程片段,但 2.6% 是語意配對與模型判定結果,不能視為工具通過實際執行測試。
生成式影像模型
螞蟻集團 inclusionAI 公開 LLaDA-Image 權重與 Diffusers 推論程式,單一模型同時處理文字生圖、參考圖編輯及中英文字渲染。蒸餾版以 Twin-DMD 將建議取樣步數由 50 降至 4,但訓練程式與獨立效能驗證仍未到位。
AI 程式開發工具
Agent Merge 預覽版把程式代理的工作範圍從產生變更延伸到 PR 收尾,可反覆處理審查意見、失敗檢查與分支衝突。啟用後工作階段會切換至 Autopilot 與 Assisted permissions,團隊必須把自動合併及必要檢查視為高權限控制面。
本機 AI/推論系統
新開源推論伺服器 Magnitude 會實測硬體,再推薦模型、量化、上下文長度與預估速度的完整組合。它把本機代理最容易配錯的記憶體與併發參數自動化,但效能與模型品質目前仍主要依賴專案方的目錄及測試。
AI 平台與基礎設施
NVIDIA 已同意收購 Hugging Face,取得模型、資料集、應用程式與推論服務的重要分發樞紐。公司承諾平台不會綁定 NVIDIA 硬體,但交易後的實際治理、排序與跨硬體最佳化仍須持續檢驗。