代理框架與上下文基礎設施
OpenViking 0.4.16 讓 VikingBot 遠端載入 Skills,並移除 Resource Relations API
新版把代理技能集中存放、搜尋及快取的流程接入 VikingBot,也加入逐使用者記憶擷取政策與持久化背景匯入。升級同時刪除實驗性的關係 API 與 CLI 指令,既有整合須先遷移。
Archive
共 960 篇技術新聞
代理框架與上下文基礎設施
新版把代理技能集中存放、搜尋及快取的流程接入 VikingBot,也加入逐使用者記憶擷取政策與持久化背景匯入。升級同時刪除實驗性的關係 API 與 CLI 指令,既有整合須先遷移。
AI 推論基礎設施
新版在啟動時並行處理 checkpoint staging 與 CUDA Graph capture,官方 H100 測試較普通預設流程快 2.38 倍。它也重寫部分張量並行通訊並加入七個模型家族,但 Torch 升級與快取路徑整併帶來遷移成本。
AI 評測與可靠性
Hume AI 與 Hugging Face 發現,若音訊與公開測試集答案衝突,部分高分語音模型仍會輸出參考稿內容。Open ASR Leaderboard 已加入 Benchmark Fitting 分頁,但這些行為不等同證明模型直接看過測試資料。
邊緣 AI 與工具呼叫
Cactus Compute 近日完善 Needle 2 的 Python API、跨平台執行與 Apache 2.0 授權,模型卡亦持續更新。它以 28MB 峰值記憶體執行工具選擇及結構化抽取,但速度與準確率仍主要來自官方測試。
AI 安全與代理基礎設施
Semantica 0.6.6 集中修補知識圖譜匯入、備份、匯出及外部請求的多類漏洞,維護者建議所有部署升級。新版也加入可保留來源紀錄的事實撤回機制與 CrewAI 整合。
推論系統
Yutori 的 Navigator 每項瀏覽器任務會連續呼叫視覺語言模型數十次,歷史上下文最長可增至約 100K token。Together AI 以 vLLM 前綴快取及分流延遲目標承載這種負載,但兩倍速度與低四至五倍成本仍是供應商披露的比較結果。
代理框架
Nous Research 將無金鑰網路搜尋、排程記憶與執行停滯防護收進 Hermes Agent 0.20.5。這次標為修補版,卻合併約 323 個 PR,完整遷移說明仍要等 0.21.0。
AI inference runtimes
Hugging Face 讓 MiniMax H3、MiniMax Music 3 及 Wan-Animate-2 直接以可組合區塊接入,不再提供傳統 DiffusionPipeline 封裝。新版也加入有限的 tensor parallel、低位元量化後端及安全修補,但帶來 Flax 移除與 LoRA 輸出變動。
AI coding tools
Slack Code 讓 Claude、Devin、Copilot、ChatGPT 與 Vercel 代理在專案專屬頻道內展示計畫、程式碼差異及即時預覽。它改善多人監督代理的介面,但執行沙盒、憑證及儲存庫權限仍由各代理供應商處理。
推薦系統
NVIDIA 將 HSTU、動態 embedding 與 Semantic ID 生成式推薦整理成可執行的 PyTorch 參考堆疊。它針對「長歷史、只生成數個 token、beam width 極大」的推薦負載重寫快取及解碼路徑,但數據目前限於 NVIDIA 硬件與合成配置。
推論系統
Liquid AI 為三款 LFM2.5 模型釋出約 3 億參數的 DSpark 草稿檢查點,並接入 llama.cpp 與 SGLang。官方測試顯示加速幅度會隨模型、資料分布及硬件大幅變動,不能把峰值直接視為所有工作負載的收益。
多模態代理與評測
RuleMaze 用可執行驗證器檢查多模態模型能否看懂迷宮、遵守自然語言規則並完成路徑規劃。DMP 將感知、移動及規則驗證拆開後明顯勝過一般微調,但測試仍限於合成網格,且驗證器曾經人工校正。