本機 AI/開發平台
Microsoft Project Zenith 將本機 30B 模型與代理隔離層綁進開發者級 Windows 裝置
Project Zenith 是針對至少 64GB 統一記憶體、250GB/s 頻寬裝置預先配置的 Windows 11 開發體驗,首批搭載於 AMD Ryzen AI Halo。它把本機模型、WSL 工具鏈與代理容器放在同一平台敘事中,但目前的 MXC 仍是不可視為安全邊界的早期預覽。
頭版
偏技術的 AI 模型、軟體、晶片、開源、研究與基礎設施新聞。
本機 AI/開發平台
Project Zenith 是針對至少 64GB 統一記憶體、250GB/s 頻寬裝置預先配置的 Windows 11 開發體驗,首批搭載於 AMD Ryzen AI Halo。它把本機模型、WSL 工具鏈與代理容器放在同一平台敘事中,但目前的 MXC 仍是不可視為安全邊界的早期預覽。
推論系統
SGLang 新版可在同一服務中以 `beam_width` 回傳多條候選序列,並將統一 radix tree 設為所有模型的預設快取。更新同時擴充 MoE、長上下文及 ROCm 核心,但包含依賴與設定行為變更,升級前須重新驗證。
代理基礎設施
AWS 發布可由 CDK 部署的參考架構,定期替長期代理評分、合併及刪除記憶。這不是 AgentCore 的新原生 TTL 功能,且範例文件與程式庫對評分公式的描述尚未完全一致。
模型訓練研究
賓州大學研究者在固定知識 token 預算下,以多種概念表述取代部分原文重複,改善事實回憶與推理。效果主要出現在 7B 以上模型,但實驗仍是短程持續預訓練,不能直接外推至前沿模型的完整預訓練。
本機推論/開發工具
Ollama 的 macOS 應用程式現在可把本機開放模型直接接入新版 ChatGPT Desktop。這仍是候選版本,且社群已回報切回雲端模型的介面問題,不宜直接大規模部署。
模型評測
新版指數加入代理知識工作與長篇 PDF 推理測試,把不公開題目的權重由 20%提高至 40%。這能降低針對公開題庫最佳化的空間,卻也使外部研究者更難完整重現排名。
AI 程式工具
新版加入具權限邊界的專案/使用者記憶、可暫停與重試的 Workflow API,以及可並行切換的命名任務。它也擴大私有 Git 延伸套件與本機 operator API 的可達範圍,企業部署須重新檢查網路及驗證邊界。
模型評測
Nemotron-3-Ultra-CC 在 IOI 2026 題目取得 535.4/600 分,高於官方最高選手的 498.27 分。關鍵不只是 550B 模型,而是以 GenCorrect 反覆產生、測試及修正大量候選程式;該次執行最多使用 760 張 GB300。
代理應用
AWS 公開可由 CDK 部署的餐飲代理範例,以三個隔離執行期共用同一套記憶與 MCP 後端工具。語音路徑直接採 Nova 2 Sonic speech-to-speech,但 WebRTC、TURN、身分連結及固定網路成本仍須自行治理。
AI 安全
Microsoft 發現釣魚郵件把不可見的 Unicode Tag 字元插入金融關鍵字,藉此改變規則與機器學習分類器看到的 token。攻擊高峰每日超過 230 萬封,顯示 AI 紅隊技術已開始反向滲入傳統資安攻防。
代理框架
新的 `langchain.mcp` 以 FastMCP 統一連線、驗證及協定協商,取代獨立的 adapter 套件。伺服器可在工具執行途中要求補充資料或核准,LangChain 則把暫停點映射成可恢復的 LangGraph interrupt。
AI 安全
惡意專案可把命令寫入 `.git/config` 的 `core.fsmonitor`,等待代理背景執行 `git status` 或 `git diff` 時在主機啟動。部分產品已修補,但事件顯示代理沙箱若未涵蓋啟動與版本控制程序,工具核准仍可能被底層程式繞過。
推論基礎設施
SGLang Simulator 以 CPU 攔截執行期元件,模擬排程、批次與多層 KV cache,而不真正載入模型或執行 GPU 核心。團隊宣稱兩款 Qwen3 在 H20 的主要指標誤差低於 5%,但硬體與模型覆蓋仍有限。