AI 晶片與推論
Extropic Z1T 為機率晶片重寫 Transformer,但百倍節能仍是排除關鍵成本的估算
Z1T 以固定四路稀疏投影、動態 tanh 與卷積式注意力,把部分解碼運算映射至 Extropic 的 Z1 機率位元晶片。程式與一組權重已公開,但節能和吞吐數字主要來自硬體模型,尚非完整端到端實測。
Archive
共 937 篇技術新聞
AI 晶片與推論
Z1T 以固定四路稀疏投影、動態 tanh 與卷積式注意力,把部分解碼運算映射至 Extropic 的 Z1 機率位元晶片。程式與一組權重已公開,但節能和吞吐數字主要來自硬體模型,尚非完整端到端實測。
開源模型
InclusionAI 公開 LLaDA-Image 的 Base、Turbo 與 FP8 權重,讓同一模型支援文字生圖、參考圖編輯及中英文字渲染。論文詳列 2.2 億筆樣本的漸進訓練方法,但承諾的訓練程式碼目前仍未交付。
本機 AI/開發平台
Project Zenith 是針對至少 64GB 統一記憶體、250GB/s 頻寬裝置預先配置的 Windows 11 開發體驗,首批搭載於 AMD Ryzen AI Halo。它把本機模型、WSL 工具鏈與代理容器放在同一平台敘事中,但目前的 MXC 仍是不可視為安全邊界的早期預覽。
推論系統
SGLang 新版可在同一服務中以 `beam_width` 回傳多條候選序列,並將統一 radix tree 設為所有模型的預設快取。更新同時擴充 MoE、長上下文及 ROCm 核心,但包含依賴與設定行為變更,升級前須重新驗證。
代理基礎設施
AWS 發布可由 CDK 部署的參考架構,定期替長期代理評分、合併及刪除記憶。這不是 AgentCore 的新原生 TTL 功能,且範例文件與程式庫對評分公式的描述尚未完全一致。
模型訓練研究
賓州大學研究者在固定知識 token 預算下,以多種概念表述取代部分原文重複,改善事實回憶與推理。效果主要出現在 7B 以上模型,但實驗仍是短程持續預訓練,不能直接外推至前沿模型的完整預訓練。
本機推論/開發工具
Ollama 的 macOS 應用程式現在可把本機開放模型直接接入新版 ChatGPT Desktop。這仍是候選版本,且社群已回報切回雲端模型的介面問題,不宜直接大規模部署。
模型評測
新版指數加入代理知識工作與長篇 PDF 推理測試,把不公開題目的權重由 20%提高至 40%。這能降低針對公開題庫最佳化的空間,卻也使外部研究者更難完整重現排名。
AI 程式工具
新版加入具權限邊界的專案/使用者記憶、可暫停與重試的 Workflow API,以及可並行切換的命名任務。它也擴大私有 Git 延伸套件與本機 operator API 的可達範圍,企業部署須重新檢查網路及驗證邊界。
模型評測
Nemotron-3-Ultra-CC 在 IOI 2026 題目取得 535.4/600 分,高於官方最高選手的 498.27 分。關鍵不只是 550B 模型,而是以 GenCorrect 反覆產生、測試及修正大量候選程式;該次執行最多使用 760 張 GB300。
代理應用
AWS 公開可由 CDK 部署的餐飲代理範例,以三個隔離執行期共用同一套記憶與 MCP 後端工具。語音路徑直接採 Nova 2 Sonic speech-to-speech,但 WebRTC、TURN、身分連結及固定網路成本仍須自行治理。
AI 安全
Microsoft 發現釣魚郵件把不可見的 Unicode Tag 字元插入金融關鍵字,藉此改變規則與機器學習分類器看到的 token。攻擊高峰每日超過 230 萬封,顯示 AI 紅隊技術已開始反向滲入傳統資安攻防。