AISPA 稽核商用 AI 的隱藏系統提示,約四成產品含損害使用者利益的指令
AISPA 把系統提示拆成八項使用者保障維度,並分析 88 款商用 AI 產品中的 3,249 條指令。雖然 98.9% 的產品至少包含一項保護性規則,完整覆蓋八個面向的比例只有 24%。
Archive
共 973 篇技術新聞
AISPA 把系統提示拆成八項使用者保障維度,並分析 88 款商用 AI 產品中的 3,249 條指令。雖然 98.9% 的產品至少包含一項保護性規則,完整覆蓋八個面向的比例只有 24%。
AI 推論與系統
WIDE 將動態剪枝細化到 token 級的注意力頭群組與 FFN 通道群組,並同時支援 prefill 與 decode。研究在 50% 稀疏度下報告最高 4.95 倍核心層解碼加速,但端到端收益縮至 1.55 倍。
AI 安全與標準
OWASP 的 Agentic Skills Top 10 v1 草案結束公開審查,將惡意技能、權限過度、依賴混淆與跨平台移植風險整理成十類控制項。框架把技能視為模型與 MCP 工具之間的行為層,並提出可宣告權限、來源及完整性的通用格式。
模型與本機推論
VIDRAFT 公開 POCKET 系列權重,把 35B 模型量化至最低 8.2 GB,並保留約 3B 的每 token 啟用參數。模型可直接使用上游 llama.cpp,但壓縮方法未公開,效能與品質證據目前也主要來自開發團隊。
AI 安全與產品工程
Google 將 Nano Banana 2 接入真實地理影像後,使用者迅速生成爆炸、空襲等虛構場景截圖,公司翌日撤回功能。生成結果雖有浮水印且不會寫入共享地圖,但事件顯示來源標記無法替代輸入限制與介面隔離。
開放模型與推論
華為 openPangu 團隊釋出以昇騰 NPU 訓練的 505B 混合專家模型,每個 token 約啟用 18B 參數。模型加入分層稀疏注意力與三頭多 token 預測,但效能數字目前主要來自團隊自評。
科學機器學習
UNICON 將河川、交通、電網、氣象與人流等資料轉成共同的圖序列介面,透過少量數值範例在上下文中指定新任務。模型在未參與訓練的網頁流量等領域接近專用模型,但目前只驗證預測問題,權重與程式碼亦未公開。
代理安全與評測
新研究以有限人工預算模擬代理群稽核,找出自報信心失真到使排序策略落後隨機抽查的臨界點。五款小中型開放權重模型在兩項測試的信心 AUROC 僅約 0.5,但結論來自單一提示與直接作答設定。
AI 代理評測
ORCA-bench 以可運行的微服務、50 GB 遙測資料與 1,079 起事故,測試程式代理能否從模糊通報找出根因。即使提供完整原始碼,最佳代理在貼近真實輸入的中等難度任務也只答對四分之一。
多模態推論
ReToken 不把所有影像 token 一次送入模型,而是從預先填入的視覺 KV cache 中取回與問題相關的稀疏區塊。其凍結骨幹、只訓練檢索 token 的做法可在單張 H100 上完成,但成果仍主要來自兩款 8B 模型。
模型 API
Mistral 的夏季模型清理進入最後一批,涉及 Devstral、Magistral、Mistral Small 與 Open Mistral Nemo 等舊版識別碼。官方替代模型並非同架構快照,遷移不能只改名稱,還要重新驗證工具呼叫、輸出 schema、上下文與成本。
AI 基礎設施
AWS 更新 HyperPod Inference Operator,讓團隊能直接調整 Kubernetes Pod 規格、配置自訂 TLS 憑證,並限制單一 Pod 的並行請求。這些介面補上大型模型服務的隔離與背壓控制,但升級前仍須驗證自訂設定不會破壞 Operator 管理的資源。