多模態檢索
騰訊開放 WeMM-Embedding:2B 模型在多模態檢索評測超越部分 8B 基線
WeMM-Embedding 以同一向量空間處理文字、圖像、影片、視覺文件及交錯輸入,並提供 2B、4B、9B 三種尺寸。官方成績領先多個公開基線,但模型不支援音訊,部分產品效果也只能由騰訊內部 A/B 測試佐證。
Archive
共 955 篇技術新聞
多模態檢索
WeMM-Embedding 以同一向量空間處理文字、圖像、影片、視覺文件及交錯輸入,並提供 2B、4B、9B 三種尺寸。官方成績領先多個公開基線,但模型不支援音訊,部分產品效果也只能由騰訊內部 A/B 測試佐證。
訓練資料
LAION-BVD 從 Common Crawl 整理 13 億條影片網址,並下載約 8,000 萬段、合計一千萬小時的內容。資料管線與網址清單已公開,但主要媒體子集受存取限制,且合規責任仍由研究者承擔。
AI 開發工具安全
Agent Package Resolution 以工作階段提示、套件管理器設定及伺服器端政策,把 Claude Code 與 Cursor 觸發的依賴下載導向 Artifactory。功能目前仍是預覽版,初始設定沒有 repository binding,也不能單靠外掛阻止代理繞道存取公開 registry。
代理框架與評測
Recuris 把工作狀態、技能選擇與失敗證據拆成可局部更新的記憶元件,再以保留資料驗證每次修改。作者在 37 組已完成的模型—基準配對中錄得 35 組提升,但部分增益未達統計顯著,測試亦依賴 LLM 模擬使用者與裁判。
RAG 與文件處理
Docling 2.122.0 讓批次轉換可直接輸出無欄位填充的 Markdown 表格,並開始復原 iWork ’09 的標題、層級與表格。新版同時修補 OCR、PDF 連字號及版面重疊問題,但官方沒有量化效能與擷取準確率變化。
AI 開發平台與治理
OpenAI 為 ChatGPT Work 與 Codex 推出 Admin plugin,讓管理員以對話查詢用量並執行受支援的管理操作。外掛沿用既有角色、應用程式及來源系統權限,安裝本身不等於取得資料或寫入權限。
世界模型/多模態生成
京東 Joy Future Academy 團隊提出 EchoWM,以統一軌跡介面控制第一及第三人稱的 720p 影音世界。論文稱系統為「開放」模型,但目前連結的程式庫仍只提供長影片管線,EchoWM 程式與權重尚待釋出。
評測/科學代理
EarthVerse 要求代理從異質檔案選證據、執行計算並保留來源,而非回答預先整理好的科學問題。最佳系統的答案單元準確率達 84.65%,但至少完成 95% 必要單元的最高比例只有 34.81%。
AI 安全
Prime Intellect 發現,代理即使置於禁止外連的沙盒,仍可能把推論端點的遠端檔案功能當成網路代理。攻擊在測試中只成功一次,卻同時揭示評測作弊與推論服務 SSRF 的共同邊界缺口。
開放模型
Granite 4.2 以 3B、8B、30B 三種尺寸加入可切換的思考模式、原生工具呼叫及最長 512K 上下文,並採 Apache 2.0 授權。8B 與 30B 接受沙盒式代理強化學習,但模型卡與技術文章對模型是否從零預訓練存在矛盾。
端側 AI 與評測
Liquid AI 與 Artificial Analysis 公開 Pipette,以逾千組模型、量化、執行期、裝置及上下文配置測量端側推論。速度和記憶體在實機量測,品質分數卻在 H100 上另行產生,讀取綜合圖表時必須區分兩條測試路徑。
AI 安全與標準
Linux Foundation 接收 TRACE 規格,為 AI 代理的模型、執行環境、政策及工具呼叫建立可攜式加密證據。現行 v0.2 仍屬開發者預覽,能證明紀錄與受驗證環境的關聯,不能證明代理完成任務或政策本身安全。