AI 開發工具
Android Studio Quail 4 穩定版內建 23 項代理技能,Gemma 4 可離線執行跨檔案重構
Google 將 Android 專用技能的自動選取與 Gemma 4 本機推論帶入 Android Studio 穩定通道。程式碼可留在開發機,但本機執行不等於代理已具備完善的權限隔離或可驗證品質。
Archive
共 941 篇技術新聞
AI 開發工具
Google 將 Android 專用技能的自動選取與 Gemma 4 本機推論帶入 Android Studio 穩定通道。程式碼可留在開發機,但本機執行不等於代理已具備完善的權限隔離或可驗證品質。
AI 程式碼審查
GitHub 讓管理員選擇是否允許 Copilot 提交可計入分支規則的 Approve review,並提供路徑層級限制。功能仍處於公開預覽,也沒有足以把模型核准視為獨立品質保證的準確率證據。
AI 程式開發基礎設施
Coder 讓 Cursor 雲端代理保留外部控制迴圈,卻把命令、檔案與工具操作移入企業自管工作區。這種分層可套用既有 RBAC、防火牆與稽核,但推理和模型流量仍經供應商,不能等同完整私有部署。
模型與代理
Meta 更新 Muse Spark,主攻長週期代理、程式開發及混雜對話中的任務追蹤,內部比較顯示工具呼叫與 token 用量同步下降。模型已進入 Muse Code 與 API,但最高推理模式、開放權重和可重現的完整評測仍未到位。
模型、代理與資安
Google 讓 Gemini 3.8 Flash 正式供生產使用,提供百萬 token 上下文、可調推理力度及新的 API 遷移要求。共用核心的 Flash Cyber 主攻弱點發現與自動修補,但僅透過 Fairwind 計畫向經審核的防禦者開放。
AI security
CrowdStrike 與 NVIDIA 發表 SafeMind,以攻擊代理產生遙測,再由 Nemotron 防禦代理撰寫、檢查及重播偵測規則。封閉測試顯示專用模型優於通用前沿模型,但模型權重、資料集與完整評測協定尚未公開。
AI coding agents
上海人工智慧實驗室團隊提出 Harness-of-Harness,在既有 coding agent 外層加入反覆規劃、實作與驗證的控制迴圈。三輪實驗平均相對增益達 52.25%,但每個條件只有一次生成,且可執行的 HoH-lite 仍標示為即將公開。
AI 程式開發工具
Cline 修正長工作階段每次狀態更新都廣播完整逐字稿、令 Hub 記憶體膨脹至數十 GB 的問題,改為只傳遞狀態快照。新版也收緊 checkpoint、子代理取消及遠端 MCP 連線行為,但未釘選模型的部署可能因預設模型大幅更新而改變結果。
開放模型/推論架構
RWKV 團隊釋出 13.3B 參數的 G1j 基礎模型,並封裝 Transformers、LoRA 與 TileLang 推論支援。固定大小的循環狀態可避開隨上下文增長的 KV cache,但模型沒有安全或能力評測,亦不能直接視為成熟聊天助手。
模型與語音 AI
Meta 的新語音模型在同一解碼迴圈輸出逐字稿、說話者標籤及語句邊界,並以動態等待機制平衡準確率與延遲。英語串流評測表現領先且 API 價格低,但多語言品質、工作階段上限與封閉權重仍限制部署判斷。
世界模型與電腦視覺
Atlas 把文字、影像、相機姿態與深度資料放進同一自回歸擴散架構,可生成受控鏡頭並輸出點雲或 3D Gaussian splat。廠商評測顯示稀疏視角重建優於專用模型,但尚無論文、權重或物理模擬驗證,現階段僅限早期存取。
AI 程式開發工具
Meta 讓 Muse Code 結束測試,加入工作階段互傳訊息、子代理工作流與可確認的回退操作。同步釋出的 TypeScript SDK 暴露 Muse Session Protocol,但仍是無相容性承諾的 pre-1.0 開發者預覽。