AI 程式代理
Open Interpreter 0.0.42 加入本機 Qwen 工具調用診斷,將文字回覆與實際副作用分開驗證
新版整理多供應商模型與傳輸設定,並提供可重複執行的 Ollama/Qwen 工具調用 smoke test。診斷程式會獨立檢查檔案副作用,降低代理只在回覆中聲稱完成工作的誤判。

Open Interpreter 發布 Rust 路徑的 0.0.42,基線對齊上游 Codex `rust-v0.153.4`。這次更新的主要內容不是新增代理能力,而是讓使用者更容易辨識正在使用的模型供應商、模型 ID 與傳輸協定:Chat Completions 設定進入根命令、`exec` 說明及 Bash、Zsh、Fish、PowerShell 自動補全,錯誤訊息與雲端設定也統一使用 Open Interpreter 品牌。
新版模型指南列出 OpenAI、Google AI Studio、Anthropic 與 Z.AI 的近期模型 ID,同時明確區分一般 Z.AI 的 Chat Completions 路徑與 ZCode 的 Messages 相容端點。這對多供應商代理很實際,因為「模型名稱正確」仍可能在帳戶權限、地區、端點或 wire format 上失敗;專案也提醒,清單只是設定起點,最終仍應以 `/model` 和供應商即時回傳的可用模型為準。
更值得工程團隊注意的是新增的 `scripts/ollama_qwen_smoke.py`。它會啟動本機 Ollama 上的 Qwen 工具調用測試,限制收集輸出的大小,在逾時時清理整個程序群組,記錄是否真的出現工具調用訊號,並將要求的檔案副作用與助手最後一句話分開核對。這可捕捉常見但容易被文字評測漏掉的失敗:模型回答「檔案已建立」,實際上卻沒有執行工具。
確定性 Python 測試可納入日常回歸,但真正的本機模型推論預設仍是選擇性執行,慢速模型可能需要較長逾時。此版本也沒有公布跨模型的成功率、延遲或資源基準。因此它較像改善可診斷性與移植性的工程版本,而非證明 Open Interpreter 已可靠支援所有列出的模型;後續應觀察這套 smoke harness 是否擴展到更多工具、副作用類型及 CI 硬體環境。