GitHub Repo
Ollama 社群回報 GLM-OCR 表格辨識退化,升級後可能輸出純文字或陷入重複生成
10 月 5 日的社群案例指出,Ollama 從 0.34.0 升級至 0.35.1 後,GLM-OCR 的表格輸出與辨識結果可能退化。回報者提供同機版本對照,但根因、影響範圍與修復狀態仍待上游確認。

Ollama 的 GitHub 在 10 月 5 日出現 GLM-OCR 表格辨識退化回報:使用者表示,升級至 0.35.1 後,相同文件影像與 Table Recognition: 提示可能只得到純文字,或持續重複生成,最後以 HTTP 500 結束。這項案例涉及文件解析的輸出結構與穩定性,對依賴表格資料的自動化流程具有直接參考價值。社群回報
測試環境為 Windows 11、RTX 5060 Ti 16GB,以及模型庫的 glm-ocr:latest bf16 模型。回報者並列執行 0.34.0 與 0.35.1,稱舊版能在 4 至 9 秒內產生完整 HTML 表格,新版部分請求耗時 1 至 5 分鐘;在其合成實驗室報告測試集上,正確值由 197/197 降至 113/197。這些數字屬於單一使用者的測試,不能直接代表一般文件的準確率。版本對照
表格提示本身有官方依據。Ollama 模型頁明列 Table Recognition: 的使用方式;Z.ai 模型卡也將文字、公式與表格辨識列為支援任務。GLM-OCR 結合視覺編碼器、跨模態連接器與語言解碼器,而官方完整文件解析 SDK 另加入版面分析及結構化輸出,因此模型直接推論與完整解析管線的結果應分別評估。Ollama 使用說明、官方模型卡
工程上的風險是:即使模型仍能讀出文字,下游也可能因缺少儲存格結構而錯配欄位,影響報表匯入或檢索資料品質。這是依案例推導的可能後果,目前沒有證據顯示其他部署普遍受影響。團隊驗證升級時,可同時檢查內容正確率、HTML 可解析性、欄列對應與逾時比例。
回報者指出兩版記錄的啟動參數相同,因而懷疑隨附的 llama-server 建置變更;這仍是待驗證假說。縮小影像或在提示末尾加入換行僅偶爾有效。接下來應追蹤維護者能否重現、定位版本差異,並以相同影像確認修補效果。問題與暫時處理結果