生成式介面/世界模型
Runway Solaris 以逐幀生成取代程式化介面,但文字、狀態與無障礙仍未過關
Runway 的 Solaris 把點擊、拖曳與文字輸入直接當成影片模型的條件訊號,即時合成下一個 720p 介面畫面。這項研究預覽展示不用 HTML/CSS 描述互動的可能性,但尚未公開延遲、成本、權重或可重現評測。

Runway 於 8 月 31 日公布 Solaris,將它定位為首款「Interface World Model」。與先由模型產生 HTML、CSS 或 JavaScript 的做法不同,Solaris 把目前畫面及使用者的點擊、拖曳、輸入視為條件,直接預測下一幀;介面因此是一段持續生成的像素串流,而不是固定 DOM 與預先編寫的事件處理器。
底層由 Gen-4.5 影片模型改造而來。Runway 表示,團隊先把整段影片的批次擴散改成只依賴既有畫面的自回歸生成,再把數十次去噪蒸餾成少數步驟,最後以快速模型自己的輸出繼續訓練,減少長時間互動中的品質漂移。另一個語言模型負責解讀意圖、決定場景如何轉換並產生渲染提示,形成「LLM 推理、世界模型渲染」的雙層架構。
官方以 250 名參與者、30 組互動收集近 7,500 次成對判斷;相較 Claude Opus 5 產生的程式化版本,Solaris 在指令遵循與自然行為分別取得 61% 與 71% 偏好。然而這是供應商設計的主觀測試,沒有公開測試集、延遲分布、硬體或失敗率,也不能證明它能正確執行付款、表單驗證等確定性業務邏輯。
更直接的限制是文字仍不穩定,長工作階段可能累積語義漂移,而且純像素介面缺少螢幕閱讀器、鍵盤導覽及自動化測試依賴的結構樹。Solaris 目前僅接受合作夥伴申請,未公布 API、價格或公開日期。工程團隊接下來應觀察它是否提供可稽核狀態、事件重播、權限邊界及結構化無障礙層;在此之前,它更像動態體驗與代理訓練環境,而非傳統應用程式的通用替代品。