Solaris 是 Runway 的實驗性研究模型,逐幀生成互動介面,而不是組合 HTML、CSS、JavaScript 與預先製作的畫面。 系統由負責理解使用者意圖的語言模型,以及建基於 Runway Gen 4.5 影片技術的視覺世界模型組成,能讓點擊、拖曳、輸入文字等操作影響下一個畫面。
研究答案

Create a landscape editorial hero image for this Studio Global article: What is Runway’s Solaris, announced on August 31 as an experimental “Interface World Model,” how does it generate fully interactive apps and. Article summary: Runway’s Solaris is an experimental “Interface World Model” announced on August 31 that treats an app or website as a continuously generated visual environment, rather than code—HTML, CSS, JavaScript, a DOM, and prebuilt. Topic tags: general, documentation, general web, academic, user generated. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, w
Runway Solaris 提出了一種截然不同的軟體使用方式:使用者看到的,不再是由程式碼預先定義好的頁面,而是一個會隨著點擊、拖曳、輸入文字或自然語言指令,持續生成與變化的視覺世界。38
因此,Solaris 不只是另一款無程式碼(no-code)App 建構工具。它嘗試把「世界模型」的概念應用到軟體介面:螢幕不是從固定實作中渲染出來,而是由模型根據互動歷史,不斷生成一連串視覺狀態。
Runway 於 8 月 31 日公布 Solaris,並將其稱為實驗性的「介面世界模型」(Interface World Model)。傳統流程通常是先撰寫 HTML、CSS 與 JavaScript,再交由瀏覽器渲染;Solaris 則試圖直接生成使用者看見的介面。
Solaris 的體驗可以從一張圖片或一個視覺場景開始,例如產品展示畫面、品牌環境或其他設計參考。模型會以這個起點生成介面,並在使用者操作後更新畫面。開發者不必逐一預先製作所有可能出現的頁面,系統會嘗試合成「下一步應該顯示什麼」。
這項差異之所以重要,是因為視覺介面往往包含大量難以完整轉換成程式碼的資訊。Runway 的說法是,讓視覺場景直接成為主要輸出,有助於在互動過程中維持畫面連貫與較自然的行為。
Solaris 將「理解使用者做了什麼」與「把結果畫面呈現出來」分成兩個部分:
視覺部分建基於 Runway 的 Gen-4.5 影片生成技術。Runway 的開發者文件將 Gen-4.5 描述為支援文字生成影片與圖片生成影片的模型;Solaris 則把這項能力延伸至可互動、以自回歸方式運作的場景。4
6
每次互動都重新生成一個視覺狀態,與製作一段短片完全不同。為降低延遲並維持長時間使用時的畫面品質,Solaris 採用了幾項設計:
Solaris 以自回歸方式生成影格,每一幀都參考先前的畫面。這讓模型可以在既有視覺狀態上接續回應,而不是每次操作都從零開始生成一段互不相關的內容。
Runway 表示,它把需要較多運算的擴散模型「教師模型」蒸餾成只需少量去噪步驟的快速模型。目標是在保留足夠視覺品質的同時,減少每次回應所需的計算量。
Runway 也表示,快速模型會使用自身生成的結果進行訓練。這是為了減少長序列互動中的品質衰退:當每個新畫面都依賴前一個畫面時,原本微小的錯誤可能逐步累積。
Runway 設定的研究目標包括將互動延遲壓低至約半秒以下、維持整段工作階段的連貫性,以及達到 720p 的視覺品質。不過,這些是研究目標,並不代表每次 Solaris 互動都能穩定達標。
Runway 表示,研究團隊進行了一項包含 250 名參與者的使用者研究,針對 30 個互動案例收集約 7,500 次兩兩比較判斷。參與者將 Solaris 生成的介面,與 Claude Opus 5 以程式碼製作的介面進行比較。
根據 Runway 公布的結果,參與者在以下情況較常偏好 Solaris:
結果顯示,在部分互動情境中,生成式介面可能讓人感覺畫面更連貫,或操作結果更符合直覺。但這不能解讀為 Solaris 整體上優於傳統軟體。這項比較主要衡量主觀互動感受,並未證明其在可靠性、正確性、安全性、可維護性、成本、效能或無障礙支援方面更好。現有資料也不足以獨立確認研究的完整方法與統計分析。
讓 Solaris 具備高度彈性的機制,同時也帶來一系列工程與產品問題。
在即時圖像與影片生成中,清晰、正確且可讀的文字一直是難題。模型可能生成一個外觀吸引人的介面,卻把標籤、數字、選單或操作說明顯示錯誤。Runway 也將文字生成列為尚未解決的問題,並提出一種可能的混合方案:由圖像模型處理文字密集的靜態畫面,再由影片模型負責連續互動。
一個看起來很有說服力的生成介面,不等於它提供的資訊可靠。Solaris 目前主要依靠起始影像與提供的參考資料建立內容,因此可能以充滿信心的方式呈現錯誤答案、產品細節或視覺資訊。Runway 將更豐富的已驗證資料、文件與參考內容列為後續研究方向。
由於每個狀態都依賴一串先前生成的畫面與模型決策,錯誤可能在開放式使用過程中逐漸放大。要在長時間工作階段維持場景、物件屬性、指令與互動歷史的一致性,仍是持續研究中的問題。
一般網站只需傳送程式碼與素材,再由使用者的裝置負責渲染。Solaris 則需要持續進行生成運算,才能產生使用者看到的結果。Runway 表示,相關最佳化讓它的成本大幅低於標準影片擴散生成,但逐幀生成仍比傳送固定程式碼頁面更耗費資源;原型的視覺品質目標則是 720p。
單純渲染出的影像,不會自動提供螢幕閱讀器與其他輔助科技所需的結構化語意。它也不會天然具備許多軟體系統需要的可檢查狀態、事件結構與可預測介面。分析指出,缺少傳統 DOM(文件物件模型)與無障礙層,是這類方法進入需要無障礙支援或高度可稽核環境時的主要障礙。
Solaris 被定位為實驗性研究,而非已廣泛推出的正式 App 建構平台。相關報導將它描述為研究預覽,可能採取早期存取或申請使用的方式,並非所有人都能直接使用的產品。
因此,Solaris 目前的意義主要在於概念與研究方向。它展示了軟體介面可能走向的另一條路,但尚未證明團隊可以把它當成傳統程式開發的即插即用替代品。
Solaris 與 Runway 更廣泛的世界模型研究有關,但用途並不相同。Runway 將 GWM-1 描述為通用、即時的模擬器,涵蓋環境、虛擬角色與機器人操作;Solaris 則把世界模型的概念聚焦於軟體介面:被模擬的「世界」是一個 App 或網站,而使用者的操作會推動這個世界持續變化。12
換句話說,Solaris 將 Runway 的重心從生成媒體延伸到生成可互動的視覺環境。介面不再只是供人觀看的影片,而是一個會回應操作、並在互動持續期間不斷重新生成的場景。
如果這種方法日後能變得可靠,創作者或許可以用自然語言描述視覺環境、產品、目標與行為,而不必在程式碼中逐一實作所有可能狀態。對於空間感強、視覺導向或需要探索性的體驗,這可能比傳統固定版面更有吸引力。
但代價是,彈性來自生成,而不是明確的程式邏輯。正式產品仍需要可預測的行為、可測試性、資料完整性、無障礙能力,以及與其他系統的整合;Solaris 尚未展示自己能取代這些傳統工程實務。
Solaris 也指向另一種可能:讓 AI Agent 在陌生的視覺環境中操作。Agent 不必完全依賴固定 API 或硬編碼流程,而可以把介面理解成一個動態世界,採取行動、觀察結果,再根據新狀態繼續操作。
對於必須使用未按照既定自動化規格設計的介面的 Agent 來說,這項構想相當重要。不過,它仍屬研究方向。當任務需要可稽核性、精準度與可重複執行時,可靠的結構化 API,以及具備傳統無障礙支援的軟體,仍然擁有明顯優勢。
Solaris 最適合被理解為「生成式軟體介面」的研究預覽,而不是 App 程式碼的終結。它最獨特的想法,是把介面本身交給模型生成:語言模型負責理解意圖,視覺模型則根據使用者操作,逐幀產生下一個畫面。
Runway 公布的研究顯示,在自然互動與指令遵循方面,部分參與者確實較偏好這種方式。但文字準確度、內容可信度、長時間連貫性、生成成本、無障礙支援與系統整合,都是產品能否落地的核心要求,並非稍後再修飾的細節。
Solaris 讓人看見「介面世界模型」可能發展成什麼樣子,也同時提醒我們:要真正取代傳統程式碼,還有很長的路要走。
Studio Global AI
這個頁面包含附來源佐證的答案,你可以在 Studio Global 內繼續追問。
Solaris 是 Runway 的實驗性研究模型,逐幀生成互動介面,而不是組合 HTML、CSS、JavaScript 與預先製作的畫面。
Solaris 是 Runway 的實驗性研究模型,逐幀生成互動介面,而不是組合 HTML、CSS、JavaScript 與預先製作的畫面。 系統由負責理解使用者意圖的語言模型,以及建基於 Runway Gen 4.5 影片技術的視覺世界模型組成,能讓點擊、拖曳、輸入文字等操作影響下一個畫面。
Solaris 目前仍是研究預覽,尚未證明能取代傳統軟體、結構化 API 或具備完整無障礙支援的正式產品介面。