Runway Solaris 是什麼?AI 不只做網頁,而是即時生成整個互動介面

Solaris 把整個畫面變成可持續生成的互動介面。本文解析它與 AI 寫程式的差別、應用方向、測試結果與目前限制。

Share
Runway Solaris Interface World Model 即時生成互動介面
Solaris 讓整個畫面成為可持續生成與操作的介面。 圖片來源:Runway Solaris 官方公告(https://runway.com/news/research/introducing-solaris)

現在用 AI 做網站,常見流程是先產生設計圖,再請模型寫成 HTML、CSS 與 JavaScript。畫面看起來再漂亮,最後仍要經過程式碼,才能真的被點擊與操作。

Runway 在 2026 年 8 月 31 日公布 Solaris,想跳過這個轉換過程。它不是單純生成一張網頁圖片,也不是把 Prompt 變成前端程式碼,而是直接把「正在生成的畫面」當成網站或 App 本身。使用者點擊、拖曳或輸入文字後,模型會繼續生成下一個畫面,讓介面即時回應。

這是一種很不一樣的軟體想像,但距離取代現有網站與 App 還很遠。Solaris 最有機會先改變高視覺、探索式的體驗,例如虛擬購物空間、互動教學與情境模擬。需要文字精準、結果可重現或交易不能出錯的服務,目前仍應使用傳統程式介面。

本文會帶你理解 Solaris 是什麼、它與 AI 寫程式有何不同、可能用在哪裡,以及為什麼現在還不能把它當成成熟的建站工具。

Solaris 是什麼?

Solaris 是 Runway 第一款「介面世界模型」(Interface World Model)。世界模型是能在內部學習環境如何變化,並根據動作推演下一個狀態的 AI 系統。一般影片模型只是產生一段可以觀看的內容,Solaris 則把使用者的點擊、拖曳與文字輸入也納入生成過程。

你可以把傳統網站想成一本事先做好的互動書。每個按鈕、頁面與切換效果,都由設計師與工程師先定義完成。Solaris 比較像一個邊觀察、邊作畫的 AI:它先看到起始畫面,再根據你的動作即時畫出下一幀,因此同一個物件不必永遠只有開啟選單或跳轉頁面這兩種反應。

Runway 將 Solaris 的特性歸納成三個方向:完全視覺化、持續變動,以及開放式互動。官方展示的情境包括在虛擬服飾店直接把衣服拖到自己身上、移動家具查看空間配置、把食材拖入碗中組合沙拉,以及操作燃燒反應的互動教材。

這些華麗範例背後,真正重要的是介面的行為不必全部在開發階段寫死。軟體因此能從「使用者走進既定流程」,變成「系統依使用者當下意圖生成下一步」。

Solaris 與 AI 寫程式有什麼不同?

現有的 AI 建站工具通常會產生 React、HTML、CSS 或 JavaScript。即使使用者不需要親自寫程式,底層仍是一套確定的程式:按鈕會執行固定動作,表單會依規則驗證,付款也能留下可追蹤的紀錄。

Solaris 採用另一條路。它把整個畫面視為可持續生成的影像,使用者每次互動都成為下一幀的條件。官方表示,系統沒有預先準備好的頁面或範本,而是透過自然語言描述點擊、拖曳等操作在當前場景中代表什麼。

比較項目 傳統介面/AI 寫程式 Solaris
底層形式 程式碼、元件與資料結構 模型即時生成的連續畫面
互動方式 開發者事先定義 模型依情境與指令生成回應
優勢 結果穩定、文字清楚、容易測試與記錄 視覺自由度高,可產生未預先設計的互動
主要風險 設計轉成程式後可能失去部分細節 結果不一定可重現,文字與長時間一致性仍有限
較適合 結帳、銀行、後台、表單與正式工作流程 虛擬展示、探索式教學、模擬與高度個人化體驗

Runway 認為,傳統介面必須把視覺設計壓縮成程式碼與元件,因此會損失部分視覺與互動可能性。這個觀點說中了現有開發流程的限制,但「跳過程式碼」也會失去另一種保障:程式可以被測試、檢查、重播與稽核,生成畫面卻可能每次略有不同。

Runway 也測試 GPT-4o、Gemini 2.5 Pro 與 Fable 5 從單一截圖重建介面的能力。官方圖表顯示,當測試內容從一般網頁、簡報,逐步增加到圖像設計與自然場景,三個模型的視覺與結構相似度都會下降。這是 Runway 自行設計的內部測試,適合用來說明轉換過程可能遺失資訊,不能解讀成對所有 AI 建站工具的完整排名。

Runway 測試多模態模型從單一截圖重建介面時的相似度變化
Runway 的內部測試顯示,畫面越接近複雜的自然場景,模型重建後的視覺與結構相似度越低。 圖片來源:Runway Solaris 官方公告

所以,Solaris 目前比較像新增一種介面媒介,而不是宣告前端工程已經過時。它擴大的是「互動能長什麼樣子」,還沒有解決正式軟體必須正確、穩定與可驗證的全部要求。

Solaris 如何即時生成互動介面?

Solaris 建立在 Runway 的 Gen-4.5 影片模型之上,也延續該公司從 General World Models 開始研究的世界模型方向。Runway 主要做了兩件事:讓影片模型理解使用者動作,再把生成速度縮短到能進行即時互動。

第一步是讓模型學會動作與結果的關係。點擊、拖曳等輸入會和文字、圖片一樣,成為下一幀的生成條件。模型只會看到已經發生的操作,不會偷看未來,因此必須從資料中學習「當使用者這樣做,畫面接下來通常如何改變」。

第二步是加快生成。一般影片擴散模型會用多輪去雜訊逐步修正整段影片,等待時間可能以秒或分鐘計算。Solaris 改成自回歸生成,也就是依已經出現的畫面,一幀接一幀往下預測。Runway 再透過模型蒸餾,把原本需要多輪完成的去雜訊過程壓縮成少數步驟,並讓快速版模型使用自己的輸出繼續訓練,以降低長時間互動時的品質衰退。

系統內還有一個大型語言模型(LLM)負責推理。LLM 先理解使用者要求,判斷畫面應在原場景中改變,還是轉換到另一個狀態,再產生引導 Solaris 渲染的指令。簡單來說,語言模型決定「接下來要做什麼」,世界模型負責「這件事要如何出現在畫面上」。

這個分工讓產品邏輯與畫面生成可以互相配合,但也代表 Solaris 並非只有單一影片模型在獨立運作。未來實際部署的成本、延遲與可靠性,仍會同時受到語言模型、世界模型與外部資料來源影響。

Runway 公布的測試結果代表什麼?

Runway 將 Solaris 與 Claude Opus 5 生成的程式介面比較。兩邊從相同圖片開始,也收到相同的互動要求。官方找來 250 名參與者,針對 30 組互動例子收集接近 7,500 次成對判斷。

在「是否遵循互動指令」這一題,官方圖表顯示 62% 的比較偏好 Solaris,25% 偏好程式介面,13% 沒有偏好。在「行為是否自然」這一題,72% 偏好 Solaris,21% 偏好程式介面,7% 沒有偏好。Runway 同頁正文列出的數字各有 1 個百分點差異,本文依加總為 100% 的官方圖表呈現。這項差異不影響 Solaris 取得較高偏好的整體方向。

Runway Solaris 與 Claude Opus 5 程式介面的使用者偏好測試
Runway 找來 250 名參與者,比較 Solaris 與 Claude Opus 5 建立的程式介面。這是 Runway 內部研究,不是第三方 benchmark。 圖片來源:Runway Solaris 官方公告

這組結果支持 Solaris 在視覺連續性與場景反應上的優勢,但不能直接推論它「比程式碼更會做網站」。測試題目偏向讓物件漂浮、改變鏡頭與操作場景等視覺互動,本來就是世界模型擅長的範圍。Runway 也沒有在這份公告中提供完整題庫、錯誤案例、統計方法或第三方重現結果。

我的解讀是:這份測試足以證明 Solaris 的研究方向值得繼續,但還不足以證明它能處理登入、搜尋、資料輸入、付款、無障礙操作與正式商業流程。要評估後者,需要完全不同的測試標準。

Solaris 適合拿來做什麼?

Solaris 最有吸引力的地方,是能把「內容」與「操作介面」合成同一件事。只要情境重視視覺探索,而且允許結果帶有一定生成變化,就可能比固定頁面更自然。

虛擬購物與產品展示

一般電商把商品放在列表與產品頁中,使用者靠篩選器縮小選擇。Solaris 類型的介面可以把商店變成會回應意圖的場景,例如直接更換家具材質、移動擺設,或把服飾套用到參考影像上。

對品牌來說,重點不在於「網頁變成一段影片」,而是商品展示能依每個人的空間、外觀與偏好重組。前提是產品尺寸、顏色與庫存必須由可靠資料約束,否則畫面越逼真,錯誤推薦造成的落差也越大。

0:00
/0:00

Runway 示範把虛擬商店直接變成可拖曳、試穿與重新排列的互動場景。 影片來源:Runway Solaris 官方公告

個人化教學與操作引導

傳統教學影片只能照固定順序播放。生成式介面可以觀察學習者目前做到哪一步,直接在相同情境中顯示下一個動作。如果操作偏離預定流程,系統也能重新產生引導。

這類用途特別適合視覺操作、空間配置或現象模擬。不過,醫療、安全與專業訓練不能只追求看起來合理,內容仍需要可驗證的知識來源與錯誤防護。

0:00
/0:00

Solaris 官方示範讓使用者操作燃燒教材,並依互動生成下一個視覺狀態。 影片來源:Runway Solaris 官方公告

AI Agent 的電腦操作訓練

現在的電腦操作 Agent 常記住特定網站的按鈕位置,版面一改就可能失敗。Solaris 可以持續生成不同布局與互動方式,讓 Agent 在大量變化環境中練習辨認意圖,降低只會背單一網站的風險。

這可能是短期內很重要、卻不一定最容易被一般使用者看到的用途。若 Agent 能在生成環境中學會更通用的操作策略,它面對陌生網站時可能更有韌性。判斷成果仍要看實際任務成功率,互動畫面自然只是其中一項條件。

Solaris 還有哪些限制?

Runway 已直接列出三個主要問題:文字、可信度與長時間一致性。這三項剛好也是 Solaris 能否從研究展示走進正式產品的關鍵。

第一,生成影片中的文字仍可能不清楚或不穩定,但大多數網站都高度依賴文字。Runway 提出的可能做法是混合介面:需要閱讀時改由圖片模型生成較穩定的靜態畫面,連續互動再交給影片模型。這也說明純生成式介面短期內可能仍要和其他技術搭配。

第二,畫面合理不代表資訊正確。Solaris 可以用真實產品圖片與參考素材建立起始畫面,Runway 也正在研究如何在互動過程中持續加入產品資料與文件。不過,官方尚未證明它能在長流程中始終遵守這些資料。對購物、教學或商業服務來說,一個自信但錯誤的生成結果,通常比傳統頁面的小瑕疵更危險。

第三,互動時間越長,小錯誤越容易累積。物件外觀、位置、文字與語意都可能逐步漂移。Runway 表示 Solaris 著重在即時反應、整段 session 的一致性,以及維持 720p 視覺品質,但沒有公布最長穩定時間、每秒幀數或實測延遲。

另外,官方稱 Solaris 的執行成本比標準影片擴散模型低數個數量級,卻沒有提供比較模型、硬體、計價單位或金額。這能證明團隊正在處理成本問題,還不能證明它已經便宜到能服務大量公開網站。

從產品角度看,還有幾個官方公告未回答的問題:生成介面如何支援螢幕閱讀器與鍵盤操作、如何保存可稽核紀錄、如何阻止介面產生未授權動作,以及同一個操作能否得到可重現結果。展示影片通常不會優先呈現這些功能,正式軟體卻不能缺少它們。

Solaris 現在可以使用嗎?

截至 2026 年 9 月 1 日,Solaris 尚未對一般使用者全面開放。Runway 表示正與合作夥伴準備公開推出,目前可在官方頁面填表申請 early access。

官方尚未公布一般上線日期、價格、API(讓其他軟體依固定規格呼叫 Solaris 的介面)、使用額度或商業授權方式。因此,現在無法把 Solaris 納入正式專案排程,也不應把官方展示當成所有申請者都能立即取得的現成功能。

如果你是產品團隊,現階段較實際的做法是保留現有網站,先挑一段高度視覺化、沒有金流與關鍵資料寫入的體驗,作為未來 early access 的測試範圍。例如品牌展示、商品探索或互動教材,都比會員登入、訂單確認與付款流程更適合作為 MVP。

Solaris 會取代網站、App 或前端工程師嗎?

短期內不會。Solaris 目前證明的是,生成模型可以成為互動介面的渲染引擎。它沒有證明資料庫、身份驗證、權限、交易、無障礙、測試與稽核都可以被生成畫面取代。

比較可能出現的方向是混合架構。需要準確與可預期的核心流程繼續使用程式碼,品牌展示、探索與教學等視覺層則由世界模型即時生成。前端工程師的工作也可能從逐頁實作,往資料約束、互動規則、可靠性與生成結果驗收移動。

我的結論是中性偏多。Solaris 已經超出一般網頁特效的範圍,更接近一種新的互動媒介,值得產品與設計團隊提早研究。但在 Runway 公布量化延遲、成本、長時間穩定性,以及真實商業流程的錯誤率以前,它仍是有潛力的研究系統,還不能直接取代現有技術棧。

Runway Solaris 常見問題

Solaris 是新的 AI 影片生成模型嗎?

不完全是。它建立在 Gen-4.5 影片模型之上,但輸出不會停在一段看完就結束的影片。Solaris 會根據使用者操作,持續生成可互動的網站或 App 畫面。

Solaris 會產生 HTML、CSS 或 JavaScript 嗎?

依 Runway 公布的設計,Solaris 直接生成畫面與互動反應,不需要先把視覺設計轉成傳統前端程式碼。不過,正式產品仍可能需要程式系統提供資料、權限、記錄與交易功能。

Solaris 的畫質與速度如何?

Runway 表示研發重點包含即時互動與維持 720p 視覺品質,但沒有公布 FPS、實測延遲、硬體配置或不同情境的穩定時間。因此,目前只能確認官方展示達到互動效果,不能推論所有部署環境都有相同表現。

一般使用者現在能用 Solaris 嗎?

目前只能向 Runway 申請 early access,尚未全面開放。官方也還沒有公布價格、API 與一般上線日期。

Solaris 最適合哪些產品?

優先考慮高視覺、探索式,而且容許生成結果有變化的體驗,例如虛擬商店、商品展示、互動教學與模擬。金流、醫療、銀行、表單與需要精準文字的流程,現階段不適合完全交給生成式介面。

資料來源