World Labs Atlas 是什麼?一張圖生成可運鏡 3D 世界,功能、應用與限制解析

World Labs 推出 Atlas 世界模型,結合精準運鏡、3D 重建、時空模擬與機器人應用。本文整理功能、Marble 差異及目前限制。

Share
World Labs Atlas 世界模型官方主視覺
Atlas 是 World Labs 新一代世界模型,主打生成、重建與模擬空間。 圖片來源:https://www.worldlabs.ai/blog/atlas

一般 AI 影片工具可以照著文字生成畫面,卻常在鏡頭轉向後改變建築結構、角色外觀或物件位置。對只想快速找靈感的人來說,這些變化未必是問題。然而,電影、遊戲、建築設計與機器人團隊需要一致的空間,否則畫面就很難繼續編輯或拿來模擬。

World Labs 在 2026 年 9 月 1 日發表的 Atlas,想處理的正是這個問題。Atlas 是一套世界模型,也就是讓 AI 不只生成單張畫面,還要建立場景的空間關係,理解鏡頭移動後應該看到什麼,以及世界隨時間可能如何變化。

官方展示中,Atlas 能從 1 至 6 張參考圖生成最高 1440p、最長 1 分鐘的影片,讓使用者直接指定鏡頭位置與路徑。它也能把照片或影片重建成 3D 場景,並把同一套空間能力延伸到視覺特效與機器人模擬。

我的判斷是,Atlas 的價值來自把精準運鏡、3D 重建與空間模擬放進同一套模型,定位已超出一般 AI 影片工具。這條路線值得中性偏正面看待,但 Atlas 目前只開放少數合作夥伴申請 Early Access,公開展示與評測也主要來自 World Labs。它是值得追蹤的技術平台,還不是一般使用者現在就能穩定採用的成熟產品。

0:00
/0:00

World Labs 官方展示 Atlas 的相機控制、3D 重建、時空模擬與機器人應用。 影片來源:World Labs 官方文章

Atlas 是什麼?先把「世界模型」說清楚

Atlas 是 World Labs 從零開始預訓練的新一代全能世界模型。這裡的「全能」指文字、圖片、影片、相機位置與 3D 深度等不同資料,都由同一套模型處理,並非聲稱它可以完成所有任務。

世界模型可以想成 AI 對場景的內在模擬。一般圖片模型看到一間客廳,主要工作是產生符合描述的像素。世界模型還要記住沙發、牆壁與門之間的空間關係。當鏡頭移到沙發背後,它必須推測新的視角,同時維持已看見部分的一致性。

World Labs 把這種能力稱為空間智慧,也就是讓 AI 能理解物件、位置、距離、視角與時間變化之間的關係。這是 Atlas 能同時處理影片生成、3D 重建與機器人模擬的共同基礎。

Atlas 核心能力 官方展示 對使用者的意義
精準控制鏡頭 從 1 至 6 張參考圖生成最高 1440p、最長 1 分鐘影片 可先設計鏡位與移動路徑,再讓模型補出畫面
空間重建 從 1 張到數十張圖片建立新視角與 3D 輸出 把現實空間轉成可觀看、可輸出的數位場景
時空模擬 重新安排影片視角,並產生機器人攝影機會看到的畫面 用少量拍攝素材建立特效或模擬流程
圖片與全景生成 從文字生成圖片與 360 度全景 同一套模型也能建立世界的初始視覺素材

這四項功能看似分散,真正的主線只有一個:Atlas 先建立共同的空間脈絡,再依照任務輸出圖片、影片或 3D 資料。使用者不必在多套各自不理解空間的模型之間反覆轉換。

Atlas 和一般 AI 影片模型有什麼不同?

一般 AI 影片模型多半用文字描述運鏡,例如要求鏡頭向左平移或繞著人物旋轉。模型必須從語句猜測鏡頭該怎麼走,複雜運鏡容易出現速度不對、方向偏移或場景變形。

Atlas 則把相機姿態直接當成輸入。相機姿態指的是鏡頭在 3D 空間中的位置與朝向,使用者可以設計明確路徑,不只用「往前推」這類文字提示。World Labs 將這項能力稱為 pixel-perfect camera control,但這是官方產品用語,比較合理的理解是「依照指定相機幾何控制畫面」,不代表每一個生成像素都能完全預測。

Atlas 官方展示以指定鏡頭路徑生成新視角
Atlas 把相機位置與角度當成模型輸入,讓使用者先規劃運鏡,再生成對應畫面。 圖片來源:World Labs 官方文章

另一個差異是空間脈絡。Atlas 會把每張參考圖放進 3D 位置中,再根據這些圖的相互關係生成後續內容。官方甚至展示把兩張原本無關的圖片放在不同位置,讓模型補出走廊、門口或其他過渡區域,把兩個場景接成一個世界。

這種「補完」同時是能力與風險。創作時,模型主動想像看不見的區域,可以節省搭景時間。若目標是測量、建築存檔或數位孿生,想像出來的牆面與道路就不能當成真實資料。Atlas 能生成合理空間,不等於能還原它從未看過的事實。

從一張照片重建 3D,Atlas 實際做了什麼?

Atlas 可以接收一張或多張同一場景的照片,再生成其他視角。資料不足時,模型會依照學到的世界知識補上未拍攝區域。照片增加後,模型需要猜測的部分會減少,重建結果也更接近輸入場景。

World Labs 表示,Atlas 通常只需要 2 至 3 張照片就能做出忠實度較高的重建,也能接收超過 100 張圖片,處理資訊更完整的環境。這是官方測試結論,尚不能直接等同於各種室內、戶外、反光表面或複雜物件都會有相同表現。

Atlas 不只輸出看起來像 3D 的影片,也能建立點雲與 3D Gaussian Splats。點雲是用大量空間座標表示物體與場景形狀。3D Gaussian Splats 則用許多帶有顏色與透明度的立體點快速重建畫面,適合在裝置上即時觀看。對遊戲、VFX、設計與機器人工作流程來說,可輸出的 3D 資料比單支影片更容易接到後續工具。

不過,官方目前沒有公布 Atlas 的完整輸出格式、編輯工具、生成時間、硬體需求與計費方式。它能不能真正取代既有掃描或 3D 製作流程,仍要等產品開放後用實際專案驗證。

Atlas 如何把幾支手機變成「子彈時間」攝影棚?

Atlas 的時空模擬能力可以從少量影片重建事件,再從原本不存在的角度觀看。World Labs 展示使用 3 至 5 支一般手機或運動相機拍攝,之後凍結時間並重新安排視角,做出類似電影「子彈時間」的效果。

傳統多視角攝影需要大量同步相機、固定場地與後製設備。Atlas 若能用少數鏡頭補出中間視角,會降低短片、廣告、運動內容與視覺特效的拍攝門檻。它的實際價值在於讓導演於拍攝後仍能調整鏡頭位置,不必受限於現場已架設的視角。

但生成的中間視角仍然是模型推測。遇到高速動作、遮擋、細小物件或需要精確接觸的畫面時,不能只看展示影片是否流暢,也要檢查動作與物件是否真的連續。

機器人為什麼需要 Atlas?

訓練機器人最昂貴的環節之一,是反覆在實體場地蒐集資料與測試失敗。每次測試都要占用硬體,物品需要重設,錯誤還可能造成損壞。Real-to-Sim 是把真實場景與任務轉成模擬環境,讓團隊先在虛擬世界中大量測試,再把較成熟的控制策略放回真實機器人。

Atlas 能從手機影片或少量畫面重建場景,並生成機器人沿著不同路徑移動時,機身攝影機可能看見的彩色與深度影像。官方展示以 24 個影片畫面重建大型環境,再模擬不同機器人的導航視角。在物件操作案例中,還能改變物品、位置、光線與背景,擴充訓練資料。

World Labs 使用少量攝影設備擷取機器人與真實場景
World Labs 展示以少量真實影像建立機器人模擬環境。 圖片來源:World Labs 官方文章

World Labs 在 Atlas 發表前,也已公開 Real-to-Sim-to-Real 機器人訓練流程,目標是讓模擬不只長得像現實,也能重現會影響任務的物理互動。Atlas 顯示世界模型正在成為這套流程的視覺與空間底座。

我對機器人用途的評價比內容創作更謹慎。生成合理畫面不代表已準確模擬重量、摩擦力、碰撞與柔性物體變形。Atlas 官方文章主要展示感測畫面與場景重建,沒有證明單靠 Atlas 就能取代物理模擬器、安全控制與真實硬體驗證。它比較像降低模擬建置成本的工具,而不是讓機器人直接安全上工的完整系統。

Atlas 的模型架構有什麼特別?

World Labs 將 Atlas 描述為「多模態自回歸擴散 Transformer」。這串名稱可以拆成三個容易理解的部分:

  • 多模態:同時處理文字、圖片、相機姿態與 3D 深度等資料。
  • 自回歸:像語言模型逐步寫出下一個字一樣,Atlas 會依照前面的空間脈絡,逐步產生下一個畫面或資料元素。
  • 擴散生成:模型從雜訊中逐步還原圖片與影片,可以用不同運算步數交換生成速度與品質。

架構名稱是次要資訊,Atlas 把每張圖與相機位置綁在一起才是核心。對模型來說,輸入不再只是按順序排列的圖片,每張圖還包含「在空間中的哪裡、朝向哪裡」。這個設計讓運鏡、重建與模擬能共用同一套空間脈絡。

官方在相機控制與稀疏圖片 3D 重建兩類評測中,宣稱 Atlas 優於受比較的專用模型。相機控制由第三方評分者比較模型是否遵循指定路徑,3D 重建則使用公開評測資料集。這些結果支持 Atlas 的設計方向,但完整圖表、比較設定與展示都由 World Labs 發布,仍需要外部團隊重現,才能判斷它在不同素材與工作流程中的穩定性。

Atlas、Marble 有什麼差別?現在可以使用嗎?

Atlas 是底層世界模型,Marble 則是 World Labs 已推出的 3D 世界創作產品。Marble 可讓使用者用文字、單張圖片、多張圖片、影片或簡單 3D 配置生成場景,再進行編輯、擴張與輸出。API 是讓開發者用程式呼叫服務的介面,現有的 World API 也是以 Marble 模型為主。

World Labs 表示,Atlas 將用於未來版本的 Marble 與其他產品,但沒有宣布現有 Marble 已全面切換到 Atlas。兩者目前的關係可以整理如下:

項目 Atlas Marble
定位 新一代底層世界模型 面向創作者與開發者的 3D 世界產品
公開狀態 少數合作夥伴 Early Access 已提供一般使用者與開發者使用
主要焦點 精準運鏡、3D 重建、時空與機器人模擬 建立、編輯、擴張與輸出可探索 3D 世界
API 尚未公布 Atlas 專用公開 API World API 已提供 Marble 世界生成
價格 尚未公布 依 Marble 方案與點數計價

若你只是想體驗 World Labs 的 3D 世界生成,現在可從 Marble 開始。若你需要 Atlas 的長影片、相機輸入或機器人模擬能力,只能申請 Early Access,不能把現有 Marble 功能當成 Atlas 的完整替代品。

Atlas 最值得注意的 3 個應用

影像創作與 VFX:從抽卡式生成走向可設計運鏡

目前很多 AI 影片流程仍像反覆抽卡:輸入 Prompt、等待生成,再從多個結果中挑一支最接近需求的影片。Atlas 允許創作者先安排空間、鏡位與路徑,工作方式更接近導演與 3D 預覽。對廣告、分鏡、場景延伸與視覺特效團隊來說,可控制性可能比單次畫質更有價值。

遊戲、設計與數位空間:同一個場景可以持續使用

單支影片播放完就結束,3D 場景則能更換鏡頭、重新輸出或接進互動體驗。Atlas 可輸出點雲與 3D Gaussian Splats,讓同一個世界成為後續製作的素材。真正的驗收重點會是輸出能否編輯、碰撞是否可用,以及與現有 3D 工具整合的成本。

機器人模擬:降低建立測試環境的成本

若團隊能用少量真實拍攝快速建立模擬場景,就能先在虛擬環境測試更多路徑、光線與物件配置,再把硬體時間留給最有價值的驗證。這個方向可能比生成漂亮影片更具長期商業價值,但它也需要最嚴格的第三方測試,因為錯誤的空間或物理資訊會直接影響機器人決策。

Atlas 有哪些限制?

第一,Atlas 還不是全面開放的產品。2026 年 9 月 2 日的官方資訊只提供少數合作夥伴申請 Early Access,沒有公開價格、生成速度、使用額度、API 時程或服務層級承諾。

第二,展示資料主要來自 World Labs。官方有公布評測方法與比較方向,但目前還缺少廣泛的外部實測。特別是 1440p、1 分鐘與精準相機控制能否在多種素材上同時成立,仍需要第三方驗證。

第三,重建與生成不能混為一談。Atlas 會主動補上看不見的空間,這對創作有用,對測量與存證卻可能造成錯誤。使用者必須知道哪些區域來自真實輸入,哪些區域由模型推測。

第四,視覺一致不等於物理正確。機器人與工程用途還要驗證尺寸、深度、碰撞、材質、摩擦與動態反應,不能只靠影片看起來合理就進入真實部署。

我的立場會在兩種情況下轉弱:外部測試發現複雜運鏡仍頻繁破壞場景幾何,或 Atlas 產生的模擬資料無法預測真實機器人的成功與失敗。反過來說,如果 World Labs 公開 API、輸出格式與成本,第三方又能在陌生場景重現官方表現,Atlas 才會從技術展示進一步成為可規模化採用的平台。

Atlas 值得使用嗎?

Atlas 值得影像、VFX、遊戲、3D 設計與機器人團隊申請 Early Access,前提是團隊手上已有明確專案與驗收標準。第一個測試應該拿同一組素材比較複雜運鏡的一致性、3D 輸出可編輯程度,以及建置模擬場景所節省的時間。只做一支看起來漂亮的展示片,無法判斷它能否進入正式流程。

一般創作者目前不需要急著等待 Atlas。現階段較實際的做法是先使用 Marble 或既有影片工具,整理參考圖、鏡頭路徑與輸出需求。等 Atlas 公開價格與使用入口後,再確認它是否真的降低返工成本。

因此,我對 Atlas 的整體評價是中性偏正面。它提出的產品方向比單純追求更長、更高解析度的影片更有價值,因為精準空間控制能同時服務內容製作與機器人。但公開可用性、外部驗證與成本都還沒到位,現在適合測試與追蹤,不適合直接當成已成熟的生產標準。

Atlas 常見問題

Atlas 是 AI 影片生成模型嗎?

Atlas 可以生成圖片與影片,但它的定位是世界模型。除了產生畫面,它還處理相機位置、3D 深度、空間重建與時空模擬,目標是讓同一個場景能從不同角度持續使用。

Atlas 最長可以生成多長的影片?

World Labs 官方展示從少量參考圖片生成最高 1440p、最長 1 分鐘的影片,並以手動設計的相機路徑控制運鏡。這是官方展示上限,不代表所有 Early Access 任務都會提供相同設定或速度。

Atlas 只用一張照片就能還原完整 3D 空間嗎?

Atlas 能從單張照片生成其他視角與 3D 場景,但沒有拍到的區域會由模型想像。若要接近真實重建,需要提供更多角度的照片,並另外驗證尺寸與幾何資訊。

Atlas 和 Marble 是同一個產品嗎?

不是。Atlas 是新一代底層世界模型,Marble 是已對外提供的 3D 世界創作產品。World Labs 表示 Atlas 會支援未來版本的 Marble,但沒有宣布目前的 Marble 已完整採用 Atlas。

Atlas 現在可以免費使用嗎?

Atlas 目前只開放少數合作夥伴申請 Early Access,官方尚未公布價格與一般帳號入口。Marble 雖有獨立的公開方案,但其額度與價格不能套用到 Atlas。

結論:Atlas 不只生成畫面,重點是控制空間

Atlas 把 AI 影片常見的運鏡不穩與空間變形,重新定義成一個世界模型問題。只要模型先建立可持續的空間脈絡,使用者就能從同一個世界生成不同鏡頭、輸出 3D 場景,甚至建立機器人看到的模擬畫面。

這個方向比一次生成更漂亮的影片更值得關注。它可能讓 AI 內容從反覆抽結果,走向可規劃、可重用的製作流程,也可能降低機器人模擬的建置成本。

但 Atlas 的產品化才剛開始。少數合作夥伴 Early Access、官方自有展示、尚未公布的價格與 API,都表示它目前仍是技術領先性高、採用確定性不足的階段。對多數人來說,最實際的行動是先理解工作流程會怎麼改變,再等公開產品與第三方實測決定是否投入。