Meta Pixel跳至主要內容
HenryHenry· AI 作者,經人工審閱
10 min read
143

Runway GWM-1: 即時世界模型模擬現實

GWM-1從影片生成轉向世界模擬。創建可探索的環境、虛擬形象和機器人訓練數據。

Runway GWM-1: 即時世界模型模擬現實

準備好製作自己的 AI 影片了嗎?

加入數千名使用 Bonega.ai 的創作者

如果AI不僅僅能生成影片,而是能模擬整個世界供您探索,能創建可對話的角色,還能即時訓練機器人,會怎麼樣呢?

這正是Runway在2025年12月發布的首個通用世界模型GWM-1所承諾的願景。這不僅僅是行銷話術,而是代表了我們對AI影片技術思考方式的根本性轉變。

從影片生成到世界模擬

傳統的影片生成器創建片段。您輸入提示詞,等待,然後獲得一個預先確定的影格序列。GWM-1的工作方式有所不同。它構建環境的內部表示,並使用它來模擬該環境中的未來事件。

💡

GWM-1是自迴歸的,即時逐影格生成。與批次影片生成不同,它會在您輸入時做出回應。

請思考這其中的含義。當您探索由GWM-1創建的虛擬空間時,當您轉身時,物體會保持在應有的位置。物理規則保持一致。光照回應您的攝影機移動。這不是預先算繪的影片,而是即時運行的模擬。

GWM-1的三大支柱

Runway將GWM-1分為三個專業化變體,每個都針對不同的領域。它們目前是獨立的模型,但公司計劃將它們合併為一個統一系統。

🌍

GWM Worlds

具有幾何、光照和物理特性的可探索環境,適用於遊戲、VR和智慧體訓練。

👤

GWM Avatars

音訊驅動的角色,具有唇形同步、眼球運動和手勢,可進行長時間對話。

🤖

GWM Robotics

為機器人策略生成合成訓練資料,消除物理硬體的瓶頸。

GWM Worlds:可漫步的無限空間

Worlds變體創建可互動探索的環境。在程式化一致的空間中導航,模型保持空間連貫性:如果您向前走,向左轉,然後轉身,您會看到預期的場景。

這解決了AI影片中最困難的問題之一:在延伸序列中的一致性。以前的方法難以隨著時間推移保持物體位置和場景連貫性。GWM Worlds將環境視為持久狀態,而不是一系列不相關的影格。

使用場景涵蓋遊戲、虛擬實境體驗和訓練AI智慧體。想像一下,讓強化學習演算法探索數千個程式生成的環境,而無需手動建構每一個。

GWM Avatars:能傾聽的逼真角色

Avatars變體生成具有不同尋常細節水準的音訊驅動角色。除了基本的唇形同步外,它還算繪:

  • 自然的面部表情
  • 逼真的眼球運動和注視方向
  • 與語音的唇形同步
  • 說話和傾聽時的手勢

「傾聽」部分很重要。大多數虛擬形象系統僅在角色說話時才有動畫。GWM Avatars即使在角色不說話時也保持自然的閒置行為、微妙的動作和回應式表情,使對話感覺不像是在與錄音對話。

Runway聲稱該系統可以進行「長時間對話而不會出現品質下降」,表明他們已經解決了困擾長時間虛擬形象生成的時間一致性問題。

GWM Robotics:大規模思想實驗

也許最實用的應用是機器人訓練。物理機器人價格昂貴,會損壞,並且一次只能運行一個實驗。GWM Robotics生成合成訓練資料,讓開發人員在接觸真實硬體之前在模擬中測試策略。

💡

該模型支援反事實生成,因此您可以探索「如果機器人以不同方式抓取物體會怎樣?」的場景,而無需物理干預。

這裡的SDK方法很重要。Runway透過Python介面提供GWM Robotics,將其定位為機器人公司的基礎設施,而不是消費產品。他們正在與機器人公司討論企業部署。

技術規格

720p
解析度
24 fps
影格率
2分鐘
最大長度
即時
生成速度

GWM-1建立在Gen-4.5之上,這是Runway的影片模型,最近在Video Arena排行榜上超越了Google和OpenAI。自迴歸架構意味著它逐影格生成,而不是批次處理整個序列。

動作條件接受多種輸入類型:攝影機姿態調整、基於事件的命令、機器人姿態參數以及語音/音訊輸入。這使其成為真正的互動式系統,而不是一次性生成器。

與競爭對手的比較

Runway明確聲稱GWM-1比Google的Genie-3和其他世界模型嘗試更「通用」。這種區別很重要:雖然Genie-3專注於類似遊戲的環境,但Runway將GWM-1定位為可以跨領域模擬的模型,從機器人到生命科學。

傳統影片生成器

生成固定序列。沒有互動,沒有探索,沒有對輸入的即時回應。

GWM-1世界模型

模擬持久環境。即時回應動作。保持空間和時間一致性。

機器人角度特別有趣。雖然大多數AI影片公司追逐創意專業人士和行銷人員,但Runway正在為工業應用建構基礎設施。這是一個賭注,即世界模型的重要性超越了娛樂。

對創作者的意義

對於我們這些在AI影片領域工作的人來說,GWM-1標誌著更廣泛的轉變。我們花了多年時間學習如何製作更好的提示詞並將片段連結在一起。世界模型暗示了一個未來,我們設計空間,設定規則,然後讓模擬運行。

這與我們一直在關注的世界模型對話相聯繫。AI應該理解物理和因果關係,而不僅僅是模式匹配像素的論點,正在成為產品現實。

遊戲開發者應該關注。創建可探索的3D環境通常需要美術師、關卡設計師以及Unity或Unreal等引擎。GWM Worlds暗示了一個未來,您描述空間,讓AI填充幾何。

Gen-4.5也獲得了音訊

除了GWM-1公告外,Runway還更新了Gen-4.5,增加了原生音訊生成。您現在可以直接生成帶有同步聲音的影片,無需在後期添加音訊。他們還新增了音訊編輯功能和多鏡頭影片編輯,用於創建具有一致角色的一分鐘片段。

要更深入了解音訊如何改變AI影片,請查看我們對AI影片的靜音時代如何結束的報導。

未來之路

三個GWM-1變體,Worlds、Avatars和Robotics,最終將合併為一個模型。目標是一個能夠模擬任何類型環境、角色或物理系統的統一系統。

💡

GWM Avatars和增強的World功能「即將推出」。GWM Robotics SDK可透過請求獲得。

最讓我興奮的不是任何單一功能,而是框架。Runway不再銷售影片片段。他們銷售模擬基礎設施。這是一個完全不同的產品類別。

問題不在於世界模型是否會取代影片生成器,而在於「創建影片」和「模擬世界」之間的區別會多快模糊。基於GWM-1,Runway押注會更早而不是更晚。


Runway的GWM-1以研究預覽版提供,預計在2026年初實現更廣泛的存取。要與其他領先的AI影片工具進行比較,請參閱我們對Sora 2 vs Runway vs Veo 3的分析。

Henry
HenryCreative TechnologistAI Author

來自洛桑的創意技術專家,探索 AI 與藝術交會之處。他在電子音樂創作之餘,實驗各種生成式模型。

View profile →

喜歡你所讀的內容嗎?

幾分鐘內將你的想法轉化為不限長度的 AI 影片。

相關文章

繼續探索這些相關文章

喜歡這篇文章嗎?

探索更多觀點,並隨時掌握我們的最新內容。