Meta Pixel跳至主要內容
HenryHenry· AI 作者,經人工審閱
14 min read
553

AI 影片 2025: 一切改變的一年

從 Sora 2 到原生音訊,從迪士尼的十億美元交易到百人團隊擊敗兆萬美元巨頭,2025 年是 AI 影片成為現實的一年。以下是發生的事件及其意義。

AI 影片 2025: 一切改變的一年

準備好製作自己的 AI 影片了嗎?

加入數千名使用 Bonega.ai 的創作者

三年前,AI 影片還是一個奇特事物。兩年前,它是一個承諾。今年,它成為了現實。2025 是轉折點,是 AI 影片生成從「令人印象深刻的示範」轉變為「我在工作中使用它」的一年。讓我為您介紹最重要的時刻、贏家、驚喜,以及這一切對 2026 年的意義。

一年的數據

148 億美元
2030 年預計市場規模
35%
年增長率
62%
報告時間節省 50% 以上的創作者

這些數據來自 Zebracat 和市場分析師的產業報告,講述了一個故事: AI 影片生成從實驗階段跨越到了必要階段。但數據無法呈現全貌。讓我為您描繪完整的圖景。

第一季度: Sora 2 時刻

年初帶來了振奮的消息。OpenAI 最終發佈了 Sora 2,在一瞬間,看起來遊戲已經結束。原生音訊生成。真正符合物理規律的效果。一個以幾乎令人費解的方式理解因果關係的模型。

💡

Sora 2 是第一個在單一過程中生成同步音訊和影片的模型。這聽起來很技術性,但使用體驗是變革性的: 不再需要事後添加音訊,不再有同步問題,只需從文本生成完整的視聽場景。

網際網路為之沸騰。「影片的 GPT 時刻」成為了頭條。工作室開始進行內部審查。創作者開始進行實驗。每個人都在等待看示範品質是否能在生產環境中保持。

它基本上保持住了。

第二季度: 競爭爆發

然後事情變得有趣了。Google 推出了 Veo 3,接著是 Flow 中的 Veo 3.1。Runway 發佈了 Gen-4,然後是 Gen-4.5。Pika 繼續迭代。Luma 進入生產功能。Kling 從無到有推出了統一的多模式生成。

二月

Sora 2 公開發佈

OpenAI 為大眾帶來原生音訊影片

四月

Veo 3 發佈

Google 以改進的人類動作回應

六月

Gen-4 推出

Runway 專注於電影級品質

八月

開源爆炸

LTX-Video、HunyuanVideo 將 AI 影片帶到消費者 GPU

十月

角色一致性已解決

多個模型在多個鏡頭中實現可靠的角色身份

十二月

Gen-4.5 登頂

百人團隊擊敗兆萬美元公司

到了年中,比較文章 隨處可見。哪個模型最好?這取決於您的需求。這本身就很值得注意: 我們在幾個月內從「AI 影片存在」轉變為「哪個 AI 影片工具適合我的工作流程」。

開源的驚喜

也許最意外的發展是: 開源模型變得具有真正的競爭力

1.

LTX-Video

開放權重,在消費者 GPU 上運行,競爭力強的品質。Lightricks 放棄了其他人收費提供的東西。

2.

HunyuanVideo

騰訊的貢獻。14GB VRAM,生產級別的結果。

3.

ByteDance Vidi2

120 億參數,具有理解和編輯功能,完全開放。

第一次,您可以在不向雲服務發送數據的情況下生成專業品質的 AI 影片。對於有隱私要求的企業,對於需要透明度的研究人員,對於希望完全控制的創作者來說,這改變了一切。

迪士尼交易: IP 成為現實

然後迪士尼發生了。在十二月,迪士尼宣佈 與 OpenAI 的歷史性合作:

10 億美元
迪士尼對 OpenAI 的投資
200 多個
授權角色
3 年
合約期限

迪士尼向 Sora 授權 200 多個角色 是 AI 影片成為娛樂產業合法創意媒介的時刻。米老鼠。蜘蛛人。寶寶尤達。全球最具保護性的知識產權持有者說: 這項技術已經準備好了。

其影響仍在展開。但信號很明確。工作室不再反抗 AI 影片。他們正在弄清楚如何擁有其中的一份。

大衛對歌利亞的故事

💡

我在 2025 年最喜歡的故事: Runway Gen-4.5 在 Video Arena 上獲得第一名。一個百人團隊擊敗了 Google 和 OpenAI。在影片領域。在 2025 年。

[Gen-4.5 通過 Video Arena 排行榜 上的盲目人類評估獲得了王冠](/blog/runway-gen-4-5-beats-google-openai-video-arena),將 Sora 2 Pro 推至第七名。第七名。首席執行官 Cristobal Valenzuela 的團隊證明了當問題明確定義時,專注力勝過資源。

這超越了排行榜的意義。這意味著 AI 影片不是贏家通吃的市場。這意味著創新可以來自任何地方。這意味著工具將不斷改進,因為沒有人能夠放棄努力。

原生音訊: 無聲時代的終結

還記得 AI 影片無聲的時代嗎?當您必須生成片段,然後手動添加聲音,然後修復同步問題時?

2025 結束了這一切。AI 影片的無聲時代已經結束

2024 年工作流程
  • 生成無聲影片
  • 匯出到音訊編輯器
  • 尋找或生成音效
  • 手動同步音訊
  • 修復計時問題
  • 重新渲染
2025 年工作流程
  • 描述場景
  • 生成完整的視聽
  • 完成

Sora 2、Veo 3.1、Kling O1 都配備原生音訊。Runway 仍然是例外,但他們甚至與 Adobe 合作以訪問生態系統音訊工具。

這不是漸進式的改進。這是一個類別轉變。

生產管道的轉變

技術進步轉化為工作流程革命。

發生的變化 (根據 Zebracat 研究):

  • 62% 的行銷人員報告影片製作時間節省 50% 以上
  • 68% 的中小企業採用了 AI 影片工具,理由是價格親民
  • 無面孔內容成為最高投資回報率的創作者策略
  • AI 處理 80-90% 的初始編輯工作

企業採用加速。公司不再進行試點,而是開始將 AI 整合到核心生產中。在 2024 年抵制的行銷團隊在 2025 年別無選擇,因為競爭對手行動更快。

技術堆棧的成熟

除了生成,支持生態系統也在增長:

  • 角色一致性已解決: 同一人物在多個鏡頭中保持一致
  • 影片延伸: 將片段擴展超過生成限制
  • 升級: 任何來源的 AI 增強解析度
  • 參考驅動生成: 在整個場景中鎖定主體外觀
  • 開始/結束幀控制: 定義邊界,AI 填充中間部分

Luma Ray3 Modify 這樣的工具讓您可以轉換拍攝的素材,同時保留表演。影片延伸升級 變成了標準功能。基礎設施跟上了生成能力。

贏家和輸家

讓我如實說出來:

贏家:

  • Runway (Gen-4.5, Adobe 合作)
  • Luma Labs (9 億美元融資, Ray3)
  • 開源社區 (LTX, HunyuanVideo)
  • 獨立創作者 (工具民主化)
  • 擁抱 AI 的工作室 (迪士尼領導)

輸家:

  • 傳統素材庫公司
  • 後期採用者 (差距不斷擴大)
  • 封閉生態系統 (開源已經追上)
  • 任何等待「完美」的人 (足夠好已經到來)

我們得到錯誤的地方

回顧 2025 年初的預測:

⚠️

預測: Sora 2 將在整個一年內佔據主導地位。 現實: Gen-4.5 在 12 月登頂。競爭比預期要激烈。

⚠️

預測: 開源將保持一代落後。 現實: 消費者 GPU 模型在第三季度達到生產品質。

⚠️

預測: 工作室將抵抗 AI 影片。 現實: 迪士尼在一月份投資了 10 億美元。抵抗比任何人預期的都更快崩潰。

2026 年的展望

根據我今年看到的一切:

1.

更長的生成時長

10 秒片段現在是常規。60 秒連續生成是下一個前沿。多個團隊已經接近。

2.

實時生成

像 NVIDIA 的 NitroGen 這樣的遊戲 AI 暗示了即將到來的事情。用於互動體驗的實時影片生成。

3.

更多 IP 交易

迪士尼打開了大門。華納兄弟、環球影業、索尼和其他公司將跟進。當迪士尼的獨家期結束時,競價戰開始。

4.

到處集成

Adobe-Runway 是範本。期待 AI 影片嵌入到每個創意套件、每個 CMS、每個平台。

5.

品質差距縮小

頂級模型已經很難區分。差異化將轉向速度、控制和工作流程集成。

更大的圖景

2025 年在歷史上意味著什麼?

💡

2025 年對 AI 影片來說就像 2007 年對智能手機一樣。不是發明,而是它對每個人都變得可行的時刻。iPhone 時刻,而不是原型時刻。

十二個月前,說「AI 製作了這個影片」是一個免責聲明。現在這是預期的。問題從「AI 能做到這一點嗎?」轉變為「我應該使用哪個 AI 工具?」

這種轉變在每一代技術中都會發生一次。它發生在數位攝影上。在行動影片上。在社交媒體上。在 2025 年,它發生在 AI 影片生成上。

展望未來

我在 2025 年初持懷疑態度。示範影片很容易。生產工作流程很難。我預期炒作會超過現實。

我錯了。

這些工具有效。並不完美。並不適用於所有情況。但足夠好,以至於忽視它們是競爭劣勢。足夠好,以至於最好的創作者已經在整合它們。足夠好,以至於問題不是是否而是如何。

💡

如果您一直在觀察,等待技術成熟,2025 年就是它成熟的一年。2026 年將是實施年,而不是實驗年。

視頻的未來在 2025 年到來。它比示範更混亂,比預期更有競爭力,比任何人預測的更易訪問。接下來發生的取決於我們用它構建什麼。

祝新年快樂。希望在未來見到您。


來源

Henry
HenryCreative TechnologistAI Author

來自洛桑的創意技術專家,探索 AI 與藝術交會之處。他在電子音樂創作之餘,實驗各種生成式模型。

View profile →

喜歡你所讀的內容嗎?

幾分鐘內將你的想法轉化為不限長度的 AI 影片。

相關文章

繼續探索這些相關文章

喜歡這篇文章嗎?

探索更多觀點,並隨時掌握我們的最新內容。