Meta Pixelข้ามไปยังเนื้อหาหลัก
HenryHenry· ผู้เขียน AI ตรวจทานโดยมนุษย์
3 min read
489 คำ

Google Flow และ Veo 3.1: การตัดต่อวิดีโอด้วย AI ก้าวเข้าสู่ยุคใหม่

Google เปิดตัวการอัปเดตครั้งใหญ่สำหรับ Flow พร้อม Veo 3.1 นำเสนอเครื่องมือตัดต่อ Insert และ Remove เสียงในทุกฟีเจอร์ และยกระดับการตัดต่อวิดีโอด้วย AI จากการสร้างแบบธรรมดาไปสู่การควบคุมความคิดสร้างสรรค์อย่างแท้จริง

Google Flow และ Veo 3.1: การตัดต่อวิดีโอด้วย AI ก้าวเข้าสู่ยุคใหม่

พร้อมสร้างวิดีโอ AI ของคุณเองหรือยัง?

เข้าร่วมกับครีเอเตอร์หลายพันคนที่ใช้ Bonega.ai

Google เพิ่งเปิดตัวการอัปเดตครั้งใหญ่ที่สุดสำหรับแพลตฟอร์มวิดีโอ AI นับตั้งแต่เปิดให้บริการ Flow ที่ขับเคลื่อนด้วย Veo 3.1 ไม่ใช่แค่การสร้างวิดีโอที่สวยงามขึ้น แต่เป็นการตัดต่อด้วย AI ไม่ว่าจะเป็นการแทรกองค์ประกอบ ลบวัตถุ ขยายคลิป ทั้งหมดพร้อมเสียงที่ซิงค์กัน หลังจากสร้างวิดีโอไปแล้วกว่า 275 ล้านรายการ Google กำลังส่งสัญญาณว่าอนาคตของการตัดต่อวิดีโอคือแบบ generative

ก้าวข้ามการสร้าง: การปฏิวัติการตัดต่อ

ตลอดปีที่ผ่านมา เราหมกมุ่นอยู่กับคุณภาพการสร้าง โมเดลไหนสร้างภาพระเบิดที่สมจริงที่สุด? ใครจัดการฟิสิกส์ได้ดีกว่า? AI สามารถเรนเดอร์นิ้วได้ถูกต้องหรือยัง?

คำถามเหล่านี้ยังคงสำคัญ แต่ Google กำลังถามคำถามที่ต่างออกไป: จะเกิดอะไรขึ้นหลังจากสร้างเสร็จ?

คำตอบก็คือ Flow

💡

Flow ได้สร้างวิดีโอไปแล้วกว่า 275 ล้านรายการนับตั้งแต่เปิดตัวในเดือนพฤษภาคม 2025 การอัปเดต Veo 3.1 ใหม่เปลี่ยนจากเครื่องมือสร้างให้กลายเป็นชุดเครื่องมือตัดต่อสร้างสรรค์ที่สมบูรณ์

การตัดต่อวิดีโอแบบดั้งเดิมเป็นการทำลาย คุณตัด ต่อ ซ้อนเลเยอร์ เรนเดอร์ การเปลี่ยนแปลงหมายถึงการเรนเดอร์ใหม่ การเพิ่มองค์ประกอบหมายถึงการหาฟุตเทจ การ keying การ compositing

การตัดต่อแบบ generative พลิกกลับสิ่งนี้ ต้องการเพิ่มนกที่บินผ่านฉากของคุณ? อธิบายมัน ต้องการลบป้ายที่รบกวนในพื้นหลัง? บอก AI มันจะจัดการเงา แสง ความต่อเนื่องของฉาก

สิ่งที่ Veo 3.1 นำมาสู่ Flow

ขอแยกความสามารถที่แท้จริง เพราะข่าวประชาสัมพันธ์ซ่อนฟีเจอร์ที่สำคัญบางอย่างไว้

Insert: เพิ่มองค์ประกอบในฉากที่มีอยู่

นี่คือฟีเจอร์หลัก ตอนนี้คุณสามารถเพิ่มวัตถุหรือตัวละครใหม่ในคลิปวิดีโอที่สร้างหรืออัปโหลด

Input: ทางเดินป่าเงียบสงบ แสงแดดส่องลอดผ่านใบไม้
คำสั่ง Insert: "กวางข้ามทาง หยุดมองกล้อง"
Output: กวางปรากฏขึ้นอย่างเป็นธรรมชาติ เงาถูกต้อง แสงสอดคล้อง

ระบบจัดการส่วนที่ยากโดยอัตโนมัติ ทิศทางของเงาตรงกับแสงของฉาก องค์ประกอบที่แทรกโต้ตอบอย่างถูกต้องกับวัตถุที่มีอยู่ นี่ไม่ใช่การ compositing แต่เป็นการสร้างฉากใหม่โดยมีส่วนเพิ่มของคุณรวมอยู่

Remove: ลบองค์ประกอบที่ไม่ต้องการ

ฟีเจอร์ Remove ที่กำลังจะมาถึง Flow ช่วยให้คุณลบวัตถุหรือตัวละครออกจากฉาก AI จะสร้างสิ่งที่ควรอยู่ด้านหลังขึ้นมาใหม่

สิ่งนี้ยากกว่าที่ฟังดู เมื่อคุณลบคนออกจากฉาก คุณต้อง:

  1. เข้าใจว่าพื้นหลังควรมีลักษณะอย่างไร
  2. จัดการเงาหรือการสะท้อนที่เขาทอดไว้
  3. รักษาความต่อเนื่องของเวลาข้ามเฟรม
  4. ทำให้การลบมองไม่เห็น ไม่มี artifacts ไม่มีความเบลอแปลกๆ

ทีม VFX แบบดั้งเดิมใช้เวลาหลายชั่วโมงกับงาน clean plate การลบแบบ generative ทำได้ในไม่กี่วินาที

เสียงในทุกฟีเจอร์

นี่คือการอัปเดตที่เงียบๆ: เสียงตอนนี้ทำงานกับฟีเจอร์ที่ก่อนหน้านี้เงียบ

ฟีเจอร์ก่อนหน้าตอนนี้
Ingredients to VideoOutput เงียบเสียงที่สร้างขึ้น
Frames to VideoOutput เงียบเสียงที่สร้างขึ้น
Extendเสียงเป็นตัวเลือกรวมเสียงเต็มรูปแบบ

Ingredients to Video ให้คุณรวมภาพอ้างอิงหลายภาพเพื่อควบคุมตัวละคร วัตถุ และสไตล์ ตอนนี้วิดีโอที่สร้างขึ้นมาพร้อมเสียงที่ซิงค์กัน ทั้งเสียงบรรยากาศ บทสนทนา เอฟเฟกต์

Frames to Video สร้างการเปลี่ยนผ่านที่ไร้รอยต่อระหว่างเฟรมเริ่มต้นและสิ้นสุด ก่อนหน้านี้คุณได้ visual morphs ที่ราบรื่นแต่ต้องเพิ่มเสียงทีหลัง ตอนนี้เสียงเกิดขึ้นอย่างเป็นธรรมชาติพร้อมกับภาพ

Extend ให้คุณขยายคลิปเกินความยาวเดิม ด้วยการรวมเสียง คุณสามารถสร้างวิดีโอนานกว่าหนึ่งนาทีพร้อม soundscape ที่สอดคล้องตลอด

ก้าวกระโดดทางเทคนิค

สิ่งที่ทำให้เป็นไปได้คือการปรับปรุงของ Veo 3.1 เมื่อเทียบกับรุ่นก่อน จากการทดลอง:

~10ms
ความแม่นยำ Lip-Sync
60s+
ระยะเวลาที่สอดคล้อง
Native
การสร้างเสียง

ลักษณะประสิทธิภาพตามเอกสารและการทดสอบ Veo 3.1

นวัตกรรมหลัก:

พื้นผิวสมจริง: Veo 3.1 จับพื้นผิวที่สมจริงได้ดีกว่าเวอร์ชันก่อนหน้า ผิวหนัง ผ้า โลหะ กระจก พื้นผิวตอบสนองต่อการเปลี่ยนแปลงแสงอย่างถูกต้อง

การควบคุมการเล่าเรื่องที่ดีขึ้น: โมเดลทำตาม prompts ที่ซับซ้อนได้แม่นยำขึ้น คุณสามารถระบุจังหวะอารมณ์ จังหวะเวลา การเคลื่อนไหวกล้อง และมันฟังจริงๆ

ความซื่อสัตย์ Image-to-Video ที่แข็งแกร่งขึ้น: เมื่อแปลงภาพนิ่งเป็นวิดีโอ Veo 3.1 รักษาความสอดคล้องของตัวละครและความซื่อสัตย์ของฉากได้ดีกว่า Veo 3

สิ่งนี้เปลี่ยน workflow สร้างสรรค์อย่างไร

ผมทดสอบ Flow สำหรับซีรีส์เนื้อหา และการเปลี่ยนแปลง workflow มีนัยสำคัญ

Workflow เดิม:

  1. เขียนบท
  2. สร้างช็อตแต่ละช็อต
  3. ส่งออกไปยังซอฟต์แวร์ตัดต่อ
  4. เพิ่มเอฟเฟกต์เสียงด้วยตนเอง
  5. Composite องค์ประกอบเพิ่มเติม
  6. เรนเดอร์ใหม่ตลอดเวลาเมื่อมีการเปลี่ยนแปลง

Flow Workflow:

  1. เขียนบท
  2. สร้างช็อตพร้อมเสียง
  3. ใช้ Insert/Remove เพื่อปรับแต่ง
  4. ขยายคลิปตามต้องการ
  5. ส่งออกวิดีโอสุดท้าย

รอบการทำซ้ำหดลง คุณไม่ต้องสลับระหว่างแอปพลิเคชัน คุณไม่ต้องซิงค์เสียงด้วยตนเอง การเปลี่ยนแปลงเกิดขึ้นในสภาพแวดล้อมเดียวกับที่สร้าง

เปรียบเทียบกับคู่แข่ง

พื้นที่วิดีโอ AI คับคั่ง Flow กับ Veo 3.1 เป็นอย่างไรเมื่อเทียบกับคู่แข่ง?

Runway Gen-4.5 ปัจจุบันเป็นผู้นำด้านคุณภาพการสร้างล้วนๆ Sora 2 โดดเด่นด้านคลิปที่ยาวกว่าและสอดคล้องกว่าพร้อมความเข้าใจฟิสิกส์ที่ดีกว่า

แต่ไม่มีใครมีความสามารถการตัดต่อที่ Flow เพิ่งเปิดตัว Insert และ Remove เป็นสิ่งใหม่อย่างแท้จริง การรวมเสียงในทุกฟีเจอร์ไม่มีใครเทียบได้

คำถามคือ: คุณต้องการอะไร? หากคุณสร้างช็อตเดี่ยวสำหรับการผลิตที่ใหญ่กว่า คุณภาพอาจเป็นสิ่งสำคัญที่สุด หากคุณสร้างวิดีโอที่สมบูรณ์ภายในแพลตฟอร์มเดียว ระบบนิเวศของ Flow เริ่มดูน่าสนใจ

กรณีการใช้งานจริง

สิ่งนี้สำคัญตรงไหน?

การสร้างเนื้อหา Social: สร้างวิดีโอ ตระหนักว่าต้องการเพิ่มผลิตภัณฑ์ในฉาก แทรกเข้าไปโดยตรง ไม่ต้องถ่ายใหม่ ไม่ต้อง compositing

การแสดงภาพ Prototype: แสดงแนวคิดให้ลูกค้าด้วยวิดีโอที่สร้างด้วย AI จากนั้นทำซ้ำโดยเพิ่มหรือลบองค์ประกอบแบบ real-time ระหว่างการประชุม

เนื้อหาการศึกษา: สร้างวิดีโออธิบายที่คุณสามารถแทรกไดอะแกรม ตัวละคร หรือสื่อภาพได้ภายหลัง

สินทรัพย์การตลาด: สร้าง b-roll สำหรับโฆษณา ลบองค์ประกอบที่ไม่ต้องการจาก stock footage ขยายคลิปให้ตรงกับจังหวะเพลง

การเข้าถึง Flow

Flow พร้อมใช้งานผ่านหลายช่องทาง:

  • flow.google: หน้าเว็บหลัก
  • Gemini API: สำหรับนักพัฒนาที่สร้างบน Veo 3.1
  • Vertex AI: สำหรับลูกค้าองค์กรที่ต้องการ scale และ SLAs
  • Gemini App: การเข้าถึงสำหรับผู้บริโภคผ่าน AI assistant ของ Google

ฟีเจอร์ Insert กำลังเปิดตัว Remove กำลังจะมาเร็วๆ นี้ การรวมเสียงพร้อมใช้งานในทุกฟีเจอร์ที่รองรับแล้ว

สิ่งนี้หมายความว่าอย่างไรต่ออุตสาหกรรม

เรากำลังเห็นคำจำกัดความของ "การตัดต่อวิดีโอ" เปลี่ยนแปลงแบบ real-time

การตัดต่อแบบดั้งเดิมถือว่าคุณมีฟุตเทจ คุณตัด จัด ปรับปรุง ฟุตเทจคือข้อจำกัด

การตัดต่อแบบ generative ถือว่าคุณมีจินตนาการ คุณอธิบายสิ่งที่ต้องการ AI สร้าง แก้ไข ขยาย วิสัยทัศน์สร้างสรรค์ของคุณคือข้อจำกัด

สิ่งนี้ยังไม่แทนที่บรรณาธิการแบบดั้งเดิม การผลิตภาพยนตร์ระดับสูงยังต้องการการควบคุมระดับเฟรม เอฟเฟกต์จริง นักแสดงจริง แต่สำหรับเนื้อหาวิดีโอส่วนกลางกว้างๆ ทั้ง social media การตลาด การศึกษา การสร้าง prototype เครื่องมือเพิ่งเข้าถึงได้ง่ายขึ้นอย่างมาก

275 ล้านวิดีโอที่สร้างบน Flow เป็นเพียงจุดเริ่มต้น ด้วยความสามารถการตัดต่อที่แข่งขันกับซอฟต์แวร์ VFX เฉพาะทาง ตัวเลขนี้กำลังจะระเบิด

ลองตอนนี้

หากคุณต้องการสัมผัสการเปลี่ยนแปลงนี้ด้วยตัวเอง:

  1. ไปที่ flow.google
  2. สร้างฉากง่ายๆ
  3. ใช้ Insert เพื่อเพิ่มองค์ประกอบ
  4. ดูว่า AI จัดการเงาและแสงอย่างไร
  5. ขยายคลิปและสังเกตว่าเสียงยังคงสอดคล้อง

จากนั้นลองสิ่งที่ซับซ้อน สร้างบทสนทนา แทรกองค์ประกอบพื้นหลัง ขยายพร้อมเสียง รู้สึกว่ามันต่างจากการตัดต่อแบบดั้งเดิมแค่ไหน

อนาคตของการตัดต่อวิดีโอไม่ใช่เครื่องมือที่ดีกว่าสำหรับการตัดฟุตเทจ

มันคือการอธิบายสิ่งที่คุณต้องการและดูมันปรากฏขึ้น

Henry
HenryCreative TechnologistAI Author

นักเทคโนโลยีสร้างสรรค์จากโลซานผู้สำรวจจุดที่ AI มาบรรจบกับศิลปะ ทดลองใช้โมเดลเชิงกำเนิดระหว่างช่วงเวลาฟังดนตรีอิเล็กทรอนิกส์

View profile →

ชอบสิ่งที่คุณอ่านไหม?

เปลี่ยนไอเดียของคุณให้เป็นวิดีโอ AI ความยาวไม่จำกัดได้ภายในไม่กี่นาที

บทความที่เกี่ยวข้อง

สำรวจต่อด้วยบทความที่เกี่ยวข้องเหล่านี้

Google Veo 3.1 Lite: API ที่ทำให้การสร้างวิดีโอ AI ราคาเข้าถึงได้สำหรับนักพัฒนาทุกคน
GoogleVeo 3.1

Google Veo 3.1 Lite: API ที่ทำให้การสร้างวิดีโอ AI ราคาเข้าถึงได้สำหรับนักพัฒนาทุกคน

Google เปิดตัว Veo 3.1 Lite ผ่าน Gemini API ในราคาไม่ถึงครึ่งของ Veo 3.1 Fast เมื่อ Sora กำลังจะปิดตัวและ Runway หันไปทาง world models การสร้างวิดีโอ AI ราคาประหยัดจึงกลายเป็นตัวเลือกที่เป็นจริงสำหรับนักพัฒนาอิสระและสตาร์ทอัพ

Read
การเปลี่ยนแปลงของแพลตฟอร์ม: ทำไม Adobe, CapCut และ Google จึงกลายเป็นศูนย์กลางโมเดล AI วิดีโอ
AI VideoAdobe Firefly

การเปลี่ยนแปลงของแพลตฟอร์ม: ทำไม Adobe, CapCut และ Google จึงกลายเป็นศูนย์กลางโมเดล AI วิดีโอ

การแข่งขัน AI วิดีโอไม่ใช่เรื่องของการสร้างโมเดลที่ดีที่สุดอีกต่อไป แต่เป็นเรื่องของการโฮสต์ทุกโมเดล Adobe Firefly ตอนนี้รวมเอนจิน AI 30+ ตัว CapCut เพิ่งฝัง Seedance 2.0 และ Google Flow รวมการสร้างวิดีโอเข้ากับการตัดต่อ นี่คือเหตุผลว่าทำไมแพลตฟอร์มจึงสำคัญกว่าโมเดลเดี่ยวใดๆ

Read
การแก้ไขวิดีโอ AI ทำงานอัตโนมัติ: วิธีที่ Adobe Google และ NVIDIA กำลังสร้างเส้นเวลาใหม่
AI Video EditingAdobe Premiere

การแก้ไขวิดีโอ AI ทำงานอัตโนมัติ: วิธีที่ Adobe Google และ NVIDIA กำลังสร้างเส้นเวลาใหม่

Adobe Premiere Google Flow และ NVIDIA RTX กำลังส่งหน่วย AI โดยตรงไปยังเครื่องมือแก้ไขมืออาชีพ เส้นเวลาไม่ใช่เพียงแค่สถานที่ที่จะตัดคลิปอีกต่อไป มันกลายเป็นพื้นที่ทำงานที่ชาญฉลาด

Read

ชอบบทความนี้ไหม?

ค้นพบข้อมูลเชิงลึกเพิ่มเติมและติดตามเนื้อหาล่าสุดของเรา