Google Veo 3.1 Lite: Tạo video AI chi phí thấp đã có mặt trên Gemini API
Google vừa ra mắt Veo 3.1 Lite, mô hình tạo video AI nhanh chóng, giá cả phải chăng ngay trong Gemini API. Dưới đây là những điều các nhà phát triển cần biết về giá cả, sự đánh đổi chất lượng và việc tích hợp video vào các ứng dụng production.

Sẵn sàng tạo video AI của riêng bạn?
Tham gia cùng hàng nghìn nhà sáng tạo đang sử dụng Bonega.ai Video bắt đầu được tạo sau khi thanh toán.
Vấn đề mà Veo 3.1 Lite giải quyết
Hãy thẳng thắn: tạo video bằng AI vốn gặp vấn đề lớn về chi phí. Chạy suy luận Veo 3.1 đầy đủ cho một đoạn clip 6 giây có thể tốn từ $0.10 đến $0.50 tùy thuộc vào độ phân giải và cài đặt âm thanh. Con số đó nghe có vẻ hợp lý cho đến khi bạn nhân nó với hàng nghìn lệnh gọi API mỗi ngày. Đối với một startup đang tích hợp video vào sản phẩm của mình, các con số đó sẽ tăng lên rất nhanh.
Veo 3.1 Lite tinh gọn mô hình về những phần thiết yếu. Độ phân giải mặc định thấp hơn, không có bộ tổng hợp âm thanh gốc, và giá ở mức $0.05 mỗi giây cho 720p. Kết quả là một mô hình có chi phí thấp hơn 50% so với Veo 3.1 Fast trong khi vẫn duy trì chất lượng hình ảnh đủ tốt cho hầu hết các trường hợp sử dụng trong production.
Những gì bạn nhận được (và những gì phải đánh đổi)
Đây là sự đánh đổi, không phải một bản nâng cấp miễn phí. Việc hiểu rõ những khác biệt là rất quan trọng trước khi bạn tiến hành tích hợp.
Rẻ hơn 50% mỗi giây so với Veo 3.1 Fast. Hỗ trợ chuyển văn bản thành video (text-to-video) và hình ảnh thành video (image-to-video). Tuân thủ prompt nhất quán cho các cảnh đơn giản. Định giá theo giây giúp kiểm soát chi phí chính xác. Khả dụng thông qua Gemini API tiêu chuẩn với các SDK quen thuộc.
Không có tính năng tạo âm thanh gốc (bạn phải tự bổ sung bằng một pipeline riêng). Mặc định 720p, tối đa 1080p (không có 4K). Thời lượng clip tối đa ngắn hơn (8 giây so với 16 giây ở Veo 3.1 đầy đủ). Các cảnh phức tạp có nhiều đối tượng có thể mất tính mạch lạc. Khả năng điều khiển camera chi tiết bị hạn chế so với mô hình đầy đủ.
Đối với hầu hết các trường hợp sử dụng của nhà phát triển, như bản xem trước trên mạng xã hội, bản demo sản phẩm, tự động hóa tiếp thị, video hướng dẫn ban đầu, mô hình Lite là quá đủ. Bạn chỉ cần bản Veo 3.1 đầy đủ khi cần chất lượng chuẩn điện ảnh, âm thanh gốc, hoặc thời lượng dài hơn.
Thiết lập Gemini API để tạo video
Nếu bạn đã có khóa Gemini API, việc bổ sung tính năng tạo video chỉ mất khoảng 10 dòng mã. Dưới đây là một ví dụ Python tối giản:
import google.generativeai as genai
genai.configure(api_key="YOUR_API_KEY")
model = genai.GenerativeModel("veo-3.1-lite")
response = model.generate_video(
prompt="A cycling route through the French countryside at golden hour, "
"drone perspective following the road between lavender fields",
duration=4,
resolution="720p"
)
# Save the video
with open("output.mp4", "wb") as f:
f.write(response.video_bytes)API sẽ trả về dữ liệu video trực tiếp. Quá trình tạo mất khoảng 45-60 giây cho một clip 4 giây và 90-120 giây cho một clip 8 giây, vì vậy bạn sẽ muốn xử lý các yêu cầu theo phương thức bất đồng bộ trong bất kỳ ứng dụng production nào.
resolution="1080p" khi thực sự cần thiết. Chênh lệch chi phí giữa 720p và 1080p là khoảng 2 lần, và đối với nội dung mạng xã hội, 720p thường không có sự khác biệt rõ rệt trên các thiết bị di động.Phân tích chi tiết bảng giá
Google định giá Veo 3.1 Lite theo từng giây video được tạo ra. Dưới đây là bảng phân tích hiện tại:
| Độ phân giải | Đơn giá | Clip 4 giây | Clip 8 giây |
|---|---|---|---|
| 720p | $0.05/giây | $0.20 | $0.40 |
| 1080p | $0.08/giây | $0.32 | $0.64 |
So sánh mức này với mô hình Veo 3.1 đầy đủ, vốn có giá đắt hơn khoảng 2 lần mỗi giây và hỗ trợ đầu ra 4K kèm âm thanh gốc.
Đối với một sản phẩm tạo ra 10.000 clip mỗi ngày ở chất lượng 720p/4s, mô hình Lite tốn khoảng $2,000/ngày. Con số đó vẫn đáng kể, nhưng rẻ hơn 50% so với mô hình đầy đủ, và cách tính giá theo giây giúp bạn kiểm soát chi phí một cách chuẩn xác.
So sánh với việc tự chạy các mô hình trên máy cục bộ
Đối với các nhà phát triển đang cân nhắc giữa chi phí API và việc tự chạy suy luận cục bộ, bài toán khá đơn giản.
Không cần đầu tư phần cứng. Khả năng mở rộng tức thì. Chất lượng ổn định. Trả tiền theo mức sử dụng mà không chịu chi phí nhàn rỗi. Tự động tiếp cận những cải tiến mô hình mới nhất của Google.
Chi phí phần cứng ban đầu cao hơn. Toàn quyền kiểm soát pipeline. Không phát sinh chi phí trên mỗi clip sau khi đã đầu tư phần cứng. Bị giới hạn bởi VRAM và năng lực tính toán cục bộ. Đòi hỏi việc bảo trì và cập nhật thường xuyên.
Điểm hòa vốn tùy thuộc vào lưu lượng sử dụng: với số lượng clip hàng tháng duy trì ở mức cao, một hệ thống cài đặt cục bộ có thể tiết kiệm chi phí hơn theo thời gian so với giá API tính theo giây, trong khi ở mức thấp hơn, hoặc bất cứ khi nào giới hạn chất lượng của Veo 3.1 đóng vai trò quyết định, API là lựa chọn gọn gàng hơn. Chúng tôi chưa công bố phép đo điểm hòa vốn riêng của mình, vì vậy chúng tôi không đưa ra con số cụ thể ở đây.
Khi nào nên dùng bản Lite so với bản Full
Tôi đã thử nghiệm cả hai mô hình trong suốt tuần qua, và đây là cẩm nang thực tế của tôi:
Dùng Veo 3.1 Lite cho:
- Nội dung mạng xã hội (TikTok, Reels, Shorts)
- Clip giới thiệu sản phẩm
- Ảnh thu nhỏ/bản xem trước cho email marketing
- Tạo mẫu nhanh và lặp lại thử nghiệm
- Tạo hàng loạt với khối lượng lớn
- Các ứng dụng thời gian thực hoặc gần thời gian thực
Dùng Veo 3.1 Full cho:
- Video hero chất lượng điện ảnh hoặc chiến dịch tiếp thị lớn
- Nội dung yêu cầu âm thanh gốc
- Xuất định dạng 4K cho màn hình lớn
- Cảnh phức tạp có nhiều nhân vật
- Các đoạn clip dài hơn (10-16 giây)
- Khả năng kiểm soát chuyển động camera chuẩn xác
Hình ảnh thành video: Tính năng đắt giá
Chuyển văn bản thành video thu hút nhiều sự chú ý từ truyền thông, nhưng chuyển hình ảnh thành video mới là nơi Veo 3.1 Lite thực sự tỏa sáng trong thực tế. Bạn cung cấp ảnh chụp sản phẩm, ảnh chụp màn hình giao diện người dùng, hoặc bản thiết kế mẫu, và mô hình sẽ tạo ra một đoạn chuyển động ngắn.
import google.generativeai as genai
from pathlib import Path
genai.configure(api_key="YOUR_API_KEY")
model = genai.GenerativeModel("veo-3.1-lite")
image_data = Path("product_photo.jpg").read_bytes()
response = model.generate_video(
prompt="Smooth camera orbit around the product, studio lighting, "
"white background with subtle shadows",
image=image_data,
duration=4,
resolution="720p"
)Khuôn mẫu này hoạt động rất hiệu quả cho các nền tảng thương mại điện tử, trang đích SaaS, và bất kỳ ứng dụng nào bạn cần biến các tài nguyên tĩnh thành nội dung động mà không cần đến cả một dây chuyền sản xuất video.
Xây dựng pipeline tạo video đơn giản
Dưới đây là một ví dụ thực tế hơn minh họa cách tích hợp Veo 3.1 Lite vào backend FastAPI với khả năng xử lý lỗi cơ bản và quy trình xử lý bất đồng bộ:
from fastapi import FastAPI, BackgroundTasks
import google.generativeai as genai
import asyncio
import uuid
app = FastAPI()
genai.configure(api_key="YOUR_API_KEY")
model = genai.GenerativeModel("veo-3.1-lite")
# In-memory store (use Redis or a database in production)
jobs = {}
async def generate_video_task(job_id: str, prompt: str):
try:
response = model.generate_video(
prompt=prompt, duration=4, resolution="720p"
)
jobs[job_id] = {
"status": "completed",
"video_bytes": response.video_bytes
}
except Exception as e:
jobs[job_id] = {"status": "failed", "error": str(e)}
@app.post("/generate")
async def create_video(prompt: str, background_tasks: BackgroundTasks):
job_id = str(uuid.uuid4())
jobs[job_id] = {"status": "processing"}
background_tasks.add_task(generate_video_task, job_id, prompt)
return {"job_id": job_id}
@app.get("/status/{job_id}")
async def get_status(job_id: str):
return jobs.get(job_id, {"status": "not_found"})Mô hình này cung cấp cho bạn một API không chặn (non-blocking), nơi các client gửi yêu cầu tạo video và thăm dò định kỳ để nhận kết quả. Đối với môi trường production, hãy thay thế từ điển trong bộ nhớ bằng Redis, thêm giới hạn tốc độ gọi (rate limiting), và lưu trữ các video đã hoàn thành trên cloud storage.
Bức tranh toàn cảnh: Vì sao điều này lại quan trọng
Veo 3.1 Lite không chỉ là một mô hình rẻ hơn. Nó đại diện cho một bước chuyển trong cách Google nhìn nhận việc phân phối video AI.
Cho đến nay, những mô hình video AI tốt nhất vẫn được định vị như những công cụ sáng tạo cao cấp. Sora từng yêu cầu gói đăng ký ChatGPT Pro, và giờ đây OpenAI đã đóng cửa dịch vụ này hoàn toàn. Runway tính phí theo từng lượt tạo. Ngay cả Veo 3.1 Full cũng được định giá cho các trường hợp sử dụng có chủ đích và giá trị cao.
Bản Lite làm thay đổi bài toán kinh tế. Ở mức $0.20 cho mỗi clip 4 giây (720p), việc tạo video trở nên đủ rẻ để nhúng vào các pipeline tự động hóa nội dung, nền tảng tiếp thị, và các ứng dụng giáo dục. Mặc dù vẫn chưa đủ rẻ để thay thế hoàn toàn các gói thuê bao video có sẵn (stock footage), nhưng mức tiết kiệm hơn 50% so với mô hình đầy đủ đã giúp nó trở nên khả thi cho các trường hợp khối lượng lớn vốn trước đây quá đắt đỏ. Đây là sự tiếp nối của cuộc cách mạng định giá mà chúng tôi đã theo dõi trên toàn ngành.
Phân phối ưu tiên API
Tốc độ mở ra quy trình làm việc mới
Bài toán kinh tế thúc đẩy ứng dụng
Toàn cảnh hậu Sora
Tính đến giữa năm 2026, các nền tảng tạo video chính được phân bổ theo các phân khúc giá rõ rệt:
| Nền tảng | Trạng thái | Điểm mạnh | Phân khúc giá |
|---|---|---|---|
| Google Veo 3.1 | Đang hoạt động, mở rộng | Chất lượng, hệ sinh thái, API | Tầm trung (đang giảm) |
| Google Veo 3.1 Lite | Mới ra mắt | Hiệu quả chi phí | Tiết kiệm |
| Runway Gen-4.5 | Đang hoạt động | Chất lượng, kiểm soát sáng tạo | Cao cấp |
| Kling 2.0 | Đang hoạt động | Vật lý chuyển động, giá trị | Tiết kiệm - tầm trung |
| Pika 2.5+ | Đang hoạt động | Hiệu ứng sáng tạo, công cụ tạo xu hướng | Tiết kiệm |
| Sora | Ứng dụng đóng cửa ngày 26 tháng 4 năm 2026; API dừng hoạt động ngày 24 tháng 9 năm 2026 | N/A | N/A |
Mô hình định hướng rất rõ ràng: Google đang xây dựng một nấc thang giá cả. Veo 3.1 Lite cho các ứng dụng khối lượng lớn, Veo 3.1 Fast cho chất lượng production, và Veo 3.1 đầy đủ cho độ trung thực tối đa. Điều này phản ánh sự phát triển của điện toán đám mây: cung cấp các phân khúc khác nhau cho từng khối lượng công việc khác nhau.
Google Vids được bổ sung các tính năng Veo 3.1
Cùng với sự ra mắt của Lite API, Google cũng đã cập nhật Google Vids với những năng lực mới: sản phẩm này hiện có thể tạo video với Veo 3.1, và ba tính năng bổ sung đã được phát hành kèm theo.
Bản cập nhật bổ sung ba tính năng quan trọng:
- ✓Tạo nhạc AI qua Lyria 3 và Lyria 3 Pro (các bản nhạc từ 30 giây đến 3 phút)
- ✓Avatar AI hoạt động trên nền tảng Veo 3.1 có thể tương tác với các vật thể và hình nền tùy chỉnh
- ✓Tiện ích mở rộng quay màn hình Chrome để ghi hình tức thì
Sản phẩm thuộc hệ sinh thái Workspace và API dành cho nhà phát triển giờ đây song hành cùng nhau trong danh mục video của Google.
Điều gì sẽ diễn ra tiếp theo
Google đã hé lộ về Veo 4 chỉ vài ngày sau khi Sora dừng hoạt động, nhưng lộ trình thời gian vẫn chưa rõ ràng. Trong thời gian chờ đợi, Veo 3.1 Lite lấp đầy một khoảng trống quan trọng trên thị trường. Sự kết hợp giữa chi phí thấp, độ trễ thấp và tích hợp API dễ dàng khiến nó trở thành lựa chọn thực tế nhất cho các nhà phát triển đang xây dựng các sản phẩm ưu tiên video vào năm 2026.
Nếu bạn đang đánh giá các API video AI cho dự án tiếp theo của mình, Veo 3.1 Lite chắc chắn nên nằm trong danh sách cân nhắc, đặc biệt nếu trường hợp sử dụng của bạn ưu tiên số lượng và tốc độ hơn là chất lượng điện ảnh. Để có cái nhìn rộng hơn về cách các mô hình lớn so kè với nhau, hãy xem bài so sánh Sora 2 với Runway và Veo 3 của chúng tôi.
Nguồn trích dẫn
- Google AI for Developers: Veo 3.1 Lite có giá $0.05 mỗi giây ở chất lượng 720p, so với $0.10 mỗi giây cho Veo 3.1 Fast (Google AI for Developers)
- Google AI for Developers: Veo 3.1 Lite mặc định 720p và hỗ trợ các clip bốn, sáu và tám giây (Google AI for Developers)
- Google Workspace: Bản cập nhật Workspace nêu chi tiết các tính năng tạo video trong Google Vids (Google Workspace)
- Google AI for Developers: Mục nhật ký thay đổi của Gemini API ngày 31 tháng 3 năm 2026 xác nhận ra mắt bản preview của Veo 3.1 Lite (Google AI for Developers)
- OpenAI Help: Ứng dụng Sora ngừng hoạt động ngày 26 tháng 4 năm 2026; Sora API dừng ngày 24 tháng 9 năm 2026 (OpenAI)

Hình mẫu lập trình viên AI. Viết hướng dẫn thực hành biến khái niệm học máy thành các bước chi tiết cho nhà sáng tạo video. Soạn thảo bằng Claude, xuất bản sau khi qua kiểm tra tự động.
View profile →Bạn thích những gì vừa đọc?
Biến ý tưởng của bạn thành video AI có độ dài không giới hạn chỉ trong vài phút. Video bắt đầu được tạo sau khi thanh toán.
Bài viết liên quan
Tiếp tục khám phá với các bài viết liên quan này

Video AI Sau Sora: 4 Cấp Độ Thị Trường Cần Biết Năm 2026
Sora đóng cửa vào ngày 26 tháng 4. Thị trường video AI đã hợp nhất thành bốn cấp độ. Hướng dẫn thực tế để chọn giải pháp thay thế Sora phù hợp với nhu cầu của bạn.

Alibaba HappyHorse-1.0: Mô hình bí ẩn đã chiếm đỉnh mọi bảng xếp hạng AI Video
Một mô hình mang tên HappyHorse-1.0 xuất hiện ẩn danh trên Artificial Analysis, leo lên vị trí số 1 ở cả hai hạng mục text-to-video và image-to-video, rồi được xác nhận thuộc về Alibaba. Dưới đây là những gì chúng tôi biết về kiến trúc, đội ngũ phát triển và ý nghĩa đối với thị trường AI video.

Alibaba Wan 2.7: Chế độ Suy nghĩ thay đổi việc tạo video AI như thế nào
Alibaba vừa phát hành Wan 2.7 với Chế độ Suy nghĩ hoàn toàn mới, cho phép lập kế hoạch bố cục trước khi tạo video. Chúng tôi phân tích cách nó hoạt động và ý nghĩa đối với người sáng tạo.