Google Veo 3.1 Lite: Gemini API में कम लागत वाली AI वीडियो जनरेशन आ गई
Google ने अभी Veo 3.1 Lite लॉन्च किया है, यह Gemini API में एक तेज़ और किफायती AI वीडियो जनरेशन मॉडल है। डेवलपर्स को कीमत, गुणवत्ता के समझौतों और प्रोडक्शन ऐप्स में वीडियो बनाने के बारे में यह जानना चाहिए।

Veo 3.1 Lite किस समस्या का समाधान करता है
सीधी बात: AI वीडियो जनरेशन में लागत की समस्या रही है। 6-सेकंड की क्लिप के लिए पूर्ण Veo 3.1 इनफेरेंस चलाने में रेज़ोल्यूशन और ऑडियो सेटिंग्स के आधार पर $0.10 से $0.50 तक खर्च हो सकता है। यह तब तक उचित लगता है जब तक आप इसे हर दिन हजारों API कॉल्स से गुणा नहीं करते। किसी स्टार्टअप के लिए जो अपने प्रोडक्ट में वीडियो बना रहा है, ये आंकड़े तेजी से बढ़ते हैं।
Veo 3.1 Lite मॉडल को आवश्यकताओं तक सीमित करता है। कम डिफ़ॉल्ट रेज़ोल्यूशन, नेटिव ऑडियो सिंथेसिस नहीं, और 720p के लिए $0.05 प्रति सेकंड की कीमत। परिणाम एक ऐसा मॉडल है जिसकी लागत Veo 3.1 Fast से 50% से अधिक कम है, जबकि अधिकांश प्रोडक्शन उपयोग मामलों के लिए पर्याप्त विज़ुअल क्वालिटी बनी रहती है।
आपको क्या मिलता है (और क्या खोना पड़ता है)
यह एक समझौता है, मुफ्त अपग्रेड नहीं। इंटीग्रेशन से पहले अंतर समझना महत्वपूर्ण है।
Veo 3.1 Fast की तुलना में प्रति सेकंड 50% से अधिक सस्ता। टेक्स्ट-टू-वीडियो और इमेज-टू-वीडियो सपोर्ट। साधारण दृश्यों के लिए लगातार प्रॉम्प्ट अनुपालन। प्रति-सेकंड मूल्य निर्धारण सटीक लागत नियंत्रण देता है। परिचित SDKs के साथ मानक Gemini API के माध्यम से उपलब्ध।
नेटिव ऑडियो जनरेशन नहीं है (इसे अलग पाइपलाइन से खुद जोड़ें)। 720p डिफ़ॉल्ट, 1080p अधिकतम (4K नहीं)। कम अधिकतम क्लिप लंबाई (पूर्ण Veo 3.1 के 16 सेकंड के मुकाबले 8 सेकंड)। जटिल मल्टी-सब्जेक्ट दृश्य सामंजस्य खो सकते हैं। पूर्ण मॉडल की तुलना में सूक्ष्म कैमरा नियंत्रण सीमित है।
अधिकांश डेवलपर उपयोग मामलों, सोशल मीडिया प्रीव्यू, प्रोडक्ट डेमो, मार्केटिंग ऑटोमेशन और ऑनबोर्डिंग वीडियो के लिए Lite मॉडल पर्याप्त से भी अधिक है। आपको पूर्ण Veo 3.1 की जरूरत केवल तब है जब आपको सिनेमाई गुणवत्ता, नेटिव ऑडियो, या लंबी अवधि चाहिए।
वीडियो जनरेशन के लिए Gemini API सेट अप करना
यदि आपके पास पहले से Gemini API कुंजी है, तो वीडियो जनरेशन जोड़ने में लगभग 10 लाइन का कोड लगता है। यहां एक न्यूनतम Python उदाहरण है:
import google.generativeai as genai
genai.configure(api_key="YOUR_API_KEY")
model = genai.GenerativeModel("veo-3.1-lite")
response = model.generate_video(
prompt="A cycling route through the French countryside at golden hour, "
"drone perspective following the road between lavender fields",
duration=4,
resolution="720p"
)
# वीडियो सहेजें
with open("output.mp4", "wb") as f:
f.write(response.video_bytes)API सीधे वीडियो डेटा लौटाता है। 4-सेकंड की क्लिप के लिए जनरेशन में लगभग 45-60 सेकंड और 8-सेकंड की क्लिप के लिए 90-120 सेकंड लगते हैं, इसलिए किसी भी प्रोडक्शन ऐप में आपको अनुरोधों को असिंक्रोनस तरीके से संभालना चाहिए।
resolution="1080p" का उपयोग केवल तब करें जब इसकी आवश्यकता हो। 720p और 1080p के बीच लागत का अंतर लगभग 2x है, और सोशल मीडिया कंटेंट के लिए 720p अक्सर मोबाइल डिवाइस पर अलग दिखता ही नहीं है।कीमत का विवरण
Google Veo 3.1 Lite की कीमत जनरेट किए गए वीडियो के प्रति सेकंड के आधार पर तय करता है। वर्तमान विवरण यहां है:
| रेज़ोल्यूशन | दर | 4-सेकंड की क्लिप | 8-सेकंड की क्लिप |
|---|---|---|---|
| 720p | $0.05/second | $0.20 | $0.40 |
| 1080p | $0.08/second | $0.32 | $0.64 |
इसे पूर्ण Veo 3.1 मॉडल से तुलना करें, जिसकी कीमत प्रति सेकंड लगभग 2x अधिक है और जो नेटिव ऑडियो के साथ 4K आउटपुट सपोर्ट करता है।
720p/4s पर प्रतिदिन 10,000 क्लिप जनरेट करने वाले प्रोडक्ट के लिए, Lite मॉडल की लागत लगभग $2,000/day होगी। यह अब भी महत्वपूर्ण है, लेकिन पूर्ण मॉडल से 50% से अधिक सस्ता है, और प्रति-सेकंड मूल्य निर्धारण आपको सटीक लागत नियंत्रण देता है।
Lite बनाम Full का उपयोग कब करें
मैं पिछले सप्ताह से दोनों मॉडलों का परीक्षण कर रहा हूं, और यहां मेरी व्यावहारिक गाइड है:
इन मामलों में Veo 3.1 Lite का उपयोग करें:
- सोशल मीडिया कंटेंट (TikTok, Reels, Shorts)
- प्रोडक्ट शोकेस क्लिप्स
- ईमेल मार्केटिंग थंबनेल/प्रीव्यू
- तेज़ प्रोटोटाइपिंग और पुनरावृत्ति
- उच्च-वॉल्यूम बैच जनरेशन
- रियल-टाइम या लगभग रियल-टाइम एप्लिकेशन
इन मामलों में Veo 3.1 Full का उपयोग करें:
- सिनेमाई/मार्केटिंग हीरो वीडियो
- नेटिव ऑडियो की जरूरत वाला कंटेंट
- बड़े डिस्प्ले के लिए 4K आउटपुट
- जटिल मल्टी-कैरेक्टर दृश्य
- लंबी क्लिप्स (10-16 सेकंड)
- सटीक कैमरा मूवमेंट नियंत्रण
इमेज-टू-वीडियो: निर्णायक फीचर
टेक्स्ट-टू-वीडियो सुर्खियां बटोरता है, लेकिन प्रोडक्शन में Veo 3.1 Lite वास्तव में इमेज-टू-वीडियो में चमकता है। आप इसे प्रोडक्ट फोटो, UI स्क्रीनशॉट या डिज़ाइन मॉकअप देते हैं, और यह उसका छोटा एनिमेटेड संस्करण जनरेट करता है।
import google.generativeai as genai
from pathlib import Path
genai.configure(api_key="YOUR_API_KEY")
model = genai.GenerativeModel("veo-3.1-lite")
image_data = Path("product_photo.jpg").read_bytes()
response = model.generate_video(
prompt="Smooth camera orbit around the product, studio lighting, "
"white background with subtle shadows",
image=image_data,
duration=4,
resolution="720p"
)यह पैटर्न ई-कॉमर्स प्लेटफॉर्म, SaaS लैंडिंग पेज और ऐसे किसी भी एप्लिकेशन के लिए अच्छी तरह काम करता है जहां आपको वीडियो प्रोडक्शन पाइपलाइन के बिना स्थिर एसेट्स को डायनेमिक कंटेंट में बदलना हो।
एक सरल वीडियो जनरेशन पाइपलाइन बनाना
यहां एक अधिक यथार्थवादी उदाहरण है, जो बुनियादी एरर हैंडलिंग और असिंक्रोनस प्रोसेसिंग के साथ Veo 3.1 Lite को FastAPI बैकएंड में इंटीग्रेट करना दिखाता है:
from fastapi import FastAPI, BackgroundTasks
import google.generativeai as genai
import asyncio
import uuid
app = FastAPI()
genai.configure(api_key="YOUR_API_KEY")
model = genai.GenerativeModel("veo-3.1-lite")
# इन-मेमोरी स्टोर (प्रोडक्शन में Redis या डेटाबेस का उपयोग करें)
jobs = {}
async def generate_video_task(job_id: str, prompt: str):
try:
response = model.generate_video(
prompt=prompt, duration=4, resolution="720p"
)
jobs[job_id] = {
"status": "completed",
"video_bytes": response.video_bytes
}
except Exception as e:
jobs[job_id] = {"status": "failed", "error": str(e)}
@app.post("/generate")
async def create_video(prompt: str, background_tasks: BackgroundTasks):
job_id = str(uuid.uuid4())
jobs[job_id] = {"status": "processing"}
background_tasks.add_task(generate_video_task, job_id, prompt)
return {"job_id": job_id}
@app.get("/status/{job_id}")
async def get_status(job_id: str):
return jobs.get(job_id, {"status": "not_found"})यह आपको एक नॉन-ब्लॉकिंग API देता है, जिसमें क्लाइंट जनरेशन अनुरोध सबमिट करते हैं और परिणामों के लिए पोल करते हैं। प्रोडक्शन के लिए इन-मेमोरी डिक्शनरी को Redis से बदलें, रेट लिमिटिंग जोड़ें, और पूर्ण वीडियो को क्लाउड स्टोरेज में रखें।
व्यापक परिप्रेक्ष्य: यह क्यों महत्वपूर्ण है
Veo 3.1 Lite केवल एक सस्ता मॉडल नहीं है। यह दर्शाता है कि Google AI वीडियो वितरण के बारे में कैसे सोचता है।
अब तक, सर्वोत्तम AI वीडियो मॉडलों को प्रीमियम क्रिएटिव टूल्स के रूप में पेश किया गया था। Sora के लिए ChatGPT Pro सब्सक्रिप्शन जरूरी था, और अब OpenAI ने इसे पूरी तरह बंद कर दिया है। Runway प्रति जनरेशन शुल्क लेता है। Veo 3.1 Full भी सोच-समझकर किए जाने वाले, उच्च-मूल्य उपयोग मामलों के लिए मूल्यित है।
Lite अर्थशास्त्र बदल देता है। $0.20 प्रति 4-सेकंड क्लिप (720p) पर, वीडियो जनरेशन कंटेंट ऑटोमेशन पाइपलाइन, मार्केटिंग प्लेटफॉर्म और शैक्षिक ऐप्स में एम्बेड करने लायक किफायती हो जाती है। हालांकि यह अभी भी स्टॉक फुटेज सब्सक्रिप्शन को पूरी तरह बदलने जितना सस्ता नहीं है, पूर्ण मॉडल की तुलना में 50%+ की बचत इसे उन उच्च-वॉल्यूम उपयोग मामलों के लिए व्यवहार्य बनाती है जो पहले बहुत महंगे थे। यह पूरे उद्योग में उस मूल्य निर्धारण क्रांति की निरंतरता है जिसे हम ट्रैक कर रहे हैं।
API-First वितरण
गति नए वर्कफ़्लो सक्षम करती है
अर्थशास्त्र अपनाने को बढ़ावा देता है
आगे क्या आने वाला है
Sora के बंद होने के कुछ ही दिनों बाद Google ने Veo 4 का संकेत दिया, लेकिन समयसीमा स्पष्ट नहीं है। इस बीच, Veo 3.1 Lite बाजार में एक महत्वपूर्ण कमी को भरता है। कम लागत, कम लेटेंसी और आसान API इंटीग्रेशन का संयोजन इसे 2026 में वीडियो-केंद्रित प्रोडक्ट्स बनाने वाले डेवलपर्स के लिए सबसे व्यावहारिक विकल्प बनाता है।
यदि आप अपने अगले प्रोजेक्ट के लिए AI वीडियो APIs का मूल्यांकन कर रहे हैं, तो Veo 3.1 Lite आपकी शॉर्टलिस्ट में होना चाहिए, खासकर यदि आपका उपयोग मामला सिनेमाई गुणवत्ता से अधिक वॉल्यूम और गति को प्राथमिकता देता है। प्रमुख मॉडलों की व्यापक तुलना के लिए, हमारी Sora 2 vs Runway vs Veo 3 तुलना देखें।
स्रोत
- Google AI for Developers: Veo 3.1 Lite की 720p पर लागत $0.05 प्रति सेकंड है, जबकि Veo 3.1 Fast की लागत $0.10 प्रति सेकंड है (Google AI for Developers)
- Google AI for Developers: Veo 3.1 Lite का डिफ़ॉल्ट रेज़ोल्यूशन 720p है और यह चार-, छह- और आठ-सेकंड की क्लिप्स सपोर्ट करता है (Google AI for Developers)

लियोन के AI डेवलपर, जिन्हें जटिल ML अवधारणाओं को आसान तरीकों में बदलना पसंद है। मॉडलों की डीबगिंग न करते समय, आप उन्हें रोन घाटी में साइकिल चलाते पाएँगे।
View profile →संबंधित लेख
इन संबंधित पोस्ट के साथ आगे जानें

Alibaba HappyHorse-1.0: वह रहस्यमय मॉडल जिसने हर AI वीडियो लीडरबोर्ड में शीर्ष स्थान हासिल किया
HappyHorse-1.0 नाम का एक मॉडल बिना किसी पहचान के Artificial Analysis पर दिखाई दिया, टेक्स्ट-टू-वीडियो और इमेज-टू-वीडियो दोनों में #1 तक पहुंचा, फिर पता चला कि यह Alibaba का है। यहां हम इसकी आर्किटेक्चर, टीम और AI वीडियो बाजार के लिए इसके मायने के बारे में जानते हैं।

चीन का AI वीडियो प्रभुत्व, क्लिंग और कुइशू सिलिकॉन वैली को पीछे छोड़ रहे हैं
शीर्ष 8 में से 7 AI वीडियो मॉडल अब चीनी कंपनियों से आ रहे हैं। देखते हैं कि कुइशू का क्लिंग AI 60 मिलियन उपयोगकर्ताओं तक कैसे पहुँचा और इसका उद्योग के लिए क्या मतलब है।

ओपन-सोर्स AI वीडियो क्रांति: क्या Consumer GPU टेक दिग्गजों के साथ प्रतिस्पर्धा कर सकते हैं?
ByteDance और Tencent ने अभी ओपन-सोर्स वीडियो मॉडल रिलीज किए हैं जो consumer hardware पर चलते हैं। यह independent creators के लिए सब कुछ बदल देता है।