Google Veo 3.1 Lite: Gemini API में कम लागत वाला AI वीडियो जनरेशन उपलब्ध
Google ने अभी-अभी Gemini API में Veo 3.1 Lite लॉन्च किया है, जो एक तेज़ और किफ़ायती AI वीडियो जनरेशन मॉडल है। डेवलपर्स को मूल्य निर्धारण, गुणवत्ता के संतुलन और प्रोडक्शन ऐप्स में वीडियो जोड़ने के बारे में जो कुछ जानना चाहिए, वह सब यहाँ है।

अपने AI वीडियो बनाने के लिए तैयार हैं?
Bonega.ai का उपयोग करने वाले हजारों क्रिएटर्स से जुड़ें भुगतान के बाद जनरेशन शुरू होती है।
Veo 3.1 Lite जिस समस्या का समाधान करता है
मैं सीधे तौर पर कहूँ: AI वीडियो जनरेशन के साथ हमेशा लागत की एक समस्या रही है। 6-सेकंड के क्लिप के लिए पूरे Veo 3.1 का इनफरेंस रन करने पर रिज़ॉल्यूशन और ऑडियो सेटिंग्स के आधार पर $0.10 से $0.50 तक की लागत आ सकती है। यह सुनने में उचित लग सकता है जब तक कि आप इसे प्रति दिन हज़ारों API कॉल से गुणा न करें। अपने प्रोडक्ट में वीडियो शामिल करने वाले किसी स्टार्टअप के लिए, ये आँकड़े तेज़ी से बढ़ते हैं।
Veo 3.1 Lite मॉडल को केवल आवश्यक चीज़ों तक सीमित रखता है। कम रिज़ॉल्यूशन डिफॉल्ट्स, कोई नेटिव ऑडियो सिंथेसिस नहीं, और 720p के लिए $0.05 प्रति सेकंड का मूल्य। इसका परिणाम एक ऐसा मॉडल है जिसकी लागत Veo 3.1 Fast की तुलना में 50% से अधिक कम है, जबकि अधिकांश प्रोडक्शन उपयोग के मामलों के लिए पर्याप्त विज़ुअल गुणवत्ता बनी रहती है।
आपको क्या मिलता है (और क्या खोना पड़ता है)
यह एक समझौता है, मुफ़्त अपग्रेड नहीं। इंटीग्रेट करने से पहले इन अंतरों को समझना महत्वपूर्ण है।
Veo 3.1 Fast की तुलना में प्रति सेकंड 50% से अधिक सस्ता। टेक्स्ट-टू-वीडियो और इमेज-टू-वीडियो समर्थन। सरल दृश्यों के लिए निरंतर प्रॉम्प्ट पालन। प्रति-सेकंड मूल्य निर्धारण सटीक लागत नियंत्रण प्रदान करता है। परिचित SDKs के साथ मानक Gemini API के माध्यम से उपलब्ध।
कोई नेटिव ऑडियो जनरेशन नहीं (इसे अलग पाइपलाइन के साथ स्वयं जोड़ें)। 720p डिफ़ॉल्ट, 1080p अधिकतम (कोई 4K नहीं)। अधिकतम क्लिप लंबाई कम (पूर्ण Veo 3.1 के लिए 16 की तुलना में 8 सेकंड)। जटिल मल्टी-सब्जेक्ट दृश्य सामंजस्य खो सकते हैं। पूर्ण मॉडल की तुलना में फाइन-ग्रेन्ड कैमरा नियंत्रण सीमित है।
डेवलपर के अधिकांश उपयोग के मामलों, जैसे सोशल मीडिया प्रीव्यू, प्रोडक्ट डेमो, मार्केटिंग ऑटोमेशन, ऑनबोर्डिंग वीडियो के लिए, Lite मॉडल पर्याप्त से भी अधिक है। आपको पूर्ण Veo 3.1 की आवश्यकता केवल तभी होती है जब आपको सिनेमाई गुणवत्ता, नेटिव ऑडियो, या लंबी अवधि की आवश्यकता हो।
वीडियो जनरेशन के लिए Gemini API सेट करना
यदि आपके पास पहले से ही एक Gemini API कुंजी है, तो वीडियो जनरेशन जोड़ने में लगभग 10 लाइन कोड लगते हैं। यहाँ एक न्यूनतम Python उदाहरण दिया गया है:
import google.generativeai as genai
genai.configure(api_key="YOUR_API_KEY")
model = genai.GenerativeModel("veo-3.1-lite")
response = model.generate_video(
prompt="A cycling route through the French countryside at golden hour, "
"drone perspective following the road between lavender fields",
duration=4,
resolution="720p"
)
# Save the video
with open("output.mp4", "wb") as f:
f.write(response.video_bytes)API सीधे वीडियो डेटा लौटाता है। 4-सेकंड के क्लिप के लिए जनरेशन में लगभग 45-60 सेकंड और 8-सेकंड के क्लिप के लिए 90-120 सेकंड लगते हैं, इसलिए आप किसी भी प्रोडक्शन ऐप में अनुरोधों को एसिंक्रोनस रूप से संभालना चाहेंगे।
resolution="1080p" का उपयोग केवल तभी करें जब आपको इसकी आवश्यकता हो। 720p और 1080p के बीच लागत का अंतर लगभग 2 गुना है, और सोशल मीडिया कंटेंट के लिए, 720p अक्सर मोबाइल डिवाइसों पर अप्रभेद्य होता है।मूल्य निर्धारण विवरण
Google, Veo 3.1 Lite की कीमत जनरेट किए गए वीडियो के प्रति सेकंड के हिसाब से तय करता है। वर्तमान विवरण इस प्रकार है:
| रिज़ॉल्यूशन | दर | 4-सेकंड क्लिप | 8-सेकंड क्लिप |
|---|---|---|---|
| 720p | $0.05/सेकंड | $0.20 | $0.40 |
| 1080p | $0.08/सेकंड | $0.32 | $0.64 |
इसकी तुलना पूर्ण Veo 3.1 मॉडल से करें, जिसकी लागत प्रति सेकंड लगभग 2 गुना अधिक है और जो नेटिव ऑडियो के साथ 4K आउटपुट का समर्थन करता है।
720p/4s पर प्रति दिन 10,000 क्लिप जनरेट करने वाले प्रोडक्ट के लिए, Lite मॉडल की लागत लगभग $2,000/दिन होती है। यह अभी भी महत्वपूर्ण है, लेकिन यह पूर्ण मॉडल से 50% से अधिक सस्ता है, और प्रति-सेकंड मूल्य निर्धारण आपको सटीक लागत नियंत्रण देता है।
स्थानीय रूप से मॉडल चलाने से इसकी तुलना कैसे की जाती है
लोकल इनफरेंस के मुकाबले API लागतों की तुलना करने वाले डेवलपर्स के लिए गणित सीधा है।
कोई हार्डवेयर निवेश नहीं। तत्काल स्केलिंग। सुसंगत गुणवत्ता। बिना किसी निष्क्रिय लागत के उपयोग के अनुसार भुगतान करें। Google के नवीनतम मॉडल सुधारों तक स्वचालित पहुंच।
अधिक अग्रिम हार्डवेयर लागत। पाइपलाइन पर पूर्ण नियंत्रण। हार्डवेयर निवेश के बाद कोई प्रति-क्लिप लागत नहीं। स्थानीय VRAM और कंप्यूट द्वारा सीमित। रखरखाव और अपडेट की आवश्यकता होती है।
ब्रेक-ईवन पॉइंट वॉल्यूम पर निर्भर करता है: लगातार उच्च मासिक क्लिप संख्या पर एक लोकल सेटअप समय के साथ प्रति-सेकंड API मूल्य निर्धारण की तुलना में कम लागत वाला हो सकता है, जबकि उससे कम पर, या जहाँ भी Veo 3.1 गुणवत्ता की सीमा मायने रखती है, API अधिक स्पष्ट विकल्प है। हमने अपना स्वयं का ब्रेक-ईवन माप प्रकाशित नहीं किया है, इसलिए हम यहाँ कोई आँकड़ा नहीं दे रहे हैं।
Lite बनाम Full का उपयोग कब करें
मैं पिछले एक सप्ताह से दोनों मॉडलों का परीक्षण कर रहा हूँ, और यहाँ मेरा व्यावहारिक मार्गदर्शन दिया गया है:
Veo 3.1 Lite का उपयोग इसके लिए करें:
- सोशल मीडिया कंटेंट (TikTok, Reels, Shorts)
- प्रोडक्ट शोकेस क्लिप
- ईमेल मार्केटिंग थंबनेल/प्रीव्यू
- तीव्र प्रोटोटाइपिंग और पुनरावृत्ति
- उच्च-वॉल्यूम बैच जनरेशन
- रियल-टाइम या निकट-रियल-टाइम एप्लिकेशन
Veo 3.1 Full का उपयोग इसके लिए करें:
- सिनेमाई/मार्केटिंग हीरो वीडियो
- नेटिव ऑडियो की आवश्यकता वाला कंटेंट
- बड़े डिस्प्ले के लिए 4K आउटपुट
- जटिल मल्टी-कैरेक्टर दृश्य
- विस्तारित क्लिप (10-16 सेकंड)
- सटीक कैमरा मूवमेंट नियंत्रण
इमेज-टू-वीडियो: सबसे प्रमुख फीचर
टेक्स्ट-टू-वीडियो सुर्खियाँ बटोरता है, लेकिन इमेज-टू-वीडियो वह जगह है जहाँ Veo 3.1 Lite वास्तव में प्रोडक्शन में चमकता है। आप इसे एक प्रोडक्ट फोटो, UI स्क्रीनशॉट या डिज़ाइन मॉकअप देते हैं, और यह एक छोटा एनिमेटेड संस्करण जनरेट करता है।
import google.generativeai as genai
from pathlib import Path
genai.configure(api_key="YOUR_API_KEY")
model = genai.GenerativeModel("veo-3.1-lite")
image_data = Path("product_photo.jpg").read_bytes()
response = model.generate_video(
prompt="Smooth camera orbit around the product, studio lighting, "
"white background with subtle shadows",
image=image_data,
duration=4,
resolution="720p"
)यह पैटर्न ई-कॉमर्स प्लेटफ़ॉर्म, SaaS लैंडिंग पेज और किसी भी ऐसे एप्लिकेशन के लिए अच्छी तरह से काम करता है जहाँ आपको वीडियो प्रोडक्शन पाइपलाइन के बिना स्थिर संपत्तियों को डायनेमिक कंटेंट में बदलने की आवश्यकता होती है।
एक सरल वीडियो जनरेशन पाइपलाइन का निर्माण
यहाँ एक अधिक यथार्थवादी उदाहरण दिया गया है जो दिखाता है कि बुनियादी त्रुटि प्रबंधन और एसिंक्रोनस प्रोसेसिंग के साथ FastAPI बैकएंड में Veo 3.1 Lite को कैसे एकीकृत किया जाए:
from fastapi import FastAPI, BackgroundTasks
import google.generativeai as genai
import asyncio
import uuid
app = FastAPI()
genai.configure(api_key="YOUR_API_KEY")
model = genai.GenerativeModel("veo-3.1-lite")
# In-memory store (use Redis or a database in production)
jobs = {}
async def generate_video_task(job_id: str, prompt: str):
try:
response = model.generate_video(
prompt=prompt, duration=4, resolution="720p"
)
jobs[job_id] = {
"status": "completed",
"video_bytes": response.video_bytes
}
except Exception as e:
jobs[job_id] = {"status": "failed", "error": str(e)}
@app.post("/generate")
async def create_video(prompt: str, background_tasks: BackgroundTasks):
job_id = str(uuid.uuid4())
jobs[job_id] = {"status": "processing"}
background_tasks.add_task(generate_video_task, job_id, prompt)
return {"job_id": job_id}
@app.get("/status/{job_id}")
async def get_status(job_id: str):
return jobs.get(job_id, {"status": "not_found"})यह आपको एक गैर-अवरोधक (non-blocking) API देता है जहाँ क्लाइंट जनरेशन अनुरोध सबमिट करते हैं और परिणामों के लिए पोल करते हैं। प्रोडक्शन के लिए, इन-मेमोरी डिक्शनरी को Redis से बदलें, रेट लिमिटिंग जोड़ें, और पूर्ण किए गए वीडियो को क्लाउड स्टोरेज में स्टोर करें।
व्यापक परिप्रेक्ष्य: यह क्यों मायने रखता है
Veo 3.1 Lite केवल एक सस्ता मॉडल नहीं है। यह इस बात में बदलाव का प्रतिनिधित्व करता है कि Google AI वीडियो वितरण के बारे में कैसे सोचता है।
अब तक, सर्वश्रेष्ठ AI वीडियो मॉडल को प्रीमियम रचनात्मक उपकरणों के रूप में स्थापित किया गया था। Sora के लिए ChatGPT Pro सब्सक्रिप्शन की आवश्यकता थी, और अब OpenAI ने इसे पूरी तरह से बंद कर दिया है। Runway प्रति जनरेशन शुल्क लेता है। यहाँ तक कि Veo 3.1 Full की कीमत भी सोच-समझकर किए जाने वाले, उच्च-मूल्य वाले उपयोग के मामलों के लिए तय की गई है।
Lite अर्थशास्त्र को बदल देता है। 4-सेकंड के क्लिप (720p) के लिए $0.20 पर, वीडियो जनरेशन इतना किफ़ायती हो जाता है कि इसे कंटेंट ऑटोमेशन पाइपलाइन, मार्केटिंग प्लेटफ़ॉर्म और शैक्षणिक ऐप्स में एम्बेड किया जा सके। हालाँकि यह अभी भी स्टॉक फ़ुटेज सब्सक्रिप्शन को पूरी तरह से बदलने के लिए पर्याप्त सस्ता नहीं है, लेकिन पूर्ण मॉडल पर 50%+ की बचत इसे उच्च-वॉल्यूम उपयोग के मामलों के लिए व्यावहारिक बनाती है जो पहले बहुत महंगे थे। यह उस मूल्य निर्धारण क्रांति का विस्तार है जिसे हम ट्रैक कर रहे हैं जो पूरे उद्योग में चल रही है।
API-प्रथम वितरण
गति नए वर्कफ़्लो को सक्षम बनाती है
अर्थशास्त्र अपनाने को प्रेरित करता है
पोस्ट-Sora परिदृश्य
2026 के मध्य तक, मुख्य वीडियो जनरेशन प्लेटफ़ॉर्म अलग-अलग मूल्य स्तरों पर स्थित हैं:
| प्लेटफ़ॉर्म | स्थिति | मजबूती | मूल्य स्तर |
|---|---|---|---|
| Google Veo 3.1 | सक्रिय, विस्तार कर रहा है | गुणवत्ता, इकोसिस्टम, API | मध्यम (घट रहा है) |
| Google Veo 3.1 Lite | नया लॉन्च | लागत दक्षता | बजट |
| Runway Gen-4.5 | सक्रिय | गुणवत्ता, रचनात्मक नियंत्रण | प्रीमियम |
| Kling 2.0 | सक्रिय | मोशन फिजिक्स, मूल्य | बजट-मध्यम |
| Pika 2.5+ | सक्रिय | रचनात्मक प्रभाव, वायरल टूल्स | बजट |
| Sora | ऐप 26 अप्रैल 2026 को बंद; API 24 सितंबर 2026 को समाप्त | लागू नहीं | लागू नहीं |
पैटर्न स्पष्ट है: Google एक मूल्य निर्धारण सीढ़ी बना रहा है। उच्च-वॉल्यूम अनुप्रयोगों के लिए Veo 3.1 Lite, प्रोडक्शन गुणवत्ता के लिए Veo 3.1 Fast, और अधिकतम निष्ठा के लिए पूर्ण Veo 3.1। यह दर्शाता है कि क्लाउड कंप्यूटिंग कैसे विकसित हुआ, जिसने विभिन्न वर्कलोड के लिए विभिन्न स्तरों की पेशकश की।
Google Vids को मिले Veo 3.1 फीचर्स
Lite API लॉन्च के साथ ही, Google ने Google Vids को नई क्षमताओं के साथ अपडेट किया: यह प्रोडक्ट अब Veo 3.1 के साथ वीडियो जनरेट करता है, और इसके साथ तीन और फीचर्स भी जारी किए गए हैं।
यह अपडेट तीन महत्वपूर्ण सुविधाएं जोड़ता है:
- ✓Lyria 3 और Lyria 3 Pro के माध्यम से AI म्यूज़िक जनरेशन (30-सेकंड से 3-मिनट के ट्रैक)
- ✓Veo 3.1 द्वारा संचालित AI अवतार जो वस्तुओं और कस्टम बैकग्राउंड के साथ इंटरैक्ट करते हैं
- ✓त्वरित कैप्चर के लिए Chrome स्क्रीन रिकॉर्डर एक्सटेंशन
Workspace प्रोडक्ट और डेवलपर API अब Google के वीडियो लाइनअप में साथ-साथ मौजूद हैं।
आगे क्या आने वाला है
Google ने Sora के बंद होने के कुछ ही दिनों बाद Veo 4 का टीज़र जारी किया, लेकिन इसकी समयसीमा स्पष्ट नहीं है। इस बीच, Veo 3.1 Lite बाज़ार में एक महत्वपूर्ण अंतर को भरता है। कम लागत, कम लेटेंसी और आसान API एकीकरण का संयोजन इसे 2026 में वीडियो-प्रथम उत्पादों का निर्माण करने वाले डेवलपर्स के लिए सबसे व्यावहारिक विकल्प बनाता है।
यदि आप अपने अगले प्रोजेक्ट के लिए AI वीडियो API का मूल्यांकन कर रहे हैं, तो Veo 3.1 Lite आपकी शॉर्टलिस्ट में होना चाहिए, खासकर यदि आपका उपयोग का मामला सिनेमाई गुणवत्ता की तुलना में वॉल्यूम और गति को प्राथमिकता देता है। प्रमुख मॉडल एक-दूसरे से कैसे तुलना करते हैं, इसके व्यापक अवलोकन के लिए, हमारी Sora 2 बनाम Runway बनाम Veo 3 तुलना देखें।
स्रोत
- Google AI for Developers: Veo 3.1 Lite costs $0.05 per second at 720p, compared with $0.10 per second for Veo 3.1 Fast (Google AI for Developers)
- Google AI for Developers: Veo 3.1 Lite defaults to 720p and supports four-, six- and eight-second clips (Google AI for Developers)
- Google Workspace: Workspace updates detail video creation capabilities in Google Vids (Google Workspace)
- Google AI for Developers: Gemini API changelog entry March 31, 2026 confirms Veo 3.1 Lite preview launch (Google AI for Developers)
- OpenAI Help: Sora app closed April 26, 2026; Sora API ends September 24, 2026 (OpenAI)

AI डेवलपर पर्सोना। ऐसे व्यावहारिक ट्यूटोरियल लिखते हैं जो मशीन लर्निंग की अवधारणाओं को वीडियो क्रिएटर्स के लिए चरण-दर-चरण गाइड में बदलते हैं। Claude के साथ तैयार, स्वचालित जांच के बाद प्रकाशित।
View profile →जो पढ़ा, वह पसंद आया?
कुछ ही मिनटों में अपने विचारों को असीमित अवधि के AI वीडियो में बदलें। भुगतान के बाद जनरेशन शुरू होती है।
संबंधित लेख
इन संबंधित पोस्ट के साथ आगे जानें

Veo 3.1 इंग्रेडिएंट्स टू विडियो: इमेज-टू-विडियो जेनरेशन का आपका संपूर्ण गाइड
Google Veo 3.1 को सीधे YouTube शॉर्ट्स और YouTube क्रिएट में लॉन्च करता है, जिससे क्रिएटर तीन तक इमेजेस को सुसंगत वर्टिकल विडियो में बदल सकते हैं और नेटिव 4K अपस्केलिंग का उपयोग कर सकते हैं।

Sora के बाद AI Video: 2026 में जानने योग्य 4 मार्केट टियर
Sora 26 अप्रैल को बंद हो रहा है। AI video मार्केट चार टियर में consolidate हो चुका है। अपनी जरूरतों के लिए सही Sora alternative चुनने की practical गाइड।

Alibaba Wan 2.7: Thinking Mode कैसे बदल रहा है AI Video Generation
Alibaba ने Wan 2.7 रिलीज़ किया है जिसमें एक नया Thinking Mode है जो वीडियो जेनरेट करने से पहले compositions की प्लानिंग करता है। जानिए यह कैसे काम करता है और creators के लिए इसका क्या मतलब है।