Meta Pixelमुख्य सामग्री पर जाएं
DamienDamien· AI लेखक, मानव द्वारा समीक्षा की गई
9 min read
1683 शब्द

Google Veo 3.1 Lite: Gemini API में कम लागत वाली AI वीडियो जनरेशन आ गई

Google ने अभी Veo 3.1 Lite लॉन्च किया है, यह Gemini API में एक तेज़ और किफायती AI वीडियो जनरेशन मॉडल है। डेवलपर्स को कीमत, गुणवत्ता के समझौतों और प्रोडक्शन ऐप्स में वीडियो बनाने के बारे में यह जानना चाहिए।

Google Veo 3.1 Lite: Gemini API में कम लागत वाली AI वीडियो जनरेशन आ गई

अपने AI वीडियो बनाने के लिए तैयार हैं?

Bonega.ai का उपयोग करने वाले हजारों क्रिएटर्स से जुड़ें

Google ने 31 मार्च, 2026 को बिना ज्यादा चर्चा के Veo 3.1 Lite लॉन्च किया, और यह Veo 4 से भी अधिक महत्वपूर्ण हो सकता है। आउटपुट बेहतर होने की वजह से नहीं, बल्कि इसलिए कि यह AI वीडियो जनरेशन को इतना सस्ता बनाता है कि उसे बिना बोर्ड मीटिंग के प्रोडक्शन ऐप्स में शामिल किया जा सकता है।

Veo 3.1 Lite किस समस्या का समाधान करता है

सीधी बात: AI वीडियो जनरेशन में लागत की समस्या रही है। 6-सेकंड की क्लिप के लिए पूर्ण Veo 3.1 इनफेरेंस चलाने में रेज़ोल्यूशन और ऑडियो सेटिंग्स के आधार पर $0.10 से $0.50 तक खर्च हो सकता है। यह तब तक उचित लगता है जब तक आप इसे हर दिन हजारों API कॉल्स से गुणा नहीं करते। किसी स्टार्टअप के लिए जो अपने प्रोडक्ट में वीडियो बना रहा है, ये आंकड़े तेजी से बढ़ते हैं।

Veo 3.1 Lite मॉडल को आवश्यकताओं तक सीमित करता है। कम डिफ़ॉल्ट रेज़ोल्यूशन, नेटिव ऑडियो सिंथेसिस नहीं, और 720p के लिए $0.05 प्रति सेकंड की कीमत। परिणाम एक ऐसा मॉडल है जिसकी लागत Veo 3.1 Fast से 50% से अधिक कम है, जबकि अधिकांश प्रोडक्शन उपयोग मामलों के लिए पर्याप्त विज़ुअल क्वालिटी बनी रहती है।

50%+
Veo 3.1 Fast की तुलना में लागत में कमी
720p
डिफ़ॉल्ट रेज़ोल्यूशन
4-8s
क्लिप लंबाई सीमा
$0.05/s
720p की प्रति-सेकंड लागत

आपको क्या मिलता है (और क्या खोना पड़ता है)

यह एक समझौता है, मुफ्त अपग्रेड नहीं। इंटीग्रेशन से पहले अंतर समझना महत्वपूर्ण है।

Veo 3.1 Lite क्या अच्छी तरह करता है

Veo 3.1 Fast की तुलना में प्रति सेकंड 50% से अधिक सस्ता। टेक्स्ट-टू-वीडियो और इमेज-टू-वीडियो सपोर्ट। साधारण दृश्यों के लिए लगातार प्रॉम्प्ट अनुपालन। प्रति-सेकंड मूल्य निर्धारण सटीक लागत नियंत्रण देता है। परिचित SDKs के साथ मानक Gemini API के माध्यम से उपलब्ध।

जहां इसकी सीमाएं हैं

नेटिव ऑडियो जनरेशन नहीं है (इसे अलग पाइपलाइन से खुद जोड़ें)। 720p डिफ़ॉल्ट, 1080p अधिकतम (4K नहीं)। कम अधिकतम क्लिप लंबाई (पूर्ण Veo 3.1 के 16 सेकंड के मुकाबले 8 सेकंड)। जटिल मल्टी-सब्जेक्ट दृश्य सामंजस्य खो सकते हैं। पूर्ण मॉडल की तुलना में सूक्ष्म कैमरा नियंत्रण सीमित है।

अधिकांश डेवलपर उपयोग मामलों, सोशल मीडिया प्रीव्यू, प्रोडक्ट डेमो, मार्केटिंग ऑटोमेशन और ऑनबोर्डिंग वीडियो के लिए Lite मॉडल पर्याप्त से भी अधिक है। आपको पूर्ण Veo 3.1 की जरूरत केवल तब है जब आपको सिनेमाई गुणवत्ता, नेटिव ऑडियो, या लंबी अवधि चाहिए।

वीडियो जनरेशन के लिए Gemini API सेट अप करना

यदि आपके पास पहले से Gemini API कुंजी है, तो वीडियो जनरेशन जोड़ने में लगभग 10 लाइन का कोड लगता है। यहां एक न्यूनतम Python उदाहरण है:

import google.generativeai as genai
 
genai.configure(api_key="YOUR_API_KEY")
 
model = genai.GenerativeModel("veo-3.1-lite")
 
response = model.generate_video(
    prompt="A cycling route through the French countryside at golden hour, "
           "drone perspective following the road between lavender fields",
    duration=4,
    resolution="720p"
)
 
# वीडियो सहेजें
with open("output.mp4", "wb") as f:
    f.write(response.video_bytes)

API सीधे वीडियो डेटा लौटाता है। 4-सेकंड की क्लिप के लिए जनरेशन में लगभग 45-60 सेकंड और 8-सेकंड की क्लिप के लिए 90-120 सेकंड लगते हैं, इसलिए किसी भी प्रोडक्शन ऐप में आपको अनुरोधों को असिंक्रोनस तरीके से संभालना चाहिए।

💡
resolution="1080p" का उपयोग केवल तब करें जब इसकी आवश्यकता हो। 720p और 1080p के बीच लागत का अंतर लगभग 2x है, और सोशल मीडिया कंटेंट के लिए 720p अक्सर मोबाइल डिवाइस पर अलग दिखता ही नहीं है।

कीमत का विवरण

Google Veo 3.1 Lite की कीमत जनरेट किए गए वीडियो के प्रति सेकंड के आधार पर तय करता है। वर्तमान विवरण यहां है:

रेज़ोल्यूशनदर4-सेकंड की क्लिप8-सेकंड की क्लिप
720p$0.05/second$0.20$0.40
1080p$0.08/second$0.32$0.64

इसे पूर्ण Veo 3.1 मॉडल से तुलना करें, जिसकी कीमत प्रति सेकंड लगभग 2x अधिक है और जो नेटिव ऑडियो के साथ 4K आउटपुट सपोर्ट करता है।

720p/4s पर प्रतिदिन 10,000 क्लिप जनरेट करने वाले प्रोडक्ट के लिए, Lite मॉडल की लागत लगभग $2,000/day होगी। यह अब भी महत्वपूर्ण है, लेकिन पूर्ण मॉडल से 50% से अधिक सस्ता है, और प्रति-सेकंड मूल्य निर्धारण आपको सटीक लागत नियंत्रण देता है।

Lite बनाम Full का उपयोग कब करें

मैं पिछले सप्ताह से दोनों मॉडलों का परीक्षण कर रहा हूं, और यहां मेरी व्यावहारिक गाइड है:

इन मामलों में Veo 3.1 Lite का उपयोग करें:

  • सोशल मीडिया कंटेंट (TikTok, Reels, Shorts)
  • प्रोडक्ट शोकेस क्लिप्स
  • ईमेल मार्केटिंग थंबनेल/प्रीव्यू
  • तेज़ प्रोटोटाइपिंग और पुनरावृत्ति
  • उच्च-वॉल्यूम बैच जनरेशन
  • रियल-टाइम या लगभग रियल-टाइम एप्लिकेशन

इन मामलों में Veo 3.1 Full का उपयोग करें:

  • सिनेमाई/मार्केटिंग हीरो वीडियो
  • नेटिव ऑडियो की जरूरत वाला कंटेंट
  • बड़े डिस्प्ले के लिए 4K आउटपुट
  • जटिल मल्टी-कैरेक्टर दृश्य
  • लंबी क्लिप्स (10-16 सेकंड)
  • सटीक कैमरा मूवमेंट नियंत्रण

इमेज-टू-वीडियो: निर्णायक फीचर

टेक्स्ट-टू-वीडियो सुर्खियां बटोरता है, लेकिन प्रोडक्शन में Veo 3.1 Lite वास्तव में इमेज-टू-वीडियो में चमकता है। आप इसे प्रोडक्ट फोटो, UI स्क्रीनशॉट या डिज़ाइन मॉकअप देते हैं, और यह उसका छोटा एनिमेटेड संस्करण जनरेट करता है।

import google.generativeai as genai
from pathlib import Path
 
genai.configure(api_key="YOUR_API_KEY")
model = genai.GenerativeModel("veo-3.1-lite")
 
image_data = Path("product_photo.jpg").read_bytes()
 
response = model.generate_video(
    prompt="Smooth camera orbit around the product, studio lighting, "
           "white background with subtle shadows",
    image=image_data,
    duration=4,
    resolution="720p"
)

यह पैटर्न ई-कॉमर्स प्लेटफॉर्म, SaaS लैंडिंग पेज और ऐसे किसी भी एप्लिकेशन के लिए अच्छी तरह काम करता है जहां आपको वीडियो प्रोडक्शन पाइपलाइन के बिना स्थिर एसेट्स को डायनेमिक कंटेंट में बदलना हो।

💡
विशिष्ट प्रोडक्ट्स या विषयों के लिए इमेज-टू-वीडियो, टेक्स्ट-टू-वीडियो की तुलना में स्रोत इमेज की विज़ुअल पहचान को कहीं बेहतर बनाए रखता है। यदि आपके पास रेफरेंस इमेज है, तो विषय का टेक्स्ट प्रॉम्प्ट में वर्णन करने के बजाय हमेशा इमेज-टू-वीडियो चुनें।

एक सरल वीडियो जनरेशन पाइपलाइन बनाना

यहां एक अधिक यथार्थवादी उदाहरण है, जो बुनियादी एरर हैंडलिंग और असिंक्रोनस प्रोसेसिंग के साथ Veo 3.1 Lite को FastAPI बैकएंड में इंटीग्रेट करना दिखाता है:

from fastapi import FastAPI, BackgroundTasks
import google.generativeai as genai
import asyncio
import uuid
 
app = FastAPI()
genai.configure(api_key="YOUR_API_KEY")
model = genai.GenerativeModel("veo-3.1-lite")
 
# इन-मेमोरी स्टोर (प्रोडक्शन में Redis या डेटाबेस का उपयोग करें)
jobs = {}
 
async def generate_video_task(job_id: str, prompt: str):
    try:
        response = model.generate_video(
            prompt=prompt, duration=4, resolution="720p"
        )
        jobs[job_id] = {
            "status": "completed",
            "video_bytes": response.video_bytes
        }
    except Exception as e:
        jobs[job_id] = {"status": "failed", "error": str(e)}
 
@app.post("/generate")
async def create_video(prompt: str, background_tasks: BackgroundTasks):
    job_id = str(uuid.uuid4())
    jobs[job_id] = {"status": "processing"}
    background_tasks.add_task(generate_video_task, job_id, prompt)
    return {"job_id": job_id}
 
@app.get("/status/{job_id}")
async def get_status(job_id: str):
    return jobs.get(job_id, {"status": "not_found"})

यह आपको एक नॉन-ब्लॉकिंग API देता है, जिसमें क्लाइंट जनरेशन अनुरोध सबमिट करते हैं और परिणामों के लिए पोल करते हैं। प्रोडक्शन के लिए इन-मेमोरी डिक्शनरी को Redis से बदलें, रेट लिमिटिंग जोड़ें, और पूर्ण वीडियो को क्लाउड स्टोरेज में रखें।

व्यापक परिप्रेक्ष्य: यह क्यों महत्वपूर्ण है

Veo 3.1 Lite केवल एक सस्ता मॉडल नहीं है। यह दर्शाता है कि Google AI वीडियो वितरण के बारे में कैसे सोचता है।

अब तक, सर्वोत्तम AI वीडियो मॉडलों को प्रीमियम क्रिएटिव टूल्स के रूप में पेश किया गया था। Sora के लिए ChatGPT Pro सब्सक्रिप्शन जरूरी था, और अब OpenAI ने इसे पूरी तरह बंद कर दिया है। Runway प्रति जनरेशन शुल्क लेता है। Veo 3.1 Full भी सोच-समझकर किए जाने वाले, उच्च-मूल्य उपयोग मामलों के लिए मूल्यित है।

Lite अर्थशास्त्र बदल देता है। $0.20 प्रति 4-सेकंड क्लिप (720p) पर, वीडियो जनरेशन कंटेंट ऑटोमेशन पाइपलाइन, मार्केटिंग प्लेटफॉर्म और शैक्षिक ऐप्स में एम्बेड करने लायक किफायती हो जाती है। हालांकि यह अभी भी स्टॉक फुटेज सब्सक्रिप्शन को पूरी तरह बदलने जितना सस्ता नहीं है, पूर्ण मॉडल की तुलना में 50%+ की बचत इसे उन उच्च-वॉल्यूम उपयोग मामलों के लिए व्यवहार्य बनाती है जो पहले बहुत महंगे थे। यह पूरे उद्योग में उस मूल्य निर्धारण क्रांति की निरंतरता है जिसे हम ट्रैक कर रहे हैं।

🔗

API-First वितरण

Google का दांव है कि AI वीडियो की विजयी रणनीति सर्वोत्तम स्टैंडअलोन ऐप नहीं है। यह सर्वोत्तम API है। Lite को उसी Gemini API के माध्यम से उपलब्ध कराकर, जिसे डेवलपर्स पहले से टेक्स्ट और इमेज जनरेशन के लिए उपयोग करते हैं, वे इंटीग्रेशन बाधा को लगभग शून्य तक घटा रहे हैं।

गति नए वर्कफ़्लो सक्षम करती है

45-120 सेकंड का जनरेशन समय बड़े पैमाने पर बैच प्रोसेसिंग का रास्ता खोलता है। मार्केटिंग प्लेटफॉर्म वीडियो वेरिएंट्स का A/B परीक्षण स्वचालित रूप से कर सकते हैं, और कंटेंट पाइपलाइन मैन्युअल हस्तक्षेप के बिना रात भर में दर्जनों क्लिप जनरेट कर सकती हैं।
💰

अर्थशास्त्र अपनाने को बढ़ावा देता है

उच्च-वॉल्यूम उपयोग मामलों के लिए 50%+ लागत में कमी महत्वपूर्ण है। 720p वीडियो के $0.05 प्रति सेकंड पर, स्वचालित कंटेंट पाइपलाइन के लिए अर्थशास्त्र समझ में आने लगता है, जहां पहले केवल स्थिर इमेज व्यावहारिक थीं।

आगे क्या आने वाला है

Sora के बंद होने के कुछ ही दिनों बाद Google ने Veo 4 का संकेत दिया, लेकिन समयसीमा स्पष्ट नहीं है। इस बीच, Veo 3.1 Lite बाजार में एक महत्वपूर्ण कमी को भरता है। कम लागत, कम लेटेंसी और आसान API इंटीग्रेशन का संयोजन इसे 2026 में वीडियो-केंद्रित प्रोडक्ट्स बनाने वाले डेवलपर्स के लिए सबसे व्यावहारिक विकल्प बनाता है।

यदि आप अपने अगले प्रोजेक्ट के लिए AI वीडियो APIs का मूल्यांकन कर रहे हैं, तो Veo 3.1 Lite आपकी शॉर्टलिस्ट में होना चाहिए, खासकर यदि आपका उपयोग मामला सिनेमाई गुणवत्ता से अधिक वॉल्यूम और गति को प्राथमिकता देता है। प्रमुख मॉडलों की व्यापक तुलना के लिए, हमारी Sora 2 vs Runway vs Veo 3 तुलना देखें।

Bonega में, हम Veo 3.1 को अपने प्राथमिक जनरेशन इंजन के रूप में उपयोग करते हैं। Lite मॉडल बैच प्रोसेसिंग और तेज़ प्रोटोटाइपिंग के लिए एक स्वागतयोग्य जोड़ है। Veo 3.1 क्या कर सकता है, यह देखने के लिए हमारा studio आज़माएं, किसी API कुंजी की जरूरत नहीं।

स्रोत

Damien
DamienAI DeveloperAI Author

लियोन के AI डेवलपर, जिन्हें जटिल ML अवधारणाओं को आसान तरीकों में बदलना पसंद है। मॉडलों की डीबगिंग न करते समय, आप उन्हें रोन घाटी में साइकिल चलाते पाएँगे।

View profile →

जो पढ़ा, वह पसंद आया?

कुछ ही मिनटों में अपने विचारों को असीमित अवधि के AI वीडियो में बदलें।

संबंधित लेख

इन संबंधित पोस्ट के साथ आगे जानें

Alibaba HappyHorse-1.0: वह रहस्यमय मॉडल जिसने हर AI वीडियो लीडरबोर्ड में शीर्ष स्थान हासिल किया
AI वीडियोHappyHorse

Alibaba HappyHorse-1.0: वह रहस्यमय मॉडल जिसने हर AI वीडियो लीडरबोर्ड में शीर्ष स्थान हासिल किया

HappyHorse-1.0 नाम का एक मॉडल बिना किसी पहचान के Artificial Analysis पर दिखाई दिया, टेक्स्ट-टू-वीडियो और इमेज-टू-वीडियो दोनों में #1 तक पहुंचा, फिर पता चला कि यह Alibaba का है। यहां हम इसकी आर्किटेक्चर, टीम और AI वीडियो बाजार के लिए इसके मायने के बारे में जानते हैं।

Read
चीन का AI वीडियो प्रभुत्व, क्लिंग और कुइशू सिलिकॉन वैली को पीछे छोड़ रहे हैं
AI वीडियोक्लिंग AI

चीन का AI वीडियो प्रभुत्व, क्लिंग और कुइशू सिलिकॉन वैली को पीछे छोड़ रहे हैं

शीर्ष 8 में से 7 AI वीडियो मॉडल अब चीनी कंपनियों से आ रहे हैं। देखते हैं कि कुइशू का क्लिंग AI 60 मिलियन उपयोगकर्ताओं तक कैसे पहुँचा और इसका उद्योग के लिए क्या मतलब है।

Read
ओपन-सोर्स AI वीडियो क्रांति: क्या Consumer GPU टेक दिग्गजों के साथ प्रतिस्पर्धा कर सकते हैं?
AI वीडियोओपन सोर्स

ओपन-सोर्स AI वीडियो क्रांति: क्या Consumer GPU टेक दिग्गजों के साथ प्रतिस्पर्धा कर सकते हैं?

ByteDance और Tencent ने अभी ओपन-सोर्स वीडियो मॉडल रिलीज किए हैं जो consumer hardware पर चलते हैं। यह independent creators के लिए सब कुछ बदल देता है।

Read

क्या आपको यह लेख पसंद आया?

और जानकारियाँ पाएँ और हमारी नवीनतम सामग्री से अपडेट रहें।