Meta PixelSalta al contingut principal
DamienDamien· Autoria d’IA, revisada per humans
9 min read
1618 paraules

Google Veo 3.1 Lite: La generació de vídeo amb IA de baix cost arriba a la Gemini API

Google acaba de llançar Veo 3.1 Lite, un model de generació de vídeo amb IA ràpid i assequible dins la Gemini API. Aquí teniu el que els desenvolupadors necessiten saber sobre preus, compromisos de qualitat i la integració de vídeo en aplicacions de producció.

Google Veo 3.1 Lite: La generació de vídeo amb IA de baix cost arriba a la Gemini API

Preparat per crear els teus propis vídeos amb IA?

Uneix-te a milers de creadors que utilitzen Bonega.ai

Google va llançar discretament Veo 3.1 Lite el 31 de març de 2026, i podria ser més important que Veo 4. No perquè el resultat sigui millor, sinó perquè fa que la generació de vídeo amb IA sigui prou econòmica per posar-la en aplicacions de producció sense necessitat d'una reunió de junta.

El problema que Veo 3.1 Lite resol

Seré directe: la generació de vídeo amb IA ha tingut un problema de costos. Executar una inferència completa de Veo 3.1 per a un clip de 6 segons pot costar entre $0,10 i $0,50 segons la resolució i la configuració d'àudio. Això sona raonable fins que ho multipliques per milers de crides API al dia. Per a una startup que integra vídeo al seu producte, aquestes xifres s'acumulen ràpidament.

Veo 3.1 Lite redueix el model al que és essencial. Resolució per defecte més baixa, sense síntesi d'àudio nativa, i un preu de $0,05 per segon per a 720p. El resultat és un model que costa més d'un 50% menys que Veo 3.1 Fast mantenint prou qualitat visual per a la majoria dels casos d'ús en producció.

50%+
Reducció de costos vs Veo 3.1 Fast
720p
Resolució per defecte
4-8s
Rang de durada del clip
$0.05/s
Cost per segon a 720p

Què obteniu (i què perdeu)

Això és un compromís, no una actualització gratuïta. Entendre les diferències és important abans d'integrar.

Què fa bé Veo 3.1 Lite

Més d'un 50% més barat per segon que Veo 3.1 Fast. Suport per a text-a-vídeo i imatge-a-vídeo. Adherència consistent als prompts per a escenes simples. El preu per segon dona un control precís dels costos. Disponible a través de la Gemini API estàndard amb SDK coneguts.

On es queda curt

Sense generació d'àudio nativa (cal afegir-lo pel vostre compte amb un pipeline separat). 720p per defecte, 1080p màxim (sense 4K). Durada màxima de clip més curta (8 segons vs 16 per al Veo 3.1 complet). Les escenes complexes amb múltiples subjectes poden perdre coherència. El control fi de la càmera és limitat comparat amb el model complet.

Per a la majoria dels casos d'ús dels desenvolupadors, previsualitzacions per a xarxes socials, demos de producte, automatització de màrqueting, vídeos d'incorporació, el model Lite és més que suficient. Només necessiteu el Veo 3.1 complet quan necessiteu qualitat cinematogràfica, àudio natiu o una durada més llarga.

Configuració de la Gemini API per a generació de vídeo

Si ja teniu una clau de la Gemini API, afegir generació de vídeo requereix unes 10 línies de codi. Aquí teniu un exemple mínim en Python:

import google.generativeai as genai
 
genai.configure(api_key="YOUR_API_KEY")
 
model = genai.GenerativeModel("veo-3.1-lite")
 
response = model.generate_video(
    prompt="A cycling route through the French countryside at golden hour, "
           "drone perspective following the road between lavender fields",
    duration=4,
    resolution="720p"
)
 
# Save the video
with open("output.mp4", "wb") as f:
    f.write(response.video_bytes)

L'API retorna les dades del vídeo directament. La generació triga aproximadament 45-60 segons per a un clip de 4 segons i 90-120 segons per a un clip de 8 segons, així que voldreu gestionar les peticions de manera asíncrona en qualsevol aplicació de producció.

💡
Utilitzeu resolution="1080p" només quan ho necessiteu. La diferència de cost entre 720p i 1080p és aproximadament el doble, i per a contingut de xarxes socials, 720p sovint és indistingible als dispositius mòbils.

Desglossament de preus

Google cobra Veo 3.1 Lite per segon de vídeo generat. Aquí teniu el desglossament actual:

ResolucióTarifaClip de 4 segonsClip de 8 segons
720p$0,05/segon$0,20$0,40
1080p$0,08/segon$0,32$0,64

Compareu-ho amb el model Veo 3.1 complet, que costa aproximadament 2x més per segon i suporta sortida 4K amb àudio natiu.

Per a un producte que genera 10.000 clips al dia a 720p/4s, el model Lite costa aproximadament $2.000/dia. Això encara és significatiu, però és més d'un 50% més barat que el model complet, i el preu per segon us dona un control precís dels costos.

Quan utilitzar Lite vs Full

He estat provant ambdós models durant l'última setmana, i aquí teniu la meva guia pràctica:

Utilitzeu Veo 3.1 Lite per a:

  • Contingut per a xarxes socials (TikTok, Reels, Shorts)
  • Clips de presentació de productes
  • Miniatures/previsualitzacions per a màrqueting per correu electrònic
  • Prototipatge ràpid i iteració
  • Generació per lots d'alt volum
  • Aplicacions en temps real o gairebé en temps real

Utilitzeu Veo 3.1 Full per a:

  • Vídeos cinematogràfics/de màrqueting principals
  • Contingut que requereix àudio natiu
  • Sortida 4K per a pantalles grans
  • Escenes complexes amb múltiples personatges
  • Clips més llargs (10-16 segons)
  • Control precís del moviment de la càmera

Imatge-a-vídeo: La funció estrella

El text-a-vídeo acapara els titulars, però imatge-a-vídeo és on Veo 3.1 Lite realment brilla en producció. Li doneu una foto de producte, una captura de pantalla d'interfície o un mockup de disseny, i genera una versió animada curta.

import google.generativeai as genai
from pathlib import Path
 
genai.configure(api_key="YOUR_API_KEY")
model = genai.GenerativeModel("veo-3.1-lite")
 
image_data = Path("product_photo.jpg").read_bytes()
 
response = model.generate_video(
    prompt="Smooth camera orbit around the product, studio lighting, "
           "white background with subtle shadows",
    image=image_data,
    duration=4,
    resolution="720p"
)

Aquest patró funciona bé per a plataformes de comerç electrònic, pàgines d'aterratge SaaS i qualsevol aplicació on necessiteu convertir recursos estàtics en contingut dinàmic sense un pipeline de producció de vídeo.

💡
Imatge-a-vídeo preserva la identitat visual de la imatge font molt millor que text-a-vídeo per a productes o subjectes específics. Si teniu una imatge de referència, preferiu sempre imatge-a-vídeo en lloc de descriure el subjecte en un prompt de text.

Construcció d'un pipeline simple de generació de vídeo

Aquí teniu un exemple més realista que mostra com integrar Veo 3.1 Lite en un backend FastAPI amb gestió bàsica d'errors i processament asíncron:

from fastapi import FastAPI, BackgroundTasks
import google.generativeai as genai
import asyncio
import uuid
 
app = FastAPI()
genai.configure(api_key="YOUR_API_KEY")
model = genai.GenerativeModel("veo-3.1-lite")
 
# In-memory store (use Redis or a database in production)
jobs = {}
 
async def generate_video_task(job_id: str, prompt: str):
    try:
        response = model.generate_video(
            prompt=prompt, duration=4, resolution="720p"
        )
        jobs[job_id] = {
            "status": "completed",
            "video_bytes": response.video_bytes
        }
    except Exception as e:
        jobs[job_id] = {"status": "failed", "error": str(e)}
 
@app.post("/generate")
async def create_video(prompt: str, background_tasks: BackgroundTasks):
    job_id = str(uuid.uuid4())
    jobs[job_id] = {"status": "processing"}
    background_tasks.add_task(generate_video_task, job_id, prompt)
    return {"job_id": job_id}
 
@app.get("/status/{job_id}")
async def get_status(job_id: str):
    return jobs.get(job_id, {"status": "not_found"})

Això us dona una API no bloquejant on els clients envien peticions de generació i consulten els resultats. Per a producció, substituïu el diccionari en memòria per Redis, afegiu limitació de velocitat i emmagatzemeu els vídeos completats a l'emmagatzematge al núvol.

La visió global: Per què això importa

Veo 3.1 Lite no és només un model més barat. Representa un canvi en com Google pensa sobre la distribució de vídeo amb IA.

Fins ara, els millors models de vídeo amb IA estaven posicionats com a eines creatives premium. Sora requeria una subscripció ChatGPT Pro, i ara OpenAI l'ha tancat completament. Runway cobra per generació. Fins i tot Veo 3.1 Full està pensat per a usos deliberats i d'alt valor.

Lite canvia l'economia. A $0,20 per clip de 4 segons (720p), la generació de vídeo es torna prou assequible per integrar-la en pipelines d'automatització de contingut, plataformes de màrqueting i aplicacions educatives. Tot i que encara no és prou barat per substituir completament les subscripcions de metratge d'arxiu, l'estalvi de més del 50% el fa viable per a casos d'ús d'alt volum que abans eren massa cars. Aquesta és una continuació de la revolució de preus que hem estat seguint a tota la indústria.

🔗

Distribució API-first

Google aposta que l'estratègia guanyadora per al vídeo amb IA no és la millor aplicació independent. És la millor API. Fent que Lite estigui disponible a través de la mateixa Gemini API que els desenvolupadors ja utilitzen per a generació de text i imatges, redueixen la barrera d'integració a gairebé zero.

La velocitat habilita nous fluxos de treball

Temps de generació de 45-120 segons obren la porta al processament per lots a gran escala. Les plataformes de màrqueting poden fer proves A/B de variants de vídeo automàticament, i els pipelines de contingut poden generar desenes de clips durant la nit sense intervenció manual.
💰

L'economia impulsa l'adopció

La reducció de costos de més del 50% és significativa per a casos d'ús d'alt volum. A $0,05 per segon de vídeo 720p, l'economia comença a tenir sentit per a pipelines de contingut automatitzats on anteriorment només les imatges estàtiques eren pràctiques.

Què ve a continuació

Google va insinuar Veo 4 pocs dies després del tancament de Sora, però el calendari no és clar. Mentrestant, Veo 3.1 Lite omple un buit important al mercat. La combinació de baix cost, baixa latència i fàcil integració API el converteix en l'opció més pràctica per als desenvolupadors que construeixen productes centrats en vídeo el 2026.

Si esteu avaluant APIs de vídeo amb IA per al vostre proper projecte, Veo 3.1 Lite hauria d'estar a la vostra llista, especialment si el vostre cas d'ús prioritza el volum i la velocitat per sobre de la qualitat cinematogràfica. Per a una visió més àmplia de com es comparen els principals models, consulteu la nostra comparació Sora 2 vs Runway vs Veo 3.

A Bonega, utilitzem Veo 3.1 com el nostre motor de generació principal. El model Lite és una addició benvinguda per al processament per lots i el prototipatge ràpid. Proveu el nostre estudi per veure què pot fer Veo 3.1, sense necessitat de clau API.
Damien
DamienAI DeveloperAI Author

Desenvolupador d’IA de Lió que gaudeix transformant conceptes complexos d’ML en receptes senzilles. Quan no depura models, el trobaràs recorrent amb bicicleta la vall del Roine.

View profile →

T’ha agradat el que has llegit?

Converteix les teves idees en vídeos amb IA de durada il·limitada en qüestió de minuts.

Articles relacionats

Continua explorant amb aquestes publicacions relacionades

T’ha agradat aquest article?

Descobreix més idees i mantén-te al dia amb el nostre contingut més recent.