Meta PixelHopp til hovedinnhold
DamienDamien· KI-forfatter, gjennomgått av mennesker
5 min read
908 ord

Helios: 14B-modellen som kjører AI-video i sanntid på forbrukerutstyr

Helios fra Peking University, ByteDance og Canva genererer minuttelange AI-videoer ved 19,5 FPS med bare 6GB VRAM, og det er helt åpen kildekode.

Helios: 14B-modellen som kjører AI-video i sanntid på forbrukerutstyr

Klar til å lage dine egne KI-videoer?

Bli med tusenvis av skapere som bruker Bonega.ai

Den største barrieren for AI-videogenerering i sanntid har alltid vært datakraft. Helios, en ny 14 milliard-parameter modell fra Peking University, ByteDance og Canva, har nettopp knust denne barrieren. Den kjører med 19,5 bilder per sekund på en enkelt H100, genererer videoer opp til 60 sekunder lange, og krever bare omkring 6GB VRAM med gruppe offloading. Og det er Apache 2.0 lisensiert.

Hvorfor Helios er viktig

De fleste AI-videomodeller tvinger deg til å velge: kvalitet eller hastighet. Store modeller som Veo 3.1 eller Runway Gen-4.5 produserer fantastiske resultater, men kjører på skylynger og belaster per sekund. Mindre modeller passer på forbrukergrafikk, men produserer merkbart svakere resultat. Helios avviser dette valget.

14B
Parametrar
19,5
FPS på enkelt H100
~6GB
VRAM med offloading
60s
Maksimal videolengde

Nøkkelinnsikten: Helios er en autoregressiv diffusjonsmodell som genererer video bilde-for-bilde på en strømmingsmetode, i stedet for å fjerne støy fra hele videoen på en gang. Dette betyr at den kan begynne å produsere bilder umiddelbar mens den fortsatt genererer resten. Ingen venting på fullstendig klipp-gjengivelse.

Hvordan det virker

Tradisjonelle diffusjonsmodeller behandler en hel video samtidig. Du sender inn en prompt, venter minutter, og får et komplett klipp. Helios tar en fundamentalt annen tilnærming.

Tradisjonell diffusjonHelios (Autoregressiv diffusjon)
Behandle alle bilder på samme tidGenerer bilde-for-bilde
Høye minnekravKonstant minnebruk
Output bare når fullstendig ferdigStrøm output i sanntid
Kvaliteten forverres med lengdeKonsistent kvalitet ved hvilken som helst lengde

Modellen bruker en toveis temporal oppmerksomhetsmekanisme som lar hvert nytt bilde referere til både tidligere og fremtidig sammenheng innen et glidende vindu. Dette forhindrer kvalitetsdriften som typisk plager autoregressiv videomodeller, hvor senere bilder gradvis mister sammenheng med tidligere.

💡
Helios oppnår minuttelang video (opp til 1 452 bilder) uten å være avhengig av KV-cache-triks eller anti-drift-hacks. Selve arkitekturen opprettholder konsistensen.

Forbrukersideutstyret vinkelen

Her blir det praktisk. Med gruppe offloading kan Helios kjøre på utstyr med omtrent 6GB VRAM. Det plasserer det direkte i RTX 4060 Ti-territorium, et grafikkort som koster omkring $400.

Sammenlign det med skybasert generering:

MetodeKostnad per minutt videoUtstyr som trengs
Sky API (Sora, Veo)$2-8 per genereringIngen (sky)
Helios (lokal, H100)~$0,15 i elektrisitetH100 ($25.000+)
Helios (lokal, RTX 4060 Ti)~$0,01 i elektrisitetRTX 4060 Ti (~$400)

Kompromisset med forbrukergrafikkort er hastigheten. På en RTX 4060 Ti når du ikke 19,5 FPS. Forvente snarere 2-3 FPS, som fortsatt betyr en 60-sekunders video på godt under 10 minutter. For lokal, privat, ubegrenset generering er det overbevisende.

Benchmarks som støtter kravene

Helios gjør ikke bare krav på sanntidsytelse. Det scorer konkurransedyktig på standard videoqualitets benchmarks.

💡
På VBench matcher eller overgår Helios modeller med lignende parameterantal på tvers av bevegelseskvalitet, tidsmessig konsistens og estetisk poengsum. Fulle benchmark resultater er tilgjengelige i avhandlingen (arXiv:2603.04379).

Forskergruppen, et samarbeid mellom Peking University, ByteDance og Canva, testet spesifikt mot:

  • CogVideoX (13B parametrar): Helios matcher kvalitet ved 5-10x raskere generering
  • Pyramid Flow (autoregressiv baseline): Helios produserer mer tidsmessig konsistent resultat
  • Open-Sora v1.2: Helios genererer lengre, mer sammenhengende klipp

Den kritiske sammenligningen er med modeller i 1-2B parameterserien, som LTX-2 og mindre CogVideo-varianter. Helios kjører ved lignende hastigheter mens den produserer resultat som virker å komme fra en langt større modell.

Hva du faktisk kan gjøre med det

Helios er ikke en forskningsnysgjerrighet. Det er et praktisk verktøy som du kan installere og kjøre i dag.

  • Tekst-til-video generering opp til 60 sekunder
  • Bilde-til-video animasjon fra en referanseramme
  • Sanntidsstrøm output (start å se mens du genererer)
  • Apache 2.0 lisens (kommersiell bruk tillatt)
  • Gruppe offloading for forbrukergrafikk-støtte

Apache 2.0-lisensen er betydningsfull. I motsetning til mange åpen-vekt modeller som begrenser kommersiell bruk, tillater Helios det eksplisitt. Dette åpner døren for uavhengige utviklere, små studioer og startups til å bygge produkter på toppen av modellen uten lisensgebyrer.

Det større bildet

Helios endrer hvordan vi nærmer oss AI-videotilgjengelighet. Forrige generasjon av "åpen" videomodeller krevde enten bedriftsutstyr eller produserte resultater som så merkbart dårligere ut enn deres sky-motparter.

Sky-generering
Ingen utstyrsinvestering nødvendig, høyeste kvalitetsresultat, stadig oppdaterte modeller
Lokal generering (Helios)
Null kostnad per generering, full personvern, ingen satsbegrensninger, kommersiell vennlig lisens, offline mulig

For fagfolk som genererer hundrevis av iterasjoner per prosjekt skifter økonomien betydelig. Et $400 grafikkort betaler seg etter omtrent 200-300 skygenerering. For lag som eksperimenterer med AI-video i produkter, fjerner den ubegrensede naturen av lokal generering nølingen for å eksperimentere.

Vi dekket det voksende lokale genereringsøkosystemet i vår guide til å kjøre AI-video lokalt, og Helios passer direkte inn i denne arbeidsflyten. Det bygger også på sanntidsgenerering gjennomlsnytt vi skrev om med TurboDiffusion, og tar konseptet videre med en langt større modell.

Hva kommer videre

Helios-teamet har allerede antydet oppfølgingsarbeid på audio-visuell generering og interaktiv kontrollevner. Hvis de samme effektivitetsgevinstene gjelder, kunne vi se sanntid, kontrollerbar, audio-inkludert videogenerering på forbrukerutstyr innen slutten av 2026.

For nå er Helios tilgjengelig på GitHub under Apache 2.0. Hvis du har et NVIDIA grafikkort med 6GB+ VRAM og ønsker å eksperimentere med genuint konkurransedyktig lokal AI-videogenerering, er dette det sterkeste startpunktet tilgjengelig.

💡

Relatert lesing: Se hvordan modeller med åpen kilde lukker gapet med proprietary plattformer](/blog/open-source-ai-video-closing-gap-2026), eller utforsk LTX-2s tilnærming til innfødt 4K-generering på forbrukergrafikk.

Damien
DamienAI DeveloperAI Author

KI-utvikler fra Lyon som elsker å gjøre komplekse ML-konsepter om til enkle oppskrifter. Når han ikke feilsøker modeller, finner du ham syklende gjennom Rhône-dalen.

View profile →

Likte du det du leste?

Gjør ideene dine om til KI-videoer med ubegrenset lengde på få minutter.

Relaterte artikler

Fortsett å utforske med disse relaterte innleggene

Likte du denne artikkelen?

Oppdag flere innsikter og hold deg oppdatert med vårt nyeste innhold.