Helios: 14B-modellen der køres AI-video i realtid på forbrugerhardware
Helios fra Peking University, ByteDance og Canva genererer minuttelange AI-videoer ved 19,5 FPS med blot 6GB VRAM, og det er fuldt open source.

Hvorfor Helios betyder noget
De fleste AI-videomodeller tvinger dig til at vælge: kvalitet eller hastighed. Store modeller som Veo 3.1 eller Runway Gen-4.5 producerer fantastiske resultater, men de kører på cloudklynger og opkræver pr. sekund. Mindre modeller passer på forbrugergrafikkort, men producerer mærkbart dårligere output. Helios afviser dette valg.
Nøgleindsigten: Helios er en autoregressiv diffusionsmodel der genererer video billed-for-billed på en streamingmåde, i stedet for at fjerne støj fra hele videoen på én gang. Dette betyder, at den kan begynde at udskrive billeder øjeblikkeligt, mens den stadig genererer resten. Ingen ventetid på fuld klip-rendering.
Hvordan det virker
Traditionelle diffusionsmodeller behandler en hele video samtidigt. Du indsender en prompt, venter minutter og får en komplet klip. Helios tager en fundamentalt anderledes tilgang.
| Traditionel diffusion | Helios (Autoregressiv diffusion) |
|---|---|
| Behandl alle billeder på samme tid | Generér billed-for-billed |
| Høje hukommelseskrav | Konstant hukommelsesudnyttelse |
| Output kun når fuldt færdig | Stream output i realtid |
| Kvalitet forringes med længde | Konsistent kvalitet ved enhver længde |
Modellen bruger en bi-directionel tidsmæssig opmærksomhedsmekanisme som lader hvert nyt billede referere til både tidligere og fremtidigt sammenhæng inden for et glidende vindue. Dette forhindrer den kvalitetsdrift, som typisk plager autoregressiv videomodeller, hvor senere billeder gradvist mister kohærence med tidligere.
Forbrugerhardware-vinklen
Her bliver tingene praktiske. Med gruppe offloading kan Helios køre på hardware med omkring 6GB VRAM. Det placerer det direkte i RTX 4060 Ti område, et grafikkort som koster omkring $400.
Sammenlign det med cloudbaseret generering:
| Metode | Omkostning pr. minut video | Påkrævet hardware |
|---|---|---|
| Cloud API (Sora, Veo) | $2-8 pr. generering | Ingen (cloud) |
| Helios (lokalt, H100) | ~$0,15 i elektricitet | H100 ($25.000+) |
| Helios (lokalt, RTX 4060 Ti) | ~$0,01 i elektricitet | RTX 4060 Ti (~$400) |
Kompromissen med forbrugergrafikkort er hastighed. På en RTX 4060 Ti rammer du ikke 19,5 FPS. Forvente snarere 2-3 FPS, hvilket stadig betyder en 60 sekunders video på godt under 10 minutter. For lokalt, privat, ubegrænset generering er det overbevisende.
Benchmarks der understøtter påstandene
Helios påstår ikke kun real-tid præstation. Det scorer konkurrencedygtigt på standard videoqualitets benchmarks.
Forskergruppen, et samarbejde mellem Peking University, ByteDance og Canva, testede specifikt mod:
- CogVideoX (13B parametre): Helios matcher kvalitet ved 5-10x hurtigere generering
- Pyramid Flow (autoregressiv baseline): Helios producerer mere tidsmæssigt konsistent output
- Open-Sora v1.2: Helios genererer længere, mere kohærente klip
Den kritiske sammenligning er med modeller i 1-2B parameter området, som LTX-2 og mindre CogVideo varianter. Helios køres ved lignende hastigheder mens den producerer output der ligner det kommer fra en meget større model.
Hvad du rent faktisk kan gøre med det
Helios er ikke en forskningsmæssig kuriositet. Det er et praktisk værktøj du kan installere og køre i dag.
- ✓Tekst til video generering op til 60 sekunder
- ✓Billede til video animation fra en referenceramme
- ✓Real-time streaming output (start med at se mens du genererer)
- ✓Apache 2.0 licens (kommerciel brug tilladt)
- ✓Gruppe offloading til forbrugergrafikkorts-support
Apache 2.0-licensen er signifikant. I modsætning til mange åbne vægt modeller der begrænser kommerciel brug, tillader Helios det eksplicit. Dette åbner døren til indie-udviklere, små studier og startups til at bygge produkter ovenpå modellen uden licensgebyrer.
Det større billede
Helios ændrer hvordan vi behandler AI-video tilgængelighed. Den forrige generation af "åbne" videomodeller krævede enten enterprise hardware eller producerede resultater der så mærkbart værre ud end deres cloud-modparter.
For professionelle som genererer hundredvis af iterationer pr. projekt skifter økonomien betydeligt. Et $400 grafikkort betaler sig selv efter omkring 200-300 cloudgenereringer. For teams der eksperimenterer med AI-video i produkter, fjerner den ubegrænsede natur af lokal generering tøven for at eksperimentere.
Vi dækkede det voksende lokale genereringes økosystem i vores guide til at køre AI-video lokalt, og Helios passer direkte ind i denne workflow. Det bygger også på real-time generering gennembruddet vi skrev om med TurboDiffusion, og tager konceptet videre med en meget større model.
Hvad kommer efter
Helios teamet har allerede hentet på opfølgende arbejde på audio-visuelt generering og interaktiv kontrolmuligheder. Hvis de samme effektivitetsgevinster gælder, kunne vi se real-tid, kontrollerbar, audio-inklusive video generering på forbrugerhardware inden slutningen af 2026.
For nu er Helios tilgængelig på GitHub under Apache 2.0. Hvis du har et NVIDIA grafikkort med 6GB+ VRAM og ønsker at eksperimentere med genuint konkurrencedygtig lokal AI-videogenerering, er dette det stærkeste startpunkt tilgængeligt.
Relateret læsning: Se hvordan open-source modeller lukker hullet med proprietære platforme](/blog/open-source-ai-video-closing-gap-2026), eller udforsk LTX-2s tilgang til native 4K generering på forbrugergrafikkort.

AI-udvikler fra Lyon, der elsker at forvandle komplekse ML-koncepter til enkle opskrifter. Når han ikke fejlsøger modeller, finder du ham på cykeltur gennem Rhônedalen.
View profile →Kan du lide det, du har læst?
Forvandl dine idéer til AI-videoer med ubegrænset længde på få minutter.
Relaterede artikler
Udforsk videre med disse relaterede indlæg

ByteDance Vidi2: AI der forstår video som en professionel redigerer
ByteDance har netop open-sourcet Vidi2, en model med 12 milliarder parametre, der forstår videoindhold godt nok til automatisk at redigere timevis af optagelser til polerede klip. Den driver allerede TikTok Smart Split.

SkyReels V4: Den Første AI-Model Der Ser og Hører Samtidig
Skywork AI's SkyReels V4 introducerer en dual-stream diffusionsarkitektur, der samgenererer video og synkroniseret lyd i en enkelt passage. Hvad det betyder for skabere.

Seedance 2.0 lander i CapCut, og Hollywood er ikke tilfreds
ByteDance har netop lanceret sin kontroversielle AI-videomodel i CapCut, få dage efter Soras lukning. Her er hvorfor det betyder noget, og hvorfor Hollywood kæmper imod.