Alibaba HappyHorse-1.0: den mystiske model, der toppede alle AI-video-ranglister
En model kaldet HappyHorse-1.0 dukkede op hos Artificial Analysis uden nogen angivelse af ophav, klatrede til nummer 1 i både text-to-video og image-to-video, og viste sig at tilhøre Alibaba. Her er, hvad vi ved om arkitekturen, teamet, og hvad det betyder for AI-videomarkedet.

Afsløringen
Artificial Analysis driver en Video Arena, hvor brugere indsender en prompt, to anonyme modeller genererer output, og brugerne vælger den, de foretrækker. Stemmer indgår i et Elo-ratingsystem (den samme matematik som bruges i skakranglisterne). Modeller kan ikke snyde systemet, fordi evaluatorerne aldrig ved, hvilken model der producerede hvilket output.
HappyHorse-1.0 gik ind i denne arena den 7. april med en tom profil. Intet logo, ingen virksomhedsangivelse. Den 10. april sad den på førstepladsen i to af de fire ranglistekategorier, og Alibaba bekræftede ejerskabet via en nyoprettet X-konto og en udtalelse til CNBC.
Tallene
HappyHorses Elo-scorer taler for sig selv:
For at sætte det i perspektiv: den tidligere nummer 1 i text-to-video var ByteDances Seedance 2.0 med Elo 1273. HappyHorse slog den med 60 point, en afstand der normalt tager måneder at lukke. I image-to-video scorede HappyHorse 1392 mod Seedance 2.0s 1355.
Kategorierne med lyd fortæller en anden historie. HappyHorse ligger som nummer 2 bag Seedance 2.0 (Elo 1219 mod 1205), hvilket tyder på, at lydpipelinen stadig kræver arbejde i forhold til videokvaliteten.
| Kategori | HappyHorse | Tidligere #1 | Forskel |
|---|---|---|---|
| Text-to-Video (stille) | 1333 | 1273 (Seedance 2.0) | +60 |
| Image-to-Video (stille) | 1392 | 1355 (Seedance 2.0) | +37 |
| Text-to-Video (lyd) | 1205 | 1219 (Seedance 2.0) | -14 |
Arkitektur: én Transformer, alt på én gang
De fleste AI-videosystemer kæder separate komponenter sammen: en tekstencoder, en videogenerator og en lydmodel, der boltes på bagefter. HappyHorse tager en anden tilgang.
Modellen bruger en 40-lags single-stream Self-Attention Transformer uden Cross-Attention-moduler. Tekst-, video- og lydtokens flyder alle gennem den samme Transformer-stak samtidigt. Dette ensartede design eliminerer overflødige parametre og reducerer inferenskompleksiteten.
Inferenspipelinen er usædvanligt slank: kun 8 denoising-trin uden Classifier-Free Guidance (CFG). Til sammenligning bruger mange konkurrerende modeller 25-50 trin med CFG aktiveret. Det tyder på aggressiv distillation under træning, hvor rå kapacitet byttes for hastighed.
Teamet bag
HappyHorse kommer fra Future Life Lab under Alibabas Taotian Group (e-handelsgrenen). Lederen er Zhang Di, tidligere VP hos Kuaishou og teknisk leder af Kling AI.
Den detalje er vigtig. Zhang Di opbyggede ingeniørkulturen bag Kling, en af de stærkeste AI-videomodeller i 2025. Han kender infrastrukturudfordringerne, træningspipelinerne og evalueringshullerne. At bringe den erfaring til Alibabas computeressourcer er en helt anden situation end at drive en selvstændig startup.
Hvorfor det er vigtigt for markedet
AI-videomarkedet i april 2026 er usædvanligt ustabilt:
Sora-nedlukning annonceret
OpenAI bekræftede, at Sora lukker den 26. april. Computeomkostninger og konkurrencepres viste sig uholdbare.
Seedance 2.0 sat på pause
ByteDance tvunget til at stoppe udrulningen efter ophavsretstvister med Hollywood-studier.
HappyHorse dukker op
En anonym model træder ind i Artificial Analysis Video Arena.
Alibaba bekræfter ejerskab
Aktien stiger, da identiteten afsløres.
Med Sora på vej ned og Seedance med juridiske problemer ankommer HappyHorse på et tidspunkt, hvor markedet leder efter en ny frontløber. Runway Gen-4.5 står stadig stærkt i produktionsworkflows, og Google Veo 3.1 dominerer inden for enterprise-integration. Men hvad angår ren generationskvalitet, målt ved blind menneskelig præference, sidder HappyHorse nu øverst.
Open source: kommer snart (måske)
GitHub-repositoriet og Hugging Face model hub viser begge "Coming Soon" pr. 11. april. Teamet har lovet open source-frigivelse af de fulde 15 milliarder parametre med kommerciel licens. Hvis det sker, ville HappyHorse være den største open source-videomodel tilgængelig, markant større end LTX-Videos 2 milliarder parametre.
Men "kommer snart" er ikke "frigivet". Indtil vægtene kan downloades og verificeres uafhængigt, har benchmarkresultaterne en stjerne. AI-videomiljøet har lært at vente på reproducerbare resultater, før der udråbes vindere.
Hvad man skal holde øje med
Tre ting afgør, om HappyHorse bevarer sit forspring:
- ✓Open source-frigivelse af vægte og uafhængig reproduktion af benchmarkresultater
- ✓Forbedringer i lydkvalitet, så Seedance 2.0 matches eller slås i lydkategorierne
- ✓API-tilgængelighed og prissætning, da benchmarkdominans er ligegyldig, hvis skabere ikke kan tilgå modellen
AI-videogenerering bevæger sig hurtigt. I januar virkede Runway Gen-4.5 urørlig. I februar tog Seedance 2.0 kronen. Nu holder HappyHorse den. Spørgsmålet er ikke, om noget til sidst slår den, men hvornår og hvorfra.
For skabere og udviklere, der bygger videopipelines i dag, er budskabet praktisk: ingen enkelt model holder sig på toppen længe. Den bedste strategi er at bygge workflows, der kan skifte modeller, når ranglisten ændrer sig, i stedet for at satse alt på ét navn.

AI-udvikler fra Lyon, der elsker at forvandle komplekse ML-koncepter til enkle opskrifter. Når han ikke fejlsøger modeller, finder du ham på cykeltur gennem Rhônedalen.
View profile →Kan du lide det, du har læst?
Forvandl dine idéer til AI-videoer med ubegrænset længde på få minutter.
Relaterede artikler
Udforsk videre med disse relaterede indlæg

Alibaba Wan 2.7: hvordan Thinking Mode forandrer AI-videogenerering
Alibaba har netop udgivet Wan 2.7 med en ny Thinking Mode, der planlægger kompositioner, før videoen genereres. Vi gennemgår, hvordan det fungerer, og hvad det betyder for skabere.

AI-video efter Sora: 4 markedsniveauer at kende i 2026
Sora lukker den 26. april. AI-videomarkedet har konsolideret sig i fire niveauer. En praktisk guide til at vælge det rigtige Sora-alternativ til dine behov.

Google Veo 3.1 bliver gratis: 10 AI-videoer om måneden for alle Google-konti
Google har åbnet Veo 3.1 for alle personlige konti med 10 gratis videogenereringer om måneden. Her er, hvad du får, hvad begrænsningerne er, og hvorfor det betyder noget for AI-videoskabere.