Meta PixelSpring til hovedindhold
DamienDamien· AI-forfatter, menneskegennemgået
5 min read
936 ord

Alibaba HappyHorse-1.0: den mystiske model, der toppede alle AI-video-ranglister

En model kaldet HappyHorse-1.0 dukkede op hos Artificial Analysis uden nogen angivelse af ophav, klatrede til nummer 1 i både text-to-video og image-to-video, og viste sig at tilhøre Alibaba. Her er, hvad vi ved om arkitekturen, teamet, og hvad det betyder for AI-videomarkedet.

Alibaba HappyHorse-1.0: den mystiske model, der toppede alle AI-video-ranglister

Klar til at skabe dine egne AI-videoer?

Slut dig til tusindvis af skabere, der bruger Bonega.ai

Den 7. april 2026 dukkede en model op i Artificial Analysis Video Arena, som ingen havde hørt om. Inden for tre dage lå den nummer 1 i både text-to-video og image-to-video. Intet branding, ingen pressemeddelelse, intet firmanavn. Så bekræftede Alibaba, at det var deres. Dette er historien om HappyHorse-1.0, den dark horse der lige har rokeret ved AI-videoranglisterne.

Afsløringen

Artificial Analysis driver en Video Arena, hvor brugere indsender en prompt, to anonyme modeller genererer output, og brugerne vælger den, de foretrækker. Stemmer indgår i et Elo-ratingsystem (den samme matematik som bruges i skakranglisterne). Modeller kan ikke snyde systemet, fordi evaluatorerne aldrig ved, hvilken model der producerede hvilket output.

HappyHorse-1.0 gik ind i denne arena den 7. april med en tom profil. Intet logo, ingen virksomhedsangivelse. Den 10. april sad den på førstepladsen i to af de fire ranglistekategorier, og Alibaba bekræftede ejerskabet via en nyoprettet X-konto og en udtalelse til CNBC.

💡
Alibabas Hongkong-noterede aktier steg 2,12 % på dagen for offentliggørelsen og var allerede steget 6,75 % tidligere på ugen, mens spekulationerne omkring den mystiske model voksede.

Tallene

HappyHorses Elo-scorer taler for sig selv:

1333
T2V Elo (uden lyd)
1392
I2V Elo (uden lyd)
1205
T2V Elo (med lyd)

For at sætte det i perspektiv: den tidligere nummer 1 i text-to-video var ByteDances Seedance 2.0 med Elo 1273. HappyHorse slog den med 60 point, en afstand der normalt tager måneder at lukke. I image-to-video scorede HappyHorse 1392 mod Seedance 2.0s 1355.

Kategorierne med lyd fortæller en anden historie. HappyHorse ligger som nummer 2 bag Seedance 2.0 (Elo 1219 mod 1205), hvilket tyder på, at lydpipelinen stadig kræver arbejde i forhold til videokvaliteten.

KategoriHappyHorseTidligere #1Forskel
Text-to-Video (stille)13331273 (Seedance 2.0)+60
Image-to-Video (stille)13921355 (Seedance 2.0)+37
Text-to-Video (lyd)12051219 (Seedance 2.0)-14

Arkitektur: én Transformer, alt på én gang

De fleste AI-videosystemer kæder separate komponenter sammen: en tekstencoder, en videogenerator og en lydmodel, der boltes på bagefter. HappyHorse tager en anden tilgang.

Modellen bruger en 40-lags single-stream Self-Attention Transformer uden Cross-Attention-moduler. Tekst-, video- og lydtokens flyder alle gennem den samme Transformer-stak samtidigt. Dette ensartede design eliminerer overflødige parametre og reducerer inferenskompleksiteten.

Ensartet arkitektur
Tekst, video og lyd behandles i ét gennemløb. Ingen separat lydpipeline. Færre bevægelige dele, lavere latenstid.
Lyd halter stadig bagefter
Trods det ensartede design rangerer lydkvaliteten som nummer 2 bag Seedance 2.0s specialiserede lydpipeline.

Inferenspipelinen er usædvanligt slank: kun 8 denoising-trin uden Classifier-Free Guidance (CFG). Til sammenligning bruger mange konkurrerende modeller 25-50 trin med CFG aktiveret. Det tyder på aggressiv distillation under træning, hvor rå kapacitet byttes for hastighed.

Teamet bag

HappyHorse kommer fra Future Life Lab under Alibabas Taotian Group (e-handelsgrenen). Lederen er Zhang Di, tidligere VP hos Kuaishou og teknisk leder af Kling AI.

Den detalje er vigtig. Zhang Di opbyggede ingeniørkulturen bag Kling, en af de stærkeste AI-videomodeller i 2025. Han kender infrastrukturudfordringerne, træningspipelinerne og evalueringshullerne. At bringe den erfaring til Alibabas computeressourcer er en helt anden situation end at drive en selvstændig startup.

💡
HappyHorse understøtter native lip sync på seks sprog: kinesisk, engelsk, japansk, koreansk, tysk og fransk. Denne flersprogede evne antyder en model trænet på diverse, omhyggeligt kuraterede data.

Hvorfor det er vigtigt for markedet

AI-videomarkedet i april 2026 er usædvanligt ustabilt:

Marts 2026

Sora-nedlukning annonceret

OpenAI bekræftede, at Sora lukker den 26. april. Computeomkostninger og konkurrencepres viste sig uholdbare.

Februar 2026

Seedance 2.0 sat på pause

ByteDance tvunget til at stoppe udrulningen efter ophavsretstvister med Hollywood-studier.

7. april 2026

HappyHorse dukker op

En anonym model træder ind i Artificial Analysis Video Arena.

10. april 2026

Alibaba bekræfter ejerskab

Aktien stiger, da identiteten afsløres.

Med Sora på vej ned og Seedance med juridiske problemer ankommer HappyHorse på et tidspunkt, hvor markedet leder efter en ny frontløber. Runway Gen-4.5 står stadig stærkt i produktionsworkflows, og Google Veo 3.1 dominerer inden for enterprise-integration. Men hvad angår ren generationskvalitet, målt ved blind menneskelig præference, sidder HappyHorse nu øverst.

Open source: kommer snart (måske)

GitHub-repositoriet og Hugging Face model hub viser begge "Coming Soon" pr. 11. april. Teamet har lovet open source-frigivelse af de fulde 15 milliarder parametre med kommerciel licens. Hvis det sker, ville HappyHorse være den største open source-videomodel tilgængelig, markant større end LTX-Videos 2 milliarder parametre.

Men "kommer snart" er ikke "frigivet". Indtil vægtene kan downloades og verificeres uafhængigt, har benchmarkresultaterne en stjerne. AI-videomiljøet har lært at vente på reproducerbare resultater, før der udråbes vindere.

Hvad man skal holde øje med

Tre ting afgør, om HappyHorse bevarer sit forspring:

  • Open source-frigivelse af vægte og uafhængig reproduktion af benchmarkresultater
  • Forbedringer i lydkvalitet, så Seedance 2.0 matches eller slås i lydkategorierne
  • API-tilgængelighed og prissætning, da benchmarkdominans er ligegyldig, hvis skabere ikke kan tilgå modellen

AI-videogenerering bevæger sig hurtigt. I januar virkede Runway Gen-4.5 urørlig. I februar tog Seedance 2.0 kronen. Nu holder HappyHorse den. Spørgsmålet er ikke, om noget til sidst slår den, men hvornår og hvorfra.

For skabere og udviklere, der bygger videopipelines i dag, er budskabet praktisk: ingen enkelt model holder sig på toppen længe. Den bedste strategi er at bygge workflows, der kan skifte modeller, når ranglisten ændrer sig, i stedet for at satse alt på ét navn.

💡
Alibaba udgav også for nylig Wan 2.7 med Thinking Mode, en separat model fra deres Tongyi Lab-division. To store videomodeller fra forskellige Alibaba-teams i samme uge signalerer en virksomhedsdækkende satsning på AI-video.
Damien
DamienAI DeveloperAI Author

AI-udvikler fra Lyon, der elsker at forvandle komplekse ML-koncepter til enkle opskrifter. Når han ikke fejlsøger modeller, finder du ham på cykeltur gennem Rhônedalen.

View profile →

Kan du lide det, du har læst?

Forvandl dine idéer til AI-videoer med ubegrænset længde på få minutter.

Relaterede artikler

Udforsk videre med disse relaterede indlæg

Kunne du lide denne artikel?

Få flere indsigter, og hold dig opdateret med vores seneste indhold.