Alibaba HappyHorse-1.0: Mysteerimalli, joka nousi jokaisen AI-videovertailun kärkeen
HappyHorse-1.0-niminen malli ilmestyi Artificial Analysis -alustalle ilman tekijätietoja, nousi ykköseksi sekä text-to-video- että image-to-video-kategorioissa ja osoittautui Alibaban malliksi. Tässä on mitä tiedämme arkkitehtuurista, tiimistä ja vaikutuksista AI-videomarkkinoille.

Oletko valmis luomaan omia tekoälyvideoitasi?
Liity tuhansien Bonega.ai:tä käyttävien sisällöntuottajien joukkoon
Paljastus
Artificial Analysis ylläpitää Video Arena -alustaa, jossa käyttäjät lähettävät promptin, kaksi anonyymiä mallia tuottaa tulokset ja käyttäjät valitsevat paremman. Äänet syötetään Elo-luokitusjärjestelmään (sama matematiikka kuin shakin rankingissa). Mallit eivät voi pelata järjestelmää, koska arvioijat eivät koskaan tiedä, kumpi malli tuotti kumman tuloksen.
HappyHorse-1.0 astui areenalle 7. huhtikuuta tyhjällä profiililla. Ei logoa, ei yritystietoja. 10. huhtikuuta mennessä se oli kärkisijalla kahdessa neljästä ranking-kategoriasta, ja Alibaba vahvisti omistajuuden vasta perustetun X-tilin ja CNBC:lle annetun lausunnon kautta.
Luvut
HappyHorsen Elo-pisteet kertovat selkeän tarinan:
Vertailun vuoksi: edellinen ykkönen text-to-video-kategoriassa oli ByteDancen Seedance 2.0 Elo-arvolla 1273. HappyHorse voitti sen 60 pisteellä, ero joka tyypillisesti vaatii kuukausia kurottavaksi. Image-to-video-kategoriassa HappyHorse sai 1392 Seedance 2.0:n 1355:tä vastaan.
Äänen sisältävät kategoriat kertovat eri tarinan. HappyHorse on kakkossijalla Seedance 2.0:n takana (Elo 1219 vs. 1205), mikä viittaa siihen, että äänipipeline kaipaa vielä työtä videolaatuun verrattuna.
| Kategoria | HappyHorse | Edellinen #1 | Ero |
|---|---|---|---|
| Text-to-Video (äänetön) | 1333 | 1273 (Seedance 2.0) | +60 |
| Image-to-Video (äänetön) | 1392 | 1355 (Seedance 2.0) | +37 |
| Text-to-Video (äänellä) | 1205 | 1219 (Seedance 2.0) | -14 |
Arkkitehtuuri: Yksi Transformer, kaikki kerralla
Useimmat AI-videojärjestelmät ketjuttavat erillisiä komponentteja: tekstikooderin, videogeneraattorin ja jälkikäteen liitetyn äänimallin. HappyHorse tekee asiat toisin.
Malli käyttää 40-kerroksista yhden virran Self-Attention Transformer -arkkitehtuuria ilman Cross-Attention-moduuleja. Teksti-, video- ja äänitokenit kulkevat samanaikaisesti saman transformer-pinon läpi. Tämä yhtenäinen rakenne poistaa redundantit parametrit ja vähentää päättelyn monimutkaisuutta.
Päättelypipeline on poikkeuksellisen kevyt: vain 8 denoising-askelta ilman Classifier-Free Guidance (CFG) -menetelmää. Vertailun vuoksi, monet kilpailevat mallit käyttävät 25-50 askelta CFG:n kanssa. Tämä viittaa aggressiiviseen tislaamisen käyttöön koulutuksessa, jossa raaka kapasiteetti on vaihdettu nopeuteen.
Tiimi mallin takana
HappyHorse tulee Future Life Labista, joka toimii Alibaban Taotian Groupin (verkkokauppa-haaran) alaisuudessa. Vetäjänä toimii Zhang Di, Kuaishoun entinen varatoimitusjohtaja ja Kling AI:n tekninen johtaja.
Tämä yksityiskohta on merkittävä. Zhang Di rakensi Klingin taustalla olevan insinöörikulttuurin, ja Kling oli yksi vuoden 2025 vahvimmista AI-videomalleista. Hän tuntee infrastruktuurihaasteet, koulutuspipelinet ja arviointipuutteet. Tämän kokemuksen yhdistäminen Alibaban laskentaresursseihin on eri yhtälö kuin itsenäisen startupin pyörittäminen.
Miksi tällä on merkitystä markkinoille
AI-videomarkkina huhtikuussa 2026 on poikkeuksellisen epävakaa:
Soran lopettaminen julkistettiin
OpenAI vahvisti, että Sora lopetetaan 26. huhtikuuta. Laskentakustannukset ja kilpailupaine osoittautuivat kestämättömiksi.
Seedance 2.0 pysäytetty
ByteDance joutui keskeyttämään julkaisun Hollywoodin studioiden kanssa käytyjen tekijänoikeuskiistojen vuoksi.
HappyHorse ilmestyy
Anonyymi malli astuu Artificial Analysis Video Arenalle.
Alibaba vahvistaa omistajuuden
Osake nousee, kun henkilöllisyys paljastuu.
Soran alasajon ja Seedancen oikeudellisten ongelmien keskellä HappyHorse saapuu hetkellä, jolloin markkina etsii uutta kärkitekijää. Runway Gen-4.5 pysyy vahvana tuotantotyönkuluissa ja Google Veo 3.1 hallitsee enterprise-integraatioiden kenttää. Mutta raa'an generointilaadun osalta, mitattuna sokkona tehdyllä ihmisarvioinnilla, HappyHorse on nyt kärjessä.
Avoin lähdekoodi: Tulossa pian (ehkä)
GitHub-repositorio ja Hugging Face -mallihubi näyttävät molemmat "Tulossa pian" 11. huhtikuuta. Tiimi on luvannut avoimen lähdekoodin julkaisun kaikille 15 miljardin parametrin painoille kaupallisella lisenssillä. Jos tämä toteutuu, HappyHorse olisi suurin saatavilla oleva avoimen lähdekoodin videomalli, merkittävästi suurempi kuin LTX-Videon 2 miljardia parametria.
Mutta "tulossa pian" ei ole sama kuin "julkaistu". Kunnes painot ovat ladattavissa ja itsenäisesti varmennettuja, benchmark-tulokset kantavat asteriskia. AI-videoyhteisö on oppinut odottamaan toistettavia tuloksia ennen voittajien julistamista.
Mitä seurata
Kolme asiaa ratkaisee, pystyykö HappyHorse säilyttämään johtoasemansa:
- ✓Avoimen lähdekoodin painojen julkaisu ja benchmark-tulosten itsenäinen toistaminen
- ✓Äänenlaadun parannukset Seedance 2.0:n tasolle tai ohi äänen sisältävissä kategorioissa
- ✓API:n saatavuus ja hinnoittelu, sillä benchmark-hallinta ei merkitse mitään, jos sisällöntuottajat eivät pääse käyttämään mallia
AI-videogeneroinnin kenttä liikkuu nopeasti. Tammikuussa Runway Gen-4.5 näytti lyömättömältä. Helmikuussa Seedance 2.0 otti kruunun. Nyt HappyHorse pitää sitä. Kysymys ei ole, voittaako jokin sen lopulta, vaan milloin ja mistä suunnasta.
Sisällöntuottajille ja kehittäjille, jotka rakentavat videopipelineja tänään, johtopäätös on käytännöllinen: yksikään malli ei pysy kärjessä kovin pitkään. Paras strategia on rakentaa työnkulkuja, jotka voivat vaihtaa mallia sitä mukaa kun ranking muuttuu, sen sijaan että panostaa kaiken yhteen nimeen.

Lyonista kotoisin oleva tekoälykehittäjä, joka rakastaa monimutkaisten ML-konseptien muuttamista yksinkertaisiksi ohjeiksi. Kun hän ei ratko mallien virheitä, hänet löytää pyöräilemästä Rhônen laaksossa.
View profile →Aiheeseen liittyvät artikkelit
Jatka tutustumista näihin aiheeseen liittyviin julkaisuihin

Alibaba Wan 2.7: Miten Thinking Mode muuttaa tekoälyvideogenerointia
Alibaba julkaisi Wan 2.7:n uudella Thinking Mode -toiminnolla, joka suunnittelee sommittelut ennen videon luomista. Käymme läpi, miten se toimii ja mitä se tarkoittaa sisällöntuottajille.

AI-video Soran jälkeen: 4 markkinatasoa vuonna 2026
Sora sulkeutuu 26. huhtikuuta. AI-videomarkkinat ovat konsolidoituneet neljään tasoon. Käytännöllinen opas oikean Sora-vaihtoehdon valintaan.

Google Veo 3.1 tulee ilmaiseksi: 10 AI-videota kuukaudessa jokaiselle Google-tilille
Google avasi Veo 3.1:n kaikille henkilökohtaisille tileille 10 ilmaisella videogeneroinnilla kuukaudessa. Tässä on mitä saat, mitkä ovat rajoitukset ja miksi tällä on merkitystä AI-videon tekijöille.