Meta PixelSiirry pääsisältöön
DamienDamien· Tekoälytekijä, ihmisen tarkistama
5 min read
812 sanaa

Alibaba HappyHorse-1.0: Mysteerimalli, joka nousi jokaisen AI-videovertailun kärkeen

HappyHorse-1.0-niminen malli ilmestyi Artificial Analysis -alustalle ilman tekijätietoja, nousi ykköseksi sekä text-to-video- että image-to-video-kategorioissa ja osoittautui Alibaban malliksi. Tässä on mitä tiedämme arkkitehtuurista, tiimistä ja vaikutuksista AI-videomarkkinoille.

Alibaba HappyHorse-1.0: Mysteerimalli, joka nousi jokaisen AI-videovertailun kärkeen

Oletko valmis luomaan omia tekoälyvideoitasi?

Liity tuhansien Bonega.ai:tä käyttävien sisällöntuottajien joukkoon

7. huhtikuuta 2026 tuntematon malli ilmestyi Artificial Analysis Video Arena -alustalle. Kolmessa päivässä se oli ykkössijalla sekä text-to-video- että image-to-video-generoinnissa. Ei brändiä, ei lehdistötiedotetta, ei yrityksen nimeä. Sitten Alibaba vahvisti sen omakseen. Tämä on tarina HappyHorse-1.0:sta, mustasta hevosesta, joka juuri sekoitti AI-videovertailujen tulokset.

Paljastus

Artificial Analysis ylläpitää Video Arena -alustaa, jossa käyttäjät lähettävät promptin, kaksi anonyymiä mallia tuottaa tulokset ja käyttäjät valitsevat paremman. Äänet syötetään Elo-luokitusjärjestelmään (sama matematiikka kuin shakin rankingissa). Mallit eivät voi pelata järjestelmää, koska arvioijat eivät koskaan tiedä, kumpi malli tuotti kumman tuloksen.

HappyHorse-1.0 astui areenalle 7. huhtikuuta tyhjällä profiililla. Ei logoa, ei yritystietoja. 10. huhtikuuta mennessä se oli kärkisijalla kahdessa neljästä ranking-kategoriasta, ja Alibaba vahvisti omistajuuden vasta perustetun X-tilin ja CNBC:lle annetun lausunnon kautta.

💡
Alibaban Hongkongin pörssiin listatut osakkeet nousivat 2,12 % ilmoituspäivänä ja olivat jo nousseet 6,75 % aiemmin viikolla, kun spekulaatio mysteerimallista kiihtyi.

Luvut

HappyHorsen Elo-pisteet kertovat selkeän tarinan:

1333
T2V Elo (ilman ääntä)
1392
I2V Elo (ilman ääntä)
1205
T2V Elo (äänellä)

Vertailun vuoksi: edellinen ykkönen text-to-video-kategoriassa oli ByteDancen Seedance 2.0 Elo-arvolla 1273. HappyHorse voitti sen 60 pisteellä, ero joka tyypillisesti vaatii kuukausia kurottavaksi. Image-to-video-kategoriassa HappyHorse sai 1392 Seedance 2.0:n 1355:tä vastaan.

Äänen sisältävät kategoriat kertovat eri tarinan. HappyHorse on kakkossijalla Seedance 2.0:n takana (Elo 1219 vs. 1205), mikä viittaa siihen, että äänipipeline kaipaa vielä työtä videolaatuun verrattuna.

KategoriaHappyHorseEdellinen #1Ero
Text-to-Video (äänetön)13331273 (Seedance 2.0)+60
Image-to-Video (äänetön)13921355 (Seedance 2.0)+37
Text-to-Video (äänellä)12051219 (Seedance 2.0)-14

Arkkitehtuuri: Yksi Transformer, kaikki kerralla

Useimmat AI-videojärjestelmät ketjuttavat erillisiä komponentteja: tekstikooderin, videogeneraattorin ja jälkikäteen liitetyn äänimallin. HappyHorse tekee asiat toisin.

Malli käyttää 40-kerroksista yhden virran Self-Attention Transformer -arkkitehtuuria ilman Cross-Attention-moduuleja. Teksti-, video- ja äänitokenit kulkevat samanaikaisesti saman transformer-pinon läpi. Tämä yhtenäinen rakenne poistaa redundantit parametrit ja vähentää päättelyn monimutkaisuutta.

Yhtenäinen arkkitehtuuri
Teksti, video ja ääni käsitellään yhdellä läpikululla. Ei erillistä äänipipelinea. Vähemmän liikkuvia osia, pienempi viive.
Ääni jää vielä jälkeen
Yhtenäisestä rakenteesta huolimatta äänenlaatu on kakkossijalla Seedance 2.0:n erikoistuneen äänipipelinen takana.

Päättelypipeline on poikkeuksellisen kevyt: vain 8 denoising-askelta ilman Classifier-Free Guidance (CFG) -menetelmää. Vertailun vuoksi, monet kilpailevat mallit käyttävät 25-50 askelta CFG:n kanssa. Tämä viittaa aggressiiviseen tislaamisen käyttöön koulutuksessa, jossa raaka kapasiteetti on vaihdettu nopeuteen.

Tiimi mallin takana

HappyHorse tulee Future Life Labista, joka toimii Alibaban Taotian Groupin (verkkokauppa-haaran) alaisuudessa. Vetäjänä toimii Zhang Di, Kuaishoun entinen varatoimitusjohtaja ja Kling AI:n tekninen johtaja.

Tämä yksityiskohta on merkittävä. Zhang Di rakensi Klingin taustalla olevan insinöörikulttuurin, ja Kling oli yksi vuoden 2025 vahvimmista AI-videomalleista. Hän tuntee infrastruktuurihaasteet, koulutuspipelinet ja arviointipuutteet. Tämän kokemuksen yhdistäminen Alibaban laskentaresursseihin on eri yhtälö kuin itsenäisen startupin pyörittäminen.

💡
HappyHorse tukee natiivisti huulten synkronointia kuudella kielellä: kiina, englanti, japani, korea, saksa ja ranska. Tämä monikielinen ominaisuus viittaa malliin, joka on koulutettu monipuolisella, huolellisesti kuratoidulla datalla.

Miksi tällä on merkitystä markkinoille

AI-videomarkkina huhtikuussa 2026 on poikkeuksellisen epävakaa:

Maaliskuu 2026

Soran lopettaminen julkistettiin

OpenAI vahvisti, että Sora lopetetaan 26. huhtikuuta. Laskentakustannukset ja kilpailupaine osoittautuivat kestämättömiksi.

Helmikuu 2026

Seedance 2.0 pysäytetty

ByteDance joutui keskeyttämään julkaisun Hollywoodin studioiden kanssa käytyjen tekijänoikeuskiistojen vuoksi.

7. huhtikuuta 2026

HappyHorse ilmestyy

Anonyymi malli astuu Artificial Analysis Video Arenalle.

10. huhtikuuta 2026

Alibaba vahvistaa omistajuuden

Osake nousee, kun henkilöllisyys paljastuu.

Soran alasajon ja Seedancen oikeudellisten ongelmien keskellä HappyHorse saapuu hetkellä, jolloin markkina etsii uutta kärkitekijää. Runway Gen-4.5 pysyy vahvana tuotantotyönkuluissa ja Google Veo 3.1 hallitsee enterprise-integraatioiden kenttää. Mutta raa'an generointilaadun osalta, mitattuna sokkona tehdyllä ihmisarvioinnilla, HappyHorse on nyt kärjessä.

Avoin lähdekoodi: Tulossa pian (ehkä)

GitHub-repositorio ja Hugging Face -mallihubi näyttävät molemmat "Tulossa pian" 11. huhtikuuta. Tiimi on luvannut avoimen lähdekoodin julkaisun kaikille 15 miljardin parametrin painoille kaupallisella lisenssillä. Jos tämä toteutuu, HappyHorse olisi suurin saatavilla oleva avoimen lähdekoodin videomalli, merkittävästi suurempi kuin LTX-Videon 2 miljardia parametria.

Mutta "tulossa pian" ei ole sama kuin "julkaistu". Kunnes painot ovat ladattavissa ja itsenäisesti varmennettuja, benchmark-tulokset kantavat asteriskia. AI-videoyhteisö on oppinut odottamaan toistettavia tuloksia ennen voittajien julistamista.

Mitä seurata

Kolme asiaa ratkaisee, pystyykö HappyHorse säilyttämään johtoasemansa:

  • Avoimen lähdekoodin painojen julkaisu ja benchmark-tulosten itsenäinen toistaminen
  • Äänenlaadun parannukset Seedance 2.0:n tasolle tai ohi äänen sisältävissä kategorioissa
  • API:n saatavuus ja hinnoittelu, sillä benchmark-hallinta ei merkitse mitään, jos sisällöntuottajat eivät pääse käyttämään mallia

AI-videogeneroinnin kenttä liikkuu nopeasti. Tammikuussa Runway Gen-4.5 näytti lyömättömältä. Helmikuussa Seedance 2.0 otti kruunun. Nyt HappyHorse pitää sitä. Kysymys ei ole, voittaako jokin sen lopulta, vaan milloin ja mistä suunnasta.

Sisällöntuottajille ja kehittäjille, jotka rakentavat videopipelineja tänään, johtopäätös on käytännöllinen: yksikään malli ei pysy kärjessä kovin pitkään. Paras strategia on rakentaa työnkulkuja, jotka voivat vaihtaa mallia sitä mukaa kun ranking muuttuu, sen sijaan että panostaa kaiken yhteen nimeen.

💡
Alibaba julkaisi hiljattain myös Wan 2.7:n Thinking Mode -tilalla, erillisen mallin Tongyi Lab -divisioonasta. Kaksi suurta videomallia kahdelta eri Alibaba-tiimiltä samalla viikolla viestii yrityksenlaajuisesta AI-video-panostuksesta.
Damien
DamienAI DeveloperAI Author

Lyonista kotoisin oleva tekoälykehittäjä, joka rakastaa monimutkaisten ML-konseptien muuttamista yksinkertaisiksi ohjeiksi. Kun hän ei ratko mallien virheitä, hänet löytää pyöräilemästä Rhônen laaksossa.

View profile →

Piditkö lukemastasi?

Muunna ideasi rajattoman pituisiksi tekoälyvideoiksi minuuteissa.

Aiheeseen liittyvät artikkelit

Jatka tutustumista näihin aiheeseen liittyviin julkaisuihin

Piditkö tästä artikkelista?

Löydä lisää oivalluksia ja pysy ajan tasalla uusimmasta sisällöstämme.