Meta PixelSkoči na glavno vsebino
DamienDamien· Avtor umetna inteligenca, pregledal človek
5 min read
966 besed

Alibaba HappyHorse-1.0: Skrivnostni model, ki je zavladal vsem lestvicam AI videa

Model z imenom HappyHorse-1.0 se je pojavil na Artificial Analysis brez navedbe podjetja, povzpel se na #1 v text-to-video in image-to-video, nato pa se je izkazalo, da za njim stoji Alibaba. Tukaj je, kar vemo o arhitekturi, ekipi in kaj to pomeni za trg AI videa.

Alibaba HappyHorse-1.0: Skrivnostni model, ki je zavladal vsem lestvicam AI videa

Ste pripravljeni ustvariti svoje AI videe?

Pridružite se tisočim ustvarjalcem, ki uporabljajo Bonega.ai

7. aprila 2026 se je na Artificial Analysis Video Arena pojavil model, za katerega nihče ni slišal. V treh dneh je zasedel pozicijo #1 tako v generiranju videa iz besedila kot iz slike. Brez logotipa, brez sporočila za javnost, brez imena podjetja. Nato je Alibaba potrdila, da je njihov. To je zgodba o HappyHorse-1.0, temnem konju, ki je pravkar premešal lestvice AI videa.

Razkritje

Artificial Analysis upravlja Video Arena, kjer uporabniki vnesejo prompt, dva anonimna modela generirata rezultate, uporabniki pa izberejo boljšega. Glasovi napajajo sistem ocenjevanja Elo (enaka matematika kot v šahovskih lestvicah). Modeli ne morejo goljufati, ker ocenjevalci nikoli ne vedo, kateri model je ustvaril kateri rezultat.

HappyHorse-1.0 je vstopil v areno 7. aprila s praznim profilom. Brez logotipa, brez navedbe podjetja. Do 10. aprila je zasedel prvo mesto v dveh od štirih kategorij lestvice, Alibaba pa je potrdila lastništvo prek novo ustvarjenega računa na X in izjave za CNBC.

💡
Delnice Alibabe na hongkonški borzi so na dan objave narasle za 2,12 % in so že prej tisti teden pridobile 6,75 %, ko so špekulacije okoli skrivnostnega modela naraščale.

Številke

Elo rezultati modela HappyHorse govorijo sami zase:

1333
T2V Elo (brez zvoka)
1392
I2V Elo (brez zvoka)
1205
T2V Elo (z zvokom)

Za kontekst, prejšnji #1 v text-to-video je bil ByteDanceov Seedance 2.0 z Elo 1273. HappyHorse ga je presegel za 60 točk, kar je razlika, ki za zaprtje običajno zahteva mesece. V image-to-video je HappyHorse dosegel 1392 v primerjavi s 1355 pri Seedance 2.0.

Kategorije z zvokom pripovedujejo drugačno zgodbo. HappyHorse sedi na #2 za Seedance 2.0 (Elo 1219 vs. 1205), kar nakazuje, da zvočni pipeline še potrebuje dodelavo v primerjavi s kakovostjo samega videa.

KategorijaHappyHorsePrejšnji #1Razlika
Text-to-Video (brez zvoka)13331273 (Seedance 2.0)+60
Image-to-Video (brez zvoka)13921355 (Seedance 2.0)+37
Text-to-Video (z zvokom)12051219 (Seedance 2.0)-14

Arhitektura: En Transformer, vse hkrati

Večina sistemov za AI video verižno povezuje ločene komponente: enkoder besedila, generator videa in zvočni model, prilepljen na koncu. HappyHorse pristopa drugače.

Model uporablja 40-slojni enotočni Self-Attention Transformer brez modulov Cross-Attention. Žetoni besedila, videa in zvoka hkrati prehajajo skozi isti stack transformerja. Ta poenotena zasnova odpravlja odvečne parametre in zmanjšuje zahtevnost inferencije.

Poenotena arhitektura
Besedilo, video in zvok obdelani v enem prehodu. Brez ločenega zvočnega pipeline-a. Manj premikajočih se delov, nižja latenca.
Zvok še zaostaja
Kljub poenoteni zasnovi se kakovost zvoka drži na #2 za specializiranim zvočnim pipeline-om Seedance 2.0.

Inferencijski pipeline je nenavadno lahek: le 8 korakov odstranjevanja šuma brez Classifier-Free Guidance (CFG). Za primerjavo, mnogi konkurenčni modeli uporabljajo 25-50 korakov z vključenim CFG. To nakazuje agresivno destilacijo med treningom, zamenjavo surove kapacitete za hitrost.

Ekipa za modelom

HappyHorse prihaja iz Future Life Lab pod Alibabino skupino Taotian Group (e-commerce veja). Na čelu je Zhang Di, nekdanji podpredsednik Kuaishoua in tehnični vodja Kling AI.

Ta podrobnost je pomembna. Zhang Di je zgradil inženirsko kulturo za Klingom, enim najmočnejših modelov AI videa leta 2025. Pozna infrastrukturne izzive, cevovode za treniranje in vrzeli v evalvaciji. Povezava teh izkušenj z računalniškimi viri Alibabe je povsem drugačna enačba od vodenja samostojnega startupa.

💡
HappyHorse izvorno podpira sinhronizacijo ustnic v šestih jezikih: kitajščini, angleščini, japonščini, korejščini, nemščini in francoščini. Ta večjezična zmožnost nakazuje model, treniran na raznolikih, skrbno izbranih podatkih.

Zakaj je to pomembno za trg

Trg AI videa v aprilu 2026 je nenavadno nestabilen:

Marec 2026

Najavljena ukinitev Sore

OpenAI je potrdil, da bo Sora ukinjena 26. aprila. Računalniški stroški in konkurenčni pritisk so se izkazali za nevzdržne.

Februar 2026

Seedance 2.0 zaustavljen

ByteDance prisiljen ustaviti uvedbo zaradi sporov o avtorskih pravicah s hollywoodskimi studii.

7. april 2026

Pojavi se HappyHorse

Anonimni model vstopi na Artificial Analysis Video Arena.

10. april 2026

Alibaba potrdi lastništvo

Delnice skočijo navzgor po razkritju identitete.

Ko Sora zapušča prizorišče in se Seedance spopada s pravnimi težavami, HappyHorse prispe v trenutku, ko trg išče novega vodilnega. Runway Gen-4.5 še vedno drži močno pozicijo v produkcijskih workflow-ih, Google Veo 3.1 pa obvladuje prostor korporativnih integracij. A kar zadeva surovo kakovost generiranja, merjeno s slepim človeškim ocenjevanjem, HappyHorse zdaj sedi na vrhu.

Open Source: kmalu (morda)

GitHub repozitorij in Hugging Face Model Hub kažeta "Coming Soon" na dan 11. aprila. Ekipa je obljubila odprto izdajo polnih 15-milijardnih uteži s komercialno licenco. Če se to zgodi, bo HappyHorse največji odprtokodni model za video, znatno večji od LTX-Video z 2 milijardama parametrov.

Toda "kmalu" ni "izdano". Dokler uteži niso na voljo za prenos in neodvisno preverjene, rezultati benchmarkov nosijo zvezdico. Skupnost AI videa se je naučila čakati na ponovljive rezultate, preden razglasi zmagovalce.

Kaj spremljati

Tri stvari bodo odločile, ali bo HappyHorse obdržal vodstvo:

  • Odprta izdaja uteži in neodvisna reprodukcija rezultatov benchmarkov
  • Izboljšanje kakovosti zvoka, da doseže ali preseže Seedance 2.0 v kategorijah z zvokom
  • Dostopnost API-ja in cenik, saj dominacija v benchmarkih nič ne pomeni, če ustvarjalci ne morejo dostopati do modela

Prostor generiranja AI videa se premika hitro. Januarja je Runway Gen-4.5 deloval nedotakljivo. Februarja je krono prevzel Seedance 2.0. Zdaj jo drži HappyHorse. Vprašanje ni, ali ga bo kaj sčasoma premagalo, temveč kdaj in od kod.

Za ustvarjalce in razvijalce, ki danes gradijo video pipeline-e, je zaključek praktičen: noben posamezen model ne ostane na vrhu dolgo. Najboljša strategija je graditi workflow-e, ki omogočajo zamenjavo modelov, ko se lestvica spreminja, namesto da se vse stavi na eno ime.

💡
Alibaba je nedavno izdala tudi Wan 2.7 s Thinking Mode, ločen model iz njihove divizije Tongyi Lab. Dva velika modela za video od različnih ekip Alibabe v istem tednu signalizirata celostni premik podjetja proti AI videu.
Damien
DamienAI DeveloperAI Author

Razvijalec umetne inteligence iz Lyona, ki rad spreminja zapletene koncepte strojnega učenja v preproste recepte. Ko ne odpravlja napak v modelih, ga boste našli na kolesu po dolini Rone.

View profile →

Vam je bilo prebrano všeč?

Svoje ideje v nekaj minutah spremenite v AI videe neomejene dolžine.

Povezani članki

Nadaljujte raziskovanje s temi povezanimi objavami

Vam je bil ta članek všeč?

Odkrijte več zanimivosti in ostanite na tekočem z našimi najnovejšimi vsebinami.