Meta PixelПерайсці да асноўнага змесціва
DamienDamien· аўтар ШІ, праверана чалавекам
5 min read
916 слоў

Alibaba HappyHorse-1.0: невядомая мадэль, якая ўзначаліла ўсе рэйтынгі AI-відэа

Мадэль пад назвай HappyHorse-1.0 з'явілася на Artificial Analysis без указання аўтара, паднялася на першае месца ў text-to-video і image-to-video, а потым аказалася распрацоўкай Alibaba. Разбіраем архітэктуру, каманду і наступствы для рынку AI-відэа.

Alibaba HappyHorse-1.0: невядомая мадэль, якая ўзначаліла ўсе рэйтынгі AI-відэа

Гатовыя ствараць уласныя ШІ-відэа?

Далучайцеся да тысяч стваральнікаў, якія карыстаюцца Bonega.ai

7 красавіка 2026 года на арэне Artificial Analysis Video Arena з'явілася мадэль, пра якую ніхто не чуў. За тры дні яна заняла першае месца адразу ў дзвюх катэгорыях: text-to-video і image-to-video. Ніякага лагатыпа, ніякага прэсрэлізу, ніякай назвы кампаніі. Потым Alibaba пацвердзіла, што гэта іхняя распрацоўка. Вось гісторыя HappyHorse-1.0, цёмнага каня, які перамяшаў рэйтынгі AI-відэа.

Раскрыццё

Artificial Analysis праводзіць Video Arena, дзе карыстальнікі ўводзяць промпт, дзве ананімныя мадэлі генеруюць відэа, а карыстальнікі выбіраюць лепшае. Галасы паступаюць у сістэму рэйтынгу Elo (тая ж матэматыка, што і ў шахматных рэйтынгах). Мадэлі не могуць ашукаць сістэму, бо ацэншчыкі не ведаюць, якая мадэль стварыла які вынік.

HappyHorse-1.0 выйшла на арэну 7 красавіка з пустым профілем. Ні лагатыпа, ні ўказання кампаніі. Да 10 красавіка мадэль заняла першы радок у дзвюх з чатырох катэгорый рэйтынгу, і Alibaba пацвердзіла аўтарства праз нядаўна створаны акаўнт у X і заяву для CNBC.

💡
Акцыі Alibaba на Ганконгскай біржы вырасла на 2,12% у дзень абвяшчэння. За тыдзень да гэтага, пакуль навокал загадкавай мадэлі нарасталі чуткі, рост ужо склаў 6,75%.

Лічбы

Рэйтынгі Elo у HappyHorse кажуць самі за сябе:

1333
T2V Elo (без аўдыё)
1392
I2V Elo (без аўдыё)
1205
T2V Elo (з аўдыё)

Для кантэксту: папярэдні лідар у text-to-video, Seedance 2.0 ад ByteDance, набраў Elo 1273. HappyHorse абышла яго на 60 пунктаў, разрыў, які звычайна закрываюць месяцамі. У image-to-video HappyHorse набрала 1392 супраць 1355 у Seedance 2.0.

У катэгорыях з аўдыё карціна іншая. HappyHorse на другім месцы пасля Seedance 2.0 (Elo 1219 супраць 1205), што ўказвае на неабходнасць дапрацоўкі аўдыёпайплайна адносна якасці відэа.

КатэгорыяHappyHorseБылы лідарРозніца
Text-to-Video (без гуку)13331273 (Seedance 2.0)+60
Image-to-Video (без гуку)13921355 (Seedance 2.0)+37
Text-to-Video (з гукам)12051219 (Seedance 2.0)-14

Архітэктура: адзін Transformer, усё адразу

Большасць AI-сістэм для генерацыі відэа звязваюць асобныя кампаненты ў ланцужок: тэкставы энкодэр, генератар відэа і мадэль аўдыё, прышрубаваную зверху. HappyHorse абірае іншы шлях.

Мадэль выкарыстоўвае 40-слаёвы аднапатокавы Self-Attention Transformer без модуляў Cross-Attention. Тэкставыя, відэа- і аўдыётокены праходзяць праз адзін і той жа стэк трансформера адначасова. Такая ўніфікаваная архітэктура ліквідуе залішнія параметры і зніжае складанасць інферэнсу.

Уніфікаваная архітэктура
Тэкст, відэа і аўдыё апрацоўваюцца за адзін праход. Няма асобнага аўдыёпайплайна. Менш рухомых частак, ніжэйшая затрымка.
Аўдыё пакуль адстае
Нягледзячы на ўніфікаваны дызайн, якасць аўдыё займае другое месца пасля спецыялізаванага аўдыёпайплайна Seedance 2.0.

Пайплайн інферэнсу незвычайна лёгкі: усяго 8 крокаў дэноізінгу без Classifier-Free Guidance (CFG). Для параўнання, шмат канкуруючых мадэляў выкарыстоўваюць 25-50 крокаў з уключаным CFG. Гэта ўказвае на агрэсіўную дыстыляцыю падчас навучання, дзе хуткасць атрымана за кошт аб'ёму вылічэнняў.

Каманда

HappyHorse створана ў Future Life Lab пры Taotian Group (e-commerce падраздзяленне Alibaba). Кіраўнік праекта, Чжан Дзі, былы віцэ-прэзідэнт Kuaishou і тэхнічны лідар Kling AI.

Гэта важная дэталь. Чжан Дзі стварыў інжынерную культуру Kling, адной з мацнейшых AI-відэа мадэляў 2025 года. Ён ведае інфраструктурныя выклікі, навучальныя пайплайны і прагалы ў ацэнцы. Перанос гэтага досведу на вылічальныя рэсурсы Alibaba, гэта зусім іншае ўраўненне ў параўнанні з аўтаномным стартапам.

💡
HappyHorse натыўна падтрымлівае сінхранізацыю губ на шасці мовах: кітайскай, англійскай, японскай, карэйскай, нямецкай і французскай. Гэтая мультымоўная здольнасць указвае на мадэль, навучаную на разнастайных і старанна адабраных дадзеных.

Што гэта значыць для рынку

Рынак AI-відэа ў красавіку 2026 года надзвычай нестабільны:

Сакавік 2026

Абвешчана пра закрыццё Sora

OpenAI пацвердзіла, што Sora спыніць працу 26 красавіка. Выдаткі на вылічэнні і канкурэнтны ціск аказаліся непад'ёмнымі.

Люты 2026

Seedance 2.0 прыпынена

ByteDance вымушана спыніць разгортванне з-за спрэчак пра аўтарскія правы з галівудскімі студыямі.

7 красавіка 2026

З'яўленне HappyHorse

Ананімная мадэль выходзіць на арэну Artificial Analysis Video Arena.

10 красавіка 2026

Alibaba пацвярджае аўтарства

Акцыі растуць пасля раскрыцця асобы стваральніка.

З адыходам Sora і юрыдычнымі праблемамі Seedance, HappyHorse з'яўляецца ў момант, калі рынак шукае новага лідара. Runway Gen-4.5 па-ранейшаму моцны ў прадакшн-воркфлоу, а Google Veo 3.1 дамінуе ў карпаратыўных інтэграцыях. Але па чыстай якасці генерацыі, вымеранай сляпой перавагай людзей, HappyHorse цяпер на вяршыні.

Адкрыты зыходны код: хутка (магчыма)

На GitHub і ў мадэльным хабе Hugging Face па стане на 11 красавіка стаіць пазнака "Coming Soon". Каманда паабяцала выкласці поўныя вагі мадэлі на 15 мільярдаў параметраў з камерцыйнай ліцэнзіяй. Калі гэта здарыцца, HappyHorse стане найбуйнейшай адкрытай мадэллю генерацыі відэа, значна большай за 2 мільярды параметраў LTX-Video.

Але "хутка" не значыць "выпушчана". Пакуль вагі нельга спампаваць і незалежна праверыць, вынікі бенчмаркаў ідуць з зорачкай. AI-супольнасць ужо навучылася чакаць узнаўляльных вынікаў, перш чым абвяшчаць пераможцаў.

На што звярнуць увагу

Тры фактары вызначаць, ці ўтрымае HappyHorse лідарства:

  • Публікацыя вагаў у адкрыты доступ і незалежнае ўзнаўленне вынікаў бенчмаркаў
  • Паляпшэнне якасці аўдыё да ўзроўню Seedance 2.0 у катэгорыях з аўдыё
  • Даступнасць API і цэнаўтварэнне, бо дамінаванне ў бенчмарках нічога не значыць, калі стваральнікі не могуць атрымаць доступ да мадэлі

Сфера генерацыі AI-відэа рухаецца хутка. У студзені Runway Gen-4.5 здаваўся недасягальным. У лютым карону забраў Seedance 2.0. Цяпер яна ў HappyHorse. Пытанне не ў тым, ці хтосьці абыдзе гэтую мадэль, а калі і адкуль прыйдзе канкурэнт.

Для стваральнікаў і распрацоўшчыкаў, якія будуюць відэапайплайны сёння, выснова практычная: ніводная мадэль не застаецца на вяршыні надоўга. Лепшая стратэгія, будаваць воркфлоу з магчымасцю хуткай замены мадэляў пры змене рэйтынгаў, а не рабіць стаўку на адно імя.

💡
Alibaba таксама нядаўна выпусціла Wan 2.7 з рэжымам Thinking, асобную мадэль ад падраздзялення Tongyi Lab. Дзве буйныя відэамадэлі ад розных каманд Alibaba за адзін тыдзень, гэта сігнал пра маштабны рух кампаніі ў бок AI-відэа.
Damien
DamienAI DeveloperAI Author

Распрацоўшчык ШІ з Ліёна, які любіць ператвараць складаныя канцэпцыі машыннага навучання ў простыя рэцэпты. Калі ён не адладжвае мадэлі, яго можна знайсці на веласіпедзе ў даліне Роны.

View profile →

Спадабалася прачытанае?

Пераўтварайце свае ідэі ў ШІ-відэа неабмежаванай працягласці за лічаныя хвіліны.

Падобныя артыкулы

Працягвайце знаёмства з гэтымі падобнымі артыкуламі

Вам спадабаўся гэты артыкул?

Адкрыйце для сябе больш карыснай інфармацыі і сачыце за нашым новым кантэнтам.