Alibaba HappyHorse-1.0: невядомая мадэль, якая ўзначаліла ўсе рэйтынгі AI-відэа
Мадэль пад назвай HappyHorse-1.0 з'явілася на Artificial Analysis без указання аўтара, паднялася на першае месца ў text-to-video і image-to-video, а потым аказалася распрацоўкай Alibaba. Разбіраем архітэктуру, каманду і наступствы для рынку AI-відэа.

Раскрыццё
Artificial Analysis праводзіць Video Arena, дзе карыстальнікі ўводзяць промпт, дзве ананімныя мадэлі генеруюць відэа, а карыстальнікі выбіраюць лепшае. Галасы паступаюць у сістэму рэйтынгу Elo (тая ж матэматыка, што і ў шахматных рэйтынгах). Мадэлі не могуць ашукаць сістэму, бо ацэншчыкі не ведаюць, якая мадэль стварыла які вынік.
HappyHorse-1.0 выйшла на арэну 7 красавіка з пустым профілем. Ні лагатыпа, ні ўказання кампаніі. Да 10 красавіка мадэль заняла першы радок у дзвюх з чатырох катэгорый рэйтынгу, і Alibaba пацвердзіла аўтарства праз нядаўна створаны акаўнт у X і заяву для CNBC.
Лічбы
Рэйтынгі Elo у HappyHorse кажуць самі за сябе:
Для кантэксту: папярэдні лідар у text-to-video, Seedance 2.0 ад ByteDance, набраў Elo 1273. HappyHorse абышла яго на 60 пунктаў, разрыў, які звычайна закрываюць месяцамі. У image-to-video HappyHorse набрала 1392 супраць 1355 у Seedance 2.0.
У катэгорыях з аўдыё карціна іншая. HappyHorse на другім месцы пасля Seedance 2.0 (Elo 1219 супраць 1205), што ўказвае на неабходнасць дапрацоўкі аўдыёпайплайна адносна якасці відэа.
| Катэгорыя | HappyHorse | Былы лідар | Розніца |
|---|---|---|---|
| Text-to-Video (без гуку) | 1333 | 1273 (Seedance 2.0) | +60 |
| Image-to-Video (без гуку) | 1392 | 1355 (Seedance 2.0) | +37 |
| Text-to-Video (з гукам) | 1205 | 1219 (Seedance 2.0) | -14 |
Архітэктура: адзін Transformer, усё адразу
Большасць AI-сістэм для генерацыі відэа звязваюць асобныя кампаненты ў ланцужок: тэкставы энкодэр, генератар відэа і мадэль аўдыё, прышрубаваную зверху. HappyHorse абірае іншы шлях.
Мадэль выкарыстоўвае 40-слаёвы аднапатокавы Self-Attention Transformer без модуляў Cross-Attention. Тэкставыя, відэа- і аўдыётокены праходзяць праз адзін і той жа стэк трансформера адначасова. Такая ўніфікаваная архітэктура ліквідуе залішнія параметры і зніжае складанасць інферэнсу.
Пайплайн інферэнсу незвычайна лёгкі: усяго 8 крокаў дэноізінгу без Classifier-Free Guidance (CFG). Для параўнання, шмат канкуруючых мадэляў выкарыстоўваюць 25-50 крокаў з уключаным CFG. Гэта ўказвае на агрэсіўную дыстыляцыю падчас навучання, дзе хуткасць атрымана за кошт аб'ёму вылічэнняў.
Каманда
HappyHorse створана ў Future Life Lab пры Taotian Group (e-commerce падраздзяленне Alibaba). Кіраўнік праекта, Чжан Дзі, былы віцэ-прэзідэнт Kuaishou і тэхнічны лідар Kling AI.
Гэта важная дэталь. Чжан Дзі стварыў інжынерную культуру Kling, адной з мацнейшых AI-відэа мадэляў 2025 года. Ён ведае інфраструктурныя выклікі, навучальныя пайплайны і прагалы ў ацэнцы. Перанос гэтага досведу на вылічальныя рэсурсы Alibaba, гэта зусім іншае ўраўненне ў параўнанні з аўтаномным стартапам.
Што гэта значыць для рынку
Рынак AI-відэа ў красавіку 2026 года надзвычай нестабільны:
Абвешчана пра закрыццё Sora
OpenAI пацвердзіла, што Sora спыніць працу 26 красавіка. Выдаткі на вылічэнні і канкурэнтны ціск аказаліся непад'ёмнымі.
Seedance 2.0 прыпынена
ByteDance вымушана спыніць разгортванне з-за спрэчак пра аўтарскія правы з галівудскімі студыямі.
З'яўленне HappyHorse
Ананімная мадэль выходзіць на арэну Artificial Analysis Video Arena.
Alibaba пацвярджае аўтарства
Акцыі растуць пасля раскрыцця асобы стваральніка.
З адыходам Sora і юрыдычнымі праблемамі Seedance, HappyHorse з'яўляецца ў момант, калі рынак шукае новага лідара. Runway Gen-4.5 па-ранейшаму моцны ў прадакшн-воркфлоу, а Google Veo 3.1 дамінуе ў карпаратыўных інтэграцыях. Але па чыстай якасці генерацыі, вымеранай сляпой перавагай людзей, HappyHorse цяпер на вяршыні.
Адкрыты зыходны код: хутка (магчыма)
На GitHub і ў мадэльным хабе Hugging Face па стане на 11 красавіка стаіць пазнака "Coming Soon". Каманда паабяцала выкласці поўныя вагі мадэлі на 15 мільярдаў параметраў з камерцыйнай ліцэнзіяй. Калі гэта здарыцца, HappyHorse стане найбуйнейшай адкрытай мадэллю генерацыі відэа, значна большай за 2 мільярды параметраў LTX-Video.
Але "хутка" не значыць "выпушчана". Пакуль вагі нельга спампаваць і незалежна праверыць, вынікі бенчмаркаў ідуць з зорачкай. AI-супольнасць ужо навучылася чакаць узнаўляльных вынікаў, перш чым абвяшчаць пераможцаў.
На што звярнуць увагу
Тры фактары вызначаць, ці ўтрымае HappyHorse лідарства:
- ✓Публікацыя вагаў у адкрыты доступ і незалежнае ўзнаўленне вынікаў бенчмаркаў
- ✓Паляпшэнне якасці аўдыё да ўзроўню Seedance 2.0 у катэгорыях з аўдыё
- ✓Даступнасць API і цэнаўтварэнне, бо дамінаванне ў бенчмарках нічога не значыць, калі стваральнікі не могуць атрымаць доступ да мадэлі
Сфера генерацыі AI-відэа рухаецца хутка. У студзені Runway Gen-4.5 здаваўся недасягальным. У лютым карону забраў Seedance 2.0. Цяпер яна ў HappyHorse. Пытанне не ў тым, ці хтосьці абыдзе гэтую мадэль, а калі і адкуль прыйдзе канкурэнт.
Для стваральнікаў і распрацоўшчыкаў, якія будуюць відэапайплайны сёння, выснова практычная: ніводная мадэль не застаецца на вяршыні надоўга. Лепшая стратэгія, будаваць воркфлоу з магчымасцю хуткай замены мадэляў пры змене рэйтынгаў, а не рабіць стаўку на адно імя.

Распрацоўшчык ШІ з Ліёна, які любіць ператвараць складаныя канцэпцыі машыннага навучання ў простыя рэцэпты. Калі ён не адладжвае мадэлі, яго можна знайсці на веласіпедзе ў даліне Роны.
View profile →Спадабалася прачытанае?
Пераўтварайце свае ідэі ў ШІ-відэа неабмежаванай працягласці за лічаныя хвіліны.
Падобныя артыкулы
Працягвайце знаёмства з гэтымі падобнымі артыкуламі

Alibaba Wan 2.7: як рэжым Thinking Mode змяняе генерацыю відэа з дапамогай ШІ
Alibaba выпусціла Wan 2.7 з новым рэжымам Thinking Mode, які плануе кампазіцыю перад генерацыяй відэа. Разбіраем, як гэта працуе і што гэта значыць для стваральнікаў кантэнту.

Google Veo 3.1 стаў бясплатным: 10 AI-відэа на месяц для кожнага акаўнта Google
Google адкрыў Veo 3.1 для ўсіх асабістых акаўнтаў з 10 бясплатнымі генерацыямі відэа штомесяц. Вось што вы атрымліваеце, якія абмежаванні і чаму гэта важна для стваральнікаў AI-відэа.

Google Veo 3.1 Lite: танная генерацыя відэа праз Gemini API
Google выпусціла Veo 3.1 Lite, хуткую і танную мадэль генерацыі відэа ў Gemini API. Разбіраемся ў цэнах, кампрамісах па якасці і тым, як убудаваць відэа ў прадакшн-прыкладанні.