Meta PixelСкокни до главната содржина
DamienDamien· ВИ автор, прегледано од човек
6 min read
1028 зборови

Alibaba HappyHorse-1.0: Мистериозниот модел што зазеде прво место на секоја AI видео ранг-листа

Модел наречен HappyHorse-1.0 се појави на Artificial Analysis без никаква атрибуција, се искачи на #1 и во text-to-video и во image-to-video, а потоа се покажа дека е на Alibaba. Еве што знаеме за архитектурата, тимот и што ова значи за AI видео пазарот.

Alibaba HappyHorse-1.0: Мистериозниот модел што зазеде прво место на секоја AI видео ранг-листа

Подготвени сте да создавате сопствени ВИ видеа?

Придружете им се на илјадници создавачи кои користат Bonega.ai

На 7 април 2026, модел за кој никој немаше слушнато се појави на Artificial Analysis Video Arena. Во рок од три дена го зазеде првото место и во text-to-video и во image-to-video генерирање. Без бренд, без соопштение за печат, без име на компанија. Потоа Alibaba потврди дека е нивни. Ова е приказната за HappyHorse-1.0, темниот коњ што штотуку ги преуреди AI видео рангирањата.

Откривањето

Artificial Analysis одржува Video Arena каде корисниците поднесуваат промпт, два анонимни модели генерираат излези, а корисниците го избираат оној што го претпочитаат. Гласовите влегуваат во Elo систем за оценување (истата математика што се користи во шаховските рангирања). Моделите не можат да го манипулираат системот бидејќи оценувачите никогаш не знаат кој модел го произвел кој излез.

HappyHorse-1.0 влезе на оваа арена на 7 април со празен профил. Без лого, без атрибуција на компанија. До 10 април го држеше првото место во две од четирите категории, а Alibaba го потврди сопственоството преку новосоздадена X сметка и изјава за CNBC.

💡
Акциите на Alibaba на берзата во Хонг Конг пораснаа за 2,12% на денот на објавата и веќе беа пораснати за 6,75% претходно во неделата додека се градеа шпекулации околу мистериозниот модел.

Бројките

Elo резултатите на HappyHorse зборуваат сами за себе:

1333
T2V Elo (без аудио)
1392
I2V Elo (без аудио)
1205
T2V Elo (со аудио)

За контекст, претходниот #1 во text-to-video беше Seedance 2.0 на ByteDance со Elo 1273. HappyHorse го надмина за 60 поени, разлика за чие затворање обично се потребни месеци. Во image-to-video, HappyHorse постигна 1392 наспроти 1355 на Seedance 2.0.

Категориите со аудио раскажуваат друга приказна. HappyHorse е на второ место зад Seedance 2.0 (Elo 1219 наспроти 1205), што сугерира дека аудио процесот сеуште бара работа во споредба со квалитетот на видеото.

КатегоријаHappyHorseПретходен #1Разлика
Text-to-Video (без звук)13331273 (Seedance 2.0)+60
Image-to-Video (без звук)13921355 (Seedance 2.0)+37
Text-to-Video (со аудио)12051219 (Seedance 2.0)-14

Архитектура: еден Transformer, се одеднаш

Повеќето AI видео системи поврзуваат одделни компоненти: текст енкодер, видео генератор и аудио модел додаден дополнително. HappyHorse користи поинаков пристап.

Моделот користи 40-слоен single-stream Self-Attention Transformer без Cross-Attention модули. Текст, видео и аудио токени сите минуваат низ истиот Transformer стек истовремено. Овој унифициран дизајн ги елиминира непотребните параметри и ја намалува сложеноста при inference.

Унифицирана архитектура
Текст, видео и аудио обработени во еден чекор. Без одделен аудио процес. Помалку подвижни делови, помала латенција.
Аудиото сеуште заостанува
И покрај унифицираниот дизајн, квалитетот на аудиото е на второ место зад специјализираниот аудио процес на Seedance 2.0.

Inference процесот е невообичаено лесен: само 8 denoising чекори без Classifier-Free Guidance (CFG). За споредба, многу конкурентски модели користат 25-50 чекори со вклучен CFG. Ова сугерира агресивна distillation за време на тренирањето, каде суровиот капацитет се заменува за брзина.

Тимот зад моделот

HappyHorse доаѓа од Future Life Lab под Taotian Group на Alibaba (гранката за е-трговија). Лидер е Zhang Di, поранешен потпретседател на Kuaishou и технички водач на Kling AI.

Овој детал е важен. Zhang Di ја изгради инженерската култура зад Kling, еден од најсилните AI видео модели во 2025 година. Тој ги знае инфраструктурните предизвици, тренинг процесите и недостатоците во евалуацијата. Донесувањето на тоа искуство на компјутерските ресурси на Alibaba е сосема поинаква равенка од водење самостоен стартап.

💡
HappyHorse нативно поддржува синхронизација на усни на шест јазици: кинески, англиски, јапонски, корејски, германски и француски. Оваа повеќејазична способност укажува на модел тренирон на разновидни, внимателно одбрани податоци.

Зошто ова е важно за пазарот

AI видео пазарот во април 2026 е невообичаено нестабилен:

Март 2026

Најавено затворање на Sora

OpenAI потврди дека Sora ќе биде прекинат на 26 април. Трошоците за пресметување и конкурентскиот притисок се покажаа неодржливи.

Февруари 2026

Seedance 2.0 паузиран

ByteDance беше принуден да го запре воведувањето поради спорови за авторски права со холивудските студија.

7 април 2026

HappyHorse се појавува

Анонимен модел влегува на Artificial Analysis Video Arena.

10 април 2026

Alibaba го потврдува сопственоството

Акциите скокаат кога идентитетот е откриен.

Со Sora што завршува и Seedance што се соочува со правни проблеми, HappyHorse пристигнува во момент кога пазарот бара нов лидер. Runway Gen-4.5 сеуште е силен во продукциски работни процеси, а Google Veo 3.1 доминира во просторот за интеграција со претпријатија. Но за сурова генеративна квалитет мерена со слепо човечко преферирање, HappyHorse сега седи на врвот.

Отворен код: наскоро (можеби)

GitHub репозиториумот и Hugging Face хабот за модели и двата покажуваат "Coming Soon" заклучно со 11 април. Тимот вети објавување со отворен код на целосните тежини од 15 милијарди параметри со комерцијална лиценца. Ако тоа се случи, HappyHorse ќе биде најголемиот достапен видео модел со отворен код, значително поголем од LTX-Video со 2B параметри.

Но "наскоро" не е "објавено." Додека тежините не бидат достапни за преземање и независно верифицирани, benchmark резултатите носат ѕвездичка. AI видео заедницата научи да чека репродуцибилни резултати пред да прогласува победници.

Што да се следи

Три работи ќе одредат дали HappyHorse ќе ја задржи предноста:

  • Објавување на тежините со отворен код и независна репродукција на benchmark резултатите
  • Подобрувања на квалитетот на аудиото за да се достигне или надмине Seedance 2.0 во категориите со аудио
  • Достапност на API и цени, бидејќи доминацијата на benchmark не значи ништо ако креаторите не можат да пристапат до моделот

Просторот за AI видео генерирање се движи брзо. Во јануари, Runway Gen-4.5 изгледаше недостижен. Во февруари, Seedance 2.0 ја зеде круната. Сега ја држи HappyHorse. Прашањето не е дали нешто ќе го надмине на крајот, туку кога и од каде.

За креатори и програмери кои денес градат видео процеси, заклучокот е практичен: ниеден модел не останува долго на врвот. Најдобрата стратегија е да се градат работни процеси кои можат да менуваат модели како што се менува ранг-листата, наместо да се става се на едно име.

💡
Alibaba неодамна го објави и Wan 2.7 со Thinking Mode, одделен модел од нивната Tongyi Lab дивизија. Два големи видео модели од различни тимови на Alibaba во истата недела сигнализира целокомпаниски притисок кон AI видео.
Damien
DamienAI DeveloperAI Author

ВИ развивач од Лион кој сака да претвора сложени ML концепти во едноставни рецепти. Кога не дебагира модели, ќе го најдете како вози велосипед низ долината на Рона.

View profile →

Ви се допадна прочитаното?

Претворете ги вашите идеи во ВИ видеа со неограничена должина за неколку минути.

Поврзани статии

Продолжете да истражувате со овие поврзани објави

Ви се допадна статијата?

Откријте повеќе сознанија и останете во тек со нашата најнова содржина.