Alibaba HappyHorse-1.0: непознатият модел, който оглави всички класации за AI видео
Модел на име HappyHorse-1.0 се появи на Artificial Analysis без указание за автора, изкачи се до първото място в text-to-video и image-to-video, а после се оказа разработка на Alibaba. Ето какво знаем за архитектурата, екипа и какво означава това за пазара на AI видео.

Готови ли сте да създавате собствени ИИ видеа?
Присъединете се към хиляди създатели, които използват Bonega.ai
Разкриването
Artificial Analysis провежда Video Arena, където потребителите въвеждат промпт, два анонимни модела генерират видеа, а потребителите избират по-доброто. Гласовете постъпват в рейтингова система Elo (същата математика, използвана в шахматните класации). Моделите не могат да измамят системата, защото оценяващите не знаят кой модел е създал кой резултат.
HappyHorse-1.0 влезе на арената на 7 април с празен профил. Без лого, без указание за компания. До 10 април моделът зае първата позиция в две от четирите категории на класацията, а Alibaba потвърди авторството чрез новосъздаден акаунт в X и изявление пред CNBC.
Числата
Рейтингите Elo на HappyHorse говорят ясно:
За контекст: предишният лидер в text-to-video бе Seedance 2.0 на ByteDance с Elo 1273. HappyHorse го изпревари с 60 точки, разлика, която обикновено отнема месеци за преодоляване. В image-to-video HappyHorse получи 1392 срещу 1355 на Seedance 2.0.
В категориите с аудио картината е различна. HappyHorse е на второ място след Seedance 2.0 (Elo 1219 срещу 1205), което подсказва, че аудиопайплайнът все още се нуждае от работа в сравнение с качеството на видеото.
| Категория | HappyHorse | Предишен лидер | Разлика |
|---|---|---|---|
| Text-to-Video (без звук) | 1333 | 1273 (Seedance 2.0) | +60 |
| Image-to-Video (без звук) | 1392 | 1355 (Seedance 2.0) | +37 |
| Text-to-Video (с аудио) | 1205 | 1219 (Seedance 2.0) | -14 |
Архитектура: един Transformer, всичко наведнъж
Повечето AI системи за генериране на видео свързват отделни компоненти в поредица: текстов енкодер, видео генератор и аудио модел, закачен отгоре. HappyHorse избира различен подход.
Моделът използва 40-слоен еднопоточен Self-Attention Transformer без модули Cross-Attention. Текстови, видео и аудио токени преминават през един и същ стек на трансформера едновременно. Тази унифицирана архитектура елиминира излишните параметри и намалява сложността на инференса.
Пайплайнът за инференс е необичайно лек: само 8 стъпки за деноизинг без Classifier-Free Guidance (CFG). За сравнение, много конкурентни модели използват 25-50 стъпки с включен CFG. Това подсказва агресивна дистилация по време на обучението, при която скоростта е получена за сметка на обема изчисления.
Екипът
HappyHorse идва от Future Life Lab под Taotian Group (e-commerce подразделението на Alibaba). Ръководителят е Джан Ди, бивш вицепрезидент на Kuaishou и технически лидер на Kling AI.
Тази подробност е важна. Джан Ди изгради инженерната култура на Kling, един от най-силните AI видео модели на 2025 г. Той познава инфраструктурните предизвикателства, обучителните пайплайни и пропуските в оценяването. Пренасянето на този опит върху изчислителните ресурси на Alibaba е съвсем различно уравнение в сравнение с автономен стартъп.
Какво означава това за пазара
Пазарът на AI видео през април 2026 г. е необичайно нестабилен:
Обявено е закриването на Sora
OpenAI потвърди, че Sora ще прекрати работа на 26 април. Разходите за изчисления и конкурентният натиск се оказаха непосилни.
Seedance 2.0 спряна
ByteDance е принудена да спре разгръщането заради спорове за авторски права с холивудски студия.
Появата на HappyHorse
Анонимен модел влиза на арената на Artificial Analysis Video Arena.
Alibaba потвърждава авторството
Акциите скачат след разкриването на създателя.
С оттеглянето на Sora и правните проблеми на Seedance, HappyHorse се появява в момент, когато пазарът търси нов лидер. Runway Gen-4.5 все още е силен в продакшън воркфлоу, а Google Veo 3.1 доминира в корпоративните интеграции. Но по чисто качество на генериране, измерено чрез сляпо предпочитание от хора, HappyHorse вече е на върха.
Отворен код: скоро (може би)
На GitHub и в модулния хъб на Hugging Face към 11 април стои надпис "Coming Soon". Екипът обеща да публикува пълните тегла на модела от 15 милиарда параметъра с комерсиален лиценз. Ако това се случи, HappyHorse ще стане най-големият модел с отворен код за генериране на видео, значително по-голям от 2 милиарда параметъра на LTX-Video.
Но "скоро" не значи "публикувано". Докато теглата не могат да бъдат изтеглени и независимо верифицирани, резултатите от бенчмарковете идват със звездичка. AI общността вече се е научила да чака възпроизводими резултати, преди да обявява победители.
Какво да следим
Три фактора ще определят дали HappyHorse ще задържи лидерството:
- ✓Публикуване на теглата с отворен достъп и независимо възпроизвеждане на резултатите от бенчмарковете
- ✓Подобряване на качеството на аудиото до нивото на Seedance 2.0 в категориите с аудио
- ✓Наличност на API и ценообразуване, защото доминирането в бенчмаркове не струва нищо, ако създателите не могат да достъпят модела
Сферата на AI видео генерирането се движи бързо. През януари Runway Gen-4.5 изглеждаше недостижим. През февруари короната зае Seedance 2.0. Сега я държи HappyHorse. Въпросът не е дали нещо ще го надмине, а кога и откъде ще дойде конкурентът.
За създатели и разработчици, които изграждат видеопайплайни днес, изводът е практичен: никой модел не остава на върха задълго. Най-добрата стратегия е да се изграждат воркфлоу с възможност за бърза смяна на модели при промяна на класациите, вместо да се залага на едно име.

Разработчик на ИИ от Лион, който обича да превръща сложни концепции от машинното обучение в прости рецепти. Когато не отстранява грешки в модели, ще го откриете да кара колело из долината на Рона.
View profile →Свързани статии
Продължете да разглеждате с тези свързани публикации

Alibaba Wan 2.7: как Thinking Mode променя генерирането на видео с ИИ
Alibaba пусна Wan 2.7 с нов режим Thinking Mode, който планира композицията преди генериране на видео. Разглеждаме как работи и какво означава за създателите на съдържание.

AI видео след Sora: 4 пазарни нива, които трябва да знаете през 2026
Sora се затваря на 26 април. Пазарът на AI видео се консолидира в четири нива. Практическо ръководство за избор на правилната алтернатива на Sora за вашите нужди.

Google Veo 3.1 стана безплатен: 10 AI видеа на месец за всеки акаунт в Google
Google отвори Veo 3.1 за всички лични акаунти с 10 безплатни видео генерации месечно. Ето какво получавате, какви са ограниченията и защо е важно за създателите на AI видео.