Alibaba HappyHorse-1.0: неизвестная модель, которая возглавила все рейтинги AI-видео
Модель под названием HappyHorse-1.0 появилась на Artificial Analysis без указания автора, поднялась на первое место в генерации text-to-video и image-to-video, а затем оказалась разработкой Alibaba. Разбираем архитектуру, команду и последствия для рынка AI-видео.

Раскрытие
Artificial Analysis проводит Video Arena, где пользователи вводят промпт, две анонимные модели генерируют видео, а пользователи выбирают лучшее. Голоса поступают в систему рейтинга Elo (та же математика, что и в шахматных рейтингах). Модели не могут обмануть систему, потому что оценщики не знают, какая модель создала какой результат.
HappyHorse-1.0 вошла на арену 7 апреля с пустым профилем. Ни логотипа, ни указания компании. К 10 апреля модель заняла первую строку в двух из четырёх категорий рейтинга, и Alibaba подтвердила авторство через свежесозданный аккаунт в X и заявление для CNBC.
Цифры
Рейтинги Elo у HappyHorse говорят сами за себя:
Для контекста: предыдущий лидер в text-to-video, Seedance 2.0 от ByteDance, набрал Elo 1273. HappyHorse обошла его на 60 пунктов, разрыв, который обычно закрывают месяцами. В image-to-video HappyHorse набрала 1392 против 1355 у Seedance 2.0.
В категориях с аудио картина другая. HappyHorse на втором месте после Seedance 2.0 (Elo 1219 против 1205), что указывает на необходимость доработки аудиопайплайна относительно качества видео.
| Категория | HappyHorse | Бывший лидер | Разница |
|---|---|---|---|
| Text-to-Video (без звука) | 1333 | 1273 (Seedance 2.0) | +60 |
| Image-to-Video (без звука) | 1392 | 1355 (Seedance 2.0) | +37 |
| Text-to-Video (со звуком) | 1205 | 1219 (Seedance 2.0) | -14 |
Архитектура: один Transformer, всё сразу
Большинство AI-систем для генерации видео объединяют отдельные компоненты в цепочку: текстовый энкодер, генератор видео и модель аудио, прикрученную сверху. HappyHorse идёт другим путём.
Модель использует 40-слойный однопоточный Self-Attention Transformer без модулей Cross-Attention. Текстовые, видео- и аудиотокены проходят через один и тот же стек трансформера одновременно. Такая унифицированная архитектура устраняет избыточные параметры и снижает сложность инференса.
Пайплайн инференса необычно лёгкий: всего 8 шагов деноизинга без Classifier-Free Guidance (CFG). Для сравнения, многие конкурирующие модели используют 25-50 шагов с включённым CFG. Это указывает на агрессивную дистилляцию при обучении, где скорость получена за счёт объёма вычислений.
Команда
HappyHorse создана в Future Life Lab при Taotian Group (e-commerce подразделение Alibaba). Руководитель проекта, Чжан Ди, бывший вице-президент Kuaishou и технический лидер Kling AI.
Это важная деталь. Чжан Ди создал инженерную культуру Kling, одной из сильнейших AI-видео моделей 2025 года. Он знает инфраструктурные вызовы, обучающие пайплайны и пробелы в оценке. Перенос этого опыта на вычислительные ресурсы Alibaba, это совсем другое уравнение по сравнению с автономным стартапом.
Что это значит для рынка
Рынок AI-видео в апреле 2026 года необычайно нестабилен:
Объявлено о закрытии Sora
OpenAI подтвердила, что Sora прекратит работу 26 апреля. Затраты на вычисления и конкурентное давление оказались неподъёмными.
Seedance 2.0 приостановлена
ByteDance вынуждена остановить развёртывание из-за споров об авторских правах с голливудскими студиями.
Появление HappyHorse
Анонимная модель выходит на арену Artificial Analysis Video Arena.
Alibaba подтверждает авторство
Акции растут после раскрытия личности создателя.
С уходом Sora и юридическими проблемами Seedance, HappyHorse появляется в момент, когда рынок ищет нового лидера. Runway Gen-4.5 по-прежнему силён в продакшн-воркфлоу, а Google Veo 3.1 доминирует в корпоративных интеграциях. Но по чистому качеству генерации, измеренному слепым предпочтением людей, HappyHorse теперь на вершине.
Открытый исходный код: скоро (возможно)
На GitHub и в модельном хабе Hugging Face по состоянию на 11 апреля стоит отметка "Coming Soon". Команда пообещала выложить полные веса модели на 15 миллиардов параметров с коммерческой лицензией. Если это произойдёт, HappyHorse станет крупнейшей открытой моделью генерации видео, значительно больше 2 миллиардов параметров LTX-Video.
Но "скоро" не значит "выпущено". Пока веса нельзя скачать и независимо проверить, результаты бенчмарков идут со звёздочкой. AI-сообщество уже научилось ждать воспроизводимых результатов, прежде чем объявлять победителей.
На что обратить внимание
Три фактора определят, удержит ли HappyHorse лидерство:
- ✓Публикация весов в открытый доступ и независимое воспроизведение результатов бенчмарков
- ✓Улучшение качества аудио до уровня Seedance 2.0 в категориях с аудио
- ✓Доступность API и ценообразование, потому что доминирование в бенчмарках ничего не значит, если создатели не могут получить доступ к модели
Сфера генерации AI-видео движется быстро. В январе Runway Gen-4.5 казался недосягаемым. В феврале корону забрал Seedance 2.0. Теперь она у HappyHorse. Вопрос не в том, обойдёт ли кто-нибудь эту модель, а когда и откуда придёт конкурент.
Для создателей и разработчиков, которые строят видеопайплайны сегодня, вывод практический: ни одна модель не остаётся на вершине надолго. Лучшая стратегия, строить воркфлоу с возможностью быстрой замены моделей при изменении рейтингов, а не делать ставку на одно имя.

Разработчик ИИ из Лиона, который любит превращать сложные концепции ML в простые рецепты. Когда он не отлаживает модели, его можно встретить на велосипеде в долине Роны.
View profile →Похожие статьи
Продолжите знакомство с этими похожими публикациями

Alibaba Wan 2.7: как режим Thinking Mode меняет генерацию видео с помощью ИИ
Alibaba выпустила Wan 2.7 с новым режимом Thinking Mode, который планирует композицию перед генерацией видео. Разбираем, как это работает и что это значит для создателей контента.

AI-видео после Sora: 4 уровня рынка в 2026 году
Sora закрывается 26 апреля. Рынок AI-видео консолидировался в четыре уровня. Практическое руководство по выбору подходящей альтернативы Sora.

Google Veo 3.1 стал бесплатным: 10 AI-видео в месяц для каждого аккаунта Google
Google открыл Veo 3.1 для всех личных аккаунтов с 10 бесплатными генерациями видео в месяц. Что вы получаете, какие есть ограничения и почему это важно для создателей AI-видео.