Meta PixelПерейти к основному содержимому
DamienDamien· Автор ИИ, проверено человеком
5 min read
917 слов

Alibaba HappyHorse-1.0: неизвестная модель, которая возглавила все рейтинги AI-видео

Модель под названием HappyHorse-1.0 появилась на Artificial Analysis без указания автора, поднялась на первое место в генерации text-to-video и image-to-video, а затем оказалась разработкой Alibaba. Разбираем архитектуру, команду и последствия для рынка AI-видео.

Alibaba HappyHorse-1.0: неизвестная модель, которая возглавила все рейтинги AI-видео

Готовы создавать собственные видео с ИИ?

Присоединяйтесь к тысячам авторов, использующих Bonega.ai

7 апреля 2026 года на арене Artificial Analysis Video Arena появилась модель, о которой никто не слышал. За три дня она заняла первое место сразу в двух категориях: text-to-video и image-to-video. Ни логотипа, ни пресс-релиза, ни названия компании. Потом Alibaba подтвердила, что это их разработка. Вот история HappyHorse-1.0, тёмной лошадки, которая перетасовала рейтинги AI-видео.

Раскрытие

Artificial Analysis проводит Video Arena, где пользователи вводят промпт, две анонимные модели генерируют видео, а пользователи выбирают лучшее. Голоса поступают в систему рейтинга Elo (та же математика, что и в шахматных рейтингах). Модели не могут обмануть систему, потому что оценщики не знают, какая модель создала какой результат.

HappyHorse-1.0 вошла на арену 7 апреля с пустым профилем. Ни логотипа, ни указания компании. К 10 апреля модель заняла первую строку в двух из четырёх категорий рейтинга, и Alibaba подтвердила авторство через свежесозданный аккаунт в X и заявление для CNBC.

💡
Акции Alibaba на Гонконгской бирже выросли на 2,12% в день объявления. За неделю до этого, пока вокруг загадочной модели нарастали слухи, рост уже составил 6,75%.

Цифры

Рейтинги Elo у HappyHorse говорят сами за себя:

1333
T2V Elo (без аудио)
1392
I2V Elo (без аудио)
1205
T2V Elo (с аудио)

Для контекста: предыдущий лидер в text-to-video, Seedance 2.0 от ByteDance, набрал Elo 1273. HappyHorse обошла его на 60 пунктов, разрыв, который обычно закрывают месяцами. В image-to-video HappyHorse набрала 1392 против 1355 у Seedance 2.0.

В категориях с аудио картина другая. HappyHorse на втором месте после Seedance 2.0 (Elo 1219 против 1205), что указывает на необходимость доработки аудиопайплайна относительно качества видео.

КатегорияHappyHorseБывший лидерРазница
Text-to-Video (без звука)13331273 (Seedance 2.0)+60
Image-to-Video (без звука)13921355 (Seedance 2.0)+37
Text-to-Video (со звуком)12051219 (Seedance 2.0)-14

Архитектура: один Transformer, всё сразу

Большинство AI-систем для генерации видео объединяют отдельные компоненты в цепочку: текстовый энкодер, генератор видео и модель аудио, прикрученную сверху. HappyHorse идёт другим путём.

Модель использует 40-слойный однопоточный Self-Attention Transformer без модулей Cross-Attention. Текстовые, видео- и аудиотокены проходят через один и тот же стек трансформера одновременно. Такая унифицированная архитектура устраняет избыточные параметры и снижает сложность инференса.

Унифицированная архитектура
Текст, видео и аудио обрабатываются за один проход. Нет отдельного аудиопайплайна. Меньше движущихся частей, ниже задержка.
Аудио пока отстаёт
Несмотря на унифицированный дизайн, качество аудио занимает второе место после специализированного аудиопайплайна Seedance 2.0.

Пайплайн инференса необычно лёгкий: всего 8 шагов деноизинга без Classifier-Free Guidance (CFG). Для сравнения, многие конкурирующие модели используют 25-50 шагов с включённым CFG. Это указывает на агрессивную дистилляцию при обучении, где скорость получена за счёт объёма вычислений.

Команда

HappyHorse создана в Future Life Lab при Taotian Group (e-commerce подразделение Alibaba). Руководитель проекта, Чжан Ди, бывший вице-президент Kuaishou и технический лидер Kling AI.

Это важная деталь. Чжан Ди создал инженерную культуру Kling, одной из сильнейших AI-видео моделей 2025 года. Он знает инфраструктурные вызовы, обучающие пайплайны и пробелы в оценке. Перенос этого опыта на вычислительные ресурсы Alibaba, это совсем другое уравнение по сравнению с автономным стартапом.

💡
HappyHorse нативно поддерживает синхронизацию губ на шести языках: китайском, английском, японском, корейском, немецком и французском. Эта мультиязычная возможность указывает на модель, обученную на разнообразных и тщательно отобранных данных.

Что это значит для рынка

Рынок AI-видео в апреле 2026 года необычайно нестабилен:

Март 2026

Объявлено о закрытии Sora

OpenAI подтвердила, что Sora прекратит работу 26 апреля. Затраты на вычисления и конкурентное давление оказались неподъёмными.

Февраль 2026

Seedance 2.0 приостановлена

ByteDance вынуждена остановить развёртывание из-за споров об авторских правах с голливудскими студиями.

7 апреля 2026

Появление HappyHorse

Анонимная модель выходит на арену Artificial Analysis Video Arena.

10 апреля 2026

Alibaba подтверждает авторство

Акции растут после раскрытия личности создателя.

С уходом Sora и юридическими проблемами Seedance, HappyHorse появляется в момент, когда рынок ищет нового лидера. Runway Gen-4.5 по-прежнему силён в продакшн-воркфлоу, а Google Veo 3.1 доминирует в корпоративных интеграциях. Но по чистому качеству генерации, измеренному слепым предпочтением людей, HappyHorse теперь на вершине.

Открытый исходный код: скоро (возможно)

На GitHub и в модельном хабе Hugging Face по состоянию на 11 апреля стоит отметка "Coming Soon". Команда пообещала выложить полные веса модели на 15 миллиардов параметров с коммерческой лицензией. Если это произойдёт, HappyHorse станет крупнейшей открытой моделью генерации видео, значительно больше 2 миллиардов параметров LTX-Video.

Но "скоро" не значит "выпущено". Пока веса нельзя скачать и независимо проверить, результаты бенчмарков идут со звёздочкой. AI-сообщество уже научилось ждать воспроизводимых результатов, прежде чем объявлять победителей.

На что обратить внимание

Три фактора определят, удержит ли HappyHorse лидерство:

  • Публикация весов в открытый доступ и независимое воспроизведение результатов бенчмарков
  • Улучшение качества аудио до уровня Seedance 2.0 в категориях с аудио
  • Доступность API и ценообразование, потому что доминирование в бенчмарках ничего не значит, если создатели не могут получить доступ к модели

Сфера генерации AI-видео движется быстро. В январе Runway Gen-4.5 казался недосягаемым. В феврале корону забрал Seedance 2.0. Теперь она у HappyHorse. Вопрос не в том, обойдёт ли кто-нибудь эту модель, а когда и откуда придёт конкурент.

Для создателей и разработчиков, которые строят видеопайплайны сегодня, вывод практический: ни одна модель не остаётся на вершине надолго. Лучшая стратегия, строить воркфлоу с возможностью быстрой замены моделей при изменении рейтингов, а не делать ставку на одно имя.

💡
Alibaba также недавно выпустила Wan 2.7 с режимом Thinking, отдельную модель от подразделения Tongyi Lab. Две крупные видеомодели от разных команд Alibaba за одну неделю, это сигнал о масштабном движении компании в сторону AI-видео.
Damien
DamienAI DeveloperAI Author

Разработчик ИИ из Лиона, который любит превращать сложные концепции ML в простые рецепты. Когда он не отлаживает модели, его можно встретить на велосипеде в долине Роны.

View profile →

Понравилось прочитанное?

Превращайте свои идеи в ИИ-видео неограниченной длины за считанные минуты.

Похожие статьи

Продолжите знакомство с этими похожими публикациями

Понравилась эта статья?

Откройте для себя больше полезных идей и следите за нашими последними материалами.