Meta PixelLangkau ke kandungan utama
DamienDamien· Penulis AI, disemak oleh manusia
5 min read
1002 perkataan

Alibaba HappyHorse-1.0: Model Misteri Yang Mendahului Setiap Papan Pendahulu Video AI

Sebuah model bernama HappyHorse-1.0 muncul di Artificial Analysis tanpa atribusi, naik ke #1 dalam kedua-dua text-to-video dan image-to-video, kemudian didapati milik Alibaba. Inilah yang kami tahu tentang seni bina, pasukan, dan maknanya untuk pasaran video AI.

Alibaba HappyHorse-1.0: Model Misteri Yang Mendahului Setiap Papan Pendahulu Video AI

Bersedia untuk mencipta video AI anda sendiri?

Sertai ribuan pencipta yang menggunakan Bonega.ai

Pada 7 April 2026, sebuah model yang tidak pernah didengari sesiapa muncul di Artificial Analysis Video Arena. Dalam masa tiga hari, ia memegang tempat #1 dalam penjanaan text-to-video dan image-to-video. Tiada penjenamaan, tiada siaran akhbar, tiada nama syarikat dilampirkan. Kemudian Alibaba mengesahkan ia milik mereka. Inilah kisah HappyHorse-1.0, pencabar tidak diduga yang baru sahaja mengubah susunan ranking video AI.

Pendedahan

Artificial Analysis mengendalikan Video Arena tempat pengguna menyerahkan prompt, dua model tanpa nama menjana output, dan pengguna memilih yang mereka gemari. Undian dimasukkan ke dalam sistem penarafan Elo (matematik yang sama digunakan dalam ranking catur). Model tidak boleh memanipulasi sistem kerana penilai tidak pernah tahu model mana menghasilkan output tertentu.

HappyHorse-1.0 memasuki arena ini pada 7 April di bawah profil kosong. Tiada logo, tiada atribusi syarikat. Menjelang 10 April, ia memegang kedudukan teratas dalam dua daripada empat kategori ranking, dan Alibaba mengesahkan pemilikan melalui akaun X yang baru dicipta serta kenyataan kepada CNBC.

💡
Saham Alibaba yang disenaraikan di Hong Kong meningkat 2.12% pada hari pengumuman dan telah naik 6.75% lebih awal pada minggu tersebut ketika spekulasi mengenai model misteri itu semakin hangat.

Angka

Skor Elo HappyHorse menceritakan kisahnya dengan jelas:

1333
Elo T2V (Tanpa Audio)
1392
Elo I2V (Tanpa Audio)
1205
Elo T2V (Dengan Audio)

Sebagai konteks, #1 sebelumnya dalam text-to-video ialah Seedance 2.0 milik ByteDance pada Elo 1273. HappyHorse mengatasinya sebanyak 60 mata, jurang yang biasanya mengambil masa berbulan-bulan untuk dirapatkan. Dalam image-to-video, HappyHorse mencatat 1392 berbanding 1355 untuk Seedance 2.0.

Kategori yang merangkumi audio menceritakan kisah berbeza. HappyHorse berada di #2 di belakang Seedance 2.0 (Elo 1219 berbanding 1205), menunjukkan saluran audio masih memerlukan penambahbaikan berbanding kualiti video.

KategoriHappyHorse#1 SebelumnyaJurang
Text-to-Video (senyap)13331273 (Seedance 2.0)+60
Image-to-Video (senyap)13921355 (Seedance 2.0)+37
Text-to-Video (audio)12051219 (Seedance 2.0)-14

Seni Bina: Satu Transformer, Semuanya Serentak

Kebanyakan sistem video AI merantaikan komponen berasingan: pengekod teks, penjana video, dan model audio yang ditambah kemudian. HappyHorse mengambil pendekatan berbeza.

Model ini menggunakan Self-Attention Transformer aliran tunggal 40 lapisan tanpa modul Cross-Attention. Token teks, video, dan audio semuanya mengalir melalui tindanan transformer yang sama secara serentak. Reka bentuk bersepadu ini menghapuskan parameter berlebihan dan mengurangkan kerumitan inferens.

Seni bina bersepadu
Teks, video, dan audio diproses dalam satu laluan. Tiada saluran audio berasingan. Lebih sedikit komponen bergerak, kependaman lebih rendah.
Audio masih ketinggalan
Walaupun reka bentuk bersepadu, kualiti audio berada di #2 di belakang saluran audio khusus Seedance 2.0.

Saluran inferensnya luar biasa ringkas: hanya 8 langkah denoising tanpa Classifier-Free Guidance (CFG). Sebagai perbandingan, banyak model pesaing menggunakan 25-50 langkah dengan CFG diaktifkan. Ini menunjukkan penyulingan agresif semasa latihan, menukar kapasiti mentah untuk kelajuan.

Pasukan Di Sebaliknya

HappyHorse berasal daripada Future Life Lab di bawah Taotian Group Alibaba (bahagian e-dagang). Penerajunya ialah Zhang Di, bekas VP Kuaishou dan ketua teknikal Kling AI.

Butiran itu penting. Zhang Di membina budaya kejuruteraan di sebalik Kling, salah satu model video AI terkuat pada 2025. Beliau memahami cabaran infrastruktur, saluran latihan, dan jurang penilaian. Membawa pengalaman itu kepada sumber pengkomputeran Alibaba menghasilkan persamaan yang berbeza daripada mengendalikan syarikat permulaan berdiri sendiri.

💡
HappyHorse menyokong lip sync secara natif dalam enam bahasa: Cina, Inggeris, Jepun, Korea, Jerman, dan Perancis. Keupayaan pelbagai bahasa ini membayangkan model yang dilatih menggunakan data pelbagai dan dipilih dengan teliti.

Mengapa Ini Penting untuk Pasaran

Pasaran video AI pada April 2026 sangat tidak menentu:

Mac 2026

Penutupan Sora diumumkan

OpenAI mengesahkan Sora akan dihentikan pada 26 April. Kos pengkomputeran dan tekanan persaingan terbukti tidak mampan.

Februari 2026

Seedance 2.0 dihentikan sementara

ByteDance terpaksa menghentikan pelancaran susulan pertikaian hak cipta dengan studio Hollywood.

7 April 2026

HappyHorse muncul

Model tanpa nama memasuki Artificial Analysis Video Arena.

10 April 2026

Alibaba mengesahkan pemilikan

Saham melonjak apabila identiti didedahkan.

Dengan Sora semakin dihentikan dan Seedance menghadapi masalah undang-undang, HappyHorse tiba pada saat pasaran mencari peneraju baharu. Runway Gen-4.5 masih kukuh dalam aliran kerja produksi, dan Google Veo 3.1 menguasai ruang integrasi perusahaan. Namun bagi kualiti penjanaan mentah yang diukur melalui pilihan manusia secara buta, HappyHorse kini berada di puncak.

Sumber Terbuka: Akan Datang (Mungkin)

Repositori GitHub dan hab model Hugging Face kedua-duanya menunjukkan "Coming Soon" setakat 11 April. Pasukan itu menjanjikan keluaran sumber terbuka bagi pemberat penuh 15 bilion parameter dengan lesen komersial. Jika itu berlaku, HappyHorse akan menjadi model video sumber terbuka terbesar yang tersedia, jauh lebih besar daripada 2B parameter LTX-Video.

Namun "coming soon" bukan "released." Sehingga pemberat boleh dimuat turun dan disahkan secara bebas, hasil penanda aras itu mempunyai tanda bintang. Komuniti video AI telah belajar untuk menunggu hasil yang boleh dihasilkan semula sebelum mengisytiharkan pemenang.

Perkara untuk Diperhatikan

Tiga perkara akan menentukan sama ada HappyHorse mengekalkan kelebihannya:

  • Keluaran pemberat sumber terbuka dan penghasilan semula bebas bagi hasil penanda aras
  • Penambahbaikan kualiti audio untuk menyamai atau mengatasi Seedance 2.0 dalam kategori yang merangkumi audio
  • Ketersediaan dan harga API, kerana penguasaan penanda aras tidak bermakna jika pencipta tidak dapat mengakses model tersebut

Ruang penjanaan video AI bergerak pantas. Pada Januari, Runway Gen-4.5 kelihatan sukar ditandingi. Pada Februari, Seedance 2.0 mengambil takhta. Kini HappyHorse memegangnya. Persoalannya bukan sama ada sesuatu akhirnya akan mengatasinya, tetapi bila dan dari mana.

Bagi pencipta dan pembangun yang membina saluran video hari ini, kesimpulannya praktikal: tiada satu model kekal di puncak untuk tempoh lama. Strategi terbaik ialah membina aliran kerja yang boleh menukar model apabila papan pendahulu berubah, bukannya mempertaruhkan segalanya pada satu nama.

💡
Alibaba juga baru-baru ini melancarkan Wan 2.7 dengan Thinking Mode, model berasingan daripada bahagian Tongyi Lab mereka. Dua model video utama daripada pasukan Alibaba yang berbeza dalam minggu yang sama menandakan dorongan seluruh syarikat ke dalam video AI.

Sumber

Damien
DamienAI DeveloperAI Author

Pembangun AI dari Lyon yang gemar mengubah konsep ML yang kompleks menjadi resipi mudah. Apabila tidak menyahpepijat model, anda akan menemuinya berbasikal di lembah Rhône.

View profile →

Suka apa yang anda baca?

Tukar idea anda menjadi video AI berdurasi tanpa had dalam beberapa minit.

Artikel Berkaitan

Teruskan meneroka dengan catatan berkaitan ini

Menikmati artikel ini?

Temui lebih banyak pandangan dan kekal dikemas kini dengan kandungan terkini kami.