Alibaba HappyHorse-1.0: מודל המסתורין שהוביל כל דירוג של וידאו מבוסס AI
מודל בשם HappyHorse-1.0 הופיע ב-Artificial Analysis ללא ייחוס, טיפס למקום הראשון גם בטקסט לווידאו וגם בתמונה לווידאו, ואז התברר שהוא של Alibaba. הנה מה שאנו יודעים על הארכיטקטורה, הצוות ומה המשמעות עבור שוק הווידאו המבוסס AI.

החשיפה
Artificial Analysis מפעילה Video Arena שבו משתמשים שולחים פרומפט, שני מודלים אנונימיים יוצרים פלטים, והמשתמשים בוחרים את זה שהם מעדיפים. ההצבעות מזינות מערכת דירוג Elo (אותה מתמטיקה המשמשת בדירוגי שחמט). מודלים אינם יכולים להטות את המערכת, מפני שהמעריכים לעולם אינם יודעים איזה מודל יצר איזה פלט.
HappyHorse-1.0 נכנס לזירה ב-7 באפריל תחת פרופיל ריק. ללא לוגו, ללא ייחוס חברה. עד 10 באפריל הוא החזיק במקום הראשון בשתי מתוך ארבע קטגוריות הדירוג, ו-Alibaba אישרה בעלות באמצעות חשבון X חדש שנוצר והצהרה ל-CNBC.
המספרים
ציוני ה-Elo של HappyHorse מספרים את הסיפור בבירור:
לשם הקשר, המקום הראשון הקודם בטקסט לווידאו היה Seedance 2.0 של ByteDance, עם Elo של 1273. HappyHorse ניצח אותו ב-60 נקודות, פער שבדרך כלל לוקח חודשים לסגור. בתמונה לווידאו, HappyHorse קיבל 1392 לעומת 1355 של Seedance 2.0.
הקטגוריות הכוללות אודיו מספרות סיפור שונה. HappyHorse נמצא במקום השני אחרי Seedance 2.0 (Elo של 1219 לעומת 1205), מה שמרמז שצינור האודיו עדיין זקוק לעבודה ביחס לאיכות הווידאו.
| קטגוריה | HappyHorse | המקום הראשון הקודם | פער |
|---|---|---|---|
| טקסט לווידאו (שקט) | 1333 | 1273 (Seedance 2.0) | +60 |
| תמונה לווידאו (שקט) | 1392 | 1355 (Seedance 2.0) | +37 |
| טקסט לווידאו (אודיו) | 1205 | 1219 (Seedance 2.0) | -14 |
ארכיטקטורה: Transformer אחד, הכול בו-זמנית
רוב מערכות הווידאו מבוססות AI משרשרות רכיבים נפרדים: מקודד טקסט, מחולל וידאו ומודל אודיו שמחובר לאחר מכן. HappyHorse נוקט גישה אחרת.
המודל משתמש ב-40-layer single-stream Self-Attention Transformer ללא מודולי Cross-Attention. אסימוני טקסט, וידאו ואודיו כולם זורמים דרך אותה ערימת Transformer בו-זמנית. העיצוב המאוחד הזה מבטל פרמטרים מיותרים ומפחית את מורכבות ההסקה.
צינור ההסקה רזה באופן חריג: רק 8 שלבי denoising ללא Classifier-Free Guidance (CFG). לשם השוואה, מודלים מתחרים רבים משתמשים ב-25-50 שלבים עם CFG מופעל. הדבר מרמז על distillation אגרסיבי במהלך האימון, שמחליף קיבולת גולמית במהירות.
הצוות שמאחוריו
HappyHorse מגיע מ-Future Life Lab תחת Taotian Group של Alibaba (זרוע המסחר האלקטרוני). המוביל הוא Zhang Di, לשעבר VP ב-Kuaishou והמוביל הטכני של Kling AI.
הפרט הזה חשוב. Zhang Di בנה את תרבות ההנדסה שמאחורי Kling, אחד ממודלי הווידאו מבוססי AI החזקים ביותר של 2025. הוא מכיר את אתגרי התשתית, צינורות האימון ופערי ההערכה. שילוב הניסיון הזה עם משאבי המחשוב של Alibaba הוא משוואה שונה מהפעלת סטארטאפ עצמאי.
מדוע זה חשוב לשוק
שוק הווידאו מבוסס AI באפריל 2026 תנודתי באופן חריג:
הוכרז על סגירת Sora
OpenAI אישרה ש-Sora תופסק ב-26 באפריל. עלויות המחשוב והלחץ התחרותי התבררו כבלתי בני-קיימא.
Seedance 2.0 הושהתה
ByteDance נאלצה לעצור את ההשקה בעקבות סכסוכי זכויות יוצרים עם אולפני Hollywood.
HappyHorse מופיע
מודל אנונימי נכנס ל-Video Arena של Artificial Analysis.
Alibaba מאשרת בעלות
המניה מזנקת כשהזהות נחשפת.
כש-Sora מצטמצמת ו-Seedance מתמודדת עם כאבי ראש משפטיים, HappyHorse מגיע ברגע שבו השוק מחפש מוביל חדש. Runway Gen-4.5 עדיין מחזיק מעמד היטב בתהליכי הפקה, ו-Google Veo 3.1 שולט בתחום האינטגרציה הארגונית. אך באיכות יצירה גולמית הנמדדת לפי העדפה אנושית עיוורת, HappyHorse נמצא כעת בראש.
קוד פתוח: בקרוב (אולי)
מאגר ה-GitHub ומרכז המודלים של Hugging Face מציגים שניהם "Coming Soon" נכון ל-11 באפריל. הצוות הבטיח שחרור קוד פתוח של המשקלים המלאים, עם 15 מיליארד פרמטרים ורישיון מסחרי. אם זה יקרה, HappyHorse יהיה מודל הווידאו הגדול ביותר בקוד פתוח הזמין, גדול משמעותית מ-2B הפרמטרים של LTX-Video.
אך "בקרוב" אינו "שוחרר". עד שהמשקלים יהיו זמינים להורדה ויאומתו באופן עצמאי, לתוצאות ה-benchmark יש כוכבית. קהילת הווידאו מבוסס ה-AI למדה להמתין לתוצאות שניתן לשחזר לפני שמכריזים על מנצחים.
מה לעקוב אחריו
שלושה דברים יקבעו אם HappyHorse ישמור על ההובלה שלו:
- ✓שחרור משקלים בקוד פתוח ושחזור עצמאי של תוצאות ה-benchmark
- ✓שיפורי איכות אודיו כדי להשתוות ל-Seedance 2.0 או לגבור עליו בקטגוריות הכוללות אודיו
- ✓זמינות API ותמחור, כי דומיננטיות ב-benchmark אינה שווה דבר אם יוצרים אינם יכולים לגשת למודל
תחום יצירת הווידאו מבוסס AI מתקדם במהירות. בינואר, Runway Gen-4.5 נראתה בלתי ניתנת לערעור. בפברואר, Seedance 2.0 לקחה את הכתר. כעת HappyHorse מחזיק בו. השאלה אינה אם משהו יגבר עליו בסופו של דבר, אלא מתי ומאיפה.
עבור יוצרים ומפתחים שבונים כיום צינורות וידאו, המסקנה מעשית: אף מודל יחיד לא נשאר בראש לזמן רב. האסטרטגיה הטובה ביותר היא לבנות תהליכי עבודה שיכולים להחליף מודלים כשהטבלה משתנה, במקום להמר על הכול על שם אחד.
מקורות
- Kaiyuan Securities Research Institute: HappyHorse-1.0 הגיע ל-1333 Elo והוביל את טבלת הווידאו של Artificial Analysis באפריל… (Kaiyuan Securities Research Institute)

מפתח בינה מלאכותית מליון שאוהב להפוך מושגי ML מורכבים למתכונים פשוטים. כשהוא לא מנפה באגים ממודלים, תמצאו אותו רוכב על אופניים בעמק הרון.
View profile →מאמרים קשורים
המשיכו לגלות עם הפוסטים הקשורים האלה

Kling O1: Kuaishou מצטרפת למירוץ המודלים המולטימודליים המאוחדים
Kuaishou השיקה זה עתה את Kling O1, בינה מלאכותית מולטימודלית מאוחדת שחושבת בוידאו, אודיו וטקסט בו-זמנית. המירוץ על אינטליגנציה אודיו-ויזואלית מתחמם.

כלי וידאו AI חינמיים ללא הגבלה: מה עובד ב-2026
כלי וידאו AI חינמיים ללא הגבלה מבוססים בדרך כלל על תורים או על עבודה מקומית. למדו מה באמת אינו מוגבל, מה מאט אתכם ואיך לבחור מערך עבודה מעשי ל-2026.

מרחיב וידאו AI: הארכת סרטונים ב-2026
השתמשו במרחיב וידאו AI כדי להאריך סרטונים ב-2026. השוו מגבלות הארכה, שמרו על רציפות ובחרו תהליך עבודה עבור קליפים שנוצרו או קיימים.