Alibaba HappyHorse-1.0: Το μυστηριώδες μοντέλο που κατέκτησε κάθε κατάταξη AI video
Ένα μοντέλο με το όνομα HappyHorse-1.0 εμφανίστηκε στο Artificial Analysis χωρίς αναφορά δημιουργού, ανέβηκε στο #1 τόσο στο text-to-video όσο και στο image-to-video, και αποδείχτηκε ότι ανήκει στην Alibaba. Ορίστε τι γνωρίζουμε για την αρχιτεκτονική, την ομάδα και τι σημαίνει για την αγορά AI video.

Είστε έτοιμοι να δημιουργήσετε τα δικά σας βίντεο με ΤΝ;
Γίνετε μέλος της κοινότητας χιλιάδων δημιουργών που χρησιμοποιούν το Bonega.ai
Η αποκάλυψη
Το Artificial Analysis λειτουργεί ένα Video Arena όπου οι χρήστες υποβάλλουν ένα prompt, δύο ανώνυμα μοντέλα δημιουργούν αποτελέσματα και οι χρήστες επιλέγουν αυτό που προτιμούν. Οι ψήφοι τροφοδοτούν ένα σύστημα αξιολόγησης Elo (τα ίδια μαθηματικά που χρησιμοποιούνται στις κατατάξεις σκακιού). Τα μοντέλα δεν μπορούν να χειραγωγήσουν το σύστημα, γιατί οι αξιολογητές δεν γνωρίζουν ποτέ ποιο μοντέλο παρήγαγε ποιο αποτέλεσμα.
Το HappyHorse-1.0 μπήκε σε αυτή την αρένα στις 7 Απριλίου με κενό προφίλ. Χωρίς λογότυπο, χωρίς εταιρική αναφορά. Μέχρι τις 10 Απριλίου κατείχε την κορυφαία θέση σε δύο από τις τέσσερις κατηγορίες κατάταξης, και η Alibaba επιβεβαίωσε την ιδιοκτησία μέσω ενός νεοδημιουργημένου λογαριασμού X και μιας δήλωσης στο CNBC.
Οι αριθμοί
Τα Elo scores του HappyHorse μιλούν από μόνα τους:
Για να έχετε μια εικόνα, το προηγούμενο #1 στο text-to-video ήταν το Seedance 2.0 της ByteDance με Elo 1273. Το HappyHorse το ξεπέρασε κατά 60 πόντους, ένα χάσμα που συνήθως χρειάζεται μήνες για να κλείσει. Στο image-to-video, το HappyHorse πέτυχε 1392 έναντι 1355 του Seedance 2.0.
Οι κατηγορίες που περιλαμβάνουν ήχο δείχνουν διαφορετική εικόνα. Το HappyHorse βρίσκεται στη #2 θέση πίσω από το Seedance 2.0 (Elo 1219 vs. 1205), υποδεικνύοντας ότι το pipeline ήχου χρειάζεται ακόμη βελτίωση σε σχέση με την ποιότητα video.
| Κατηγορία | HappyHorse | Προηγούμενο #1 | Διαφορά |
|---|---|---|---|
| Text-to-Video (σιωπηλό) | 1333 | 1273 (Seedance 2.0) | +60 |
| Image-to-Video (σιωπηλό) | 1392 | 1355 (Seedance 2.0) | +37 |
| Text-to-Video (με ήχο) | 1205 | 1219 (Seedance 2.0) | -14 |
Αρχιτεκτονική: Ένας Transformer, τα πάντα ταυτόχρονα
Τα περισσότερα συστήματα AI video αλυσιδώνουν ξεχωριστά στοιχεία: έναν κωδικοποιητή κειμένου, έναν γεννήτρια video και ένα μοντέλο ήχου που προστίθεται εκ των υστέρων. Το HappyHorse ακολουθεί διαφορετική προσέγγιση.
Το μοντέλο χρησιμοποιεί ένα Self-Attention Transformer μονής ροής 40 επιπέδων χωρίς modules Cross-Attention. Τα tokens κειμένου, video και ήχου ρέουν ταυτόχρονα μέσα από το ίδιο transformer stack. Αυτός ο ενοποιημένος σχεδιασμός εξαλείφει τις περιττές παραμέτρους και μειώνει την πολυπλοκότητα της εξαγωγής συμπερασμάτων.
Το pipeline εξαγωγής συμπερασμάτων είναι ασυνήθιστα λιτό: μόνο 8 βήματα denoising χωρίς Classifier-Free Guidance (CFG). Για σύγκριση, πολλά ανταγωνιστικά μοντέλα χρησιμοποιούν 25-50 βήματα με ενεργοποιημένο CFG. Αυτό υποδηλώνει επιθετική απόσταξη κατά την εκπαίδευση, ανταλλάσσοντας ακατέργαστη χωρητικότητα για ταχύτητα.
Η ομάδα πίσω από το μοντέλο
Το HappyHorse προέρχεται από το Future Life Lab, μέρος του Taotian Group (ο βραχίονας ηλεκτρονικού εμπορίου) της Alibaba. Επικεφαλής είναι ο Zhang Di, πρώην VP της Kuaishou και τεχνικός επικεφαλής του Kling AI.
Αυτή η λεπτομέρεια μετράει. Ο Zhang Di χτίστηκε τη μηχανική κουλτούρα πίσω από το Kling, ένα από τα ισχυρότερα μοντέλα AI video του 2025. Γνωρίζει τις προκλήσεις υποδομής, τα pipeline εκπαίδευσης και τα κενά αξιολόγησης. Ο συνδυασμός αυτής της εμπειρίας με τους υπολογιστικούς πόρους της Alibaba είναι μια εντελώς διαφορετική εξίσωση από τη λειτουργία μιας ανεξάρτητης startup.
Γιατί αυτό έχει σημασία για την αγορά
Η αγορά AI video τον Απρίλιο του 2026 είναι ασυνήθιστα ασταθής:
Ανακοινώθηκε το κλείσιμο του Sora
Η OpenAI επιβεβαίωσε ότι το Sora θα διακοπεί στις 26 Απριλίου. Το κόστος υπολογισμού και η ανταγωνιστική πίεση αποδείχτηκαν μη βιώσιμα.
Αναστολή του Seedance 2.0
Η ByteDance αναγκάστηκε να σταματήσει την κυκλοφορία λόγω διαφορών πνευματικών δικαιωμάτων με στούντιο του Hollywood.
Εμφανίζεται το HappyHorse
Ένα ανώνυμο μοντέλο εισέρχεται στο Artificial Analysis Video Arena.
Η Alibaba επιβεβαιώνει την ιδιοκτησία
Η μετοχή ανεβαίνει καθώς αποκαλύπτεται η ταυτότητα.
Με το Sora να κλείνει και το Seedance να αντιμετωπίζει νομικά προβλήματα, το HappyHorse φτάνει σε μια στιγμή που η αγορά αναζητά νέο πρωταγωνιστή. Το Runway Gen-4.5 παραμένει ισχυρό στις ροές εργασίας παραγωγής και το Google Veo 3.1 κυριαρχεί στον χώρο των enterprise ενσωματώσεων. Αλλά σε επίπεδο ακατέργαστης ποιότητας δημιουργίας, μετρημένη με τυφλή ανθρώπινη προτίμηση, το HappyHorse βρίσκεται τώρα στην κορυφή.
Ανοιχτός κώδικας: Σύντομα (ίσως)
Τόσο το αποθετήριο GitHub όσο και ο hub μοντέλων Hugging Face εμφανίζουν "Σύντομα" από τις 11 Απριλίου. Η ομάδα υποσχέθηκε δημοσίευση ανοιχτού κώδικα των πλήρων 15 δισεκατομμυρίων παραμέτρων με εμπορική άδεια. Αν αυτό συμβεί, το HappyHorse θα είναι το μεγαλύτερο διαθέσιμο μοντέλο video ανοιχτού κώδικα, σημαντικά μεγαλύτερο από τα 2 δισεκατομμύρια παραμέτρων του LTX-Video.
Αλλά "σύντομα" δεν σημαίνει "κυκλοφόρησε". Μέχρι τα βάρη να είναι διαθέσιμα για λήψη και ανεξάρτητα επαληθευμένα, τα αποτελέσματα benchmark συνοδεύονται από αστερίσκο. Η κοινότητα AI video έχει μάθει να περιμένει αναπαραγώγιμα αποτελέσματα πριν ανακηρύξει νικητές.
Τι πρέπει να παρακολουθήσετε
Τρία πράγματα θα καθορίσουν αν το HappyHorse μπορεί να διατηρήσει το προβάδισμά του:
- ✓Δημοσίευση βαρών ανοιχτού κώδικα και ανεξάρτητη αναπαραγωγή των αποτελεσμάτων benchmark
- ✓Βελτιώσεις ποιότητας ήχου ώστε να φτάσει ή να ξεπεράσει το Seedance 2.0 στις κατηγορίες με ήχο
- ✓Διαθεσιμότητα API και τιμολόγηση, δεδομένου ότι η κυριαρχία στα benchmark δεν σημαίνει τίποτα αν οι δημιουργοί δεν μπορούν να χρησιμοποιήσουν το μοντέλο
Ο χώρος δημιουργίας AI video κινείται γρήγορα. Τον Ιανουάριο, το Runway Gen-4.5 φαινόταν ακατάβλητο. Τον Φεβρουάριο, το Seedance 2.0 πήρε τα σκήπτρα. Τώρα τα κρατά το HappyHorse. Το ερώτημα δεν είναι αν κάτι θα το ξεπεράσει τελικά, αλλά πότε και από πού.
Για δημιουργούς και προγραμματιστές που χτίζουν video pipeline σήμερα, το συμπέρασμα είναι πρακτικό: κανένα μοντέλο δεν μένει στην κορυφή για πολύ. Η καλύτερη στρατηγική είναι να χτίζεις ροές εργασίας που μπορούν να εναλλάσσουν μοντέλα καθώς αλλάζει η κατάταξη, αντί να ποντάρεις τα πάντα σε ένα όνομα.

Προγραμματιστής ΤΝ από τη Λυών που λατρεύει να μετατρέπει σύνθετες έννοιες μηχανικής μάθησης σε απλές συνταγές. Όταν δεν διορθώνει μοντέλα, θα τον βρείτε να κάνει ποδήλατο στην κοιλάδα του Ροδανού.
View profile →Σας άρεσε ό,τι διαβάσατε;
Μετατρέψτε τις ιδέες σας σε βίντεο ΤΝ απεριόριστης διάρκειας μέσα σε λίγα λεπτά.
Σχετικά άρθρα
Συνεχίστε την εξερεύνηση με αυτές τις σχετικές αναρτήσεις

Alibaba Wan 2.7: Πώς το Thinking Mode αλλάζει τη δημιουργία βίντεο με AI
Η Alibaba μόλις κυκλοφόρησε το Wan 2.7 με ένα καινοτόμο Thinking Mode που σχεδιάζει τις συνθέσεις πριν δημιουργήσει βίντεο. Αναλύουμε πώς λειτουργεί και τι σημαίνει για τους δημιουργούς.

AI βίντεο μετά το Sora: 4 επίπεδα αγοράς που πρέπει να γνωρίζετε το 2026
Το Sora κλείνει στις 26 Απριλίου. Η αγορά AI βίντεο έχει ενοποιηθεί σε τέσσερα επίπεδα. Ένας πρακτικός οδηγός για την επιλογή της κατάλληλης εναλλακτικής του Sora για τις ανάγκες σας.

Το Google Veo 3.1 γίνεται δωρεάν: 10 AI βίντεο το μήνα για κάθε λογαριασμό Google
Η Google άνοιξε το Veo 3.1 σε όλους τους προσωπικούς λογαριασμούς με 10 δωρεάν δημιουργίες βίντεο μηνιαίως. Δείτε τι παίρνετε, ποια είναι τα όρια και γιατί αυτό έχει σημασία για τους δημιουργούς AI βίντεο.