Alibaba Wan 2.7: kako način razmišljanja mijenja generiranje videa pomoću AI-ja
Alibaba je upravo objavila Wan 2.7 s novim načinom razmišljanja koji planira kompozicije prije generiranja videa. Analiziramo kako funkcionira i što to znači za kreatore.

Što je način razmišljanja?
Većina modela za generiranje videa radi u jednom prolazu. Upišete prompt, model počne pretvarati šum u piksele i dobijete što god izađe. Ovo funkcionira prilično dobro za jednostavne scene, ali zakazuje kada promptovi uključuju više subjekata, specifične prostorne odnose ili složene radnje.
Wan 2.7 dodaje međukorak. Prije nego što se generira ijedan piksel, model:
- Raščlanjuje prompt na semantičke komponente (subjekti, radnje, okolina, osvjetljenje)
- Planira kompoziciju određujući gdje se elementi trebaju pojaviti i kako trebaju međusobno djelovati
- Generira izlaz koristeći ovaj plan kao strukturalni vodič
Ovo je slično načinu na koji je "lančano razmišljanje" poboljšalo velike jezične modele. Prisiljavanjem modela da razmisli prije nego što djeluje, kvaliteta izlaza dramatično raste, posebno kod složenih promptova.
Kompletni paket Wan 2.7
Wan 2.7 nije samo jedan model. Dolazi kao paket od četiri modela koji pokrivaju različite radne tokove generiranja:
| Model | Ulaz | Izlaz | Najbolji za |
|---|---|---|---|
| Text-to-Video | Tekstualni prompt | Video isječak | Stvaranje od nule |
| Image-to-Video | Slika + prompt | Video isječak | Animiranje fotografija, konceptualnih radova |
| Reference-to-Video | Referentni video + prompt | Novi video | Prijenos stila, rekonstrukcija |
| Video Editing | Video + upute za uređivanje | Modificirani video | Postprodukcija, korekcije |
Model text-to-video već je dostupan na Together AI od 3. travnja. Preostala tri modela postupno se objavljuju tijekom sljedećih tjedana.
Ispod haube: uvidi u arhitekturu
Iako Alibaba još nije objavila potpuni znanstveni rad, nekoliko tehničkih detalja proizašlo je iz API dokumentacije i ranih benchmarkova.
| Što znamo | Što ga izdvaja |
|---|---|
| Izgrađen na arhitektonskoj liniji Wan (Wanxiang) | Prvi produkcijski model s eksplicitnim kompozicijskim planiranjem |
| Način razmišljanja dodaje fazu planiranja prije difuzije | Scene s više elemenata čisto obrađuju 5+ subjekata |
| Hiperrealističan konzistentnost likova između kadrova | Tekst prikazan u generiranom videu je čitljiv, ne iskrivljen |
| Precizna kontrola boja putem uvjetovanog promptovanja | Točnost boja ostaje konzistentna pri promjenama osvjetljenja |
| Bolje prikazivanje dugog teksta (tekst u videu) | Složeni pokreti kamere održavaju prostornu koherenciju |
Sposobnost prikazivanja dugog teksta posebno je vrijedna pozornosti. Prethodni modeli imali su problema s generiranjem čitljivog teksta unutar video kadrova. Wan 2.7 obrađuje znakove, oznake, pa čak i kratke odlomke s iznenađujućom točnošću. Za kreatore kojima trebaju tekstualni slojevi ugrađeni u generirani materijal, ovo je značajan korak naprijed.
Usporedba s konkurencijom
Područje AI videa značajno se promijenilo ovog tjedna. Wan 2.7 stigao je upravo kada je OpenAI potvrdio gašenje Sore, a Google snizio cijene Veo 3.1.
| Model | Cijena | Audio | Maks. duljina | Konzistentnost likova | Razmišljanje/Planiranje |
|---|---|---|---|---|---|
| Wan 2.7 | $0.10/s | Ne | ~10s | Jaka | Da |
| Veo 3.1 Lite | $0.05/s | Da | ~8s | Dobra | Ne |
| Veo 3.1 Fast | $0.12/s | Da | ~8s | Jaka | Ne |
| Kling 3.0 | ~$0.08-0.17/s | Da | ~10s | Jaka | Ne |
| Seedance 2.0 | U paketu | Da | 15s | Dobra | Ne |
| Runway Gen-4.5 | ~$0.15/s | Ne | ~10s | Jaka | Ne |
Cijena od $0.10 po sekundi stavlja Wan 2.7 u konkurentni srednji raspon. Dvostruko je skuplji od Googleove budžetne Lite opcije, usporediv s Kling 3.0 (čija cijena varira ovisno o platformi) i znatno jeftiniji od Runwaya.
Kada koristiti Wan 2.7
Na temelju ranih testiranja i prednosti modela, ovo su scenariji u kojima Wan 2.7 ima najviše smisla:
Složene scene s više subjekata
Sadržaj s puno teksta
Precizna kontrola boja i stila
Prijenos stila putem reference
Za jednostavnije scene s jednim subjektom gdje trebate i zvuk, modeli poput Kling 3.0 ili Veo 3.1 mogu i dalje biti bolji izbor. Dodatni teret planiranja u načinu razmišljanja donosi vrijednost specifično kada su promptovi složeni.
Što to znači za industriju
Način razmišljanja Wan 2.7 ukazuje na širi pomak u načinu rada generativnih modela. Umjesto iznuđivanja rezultata iz šuma grubom silom, budući modeli vjerojatno će uključivati eksplicitne faze planiranja za različite aspekte generiranja.
Ovaj obrazac već vidimo u drugim područjima. Modeli za generiranje koda planiraju prije pisanja. Modeli za slike koriste uvjetovano raspoređivanje. Sada modeli za video uče razmišljati prije nego što krenu stvarati.
Konkurentski pritisak je stvaran. Nakon povlačenja Sore, sniženja cijena od strane Googlea i kineskih modela poput Wan 2.7 i Kling 3.0 koji pomiču granice kvalitete, kreatori nikada nisu imali više opcija niti više razloga ostati fleksibilni.
Za detaljniji pogled na usporedbu ovih modela u specifičnim benchmarkovima, pogledajte našu analizu performansi Runway Gen-4.5. A ako vas zanima kako objava Seedance 2.0 preoblikuje ekosustav CapCut, detaljno smo to pokrili prošlog mjeseca.

AI inženjer iz Lausanne koji spaja dubinu istraživanja s praktičnim inovacijama. Dijeli vrijeme između arhitektura modela i alpskih vrhova.
View profile →Sviđa vam se ono što ste pročitali?
Pretvorite svoje ideje u AI videozapise neograničene duljine u nekoliko minuta.
Povezani članci
Nastavite istraživati uz ove povezane objave

Alibaba HappyHorse-1.0: Misteriozni model koji je zavladao svim ljestvicama AI videa
Model pod imenom HappyHorse-1.0 pojavio se na Artificial Analysis bez oznake tvrtke, popeo se na #1 u text-to-video i image-to-video kategorijama, a onda se ispostavilo da iza njega stoji Alibaba. Evo što znamo o arhitekturi, timu i što to znači za tržište AI videa.

AI video nakon Sore: 4 tržišna segmenta koja treba poznavati 2026.
Sora se gasi 26. travnja. Tržište AI videa konsolidiralo se u četiri razine. Praktični vodič za odabir prave alternative Sori.

Google Veo 3.1 besplatno: 10 AI videa mjesečno za svaki Google račun
Google je otvorio Veo 3.1 za sve osobne račune s 10 besplatnih generacija videa mjesečno. Evo što dobivate, koja su ograničenja i zašto je to važno za kreatore AI videa.