AWS Elemental Inference: Tiesioginė TV į TikTok per 6 sekundes
AWS paleidžia Elemental Inference, dirbtinio intelekto paslaugą, kuri tiesioginias transliacijas paverčia vertikaliu vaizdo įrašu realiuoju laiku. Fox Sports ir NBCUniversal jau ją naudoja.

Vasario 24 d. AWS padarė Elemental Inference viešai prieinamą. Tai yra visiškai valdoma dirbtinio intelekto paslauga, kuri tiesioginio transliacijos srautus transformuoja į vertikalų, mobiliams reikalingus vaizdo įrašus su 6-10 sekundžių delsa. Fox Sports ir NBCUniversal jau ją naudoja gamyboje.
Ką iš tikrųjų daro Elemental Inference
Iš esmės ši paslauga sėdi tarp tiesioginio transliacijos srauto ir socialinių pasiskirstymo platformų. Suteikite jai standartinį 16:9 srautą, ir ji išduoda 9:16 vertikalią versiją beveik realiuoju laiku.
Trys pagrindinės galimybės ją padaro skirtingą nuo esamo sprendimo:
1. Dirbtinio intelekto varomoji objekto sekimas
Sistema nustato pagrindinį objektą kiekviename kadre, nesvarbu, ar tai yra ketvirtadalio žaidėjas, pasitraukiantis, žinių vedėjas prie stalo, ar šokėjas, judantis per sceną. Jis dinamiškai koreguoja vertikalų žemyn, laikydamas svarbiausiąją vizualinę informaciją sukoncentruotą.
Tradiciniai metodai arba užrakina žemyn į centrinį kadrą (nepastebi kraštinių veiksmų), arba reikalauja žmogiškojo operatoriaus, kuris priima realiojo laiko sprendimus. Elemental Inference tai valdo automatiškai.
2. Aukštojo lygio išimtis iš tiesioginių transliacijų
Be perskirstymo, paslauga analizuoja turinį, kad nustatytų pagrindinius momentus. Pagalvokite apie tai kaip apie dirbtinio intelekto prodiuserį, kuris žiūri srautą ir žymi: "Tai buvo įvartis," arba "Ši atsako nuotrauka svarbi."
Šie momentai išgaunami kaip atskiri klipai, pasirengę "Instagram Reels", "YouTube Shorts" ar TikTok. Transliavimo stotys, kurioms anksčiau reikėjo atskiros priešbaigimo komandos klipams kurti, dabar gali juos generuoti vykstant renginiu.
3. Lygiagreti kelių funkcijų apdorojimas
Architektūra apdoroja kelias dirbtinio intelekto funkcijas tame pačiame vaizdo įraše pasirinktinai. Objektų sekimas, aukštojo lygio aptikimas, metaduomenų žymėjimas ir formato konvertavimas visi veikia lygiagrečiai, o ne kaip nuoseklūs žingsniai.
AWS praneša, kad šis "apdoroti kartą, optimizuoti visur" metodas duoda 34% savikainą, lyginant su keičiomis kelių taškų sprendimais.
Kodėl transliavimo stotys dabar rūpinasi
Laikas nėra atsitiktinis. Trumpaforma vertikalinis vaizdo įrašas dabar sudaro daugiau nei 60% socialinio vaizdo vartojimo, ir šis skaičius toliau auga. Transliavimo stotys, kurios negali gauti turinio į šias platformas realiuoju laiku, praranda žiūrovus tvirtamuomenėnčiams, kurie gali.
Fox Sports atliko beta versijos testavimą vėliausios NFL pirmatalio ašigalio metu ir pranešė, kad jų socialinės žiniasklaidos klipai pasiekė žiūrovus, kol žaidimas dar buvo vykdomas, o ne valandomis vėliau po žaidimo.
Kaip jis tilps į platesnę dirbtinio intelekto vaizdo stiebą
Tai infrastruktūros žaidimas, o ne turinio generavimo įrankis. Nors tokios bendrovės kaip Runway ir Sora daugiausia dėmesio skiria vaizdo generavimui iš tekstinio pasiūlymo, AWS nukreipia dėmesį į jau egzistuojantį vaizdo įrašą, kurį transliavimo stotys jau gamina.
Skirtumas yra svarbus. Generatyvis dirbtinio intelekto vaizdo įrašas sukuria ką nors iš nieko. Elemental Inference daro esamą turinį geriau veikiančiu keliose platformose. Abu yra vertingi, tačiau jie iš esmės aptarnauja skirtingais naudojimo atvejais.
Kur jis yra pasiekiamas
Paleidus, paslauga veikia keturiose AWS srityse:
| Sritis | Vieta |
|---|---|
| US East | N. Virginia |
| US West | Oregon |
| Asia Pacific | Mumbai |
| Europe | Airija |
Daugiau sričių tikimasi visą 2026 metus, kai didės pareikalavimas.
Techninė architektūra
Inžinieriams, vertinantis tai, Elemental Inference prisijungia prie esamų AWS žiniasklaidos darbo procesų. Jei jau naudojate MediaLive, MediaConnect arba CloudFront vaizdo paskirstymui, integracija yra tiesioginis.
Live Feed → MediaLive → Elemental Inference → CloudFront → Social Platforms
↓
Highlight Clips + MetadataPaslauga teikia standartines API, todėl galite programiškai valdyti apkarpymo elgseną, nustatyti svarbių momentų aptikimo jautrumą ir nukreipti išvestis į skirtingas paskirties vietas pagal turinio tipą.
Kainodara atitinka tipinį AWS modelį: mokėkite už apdorotą vaizdo valandą, be išankstinių įsipareigojimų. AWS dar nepaskelbė tikslių tarifų, tačiau 34% sutaupymo teiginys rodo konkurencingą pozicionavimą, palyginti su kelių atskirų paslaugų naudojimu.
Ką tai reiškia kūrėjams
Jei nesate transliavimo stotis, ar tai svarbu? Iš tikrųjų taip.
Technologija, susijusi su protingu objekto sekimu ir automatiniam perskirstymui, greičiausiai nulis žemyn link vartotojo įrankių. "Adobe" jau pradėjo šia linkme su Quick Cut, kurie tvarkytina dirbtinio intelekto pagalbą tiesioginės medžiagos redagavime.
Platesnis trend yra aiškus: dirbtinis intelektas negeneruoja tik naujo vaizdo turinio. Tai padaro esamą vaizdo įrašą greičiau per daugiau platformų su mažiau rankiniu pasiūla.
Nepriklausomiems autoriams ir mažiems studiams klausimu tampa kada (o ne ar) šios realiojo laiko perskirstymo galimybės bus pasiekiamos vartotojams kainomis. Jei istorija yra kokia nors gida, pradžioje skirtos dirbtinio intelekto vaizdo įrašų bendrovės galiausiai randa kelią visiems.
Apačios eilutė
AWS Elemental Inference nėra blyškus. Jis negeneruoja svetimų kraštovaizdžių arba animuoja statinius vaizdelius. Tai, ką jis daro, yra iš esmės išsprendžia realią, brangią problemą, su kuria žiniasklaidos bendrovės susiduria kiekvieną dieną: tiesioginis turinys pateikti mobilioms platformoms pakankamai greitai, kad tai turėtų reikšmę.
Kai Fox Sports ir NBCUniversal jau gaminamos, tai nėra garinė vata. Tai infrastruktūra, kuri tyliai perrašys, kaip tiesioginis vaizdo įrašas pasiekia žiūrovus 2026 ir toliau.

DI kūrėjas iš Liono, mėgstantis sudėtingas mašininio mokymosi sąvokas paversti paprastais receptais. Kai netaiso modelių klaidų, jį rasite važinėjantį dviračiu Ronos slėnyje.
View profile →Patiko tai, ką perskaitėte?
Paverskite savo idėjas neribotos trukmės DI vaizdo įrašais per kelias minutes.
Susiję straipsniai
Tęskite pažintį su šiais susijusiais įrašais

SkyReels V4: pirmasis DI modelis, kuris mato ir girdi vienu metu
Skywork AI SkyReels V4 pristato dvigubo srauto difuzijos architektūrą, kuri vienu paleidimu sukuria vaizdo įrašą ir sinchronizuotą garsą. Štai ką tai reiškia kūrėjams.

AI vaizdo įrašai po Sora: 4 rinkos lygiai, kuriuos reikia žinoti 2026 m.
Sora užsidaro balandžio 26 d. AI vaizdo įrašų rinka susijungė į keturis lygius. Praktinis vadovas, kaip pasirinkti tinkamą Sora alternatyvą.

Google Veo 3.1 tampa nemokamas: 10 AI vaizdo įrašų per mėnesį kiekvienai Google paskyrai
Google atvėrė Veo 3.1 visoms asmeninėms paskyroms su 10 nemokamų vaizdo generavimų per mėnesį. Štai ką gausite, kokie apribojimai ir kodėl tai svarbu AI vaizdo kūrėjams.