Meta PixelПерайсці да асноўнага змесціва
DamienDamien· аўтар ШІ, праверана чалавекам
5 min read
935 слоў

AWS Elemental Inference: Live TV у TikTok за 6 секунд

AWS запусціла Elemental Inference, AI-сервіс для пераўтварэння прамых трансляцій у вертыкальнае відэа ў рэжыме рэального часу. Fox Sports і NBCUniversal ужо яго выкарыстоўваюць.

AWS Elemental Inference: Live TV у TikTok за 6 секунд

Гатовыя ствараць уласныя ШІ-відэа?

Далучайцеся да тысяч стваральнікаў, якія карыстаюцца Bonega.ai

Amazon толькі што вырашыла праблему, на якую вядомасцяныя кампаніі скаржаліся ўжо тры гады: як вывесці прамую трансляцію футбольнага матча ў фармаце 16:9 на ленту TikTok 9:16 без штата рэдактараў?

24 лютага AWS зрабіла Elemental Inference дасяжнай для ўсіх. Гэта вялікі кіруемы AI-сервіс, які пераўтварае прамыя трансляцы ў вертыкальнае мабільнае відэа з затрымкай 6-10 секунд. Fox Sports і NBCUniversal ужо выкарыстоўваюць яго ў production.

Што насапраўды робіць Elemental Inference

Па сутнасці, гэты сервіс знаходзіцца паміж прамой трансляцыяй і платформамі сацыяльных сетак. Дайце яму стандартны відэапотык 16:9, і на выхадзе атрымаеце вертыкальную версію 9:16 практычна ў рэжыме рэального часу.

💡
Гэта не просто інструмент для абрэзання. AI адсочвае аб'екты, сочыць за дзеяннем і прымае рашэнні пра кадраванне кадр за кадрам.

Тры основныя магчымасці адрозніваюць яго ад існуючых рашэнняў:

6-10s
Затрымка обработкі
34%
Эканомія ў параўнаўі з кількумі інструментамі
4
AWS рэгіёнаў пры запуску

1. AI-кіруемае адсочванне аб'ектаў

Сістэма ідэнтыфікуе галоўны аб'ект ў кожным кадры, будзь то квартэрбек, што гатуецца да кідака, тэлевядучы за сталом ці выканаўца, які рухаецца па сцэне. Яна дынамічна падлаштоўвае вертыкальнае кадраванне, утрымліваючы найважнейшую візуальную інфармацыю па цэнтру.

Традыцыйныя падходы або фіксуюць кадр па цэнтру (пропускаючы дзеянне па краях), або патрабуюць аператара, які прымае рашэнні ў рэжыме рэального часу. Elemental Inference справляецца з гэтым аўтаматычна.

2. Вычаркванне яскравых момантаў з прамых трансляцый

Акрамя перафарматавання, сервіс аналізуе вміст, выяўляючы ключавыя моманты. Уявіце сабе AI-прадзюсера, які дзівіцца трансляцыю і адзначае: "Гэта быў гол" ці "Гэты кадр з рэакцыяй важны".

Гэтыя моманты вычаркваюцца як асобныя кліпы, готовыя для Instagram Reels, YouTube Shorts ці TikTok. Вядомасцяныя, якім раней трэбна была асобная каманда постпродакшану для стварэння кліпаў, цяпер могуць генерыраваць іх падчас падзеі.

3. Паралельная шматфункцыйная обработка

Архітэктура обрабляе кілька AI-функцый на адным відэапоцыку адначасова. Адсочванне аб'ектаў, выяўленне яскравых момантаў, даданне метаданных і перафарматаванне форматаў выконваюцца паралельна, а не паслядоўна.

AWS паведамляе, што гэты падход "абработаць адзін раз, аптымізаваць паўсюдна" дае 34% эканомію ў параўнаўі з выкарыстаннем кількух асобных рашэнняў.

Чаму вядомасцяныя гэта цэняць

Час абраны не выпадкова. Короткія вертыкальныя відэа цяпер складаюць больш за 60% спажывання відэа ў сацыяльных сетках, і гэта ў паказчык пастойна расце. Вядомасцяныя, якія не могуць публікаваць вміст на гэтыя платформы ў рэжыме рэального часу, губляць аудыторыю стваральнікам контэнту.

Да Elemental Inference
Затрымка постпродакшану ад хвілін да гадзін. Асобныя рэдакторскія каманды для кожнага форматаў платформы. Кліпы з яскравых момантаў дасяжныя толькі пасля падзеі. Высокія аперацыйныя выдаткі на распаўсюджванне контэнту па кількух платформах.
Пасля Elemental Inference
6-10 секунд затрымкі ад прамой трансляцыі да вертыкальнага відэа. Аўтаматычнае адсочванне аб'ектаў і разумнае кадраванне. Вычаркванне яскравых момантаў ў рэжыме рэального часу падчас прамых падзей. Адзін pipeline замяняе безліч рэдакторскіх рабочых працэсаў.

Fox Sports праводзіла бета-тэставанне падчас нядаўніх плей-офаў NFL і адзначыла, што іх кліпы сацыяльных сетак дасягалі аудыторыю, поў матч яшчэ ішоў, а не гадзінамі пазней ў пасігровым агляданні.

Як гэта ўпісваецца ў ширэйшы AI-стэк відэа

Гэта інфраструктурнае рашэнне, а не інструмент для генерування контэнту. Поўслуха кампаніі на кшталт Runway і Sora зосэрэджаны на генерыраванні відэа з тэкставых падказак, AWS спрамована на існуючае відэа, якое вядомасцяныя ўжо вырабляюць.

Гэта адрозненне важнае. Гэнэратыўнае відэа AI стварае што-то з нічога. Elemental Inference робіць існуючы контэнт лепш працуючым на розных платформах. Обудва карысныя, але яны служаць прынцыпова розным выкарыстанням.

💡
Калі вы будуеце відэаплатформу ці медыя-рабочы працэс, думайце пра Elemental Inference як пра слой распаўсюджвання. Аб'яднайце яго з гэнэратыўнымі інструментамі для стварэння контэнту, і ў вас будзе поўны pipeline.

Дзе гэта дасяжна

Пры запуску сервіс працуе у чатырох AWS рэгіёнах:

РэгіёнМесцазнаходжанне
US EastН. Вірджынія
US WestОрэгон
Asia PacificМумбаі
EuropeІрландія

На працягу 2026 года чакаецца паяўленне новых рэгіёнаў у міру роста попіту.

Тэхнічная архітэктура

Для інжынераў, якія оцэньваюць гэта, Elemental Inference інтэгруецца ў існуючыя медыя-рабочыя працэсы AWS. Калі вы ўжо выкарыстоўваеце MediaLive, MediaConnect ці CloudFront для распаўсюджвання відэа, інтэграцыя будзе простай.

Live Feed → MediaLive → Elemental Inference → CloudFront → Social Platforms

                    Highlight Clips + Metadata

Сервіс надае стандартныя API, дазваляючы праграмна кіраваць паводзі кадравання, ўстанаўліваць чутлівасць выяўленні яскравых момантаў і маршрутызаваць выхады на розныя месца ў залежнасці ад тыпу контэнту.

Цэны даслухаюцца тыповай мадэлі AWS: оплата за гадзіну абработаванага відэа без папярэдніх абавязацеў. AWS яшчэ не апублікавала дакладныя тарыфы, але сцвярджэнне пра 34% эканомію кажа аб канкурэнтным пазіцыянаванні супраціў стварэння эквівалента з кількумі сервісамі.

Што гэта азначае для стваральнікаў

Калі вы не вядомасцяны, гэта для вас мае значэнне? Насапраўды, так.

Тэхналогія, якая стаіць за разумным адсочванем аб'ектаў і аўтаматычным перафарматаваннем, вёрагодна, пракіпіць у спажывацкія інструменты. Adobe ужо рухаецца ў гэтым напрамку з Quick Cut, які абрабляе AI-асіставанау рэдакцыю сырога матэрыялу.

Ширэйшы трэнд ясны: AI не просто генерыруе новы відэаконтэнт. Яна робіць існуючае відэа больш эфектыўным на безліч платформ з мінімальнымі зусіллямі.

Для незалежных стваральнікаў і малых студыяў пытанне становіцца не "калі" (а колькі) гэтыя магчымасці перафарматавання ў рэжыме рэального часу станаць дасяжнымі па спажывацкіх цэнах. Калі гісторыя што-то кажа, інструменты AI-відэа, створаныя для enterprise, у кінцовым вынику дасягаюць ва ўсіх.

💡
Дадатковае чытанне: Для дэталяў пра тое, як AI мяняе рабочыя працэсы відэамантажу, гл. нашу асвячэнне Adobe Firefly Quick Cut і рэвалюцыі AI-відэарэкламы.

Галоўнае

AWS Elemental Inference не блісніцкая. Яна не генерыруе позаземныя ландшафты і не ажыўляе нерухомыя фота. Тое, што яна робіць, гэта вырашае рэальную, дарагую праблему, якую медыакампаніі вырашаюць кожны дзень: даставіць жывы контэнт на мабільныя платформы дастаткова хутка, каб гэта мела значэнне.

З Fox Sports і NBCUniversal ужо ў production, гэта не выпушчаны прадукт. Гэта інфраструктура, якая ціха перафарматуе, як жывое відэа дасягае аудыторыю ў 2026 годзе і далей.

Damien
DamienAI DeveloperAI Author

Распрацоўшчык ШІ з Ліёна, які любіць ператвараць складаныя канцэпцыі машыннага навучання ў простыя рэцэпты. Калі ён не адладжвае мадэлі, яго можна знайсці на веласіпедзе ў даліне Роны.

View profile →

Спадабалася прачытанае?

Пераўтварайце свае ідэі ў ШІ-відэа неабмежаванай працягласці за лічаныя хвіліны.

Падобныя артыкулы

Працягвайце знаёмства з гэтымі падобнымі артыкуламі

Вам спадабаўся гэты артыкул?

Адкрыйце для сябе больш карыснай інфармацыі і сачыце за нашым новым кантэнтам.