Meta PixelПремини към основното съдържание
DamienDamien· Автор ИИ, прегледано от човек
5 min read
984 думи

Helios: Модел с 14B параметри, генериращ видео в реално време на потребителския хардуер

Helios от Пекински университет, ByteDance и Canva генерира минутни AI видеа със скорост 19,5 FPS, изискващи всего 6 ГБ VRAM, и е напълно с отворен изходен код.

Helios: Модел с 14B параметри, генериращ видео в реално време на потребителския хардуер

Готови ли сте да създавате собствени ИИ видеа?

Присъединете се към хиляди създатели, които използват Bonega.ai

Най-голямата преграда за генериране на AI видео в реално време винаги е била изчислителната мощност. Helios, нов модел със 14 милиарда параметри от Пекински университет, ByteDance и Canva, щом разруши тази преграда. Работи със скорост 19,5 кадъра в секунда на един H100, генерира видеа с дължина до 60 секунди и изисква само около 6 ГБ VRAM с групово разтоварване. И всичко това е с лицензия Apache 2.0.

Защо Helios е важна

Повечето AI видео модели те принуждават да избереш: качество или скорост. Големите модели като Veo 3.1 или Runway Gen-4.5 произвеждат невероятни резултати, но работят в облачни клъстери и събират такса за всяка секунда. По-малките модели се вмещат на потребителски GPU, но произвеждат заметно по-слаби резултати. Helios отхвърля този избор.

14B
Параметри
19,5
FPS на един H100
~6GB
VRAM с разтоварване
60s
Максимална дължина на видеото

Ключовата идея: Helios е авторегресивен дифузионен модел, който генерира видео кадър по кадър в потоковия режим, вместо да премахва шума от цялото видео наведнъж. Това означава, че може да започне да изхвърля кадри веднага, докато все още генерира останалото. Никаква чакане на пълен рендеринг на клипа.

Как работи

Традиционните дифузионни модели обработват цялото видео едновременно. Изпращаш промпт, чакаш няколко минути и получаваш пълен клип. Helios приема принципно различен подход.

Традиционна дифузияHelios (Авторегресивна дифузия)
Обработка на всички кадъра наведнъжГенериране кадър по кадър
Високи изисквания към паметтаПостоянна употреба на паметта
Резултат само при пълна готовностПотоков изход в реално време
Качеството се влошава с дължинатаПоследователно качество при всяка дължина

Моделът използва механизъм на двусмерно временно внимание, което позволява на всеки нов кадър да се позовава както на миналия, така и на бъдещия контекст в плъзгащо се прозорец. Това предотвратява дрейфа на качеството, който типично мъчи авторегресивните видео модели, където по-късните кадъра постепенно теряват последователност с по-ранните.

💡
Helios постига видео с дължина на минута (до 1,452 кадъра) без разчитане на KV-cache трикове или анти-дрейф хакове. Самата архитектура поддържа последователността.

Ъгълът на потребителския хардуер

Ето където нещата стават практични. С групово разтоварване, Helios може да работи на хардуер с приблизително 6 ГБ VRAM. Това я поставя право в категорията RTX 4060 Ti, карта, която струва около $400.

Сравни с облачно генериране:

МетодЦена за минута видеоНеобходим хардуер
Облачно API (Sora, Veo)$2-8 за генериранеНищо (облак)
Helios (локално, H100)~$0,15 в електричествоH100 ($25,000+)
Helios (локално, RTX 4060 Ti)~$0,01 в електричествоRTX 4060 Ti (~$400)

Компромисът с потребителските GPU е скоростта. На RTX 4060 Ti няма да достигнеш 19,5 FPS. Очаквай по-близо до 2-3 FPS, което все още означава 60-секундно видео в по-малко от 10 минути. За локално, приватно, неограничено генериране, това е привлекателно.

Бенчмарки, които подкрепят претензиите

Helios не просто твърди производителност в реално време. Има конкурентни резултати на стандартни видео качествени бенчмарки.

💡
На VBench, Helios съответства или превъзхожда модели със същия брой параметри по качество на движението, временна последователност и естетична оценка. Пълните резултати от бенчмарка са налични в статията (arXiv:2603.04379).

Изследователският екип, сътрудничество между Пекински университет, ByteDance и Canva, конкретно тестваше срещу:

  • CogVideoX (13B параметри): Helios съответства по качество при 5-10x по-бързо генериране
  • Pyramid Flow (авторегресивна базова модел): Helios произвежда по-временно последователен резултат
  • Open-Sora v1.2: Helios генерира по-дълги, по-свързани клипове

Критичното сравнение е с модели в диапазона 1-2B параметри, като LTX-2 и по-малки CogVideo варианти. Helios работи със сравними скорости, докато произвежда резултати, които изглеждат като от много по-голям модел.

Какво можеш действително да направиш с това

Helios не е научна любопитство. Това е практичен инструмент, който можеш да инсталираш и използваш днес.

  • Генериране на видео от текст до 60 секунди
  • Анимация от изображение с референтен кадър
  • Потоков изход в реално време (начни да гледаш докато генерира)
  • Лицензия Apache 2.0 (comercijalno ползване е разрешено)
  • Групово разтоварване за поддържка на потребителски GPU

Лицензията Apache 2.0 е значима. За разлика от много модели с отворен код, които ограничават търговското ползване, Helios го позволява явно. Това отваря вратите за независими разработчици, малки студия и стартапи да построят продукти върху модела без лицензионни такси.

По-голямата картина

Helios променя как подхождаме към достъпността на AI видео. Предишното поколение "отворени" видео модели или изискваше корпоративния хардуер, или произвеждаше резултати, които изглеждаха забележимо по-лошо от техните облачни аналози.

Облачно генериране
Не е необходимо инвестиция в хардуер, най-високо качество на резултатите, постоянно актуализирани модели
Локално генериране (Helios)
Нула цена за генериране, пълна приватност, без ограничения на честотата, търговски приятна лицензия, възможност работа офлайн

За професионалисти, които генерират стотици итерации на проект, икономиката се измества значително. GPU за $400 се окупува след приблизително 200-300 облачни генерирания. За екипи, които експериментират с AI видео в продуктите, неограничената природа на локалното генериране премахва колебанията за експериментиране.

Обхванахме растящата екосистема на локално генериране в нашия гид за работещо AI видео локално, и Helios се вписва право в този работен поток. Тя също се основава на прорива в генериране в реално време, за който писахме с TurboDiffusion, развивайки концепцията по-нататък с много по-голям модел.

Какво идва следващо

Екипът на Helios вече намекна за последващи работи по аудиовизуално генериране и възможностите за интерактивно управление. Ако се прилагат едни и същи печалби в ефективност, можехме видим генериране на видео в реално време, управляемо, с аудиовизуално съдържание на потребителския хардуер до края на 2026.

За сега, Helios е налична на GitHub под лицензия Apache 2.0. Ако имаш NVIDIA GPU със 6GB+ VRAM и искаш да експериментираш с действително конкурентно локално генериране на AI видео, това е най-силната точка на входа, която има.

💡

Свързано четене: Виж как моделите с отворен код затварят пропастта със закритите платформи, или изследвай подхода на LTX-2 към генериране в родния 4K на потребителските GPU.

Damien
DamienAI DeveloperAI Author

Разработчик на ИИ от Лион, който обича да превръща сложни концепции от машинното обучение в прости рецепти. Когато не отстранява грешки в модели, ще го откриете да кара колело из долината на Рона.

View profile →

Хареса ли ви прочетеното?

Превърнете идеите си в ИИ видеа с неограничена дължина само за минути.

Свързани статии

Продължете да разглеждате с тези свързани публикации

Хареса ли ви тази статия?

Открийте още полезни идеи и бъдете в крак с най-новото ни съдържание.