AWS Elemental Inference: 6秒内将直播转换为竖屏视频
AWS推出Elemental Inference,一项AI服务,可实时将直播转换为竖屏视频。Fox体育和NBCUniversal已经开始使用。

2月24日,AWS正式发布了Elemental Inference。这是一项完全托管的AI服务,可将直播流转换为竖屏、移动设备友好的视频,延迟仅为6到10秒。Fox体育和NBCUniversal已经在生产环境中运行。
Elemental Inference的实际功能
从本质上讲,该服务位于直播流和社交分发平台之间。输入标准的16:9流,它会在接近实时的情况下输出9:16竖屏版本。
三项主要功能使其与现有解决方案不同:
1. AI驱动的主体追踪
系统识别每帧中的主体,无论是四分卫后退、新闻主播坐在办公桌前还是音乐会表演者在舞台上移动。它动态调整竖屏裁剪,使最重要的视觉信息保持居中。
传统方法要么将裁剪锁定在中心框(错过两侧的动作),要么需要人工操作员做出实时决策。Elemental Inference自动处理这一切。
2. 从直播流中提取亮点
除了重新格式化,该服务还分析内容以识别关键时刻。可以把它想象成一个AI制作人在观看源流并标记:"那是一个进球"或"那个反应镜头很重要"。
这些时刻被提取为独立的片段,可以在Instagram Reels、YouTube Shorts或TikTok上使用。以前需要单独后期制作团队来创建剪辑的广播公司现在可以在事件发生时生成它们。
3. 并行多功能处理
该架构在同一视频流上同时处理多个AI功能。主体追踪、亮点检测、元数据标记和格式转换都并行运行,而不是按顺序步骤进行。
AWS报告这种"处理一次,优化任何地方"的方法相比将多个点解决方案链接在一起,可交付34%的成本节省。
广播公司现在为什么关心
时机不是偶然的。短形式竖屏视频现在占社交视频消费的60%以上,这个数字还在不断上升。无法实时将内容发送到这些平台的广播公司会失去观众的关注,而能够做到这一点的创作者会获得关注。
Fox体育在最近NFL季后赛报道期间运行了测试版,报告称他们的社交媒体剪辑在比赛仍在进行时就能到达观众,而不是数小时后的赛后回顾。
它如何融入更广泛的AI视频堆栈
这是一个基础设施举措,而不是内容生成工具。虽然Runway和Sora等公司专注于从文本提示生成视频,但AWS的目标是广播公司已经制作的现有视频。
这一区分很重要。生成式AI视频从无到有创建内容。Elemental Inference使现有内容能更好地跨平台工作。两者都很有价值,但它们服务于根本不同的用例。
可用地区
在发布时,该服务在四个AWS区域运行:
| 区域 | 位置 |
|---|---|
| 美国东部 | 北弗吉尼亚 |
| 美国西部 | 俄勒冈州 |
| 亚太 | 孟买 |
| 欧洲 | 爱尔兰 |
随着需求的增加,预计2026年全年会增加更多区域。
技术架构
对于评估这个的工程师,Elemental Inference可插入现有的AWS媒体工作流。如果你已经在使用MediaLive、MediaConnect或CloudFront进行视频分发,集成是直接的。
Live Feed → MediaLive → Elemental Inference → CloudFront → Social Platforms
↓
Highlight Clips + Metadata该服务公开标准API,因此你可以以编程方式控制裁剪行为、设置亮点检测灵敏度,以及根据内容类型将输出路由到不同目的地。
定价遵循典型的AWS模式:按处理的视频小时数付费,无需前期承诺。AWS尚未公布确切费率,但34%的节省声明表明相比使用多个服务构建等效方案的竞争定位。
对创作者来说意味着什么
如果你不是广播公司,这重要吗?实际上,是的。
智能主体追踪和自动重新格式化背后的技术可能会流向消费者工具。Adobe已经朝这个方向发展,推出了Quick Cut,它处理原始素材的AI辅助编辑。
更广泛的趋势很清楚:AI不仅仅是生成新的视频内容。它正在使现有视频以更少的手动努力跨更多平台工作得更好。
对于独立创作者和小工作室,问题变成了何时(而不是如果)这些实时重新格式化功能以消费者价格点变得可用。如果历史是任何指导,企业优先的AI视频工具最终会流向每个人。
总结
AWS Elemental Inference并不花哨。它不生成外星景观或为静止照片制作动画。它所做的是解决媒体公司每天面临的一个真实、昂贵的问题:足够快地将直播内容传送到移动平台。
随着Fox体育和NBCUniversal已经在生产中,这不是空头支票。这是将在2026年及以后悄悄重塑直播视频如何到达观众的基础设施。
相关文章
继续探索这些相关文章

Grok xAI 图像转视频能力:2026 年 6 月 API 指南
2026 年 6 月的 Grok xAI image-to-video 能力:Grok Imagine 如何处理图像、提示词、原生音频、API 工作流、安全、定价逻辑,以及与 Sora/Veo 的对比。

AI 视频延长器:2026 年如何延长视频时长
使用 AI 视频延长器在 2026 年延长视频时长。比较延长限制,保持连贯性,并为生成或现有片段选择工作流程。

SkyReels V4:首个能同时看与听的AI模型
Skywork AI的SkyReels V4引入了双流扩散架构,可在一次生成过程中同步产出视频和音频。这对创作者意味着什么?
