Mirelo融资4100万美元,解决AI视频的静音难题
柏林初创公司Mirelo刚刚获得Index Ventures和a16z领投的4100万美元融资,为视频生成AI音效。在Mistral和Hugging Face高管的支持下,他们正在构建行业迫切需要的:智能音频,为静默的视频革命发声。

每次生成AI视频时,总会发生同样的情况。视觉效果令人惊叹,动作流畅,光影如电影般精致。然后点击播放……什么都没有。一片寂静。我们一直生活在无声电影时代,直到现在才意识到这个问题。
对声音的4100万美元押注
Mirelo是一家总部位于柏林的初创公司,由同时也是音乐家的AI研究人员创立,刚刚完成了4100万美元的种子轮融资。Index Ventures和Andreessen Horowitz领投。这对音频技术来说,绝非小额投资。
Mirelo的总融资额现已达到4400万美元,包括此前来自Atlantic的种子前轮支持。天使投资人名单堪称AI名人堂:Arthur Mensch(Mistral首席执行官)、Thomas Wolf(Hugging Face首席科学官)和Burkay Gur(Fal.ai联合创始人)。
产品理念简洁优雅:您上传视频,他们的AI观看视频,然后生成完美同步的音效。不是通用的背景音乐,而是与屏幕上发生的事情精准匹配的拟音风格音频。
为什么现在如此重要
回顾2025年12月的AI视频格局:
- Runway Gen-4.5能产生惊艳的视觉效果,但没有原生音频
- Sora 2可生成长达90秒的片段——全都是无声的
- Veo 3.1刚刚添加了音频功能,但仅限于某些特性
整个行业一直在向照片级写实生成的方向冲刺,却把一半的感官体验抛在了后面。Mirelo正在填补这个空白。
Mirelo SFX的工作原理
他们的旗舰模型称为Mirelo SFX v1.5。根据他们的API文档和演示,我整理出以下流程:
- 场景分析:模型观看您的视频,识别对象、动作和环境背景
- 时序映射:确定事件发生的时间——门关闭、脚步声、玻璃破碎
- 声音生成:AI创建与视觉时序和声学特性相匹配的音频
- 混音:将所有内容以适当的音量和空间定位分层组合
结果不只是把音效贴到视频上,而是让音频感觉像是本该属于那里。
输入:AI生成的雨滴打在窗户上的视频
输出:强度变化的雨滴声、玻璃共鸣、环境室内音调
结果:视频突然变得真实音乐家创始人
CJ Simon-Gabriel和Florian Wenzel既是AI研究人员,也是音乐家。这种结合比您想象的更重要。
音乐家理解音频的一个纯机器学习工程师可能会忽略的东西:时机就是一切。延迟50毫秒到达的音效会让人感觉不对劲,即使您无法有意识地识别原因。音频的情感冲击取决于微观级别的同步。
他们的双重背景体现在产品中。Mirelo不仅生成声音——还以音乐性的方式生成。
分发策略
Mirelo正在采取明智的市场策略:
| 渠道 | 用途 | 状态 |
|---|---|---|
| Mirelo Studio | 直接创作者工作区 | 已上线 |
| Fal.ai | 开发者API | 已上线 |
| Replicate | 替代API访问 | 已上线 |
| 免费增值 | €20/月创作者套餐 | 已上线 |
通过Fal.ai和Replicate分发,他们在开发者已经构建的地方与他们会合。如果您正在创建AI视频管道,可以将Mirelo放入您的技术栈,无需重建一切。
竞争即将到来
Mirelo并非在真空中运作:
| Company | Strength | Weakness |
|---|---|---|
| Mirelo | 专业聚焦 + 音乐家创始人 | 初创公司规模 |
| ElevenLabs | 语音领域主导地位 | 音效关注较少 |
| Kling AI(快手) | 集成视频平台 | 音频专业化程度较低 |
索尼、腾讯和ElevenLabs都在相邻领域竞争。但Mirelo对视频音效的专注给了他们优势。他们不试图做所有事情——而是试图在一件事上做到卓越。
训练数据的伦理
有一个细节让我印象深刻:Mirelo从公共和购买的声音库中获取训练数据,并通过收入分享合作尊重艺术家权利。
这很重要。AI行业正面临对训练数据实践越来越多的审查。Mirelo似乎从一开始就在道德构建,随着法规收紧,这可能成为竞争优势。
对创作者的意义
如果您今天正在生成AI视频,您的工作流程可能如下:
- 使用Sora/Runway/Veo生成视觉效果
- 导出到编辑软件
- 从库中手动添加音效
- 将音频同步到视频
- 调整音量和时序
- 导出最终视频
使用Mirelo,第3-5步合并为一个API调用。当您批量生产时,节省的时间会迅速累积。
通往AI音乐之路
Mirelo的路线图上有AI音乐生成。音效模型只是开始。
想象生成一个包含以下内容的视频:
- AI生成的视觉效果
- AI生成的对话(ElevenLabs)
- AI生成的音效(Mirelo)
- AI生成的配乐(未来的Mirelo)
我们正在为全合成媒体组装各个部分。这让您感到兴奋还是恐惧,可能取决于您以什么为生。
定价和访问
对于想要尝试Mirelo的创作者:
- 免费套餐:有限生成次数以测试平台
- 创作者套餐:€20/月(约$23.50),推荐使用量
- API:通过Fal.ai和Replicate按使用付费
- 企业版:大规模定制定价
考虑到技术水平,创作者套餐的价格出奇地实惠。与雇用拟音师或授权专业声音库相比。
我的看法
我们一直专注于让AI视频看起来更好,却忘记了视频是一种多感官媒介。Mirelo正在纠正这个疏忽。
尝试将您的AI生成视频上传到Mirelo平台。前后的差异就是演示与交付物之间的差异。
4100万美元的融资表明投资者看到了同样的机会。音频不是锦上添花的功能——它是使视频引人入胜的一半要素。
无声电影时代在1927年随着《爵士歌手》而结束。近一个世纪后,AI视频正在经历自己的"有声电影"时刻。
Mirelo押注他们可以成为这个新时代的声音。基于他们的技术、团队和时机,这个赌注看起来越来越明智。
开始使用
- 访问mirelo.io探索平台
- 上传一个无声AI视频
- 让Mirelo生成同步音频
- 与您的手动音频工作比较
- 决定自动化是否适合您的工作流程
入门门槛很低。潜在的时间节省很高。随着这4100万美元的部署,技术只会不断改进。
声音终于在AI视频的餐桌上有了一席之地。
相关文章
继续探索这些相关文章

Sora 之后的 AI 视频市场:2026 年需要了解的 4 个市场层级
Sora 将于 4 月 26 日关闭。AI 视频市场已整合为四个层级。这是一份实用指南,帮助您根据需求选择合适的 Sora 替代方案。

阿里巴巴 HappyHorse-1.0: 登顶所有 AI 视频排行榜的神秘模型
一个名为 HappyHorse-1.0 的模型在 Artificial Analysis 平台上匿名现身,迅速攀升至文本生成视频和图片生成视频双料第一,随后被证实来自阿里巴巴。以下是关于其架构、团队以及对 AI 视频市场影响的全面梳理。

阿里巴巴 Wan 2.7:思考模式如何改变 AI 视频生成
阿里巴巴刚刚发布了 Wan 2.7,引入了全新的思考模式,能在生成视频前规划构图。我们将详细解析其工作原理及对创作者的意义。
