
7月17日,Adobe正式发布了Firefly系列的音频生成三件套:生成音乐、生成语音、生成音效。打开Firefly网页版或手机端就能直接用,创作者不用再为一段配乐到处找素材、担心侵权风险了。
为什么这个功能值得关注?因为音乐是视频的灵魂,但也是创作者最头疼的部分。Adobe联合伯克利音乐学院做了一项调查,结果很直白:所有受访的视频创作者、音乐人和营销人员都在视频里用过音乐,而且将近三分之一的人已经在用AI生成音乐了。但还有43.2%的人卡在版权和法律的顾虑上,38.9%的人觉得授权费太贵。
Firefly这次就是冲着这些痛点来的。它的生成音乐功能像是一个懂视频的配乐师:你告诉它视频的内容、氛围、节奏、时长,它就能给出原创音乐,而且直接提供4个版本让你选。最打动人的是,生成出来的音乐不用再额外花钱买授权,可以直接用在商业作品里。
语音和音效也一起配齐了。生成语音支持Adobe自己的声音模型,也接入了ElevenLabs的模型,你还能调节表演的张力、发音的细节,让旁白听起来更自然。生成音效就更有意思了,你可以输入文字描述,也可以直接录一段声音做参考,AI会生成跟画面动作、节拍、氛围对得上的音效。
值得注意的是,Adobe在Firefly里把第三方AI模型的阵容越做越大了。这次新增了Google的Gemini Omni Flash,能结合视频、音频和图像一起创作。之前已经接入了Runway的Aleph 2.0和可灵的Kling 2.0,现在整个平台集合了Google、可灵、Luma AI、OpenAI、Runway和Adobe自家的模型。
Adobe的思路很清晰:把图像、视频、音频、模型统统装进Firefly这个篮子里,攒成一个一站式AI创作工作台。对创作者来说,这个工具箱越完整,就意味着以前需要几个人、几个软件、几周才能搞定的事,现在一个人坐在电脑前就能完成了。AI创作工具的竞争,正从单个功能的比拼,升级到综合创作流程的比拼。