跳到主要内容

AI音效生成器

你需要的声音,靠描述得到,而不是到处去找。湿砾石上的脚步声、远处的火车、一声轻柔的界面提示音——按剪辑留给它的时长生成。

  • 拟音、环境音、撞击声、界面音效
  • 按指定时长生成
  • 同一个声音的多个变体
  • 与视频共用作品库和积分

如何生成音效

声音设计的提示词是对物理过程的描述。是什么在发声、由什么材质构成、力度多大、处在什么空间——这四点能帮你完成大部分工作。

  1. 01

    描述声源和材质

    写“一扇沉重的木门关上”,而不是“一扇门”。材质和重量对声音本身的决定作用,远远超过物体的名称。

  2. 02

    描述空间

    同样一次拍手,在浴室、大厅和田野里是三种不同的效果。写明所处的空间,是让生成的声音与在特定地点拍摄的素材相匹配的最快方法。

  3. 03

    多生成几个并放进去

    音效生成成本很低,而且要放在上下文里判断。生成两三个,放到它们所属的画面下面,留下那个融入画面、让人察觉不到的。

为什么要生成,而不是去音效库里找

确切的声音,而不是最接近的那个

在音效库里搜索是一种妥协:你只能从现有的里面挑最接近的。一段描述能给你确切想要的东西,包括那些没有哪个音效库费心录过的声音。

按时长剪好

要求镜头所需的时长,音效就不必再用一个显眼的淡出去修剪。

有变化而不重复

六个略有不同的脚步声,而不是同一个文件用六次——后者正是暴露一场粗糙配音的破绽。

环境音底

生成可以垫在整个场景下面的房间底噪和室外氛围,这正是让AI生成的画面听起来像是在真实地点拍摄的关键。

界面与动效音

为产品视频和动态图形生成提示音、嗖嗖声和确认音,贴合品牌自己的质感,而不是从音效包里借来的。

不用追踪版权授权

在你的套餐下生成,与你在这里制作的其他一切适用相同的商用条款。

大家生成什么

为AI生成的画面拟音

脚步、衣物摩擦、拿取物品和撞击声,让AI生成的片段不再听起来像是无声画面上盖了一段音乐。

环境音

在场景下面铺上街道、办公室、森林或房间底噪,这对真实感的帮助比任何单个音效都大。

产品与界面

根据品牌质感调校的动态图形嗖嗖声和界面确认音。

转场

一个承接剪切点的声音,按转场所占的精确帧数生成。

游戏与原型

为交互生成占位音效和正式音效,成组生成,听起来不会重复。

无障碍与清晰度

为那些不看屏幕也需要被理解的状态,提供清晰可辨、不易疲劳的提示音。

声音,是AI视频不再显得像AI生成的地方

画面吸引了所有注意力,但观众在很大程度上是用耳朵判断真实感的。一段街景片段,如果没有车流的嗡嗡声、没有脚步声、没有环境底噪,即使每一帧都令人信服,看起来也是假的——因为真实的录音从来不是无声的。铺上一层环境音,再加两三个具体的音效,对一个AI生成的场景的帮助,通常比再对画面写一轮提示词还要大。

功夫在于叠加,而不在于任何单个声音。一扇门关上,是门把手、一阵气流、一声闷响,以及房间对它的回应。把这些分别生成再叠在一起,得到的层次感是一个写着“关门声”的提示词很难达到的;而且当镜头时长改变时,你还可以分别调整各个部分。

变化和准确同样重要。人耳会立刻注意到重复:同一个脚步声文件连用四次,即使说不出原因的人也能听出是在循环。生成几条几乎相同的版本并交替使用,是标准的解决办法;当每一条只花几个积分而不是一次录音时,这样做的成本很低。

最后,先放进去再判断。单独试听的音效几乎总是太响、太长、细节太多,不适合它要去的地方。一旦放在画面下面、调到实际播放时的音量,好的那个通常是两个候选中更朴素的那一个。

AI音效常见问题

一个音效最长可以多长?
短音效和较长的环境音底都支持;可用时长会显示在表单中。环境音按场景时长生成,撞击声按镜头时长生成。
可以为同一个声音生成多条版本吗?
可以,而且应该这样做。把同一个提示词跑几次,就能得到足够的变化,避免重复的音效听起来像在循环。
可以让声音匹配某个特定的房间吗?
在提示词中描述空间——它的大小、表面材质,以及是否在室内。这对结果的影响,比你事后做的任何后期处理都大。
可以商用吗?
可以,在付费套餐下依照服务条款使用——与生成的视频、图片和音乐适用相同的条款。
是免费的吗?
是的,在免费积分额度内免费,与工作室的其他功能从同一个余额中扣费。

接下来去哪里

描述一个声音,把它放到镜头下面

注册即送免费积分,音效按时长生成,画面和声音共用一个作品库。