描述你需要的声音,大约半分钟内拿到两个版本。氛围声可以设成循环,附带商用许可,不用加署名。
功能说明
音效库很庞大,但永远差一点。你需要一扇门,但不是随便哪扇门——你镜头里那扇更沉,找到的录音里背后那个空间又对不上。于是花二十分钟一个个试听凑合的选项,最后随便定一个。
生成把“找”变成了“描述”。“一扇沉重的木门在空旷石厅里吱呀打开”能得到照着这句话做出来的东西,不对的话改三个词再跑一次。每次都会返回两个版本,所以一次生成给你的是选择,不是要不要接受的单一答案。
音效时长在七到八秒,直接用作单次音效正合适,打开循环选项也能当氛围声用。许可覆盖商用且不用署名——这正是免费音效库让你额外付出的代价:一行署名,或者每个文件不同的条款。

使用方法
一句话,半分钟,两个结果。
是什么东西在发声、什么材质、多远、周围空间听起来什么样。“靴子踩在湿砾石上,慢,近距离收音”比“脚步声”管用得多。
要垫在场景下面的氛围声就打开;需要有始有终的单次音效就关掉。
两个版本都能下载。用音频剪辑工具裁到你需要的精确长度。
你能得到什么
材质、大小、距离和空间才是真正改变结果的东西。“吓人”几乎没用;“低沉的金属呻吟,很远,长长的衰减”才是准确指令。
low metal groan, far away, long decay
boots on wet gravel, slow, close mic
heavy rain on a tin roof, no thunder
同一句提示词会生成两个真正不同的录音。这个差异往往是弄清楚自己到底想要什么最快的办法。
7–8 seconds
same prompt, different result
雨声、房间底噪、引擎声、人群声——打开循环,结果就是为持续播放做的,而不是有始有终的一段。
免费音效库每个都有自己的许可,不少还要求署名。这里生成的一切都归到同一份商用许可下,带证书。
谁在用
一个剪辑点需要的那个具体的撞击声、脚步声或呼啸声,配合画面精确匹配。
UI 点击声、拾取音效、打击音效和氛围底噪——照着需求生成,不用买音效包。
门、天气、交通,一个听起来就是你描述的那个空间。
画面的运动需要声音来支撑。逐个镜头生成比逐个镜头搜索快。
一个没人用过的通知音,对品牌来说比听上去更值钱。
剪辑时几分钟填满时间线;很多时候临时用的声音就够好,直接留用了。
常见问题
描述物理特征,不要描述感觉。什么物体、什么材质、多大、多远,周围的空间又是什么样。“沉重的木门,空旷的石厅,慢”能说到点子上;“瘆人的门声”不行,因为模型没有东西可以照着做。
七到八秒。作为单次音效够用,作为氛围声偏短——这正是循环选项的用途。不管哪种,用音频剪辑工具裁到需要的精确长度,这个工具免费,不需要账号。
可以,包括有收益的视频、游戏、广告和客户项目,附带可下载的证书,不需要署名。这是和免费音效库最大的区别——那里的条款一个文件一个样,不少还要求署名。
不能——那是另一件事,这个工具不做。这里是照着描述生成新的声音。如果想从视频文件里取出音频,音频转换器能整轨取出来;从混音里单独分离出某一个音效,没有工具能可靠地做到。
它生成的素材是为持续播放设计的,而不是有开头结尾的一段,这已经完成了大半。想要真正无缝的接口,用音频剪辑工具切开,再在合并工具里加一小段交叉淡化。氛围声容错高;节奏性的声音就不行。
思路类似,背后的模型不一样。如果你已经在这里生成音乐,这个工具的意义就在于同一个账号、同一套积分、音乐和音效用的是同一份许可条款,不用为了几个音效再开一个订阅。
不能。它只生成音效和氛围声。语音合成是另一种技术,这个站完全不做。
因为一句文字描述本身就没法确定唯一的声音。“玻璃碎裂”可能是一扇窗、一只酒杯,也可能是罐子摔在瓷砖上,都说得通。两个版本是对你这句话的两种解读,它们之间的差距会告诉你自己漏掉了哪个细节。
每次生成消耗 25 积分,会返回两个音效——只是音乐生成花费的一小部分,因为产出是几秒钟而不是几分钟。新账号自带的积分够跑好几轮。
生成一段可循环的,再用音频合并工具重复拼接,每处接缝留几秒交叉淡化,就不会有突兀的脉动感。这两个工具都免费,也不需要账号。
