生成和编辑音频

在画布中生成语音、音乐和音效,并试听、调整、下载或继续使用结果。

在画布中新建音频节点后,你可以输入一段描述来生成语音、音乐或音效。生成结果会直接留在节点中,可以试听、下载、保存到素材库,也可以连接到支持音频输入的视频节点。

1. 创建音频节点

  1. 点击画布左侧工具栏的 +
  2. 选择音频
  3. 新音频节点会出现在画布上。单击节点,底部会打开音频输入面板;
  4. 在输入框中写下要生成的内容。

如果已经有音频文件,可以选择 + > 上传,或者把文件直接拖到画布上。上传后会生成一个可播放的音频节点。选择 Seed audio 1.0 时,可以把这个节点添加为参考音频;也可以把它连接到支持音频输入的后续节点。支持的文件格式和大小请查看上传文件并放入画布

2. 选择模型和用途

音频输入面板左下角是模型选择器。部分模型还会显示用途选择器,可在文字转语音音乐音效之间切换。

你想完成什么可以从这些模型开始需要输入什么
根据文字或参考音频生成语音Seed audio 1.0要朗读的内容和说话方式;也可以添加参考音频
生成旁白或对白ElevenLabs V3要朗读的文字,并按页面选项设置音色或表达方式
生成歌曲或背景音乐MiniMax Music 2.6Mureka V8Mureka O2Sonilo Music音乐风格、情绪、节奏、用途,以及页面要求的歌词或时长
生成环境声或动作音效ElevenLabs V3Sonilo Music声音来源、远近、节奏、时长和是否需要循环

不同账户看到的模型和工具可能不同,请以当前页面实际显示的入口为准。

3. 使用 Seed audio 1.0

Seed audio 1.0 可以直接根据文字生成语音,也可以参考画布上已有的音频。当你想让新语音接近一段参考音频里的声音,或需要调整语速、声调、音量、格式和字幕时,可以使用它。

写清要生成的声音

在输入框中说明内容、声音类型、节奏、环境和结尾方式。Seed audio 1.0 的输入最多为 3000 个字符。

生成一段中文女声旁白:“今晚八点,我们在海边见。”声音自然、克制,语速稍慢,近距离收音,背景保持安静,句尾自然收住。

添加参考音频

  1. 先把要参考的音频放到同一张画布上;
  2. 选中目标音频节点,并选择 Seed audio 1.0
  3. 在输入框上方的参考区点击 +
  4. 在画布上点击要引用的音频节点。需要多段参考时继续点击,最多选择 3 段;完成后点击顶部的退出,或按 Esc

一个 Seed audio 1.0 节点最多可以引用 3 段音频。当前不支持把图片作为这个模型的参考内容。

引用完成后,参考音频会显示在输入框上方。你可以在指令中说明要保留什么、修改什么:

参考已连接音频中的女声和说话节奏,重新朗读:“新品将在本周五正式发布。”保持相近的音色和距离感,语气更有期待感,不要加入背景音乐。

设置输出

点击模型旁显示当前格式的按钮(例如 WAV),设置字幕和输出格式;点击齿轮打开高级设置。

设置可选范围适合什么时候调整
字幕开 / 关需要同时得到可编辑文字时开启
输出格式WAV、MP3、OGG_OPUSWAV 适合继续制作;MP3 适合预览和分享
采样率8k、16k、24k、32k、44.1k、48k没有明确交付要求时可保留默认 24k
语速0.5–2.0调整朗读快慢
声调-12–+12让声音更低或更高
音量0.5–2.0调整输出响度

第一次生成时建议保留默认值。试听后再调整一个参数并重新生成,更容易判断变化来自哪里。

4. 生成并试听

  1. 确认提示词、参考音频和设置;
  2. 点击输入面板右下角的生成
  3. 生成期间,音频节点会显示进行中的状态;
  4. 完成后,节点中会出现音频波形和播放按钮。

每次实际调用模型都会消耗 Tapies。生成按钮旁会显示预估消耗;Seed audio 1.0 最终按模型输出时长计费,因此预估可能与实际消耗不同。

播放时可以拖动波形跳到指定位置,也可以使用前进或后退 10 秒按钮。暂停播放或拖动波形不会修改音频文件。

如果为 Seed audio 1.0 开启了字幕,模型返回字幕后,画布会创建一个名为音频字幕的文本节点,并自动连接到音频节点。

5. 重新生成、下载或连接结果

如果结果不合适,修改提示词、参考音频或参数,然后再次点击生成。音频节点会显示新的结果。想保留当前版本时,先下载文件或保存到素材库,再重新生成。

操作操作后会发生什么
下载把当前音频文件保存到电脑
保存到素材库打开保存面板,把音频保存到个人或团队素材库
从右侧连接点连接到视频节点把当前音频作为支持声音输入的视频节点的参考内容

音频节点中的波形和播放按钮用于试听,不提供波形裁剪。需要改变内容、节奏或声音时,请调整输入和参数后重新生成。

下一步:创作文本与 3D