生成和编辑音频
在画布中生成语音、音乐和音效,并试听、调整、下载或继续使用结果。
在画布中新建音频节点后,你可以输入一段描述来生成语音、音乐或音效。生成结果会直接留在节点中,可以试听、下载、保存到素材库,也可以连接到支持音频输入的视频节点。
1. 创建音频节点
- 点击画布左侧工具栏的
+; - 选择音频;
- 新音频节点会出现在画布上。单击节点,底部会打开音频输入面板;
- 在输入框中写下要生成的内容。
如果已经有音频文件,可以选择 + > 上传,或者把文件直接拖到画布上。上传后会生成一个可播放的音频节点。选择 Seed audio 1.0 时,可以把这个节点添加为参考音频;也可以把它连接到支持音频输入的后续节点。支持的文件格式和大小请查看上传文件并放入画布。
2. 选择模型和用途
音频输入面板左下角是模型选择器。部分模型还会显示用途选择器,可在文字转语音、音乐和音效之间切换。
| 你想完成什么 | 可以从这些模型开始 | 需要输入什么 |
|---|---|---|
| 根据文字或参考音频生成语音 | Seed audio 1.0 | 要朗读的内容和说话方式;也可以添加参考音频 |
| 生成旁白或对白 | ElevenLabs V3 | 要朗读的文字,并按页面选项设置音色或表达方式 |
| 生成歌曲或背景音乐 | MiniMax Music 2.6、Mureka V8、Mureka O2、Sonilo Music | 音乐风格、情绪、节奏、用途,以及页面要求的歌词或时长 |
| 生成环境声或动作音效 | ElevenLabs V3、Sonilo Music | 声音来源、远近、节奏、时长和是否需要循环 |
不同账户看到的模型和工具可能不同,请以当前页面实际显示的入口为准。
3. 使用 Seed audio 1.0
Seed audio 1.0 可以直接根据文字生成语音,也可以参考画布上已有的音频。当你想让新语音接近一段参考音频里的声音,或需要调整语速、声调、音量、格式和字幕时,可以使用它。
写清要生成的声音
在输入框中说明内容、声音类型、节奏、环境和结尾方式。Seed audio 1.0 的输入最多为 3000 个字符。
生成一段中文女声旁白:“今晚八点,我们在海边见。”声音自然、克制,语速稍慢,近距离收音,背景保持安静,句尾自然收住。
添加参考音频
- 先把要参考的音频放到同一张画布上;
- 选中目标音频节点,并选择 Seed audio 1.0;
- 在输入框上方的参考区点击
+; - 在画布上点击要引用的音频节点。需要多段参考时继续点击,最多选择 3 段;完成后点击顶部的退出,或按
Esc。
一个 Seed audio 1.0 节点最多可以引用 3 段音频。当前不支持把图片作为这个模型的参考内容。
引用完成后,参考音频会显示在输入框上方。你可以在指令中说明要保留什么、修改什么:
参考已连接音频中的女声和说话节奏,重新朗读:“新品将在本周五正式发布。”保持相近的音色和距离感,语气更有期待感,不要加入背景音乐。
设置输出
点击模型旁显示当前格式的按钮(例如 WAV),设置字幕和输出格式;点击齿轮打开高级设置。
| 设置 | 可选范围 | 适合什么时候调整 |
|---|---|---|
| 字幕 | 开 / 关 | 需要同时得到可编辑文字时开启 |
| 输出格式 | WAV、MP3、OGG_OPUS | WAV 适合继续制作;MP3 适合预览和分享 |
| 采样率 | 8k、16k、24k、32k、44.1k、48k | 没有明确交付要求时可保留默认 24k |
| 语速 | 0.5–2.0 | 调整朗读快慢 |
| 声调 | -12–+12 | 让声音更低或更高 |
| 音量 | 0.5–2.0 | 调整输出响度 |
第一次生成时建议保留默认值。试听后再调整一个参数并重新生成,更容易判断变化来自哪里。
4. 生成并试听
- 确认提示词、参考音频和设置;
- 点击输入面板右下角的生成;
- 生成期间,音频节点会显示进行中的状态;
- 完成后,节点中会出现音频波形和播放按钮。
每次实际调用模型都会消耗 Tapies。生成按钮旁会显示预估消耗;Seed audio 1.0 最终按模型输出时长计费,因此预估可能与实际消耗不同。
播放时可以拖动波形跳到指定位置,也可以使用前进或后退 10 秒按钮。暂停播放或拖动波形不会修改音频文件。
如果为 Seed audio 1.0 开启了字幕,模型返回字幕后,画布会创建一个名为音频字幕的文本节点,并自动连接到音频节点。
5. 重新生成、下载或连接结果
如果结果不合适,修改提示词、参考音频或参数,然后再次点击生成。音频节点会显示新的结果。想保留当前版本时,先下载文件或保存到素材库,再重新生成。
| 操作 | 操作后会发生什么 |
|---|---|
| 下载 | 把当前音频文件保存到电脑 |
| 保存到素材库 | 打开保存面板,把音频保存到个人或团队素材库 |
| 从右侧连接点连接到视频节点 | 把当前音频作为支持声音输入的视频节点的参考内容 |
音频节点中的波形和播放按钮用于试听,不提供波形裁剪。需要改变内容、节奏或声音时,请调整输入和参数后重新生成。
下一步:创作文本与 3D