오디오 생성 및 편집하기
캔버스에서 음성, 음악, 효과음을 생성하고 결과를 미리 듣고 조정하거나 다운로드해 계속 사용하는 방법을 알아봅니다.
캔버스에 오디오 노드를 만들면 설명을 입력해 음성, 음악 또는 효과음을 생성할 수 있습니다. 생성한 결과는 노드에 남으며 미리 듣기, 다운로드, 라이브러리 저장이 가능합니다. 오디오 입력을 지원하는 비디오 노드에 연결할 수도 있습니다.
1. 오디오 노드 만들기
- 캔버스 왼쪽 도구 모음에서
+를 선택합니다. - 오디오를 선택합니다.
- 캔버스에 새 오디오 노드가 나타납니다. 노드를 선택하면 노드 아래에 오디오 입력 패널이 열립니다.
- 입력란에 생성할 내용을 입력합니다.
이미 오디오 파일이 있다면 + > 업로드를 선택하거나 파일을 캔버스로 직접 드래그하세요. 업로드한 오디오는 재생 가능한 노드가 됩니다. Seed audio 1.0에서는 이 노드를 참조 오디오로 추가할 수 있으며, 오디오 입력을 지원하는 다음 노드에 연결할 수도 있습니다. 지원 형식과 파일 크기는 캔버스에 파일 업로드하기에서 확인하세요.
2. 모델과 용도 선택하기
모델 선택기는 오디오 입력 패널 왼쪽 아래에 있습니다. 일부 모델에는 용도 선택기도 표시되며 텍스트 음성 변환, 음악, 효과음을 전환할 수 있습니다.
| 하고 싶은 작업 | 먼저 사용해 볼 모델 | 입력할 내용 |
|---|---|---|
| 텍스트 또는 참조 오디오로 음성 생성 | Seed audio 1.0 | 읽을 내용과 말하기 방식. 참조 오디오도 추가할 수 있습니다 |
| 내레이션 또는 대화 생성 | ElevenLabs V3 | 읽을 문장과 화면에 표시되는 음색 또는 표현 방식 설정 |
| 노래 또는 배경음악 생성 | MiniMax Music 2.6, Mureka V8, Mureka O2, Sonilo Music | 음악 스타일, 분위기, 템포, 용도와 모델에서 요구하는 가사 또는 길이 |
| 배경음 또는 동작 효과음 생성 | ElevenLabs V3, Sonilo Music | 소리의 출처, 거리, 리듬, 길이, 반복 여부 |
사용 가능한 모델과 도구는 계정마다 다를 수 있습니다. 현재 화면에 표시되는 옵션을 기준으로 사용하세요.
3. Seed audio 1.0 사용하기
Seed audio 1.0은 텍스트로 음성을 생성하고 캔버스에 있는 오디오를 참조할 수 있습니다. 새 음성을 참조 클립의 목소리와 비슷하게 만들거나 말하기 속도, 피치, 볼륨, 형식, 자막을 조정할 때 사용하세요.
생성할 음성을 구체적으로 설명하기
입력란에 내용, 목소리 유형, 속도, 환경, 마무리 방식을 설명하세요. Seed audio 1.0에는 최대 3,000자까지 입력할 수 있습니다.
“오늘 저녁 여덟 시에 바닷가에서 만나요.”라고 말하는 한국어 여성 내레이션을 생성해 주세요. 자연스럽고 차분한 목소리로 조금 느리게 말하고, 마이크와 가까운 거리감을 유지하세요. 배경은 조용하게 하고 문장은 자연스럽게 마무리해 주세요.
참조 오디오 추가하기
- 참조할 오디오를 같은 캔버스에 놓습니다.
- 대상 오디오 노드를 선택하고 Seed audio 1.0을 선택합니다.
- 입력란 위 참조 영역에서
+를 선택합니다. - 캔버스에서 참조할 오디오 노드를 선택하세요. 최대 3개까지 선택할 수 있습니다. 완료되면 상단 도구 모음에서 나가기를 선택하거나
Esc를 누르세요.
Seed audio 1.0 노드 하나에 오디오를 최대 3개까지 참조할 수 있습니다. 현재 이 모델은 이미지를 참조 자료로 지원하지 않습니다.
선택한 오디오는 입력란 위에 표시됩니다. 프롬프트에 유지할 점과 바꿀 점을 설명하세요.
연결된 참조 오디오의 여성 목소리와 말하기 리듬을 사용해 “신제품은 이번 주 금요일에 정식 출시됩니다.”라고 다시 읽어 주세요. 비슷한 음색과 마이크 거리를 유지하고 기대감은 조금 더해 주세요. 배경음악은 추가하지 마세요.
출력 설정하기
모델 옆에 표시되는 현재 형식(예: WAV)을 선택해 자막과 출력 형식을 설정하세요. 톱니바퀴 버튼을 선택하면 고급 설정이 열립니다.
| 설정 | 선택 가능 값 | 변경할 때 |
|---|---|---|
| 자막 | 켜기 / 끄기 | 편집 가능한 텍스트도 필요할 때 켭니다 |
| 출력 형식 | WAV, MP3, OGG_OPUS | WAV는 후속 제작에, MP3는 미리 듣기와 공유에 적합합니다 |
| 샘플 레이트 | 8k, 16k, 24k, 32k, 44.1k, 48k | 별도 납품 규격이 없다면 기본값 24k를 유지해도 됩니다 |
| 말하기 속도 | 0.5–2.0 | 음성을 느리게 또는 빠르게 조정합니다 |
| 피치 | -12–+12 | 결과의 음높이를 낮추거나 높입니다 |
| 볼륨 | 0.5–2.0 | 출력 음량을 조정합니다 |
처음 생성할 때는 기본값을 유지하는 것이 좋습니다. 결과를 들어 본 뒤 설정을 한 번에 하나씩 바꾸고 다시 생성하면 어떤 변경이 결과에 영향을 주었는지 알기 쉽습니다.
4. 생성하고 미리 듣기
- 프롬프트, 참조 오디오, 설정을 확인합니다.
- 입력 패널 오른쪽 아래에서 생성을 선택합니다.
- 모델이 실행되는 동안 오디오 노드에 진행 상태가 표시됩니다.
- 완료되면 노드에 오디오 파형과 재생 버튼이 나타납니다.
모델을 실행할 때마다 Tapies가 사용됩니다. 생성 버튼 옆에 예상 사용량이 표시됩니다. Seed audio 1.0의 최종 사용량은 모델 출력 길이를 기준으로 계산되므로 예상치와 실제 사용량이 다를 수 있습니다.
파형을 드래그해 원하는 위치로 이동하거나 10초 뒤로 가기 및 앞으로 가기 버튼을 사용할 수 있습니다. 이 재생 기능은 미리 듣는 위치만 바꾸며 오디오 파일은 수정하지 않습니다.
Seed audio 1.0에서 자막을 켜고 모델이 자막 텍스트를 반환하면 캔버스에 오디오 자막이라는 텍스트 노드가 만들어지고 오디오 노드에 자동으로 연결됩니다.
5. 다시 생성, 다운로드 또는 연결하기
결과가 마음에 들지 않으면 프롬프트, 참조 오디오 또는 설정을 바꾸고 생성을 다시 선택하세요. 오디오 노드에 새 결과가 표시됩니다. 현재 버전을 보관하려면 다시 생성하기 전에 파일을 다운로드하거나 라이브러리에 저장하세요.
| 작업 | 결과 |
|---|---|
| 다운로드 | 현재 오디오 파일을 컴퓨터에 저장합니다 |
| 라이브러리에 저장 | 저장 패널을 열고 오디오를 개인 또는 팀 라이브러리에 저장합니다 |
| 오른쪽 연결점에서 비디오 노드로 연결 | 오디오 참조를 지원하는 비디오 노드의 입력으로 사용합니다 |
오디오 노드의 파형과 재생 버튼은 미리 듣기용이며 파형 자르기는 지원하지 않습니다. 내용, 속도 또는 목소리를 바꾸려면 입력이나 설정을 수정한 뒤 다시 생성하세요.
다음: 텍스트와 3D 제작하기