사운드, 음성, 대사가 있는 AI 영상 생성하는 방법
MyDreamVid · 2026-09-11
대부분의 사람들은 무음 클립으로 AI 영상을 처음 접하고, 그다음 저녁 내내 편집기에서 사운드를 입힙니다. Seedance는 오디오를 영상 과 함께 생성합니다. 장면에 맞는 주변음, 동작에 동기화된 효과음, 그리고 — 모두를 놀라게 하는 부분인 — 음성 대사까지요.
클립에 음성 넣기
프롬프트 안에 따옴표로 대사를 넣으세요. 그게 전부입니다.
노점 상인이 김이 나는 냄비를 저으며 외친다, "따끈한 국수요, 오늘 마지막 한 솥!"
이 대사는 자연스러운 억양으로 발화되며, 가장 저렴한 모델(2.0 Mini)에서도 작동합니다. 톤은 평범한 묘사로 조절할 수 있습니다 — 속삭인다, 빗속에서 소리친다, 지친 듯 말한다.
말하는 동물 요령
검증된 함정 하나: 동물에게 "입이 말에 맞춰 움직인다" 고 요청하면, 모델은 동물에게 섬뜩할 만큼 인간적인 입술과 이빨을 붙이는 경향이 있습니다. 거의 모든 립싱크 학습 영상이 사람 얼굴이기 때문이죠. 해결책은 보이스오버 구성입니다.
새끼 고양이의 목소리는 보이스오버로 들린다. 입은 자연스러운 고양이 입 그대로이며 아주 작은 움직임만 있고, 인간 같은 입술이나 이빨은 없다. "말하는" 동안 작게 고개를 기울이고 귀를 씰룩인다.
매력은 지키고 신체적 공포는 없앱니다. Seedance 2.5는 "입을 자연스럽게 유지" 제약도 Mini나 Fast보다 더 순순히 따릅니다.
오디오 비용
오디오는 기본적으로 켜져 있으며, 가격은 모델에 따라 다릅니다 — 긴 클립을 만들기로 결정하기 전에 알아 둘 가치가 있습니다.
- Seedance 2.0 Fast와 2.0 Mini: 오디오 무료 — 오디오를 켜든 끄든 가격이 동일합니다.
- Seedance 2.5와 2.0: 오디오는 클립 가격을 대략 두 배로 만듭니다. 이 모델들에서는 비주얼 초안을 잡을 때 오디오를 끄고, 최종 렌더링에서 켜세요.
어느 쪽이든, 생성기는 시작 전에 실제 설정에 대한 정확한 크레딧 비용을 견적으로 보여 줍니다 — 요금 페이지에 초당 요금표가 있습니다.
참조 오디오: 리듬 설정하기
참조-투-비디오 모드에서는 오디오 파일(최대 5분)을 첨부하고 프롬프트에서 그것을 가리킬 수 있습니다 — "@Audio1이 리듬을 설정한다" — 동작을 박자에 맞춰 편집할 때 유용합니다. 참조 오디오는 자체 길이만큼 출력 비용에 더해 별도로 청구되며, 견적에서 그 추가분이 생성 전에 따로 표시됩니다.
편집기에서 사운드를 넣는 게 나은 경우
생성된 오디오는 장면 사운드입니다 — 주변음, 효과음, 대사요. 라이선스가 있는 음악 트랙, 정밀한 내레이션, 여러 샷으로 이루어진 영화의 연속적인 스코어가 필요하다면, 클립을 내보낸 뒤(영화 워크스페이스는 샷들의 ZIP과 러프컷 MP4를 제공합니다) 원하는 편집기에서 트랙을 얹으세요. 음악 베드 아래에 깔린 생성 주변음은 대개 잘 섞입니다.
자주 묻는 질문
모든 모델이 오디오를 지원하나요?
네 — 네 가지 Seedance 영상 모델 모두 오디오를 생성하며, 네이티브 오디오는 특히 2.5의 강점입니다.
오디오를 끌 수 있나요?
네, 생성 단위로요. 2.5와 2.0에서는 가격이 대략 절반으로 줄고, Fast와 Mini에서는 가격이 바뀌지 않습니다.
특정 목소리를 복제할 수 있나요?
아니요 — 목소리는 샘플에서 복제되는 게 아니라 장면에 맞게 생성되며, 실제 인물을 사칭하는 것은 콘텐츠 정책에 위배됩니다.
대사가 원하지 않은 분위기로 나왔어요. 어떻게 고치나요?
각본가처럼 연출하세요. 따옴표 주변 산문에 전달 방식을 넣으세요 — "그녀는 고개도 들지 않고 무덤덤하게 말한다, '알아.'" — 그리고 다시 생성하세요. Mini에서 초안을 만들면 이런 재시도가 저렴하게 유지됩니다.