2 Models Available

AI로 목소리 복제하는 방법

한 팟캐스터나 강의 제작자가 30초짜리 샘플로 자신의 목소리를 복제한 뒤, 재녹음 없이 새로운 내레이션을 생성합니다. Astorie 캔버스에서 깨끗한 레퍼런스 클립을 오디오 노드에 넣고, ElevenLabs Voice Cloning, Fish Audio S2-Pro 음성 복제, 또는 Minimax Voice Design으로 보낸 뒤, 복제된 목소리를 다운스트림의 스크립트-투-스피치, 더빙, 립싱크 노드에 이어 붙이세요. 창업자 목소리 훈련용 내레이션, 강의 모듈, 기존 영상의 현지화 등에 활용할 수 있습니다. 본인이 소유했거나 사용 권한이 있는 목소리만 복제하세요. 아래에서 모델을 선택해 복제 워크플로우를 따라가 보세요.

Choose a Model to Get Started

ElevenLabs

ElevenLabs Eleven v3

ElevenLabs는 보유한 레퍼런스 음성 분량에 따라 선택하는 두 가지 보이스 클로닝 등급을 제공합니다. 즉시 보이스 클로닝(IVC)은 10초 샘플만으로 학습되어 몇 초 만에 사용할 수 있어 내부 나레이션 초안, 프로토타입 더빙, 개인 영상 보이스오버에 적합합니다. 전문 보이스 클로닝(PVC)은 30분 이상의 깨끗한 스튜디오 음원이 필요하지만, 완성된 목소리는 흔들림 없이 강의나 오디오북 전체를 소화할 수 있습니다. Astorie에서는 두 모드 모두 Eleven v3(비영어 작업은 Multilingual v2)로 연결되므로, 목소리를 한 번 등록하면 인라인 감정 태그와 함께 70개 이상 언어로 새 나레이션을 생성할 수 있습니다. 중요: 본인이 소유했거나 복제에 대한 명시적 서면 동의를 받은 목소리만 복제하세요. ElevenLabs는 본인 목소리를 복제할 때 음성 인증을 요구하지만, 플랫폼이 강제하든 하지 않든 동의는 반드시 지켜야 할 원칙입니다.

4 steps + 2 promptsView guide

Fish Audio

Fish Audio S2-Pro

Fish Audio S2-Pro는 ElevenLabs 클로닝의 오픈소스 대안으로, 두 가지 실질적인 차별점을 갖고 있습니다. 프롬프트 안에서 자연어로 표현하는 대괄호 제어(`[whispering]`, `[laughing nervously]`, `[pause]`)와 직접 셀프 호스팅할 수 있는 오픈 서빙 스택입니다. 보이스 클로닝에는 깨끗한 레퍼런스 음원과 그에 맞는 대본(transcript)이 함께 필요합니다 — Fish Audio는 대본 텍스트로 음소를 구분하기 때문에, 대본이 실제 발화와 어긋나면 ElevenLabs보다 클로닝 품질에 더 큰 타격을 줍니다. 지원 범위는 자동 감지되는 80개 이상 언어입니다. 중요: 본인이 소유했거나 복제에 대한 명시적 서면 동의를 받은 목소리만 복제하세요. Fish Audio는 오픈소스이므로 동의 이행의 책임은 플랫폼이 아니라 사용자에게 있습니다 — 레퍼런스 음원을 업로드하기 전에 권리 관계를 명확히 정리해 두세요.

4 steps + 2 promptsView guide