Suno Speech 베타는 대본을 내레이션과 오리지널 음악이 함께 들어간 트랙으로 만들어줍니다. 다만 단어 하나, 쉼표 하나까지 정밀하게 통제하는 텍스트 음성 변환 엔진은 아닙니다. 결과물에 음악이 어울리고 짧은 분량의 표현력 있는 콘텐츠를 만들 때는 유용하지만, 발음과 멈춤, 재현성을 중시한다면 전용 TTS 도구가 더 적합합니다.
Suno Speech가 맞는 작업인지 먼저 판단하기
Suno Speech는 정확한 보이스오버 제작보다는 음악을 입힌 짧은 내레이션에 더 잘 맞습니다. 2026년 10월 기준 베타 버전은 약간의 예측 불가능성을 감수할 수 있는 작업에서 강점을 보입니다. 반대로 대본, 타이밍, 화자 일관성을 엄격하게 관리해야 한다면 한계가 분명합니다.
| 프로젝트 | Suno Speech 사용 여부 | 이유 |
|---|---|---|
| 잔잔한 피아노가 깔린 동화 | 사용 추천 | 한 번의 생성으로 내레이션과 오리지널 사운드트랙을 함께 만들 수 있습니다. |
| 명상 오디오 또는 극적인 시 낭송 | 검토 후 사용 | 표현력 있는 속도 조절이 형식에 잘 맞지만, 멈춤과 억양이 달라질 수 있습니다. |
| 짧은 캐릭터 독백 | 테스트 권장 | 말투와 전달 방식은 쓸 만할 수 있지만, 정확한 발음은 보장되지 않습니다. |
| 타임코드가 필요한 제품 튜토리얼 | 사용하지 않음 | 전용 TTS 도구가 타이밍과 대사를 더 안정적으로 재현합니다. |
| 오디오북 한 챕터 | 사용하지 않음 | Suno는 Speech의 재생 시간, 연속성, 발음에 관한 사양을 공개하지 않았습니다. |
| 검증된 본인 음성으로 만든 노래 | Voices 사용 | Voices는 재사용 가능한 음성 프로필로 노래를 만드는 Suno의 별도 기능입니다. |
Suno는 제한 테스트를 거친 뒤 2026년 10월 1일 Speech를 발표하고 베타를 모든 사용자에게 공개했습니다. 공식 릴리스 노트에 따르면 웹, iOS, Android에서 사용할 수 있습니다. 다만 발표문에는 Speech 전용 크레딧 가격, 요금제별 할당량, 최대 길이, 지원 언어 목록, 파일 사양, API에 대한 내용이 없습니다.
Suno Speech 베타로 만들 수 있는 결과물
Suno Speech 베타는 말하는 목소리와 오리지널 배경 음악을 하나의 완성된 트랙으로 생성합니다. Suno의 출시 안내에 따르면 사용자는 아이디어나 시, 대본을 입력하고 원하는 목소리와 음악 스타일을 함께 설명할 수 있습니다.
Speech는 음성 출력을 위해 마련된 별도의 Create 모드입니다. Suno가 예로 든 결과물에는 잔잔한 피아노가 깔린 동화, 스타디움 드럼을 곁들인 응원 연설, 음악이 입혀진 음성 메모 등이 있습니다.
베타라는 표시는 단순한 수식어가 아닙니다. Suno는 영국식 억양을 요청해도 호주식 억양 쪽으로 흐르거나 다시 돌아올 수 있고, 극적인 멈춤이 지나치게 길어질 수 있다고 안내합니다. 이런 공식 경고를 고려하면 첫 결과가 그럴듯하게 들리더라도 검수 없이 바로 공개하기는 어렵습니다.
초기 r/SunoAI 커뮤니티에서는 독립적인 제작 테스트보다 Suno 자체 시연에서 들린 문제를 중심으로 논의가 진행됐습니다. 사용자 u/TheWeaverofDreams는 다음과 같이 썼습니다.
“시연용 결과물치고는 걱정스러울 정도로 형편없다.”
개인적인 평가이기는 하지만, Suno가 직접 문서화한 억양과 속도 불안정성에 대한 지적과는 맥락이 맞습니다.
Suno에서 음성 트랙 만들기
아래 과정은 현재 웹과 모바일 Create 환경을 기준으로 합니다. 베타 기간에는 메뉴와 동작이 바뀔 수 있습니다.
- 웹, iOS 또는 Android에서 Suno의 Create를 열고 Speech를 선택합니다. Speech가 보이지 않으면 모바일 앱을 업데이트하세요.
- 짧은 대본을 붙여 넣거나 아이디어를 입력합니다. 대사를 원하는 대로 통제하려면 Suno에 작성을 맡기기보다 완성된 대본을 직접 입력하는 편이 좋습니다.
- 화자를 구체적으로 설명합니다. 연령대, 목소리의 질감, 감정, 억양, 말하는 속도, 전달 방식을 포함하세요. 사용 허가를 받지 않은 실제 인물의 이름을 목소리로 지정하지 마세요.
- 사운드트랙은 별도로 설명합니다. 악기 구성, 분위기, 강도, 목소리 뒤에서 어느 정도로 들려야 하는지를 적습니다.
- 한 번 이상 생성하세요. Speech는 아직 베타이므로 긴 수정 지시를 계속 덧붙이기보다 두 번째 결과를 생성하는 편이 더 효과적인 경우가 많습니다.
- 공개하기 전에 원본 대본과 결과물을 대조합니다. 빠진 단어나 바뀐 표현, 이름과 숫자, 억양 변화, 긴 멈춤, 목소리와 음악의 밸런스, 끝맺음을 확인하세요.
말처럼 들리는 문장으로 쓰기
말하듯 작성한 입력은 결과물이 노래처럼 흘러가는 단서를 줄여줍니다. 문장을 짧게 쓰고, 숨을 쉴 지점에는 구두점을 활용하세요. 생각이 바뀌는 부분은 문단을 나누고, 리드미컬한 낭송을 의도한 것이 아니라면 문장 끝의 운율이나 반복 후렴구는 빼는 편이 좋습니다.
처음에는 다음과 같은 짧은 프롬프트로 시작해볼 수 있습니다.
Script:
[정확한 음성 대본을 짧은 문단으로 붙여 넣습니다.]
Voice:
따뜻한 성인 내레이터, 친밀하고 대화하듯 자연스러운 톤,
안정적인 속도, 명확한 발음, 절제된 감정.
Soundtrack:
여백이 많은 펠트 피아노와 낮은 앰비언트 질감,
주요 멜로디 없음, 믹스에서 목소리를 전면에 배치,
부드러운 마무리.
목소리와 사운드트랙 항목에는 피하고 싶은 요소만 나열하기보다 원하는 결과를 설명해야 합니다. “차분한 다큐멘터리 내레이션, 느린 속도, 아래에 잔잔한 피아노”처럼 쓰면 “노래하지 마”라는 지시를 반복하는 것보다 모델이 목표를 파악하기 쉽습니다.
깨끗한 음성만 만들거나 음악을 줄이는 방법
Suno Speech로 깨끗한 음성을 시도할 수는 있지만, Suno의 출시 안내는 이 기능을 기본적으로 음성과 오리지널 음악을 함께 만드는 도구로 설명합니다. SunoAI 뉴스 아카이브에서는 작동하는 베타 설정으로 배경 음악을 끄고, Variety를 가장 왼쪽으로 옮긴 다음 톤 지시에 No background music.를 추가하는 방법을 소개합니다.
다만 이 조합은 공식 사양이라기보다 우회 방법으로 보는 편이 안전합니다. 같은 자료에 따르면 처음에는 배경 음악 설정을 꺼도 음악이 생성됐고, Suno 역시 음성만 분리된 출력을 보장한다고 문서화하지 않았습니다. 깨끗한 보이스 트랙이 반드시 필요하다면 전용 TTS 제품을 선택하는 편이 낫습니다.
음악을 완전히 없애기보다 최소화하고 싶다면 잔잔한 배경과 목소리가 앞에 나오는 믹스를 요청하세요. Speech의 핵심 장점은 유지하면서도 적극적인 편곡이 자음을 가리거나 말 사이의 멈춤과 경쟁할 가능성을 줄일 수 있습니다.
Speech, Voices, 전용 TTS 중 무엇을 써야 할까?
Suno Speech, Suno Voices, 전용 TTS는 서로 다른 문제를 해결합니다. 모두 생성 음성을 다룬다는 이유만으로 선택하기보다 최종 결과물에 필요한 기능을 기준으로 판단하세요.
| 옵션 | 주요 용도 | 음성 입력 방식 | 잘 맞는 작업 | 주요 제약 |
|---|---|---|---|---|
| Suno Speech | 오리지널 사운드트랙과 함께 말하는 퍼포먼스 생성 | 프롬프트로 설명한 음성 | 이야기, 시, 명상 오디오, 개성 있는 내레이션 | 베타 특유의 발음, 억양, 속도 변동 |
| Suno Voices | 재사용 가능한 본인 음성으로 생성 노래 만들기 | 검증된 녹음 또는 업로드 파일 | 개인화된 노래와 음악 제작 | 별도 작업 흐름, 연령 및 지역 제한 |
| 전용 TTS | 통제된 음성으로 텍스트 렌더링 | 기본 음성 또는 사용 권한이 있는 커스텀 음성 | 튜토리얼, 접근성 콘텐츠, 장문 내레이션, 타이밍이 정해진 보이스오버 | 음악은 보통 별도의 제작 과정이 필요함 |
Suno Voices 설정 가이드에 따르면 15초에서 4분 길이의 원본 녹음이 필요하며, 사용자는 그중 가장 좋은 2분을 선택할 수 있습니다. 또한 안내된 문장을 직접 읽어 본인 인증을 진행합니다. Voices는 만 18세 이상 사용자로 제한되며 일부 지역에서는 이용할 수 없습니다. 그러나 이 같은 절차가 저장된 Voice를 Speech 안에서 선택할 수 있다는 의미는 아닙니다. 현재 Suno 문서는 두 기능을 별개의 기능으로 설명하고 있습니다.
Suno Speech 베타 FAQ
Suno Speech 베타는 지금 사용할 수 있나요?
네. Suno는 2026년 10월 1일 공개 베타를 발표했으며, 제한 테스트 이후 웹과 모바일에서 모든 사용자가 Speech를 이용할 수 있다고 밝혔습니다.
Suno Speech는 무료인가요?
Suno는 베타를 모든 사용자에게 공개한다고 했지만, 출시 자료에는 Speech 전용 크레딧 비용이나 무료 요금제의 별도 할당량이 나와 있지 않습니다. 이용 가능하다는 사실이 무제한 생성을 뜻하는 것은 아니므로, 여러 개를 한꺼번에 만들기 전에 Create 화면에서 조건을 확인하세요.
Suno Speech로 음악 없이 음성만 만들 수 있나요?
배경 음악 설정을 통해 깨끗한 음성을 시도할 수 있습니다. 한 커뮤니티 테스트에서는 Variety를 최소로 낮추고 톤 지시에 No background music.를 추가하는 방법도 권장했습니다. 하지만 Suno는 음성만 안정적으로 분리해 출력한다고 약속하지 않았습니다. 먼저 충분히 테스트하지 않고 이 동작을 기반으로 제작 workflow를 구축하지 않는 편이 좋습니다.
Suno Speech에서 내 목소리를 사용할 수 있나요?
Suno는 녹음을 검증한 뒤 생성 노래에 사용하는 개인 음성 프로필을 별도 기능인 Voices에서 제공한다고 문서화하고 있습니다. 현재 Speech 문서에는 저장된 Voice 프로필을 내레이터로 사용할 수 있다는 내용이 없습니다.
Suno Speech에 API가 있나요?
Suno의 10월 1일 발표문과 릴리스 노트에는 Speech API가 언급되어 있지 않습니다. 현재 이 기능은 웹과 모바일의 Create 환경을 통해 제공됩니다.
Suno Speech를 상업적으로 사용할 수 있나요?
Speech 발표문에는 별도의 상업적 이용 조건이 나와 있지 않습니다. 공개하기 전에 해당 계정과 생성 결과물에 적용되는 최신 Suno 요금제 약관을 확인하세요. Suno는 무료 및 유료 결과물의 이용 권한을 서로 다르게 적용해왔다는 점도 고려해야 합니다.
처음 테스트할 때는 100~150단어 분량에 음악을 절제하고, 두 번 생성해보세요. 표현력 있는 음악적 연출이 정확한 전달보다 중요하다면 Suno Speech를 사용하면 됩니다. 반대로 수정, 타이밍, 깨끗한 음성 분리가 핵심이 되는 순간에는 TTS로 전환하는 것이 좋습니다.