곡을 설명하면 들려줍니다: 실전 텍스트-투-송
텍스트-투-송은 한 문장을 완성된 곡으로 바꿉니다. 편곡, 악기 구성, 원한다면 보컬까지요. 그 문장에는 장르, 분위기, 구체적인 대상이 담겨 있어야 합니다. "밝게 해 줘"로는 모델이 쌓아 올릴 것이 없습니다. 첫 시도에서는 음악 설정을 Auto로 두고, 그다음에 한 가지만 움직이는 데 쓰세요. Musy AI에서 설명은 150자까지이고, 대부분의 곡은 1분쯤이면 준비됩니다.
문장이 곧 악기입니다
저희가 얻은 좋은 결과에는 모두 세 가지 재료가 들어 있었고, 나쁜 결과에는 대개 하나가 빠져 있었습니다.
- 겨냥할 소리 — 장르, 시대, 또는 악기. "Lo-fi", "90년대 얼터너티브 록", "솔로 피아노", "Afrobeat".
- 분위기 — 감정의 온도. "아련한", "벅찬", "위협적인", "따뜻한".
- 대상이나 장면 — 구체적인 무언가. 사람들이 건너뛰는 재료인데, 차이를 만드는 것이 바로 이겁니다. "도쿄의 비 오는 밤"은 장면이고, "칠한 바이브"는 아닙니다.
합치면 "도쿄의 비 오는 밤을 위한 lo-fi 비트" — 장르, 분위기, 장면이 짧은 한 줄에 들어갑니다. 이 형태를 따라 하세요.
처음에는 설정을 건드리지 마세요
장르, 무드, BPM, 길이는 모두 직접 정할 수 있고, 곧바로 전부 정하고 싶어집니다. 참으세요. 설명에 "도쿄의 비 오는 밤"이라고 쓰고 장르를 Metal로 정하면, 서로 다른 두 곡을 요청한 셈이고 그 평균을 받게 됩니다.
설정이 제 몫을 하는 것은 두 번째 시도, 즉 결과가 거의 맞을 때입니다. 같은 설명에 BPM만 조금 낮추고, 무드를 명시하고, 다시 생성하는 것. 그것이 통제된 실험입니다. 여섯 가지를 한꺼번에 정하는 건 아니고요.
| 설정 | Auto로 둘 때 | 직접 정할 때 |
|---|---|---|
| 장르 | 설명에 이미 소리가 명시되어 있을 때 | 29가지 중 특정 장르를 원하는데 문장이 모호할 때 |
| 무드 | 설명이 감정을 담고 있을 때 | 결과가 감정적으로 밋밋하게 나왔을 때 |
| BPM | 거의 항상 | 운동이나 영상 편집처럼 시간이 정해진 용도일 때 |
| 길이 | 없음 — 이건 의식적으로 고르세요 | 항상. 길이만이 아니라 곡의 구조가 달라집니다. |
연주곡인가 보컬곡인가
곡이 무언가의 아래에 깔린다면 — 영상, 팟캐스트 인트로, 배경 음악 — 연주곡이 더 안전한 기본값입니다. 곡 자체가 목적이거나 누군가에 관한 곡일 때는 보컬이 핵심입니다.
가사를 켜면 직접 쓰거나(500자까지) 같은 설명에서 생성할 수 있습니다. 이름, 둘만 아는 농담, 장소처럼 구체적인 것이 중요할 때는 직접 쓰는 편이 값을 합니다. 생성된 가사는 장르 흉내에서는 기대 이상이고, 특정한 의미를 담는 데서는 기대 이하입니다.
보컬은 Auto, 남성, 여성, 아동으로 설정할 수 있습니다. 앱에서 자기 목소리를 한 번 녹음해 두고 그 목소리로 노래하게 할 수도 있습니다. 이는 의도적으로 본인의 목소리로만 한정했습니다. 저희는 다른 사람의 목소리를 복제하는 기능을 만들지 않으며, 그런 기능을 어디서 보든 같은 주의를 권합니다.
첫 결과가 최종본이 아닌 이유
생성에는 실제 편차가 있습니다. 같은 설명을 두 번 넣으면 서로 다른 두 곡이 나오고, 둘 다 유효합니다. 프롬프트로 피해 갈 결함이 아니라 매체의 성질입니다. 통하는 방식은 이렇습니다.
- 재료 셋이 든 문장을 쓰세요. 길이를 고르세요. 생성하세요.
- 한 번, 끝까지 들으세요. 무엇이 구체적으로 어긋났는지 정하세요. 템포, 에너지, 악기 구성, 보컬 중에서요.
- 딱히 어긋난 건 없는데 밋밋하다면, 그대로 다시 생성하세요. 편차만으로 해결되는 경우가 많습니다.
- 구체적으로 어긋난 것이 있다면, 그 하나만 바꿔 다시 생성하세요.
- 좋은 것은 남겨 두세요. 생성은 저렴하고, 느린 쪽은 고르는 일입니다.
템플릿에서 시작하는 편이 나을 때
생일, 사랑 노래, 반려동물에 대한 노래 같은 상황별 곡이라면, Lab의 템플릿이 장르와 무드를 대신 정해 주고 그 상황에 꼭 필요한 것만 묻습니다. 설명을 처음부터 쓰는 것보다 빠르고, 대개 더 낫기도 합니다. 그런 종류의 곡이 어떻게 해야 잘 되는지 템플릿이 이미 알고 있기 때문입니다. 그 흐름을 처음부터 끝까지 보려면 생일 노래 만들기 안내를 보세요.
마음에 드는 곡을 얻고 나면, 프롬프트를 파고드는 이야기는 통하는 노래 프롬프트에 있습니다.
자주 묻는 질문
AI 텍스트-투-송은 어떻게 작동하나요?
곡을 설명하면 모델이 작곡하고 연주해 완성된 오디오를 돌려줍니다. Musy AI에서 설명은 150자까지이고, 생성은 백그라운드에서 진행되며, 대부분의 곡은 1분쯤 걸립니다.
설명에는 무엇을 써야 하나요?
장르나 참고할 소리, 분위기, 그리고 구체적인 대상입니다. "도쿄의 비 오는 밤을 위한 lo-fi 비트"에는 셋이 모두 들어 있습니다.
장르, 무드, BPM을 직접 정해야 하나요?
첫 시도에는 아닙니다. 문장과 어긋나는 설정은 결과를 양쪽으로 잡아당깁니다. 두 번째 시도에서 한 가지만 움직이는 데 쓰세요.
AI 노래는 얼마나 길 수 있나요?
30초, 60초, 90초, 2분입니다. 짧은 쪽이 더 나은 경우가 많습니다. 좋은 아이디어 하나가 2분짜리 반복보다 낫습니다.