Descreva uma música e ouça: texto para música na prática
Texto para música transforma uma frase em uma faixa pronta: arranjo, instrumentação e vocais se você quiser. A frase precisa carregar gênero, clima e um tema concreto; «deixa animado» não dá ao modelo nada sobre o que construir. Deixe os controles musicais no automático na primeira tentativa e depois use-os para mover uma coisa. No Musy AI a descrição aceita até 150 caracteres e a maioria das músicas fica pronta em cerca de um minuto.
A frase é o instrumento inteiro
Todo bom resultado que tivemos carrega três ingredientes, e à maioria dos ruins falta um:
- Um som para mirar — um gênero, uma época ou um instrumento. «Lo-fi», «rock alternativo dos anos 90», «piano solo», «afrobeat».
- Um clima — a temperatura emocional. «Melancólico», «triunfal», «ameaçador», «caloroso».
- Um tema ou cena — algo concreto. Este é o ingrediente que as pessoas pulam, e é o que faz diferença. «Uma noite chuvosa em Tóquio» é uma cena; «vibe tranquila» não é.
Montado: «Um beat lo-fi para uma noite chuvosa em Tóquio» — gênero, clima, cena, doze palavras. É essa a forma a copiar.
No começo, não mexa nos controles
Gênero, clima, BPM e duração podem ser definidos explicitamente, e o instinto é definir todos de uma vez. Resista. Se a sua descrição diz «uma noite chuvosa em Tóquio» e você também define o gênero como Metal, pediu duas músicas diferentes e vai receber a média das duas.
Os controles conquistam seu lugar na segunda passada, quando você já tem um resultado próximo: mesma descrição, BPM um pouco menor, clima definido explicitamente, gerar de novo. Isso é um experimento controlado. Mexer em seis coisas de uma vez, não.
| Controle | Deixe no automático quando… | Defina quando… |
|---|---|---|
| Gênero | Sua descrição já nomeia um som | Você quer um específico dos 29 e o texto é ambíguo |
| Clima | A descrição já carrega emoção | O resultado voltou emocionalmente plano |
| BPM | Quase sempre | A faixa é para algo com tempo fixo — um treino, uma edição de vídeo |
| Duração | Nunca — escolha de propósito | Sempre. Muda a estrutura, não só o tamanho. |
Instrumental ou com vocal
Instrumental é o padrão mais seguro para tudo aquilo sob o que a música vai: um vídeo, uma vinheta de podcast, escuta de fundo. Vocais são o ponto quando a música é a protagonista, ou quando é sobre alguém.
Com letras ligadas, você pode escrever as suas (até 500 caracteres) ou gerá-las a partir da mesma descrição. Escrever as suas vale quando os detalhes importam: um nome, uma piada interna, um lugar. Letras geradas são melhores do que as pessoas esperam em imitar convenções de gênero, e piores em significar algo em particular.
Vocais podem ser automático, masculino, feminino ou infantil. Você também pode gravar a sua própria voz uma vez no app e ter músicas cantadas com ela. Isso é deliberadamente restrito à sua voz: não construímos clonagem de voz de outras pessoas, e recomendaríamos a mesma cautela onde quer que você encontre esse recurso.
Por que o primeiro resultado não é o final
A geração tem variação real: a mesma descrição duas vezes dá duas músicas diferentes, ambas válidas. Isso não é um defeito a contornar com prompt — é o meio. O fluxo que funciona:
- Escreva a frase de três ingredientes. Escolha uma duração. Gere.
- Ouça uma vez, inteira. Decida o que está especificamente errado: andamento, energia, instrumentação, vocal.
- Se nada está especificamente errado mas está sem graça, gere de novo sem mudar nada. Só a variação costuma resolver.
- Se algo específico está errado, mude essa única coisa e gere de novo.
- Guarde as boas. Gerar é barato; decidir é a parte lenta.
Quando partir de um modelo
Para músicas de ocasião — aniversários, músicas de amor, músicas sobre um pet — os modelos do Lab definem gênero e clima por você e perguntam só o que aquela ocasião precisa saber. É um caminho mais rápido do que escrever uma descrição do zero, e normalmente melhor, porque o modelo já sabe o que faz aquele tipo de música funcionar. Veja o passo a passo da música de aniversário.
Quando já tiver uma faixa de que goste, a toca de coelho do ofício de prompts está em prompts de música que funcionam.
Perguntas frequentes
Como funciona o texto para música?
Você descreve a música; o modelo compõe e executa, devolvendo áudio pronto. No Musy AI a descrição aceita 150 caracteres, a geração roda em segundo plano e a maioria leva cerca de um minuto.
O que a descrição deve dizer?
Gênero ou som de referência, clima e um tema concreto. «Um beat lo-fi para uma noite chuvosa em Tóquio» carrega os três.
Defino gênero, clima e BPM à mão?
Na primeira tentativa não: controles que contradizem seu texto puxam o resultado para dois lados. Use-os na segunda passada para mover uma coisa.
Qual a duração?
30 segundos, 60, 90 ou 2 minutos. Curto costuma ser melhor: uma ideia forte ganha de dois minutos de repetição.