Deskripsikan lagu, dengarkan hasilnya: teks-ke-lagu dalam praktik

TL;DR

Teks-ke-lagu mengubah sebuah kalimat menjadi trek yang jadi — aransemen, instrumentasi, dan vokal kalau Anda mau. Kalimatnya harus memuat genre, suasana, dan subjek yang konkret; "buat yang gembira" tak memberi model apa pun untuk dibangun. Biarkan kontrol musiknya Otomatis pada percobaan pertama, lalu pakai kontrol itu untuk menggeser satu hal. Di Musy AI deskripsinya sampai 150 karakter dan kebanyakan lagu siap dalam sekitar semenit.

Kalimat itulah seluruh instrumennya

Setiap hasil bagus yang kami peroleh memuat tiga bahan, dan sebagian besar hasil buruk kehilangan salah satunya:

Digabung: "Beat lo-fi untuk malam hujan di Tokyo" — genre, suasana, adegan, delapan kata. Itulah bentuk yang perlu ditiru.

Layar buat di Musy AI pada iPhone dengan bidang deskripsi lagu serta kontrol opsional genre, suasana, BPM, dan durasi.
Deskripsi dulu. Setiap kontrol musik di bawahnya bersifat opsional dan bawaannya Otomatis.

Awalnya, biarkan kontrolnya saja

Genre, suasana, BPM, dan durasi semuanya bisa diatur eksplisit, dan naluri kita ingin mengatur semuanya sekaligus. Tahanlah. Kalau deskripsi Anda berbunyi "malam hujan di Tokyo" dan Anda juga menyetel genre ke Metal, Anda sudah meminta dua lagu berbeda dan akan mendapat rata-ratanya.

Kontrol mendapatkan tempatnya pada putaran kedua, ketika Anda sudah punya hasil yang mendekati: deskripsi sama, BPM diturunkan sedikit, suasana diatur eksplisit, buat ulang. Itu eksperimen terkendali. Mengatur enam hal sekaligus bukan.

KontrolBiarkan Otomatis kalau…Aturlah kalau…
GenreDeskripsi Anda sudah menyebut sebuah bunyiAnda ingin satu dari 29 secara spesifik dan teksnya ambigu
SuasanaDeskripsinya sudah membawa emosiHasilnya kembali datar secara emosi
BPMHampir selaluTreknya untuk sesuatu yang terikat waktu — olahraga, potongan video
DurasiTidak pernah — pilih ini dengan sengajaSelalu. Ia mengubah strukturnya, bukan cuma panjangnya.

Instrumental atau bervokal

Instrumental adalah bawaan yang lebih aman untuk apa pun yang lagunya duduk di bawahnya — sebuah video, pembuka podcast, dengaran latar. Vokal jadi intinya ketika lagunya sendiri adalah tujuannya, atau ketika lagunya tentang seseorang.

Dengan lirik dinyalakan, Anda bisa menulis sendiri (sampai 500 karakter) atau membuatnya dihasilkan dari deskripsi yang sama. Menulis sendiri sepadan ketika hal-hal spesifik penting — sebuah nama, lelucon dalam, sebuah tempat. Lirik yang dihasilkan lebih baik daripada dugaan kebanyakan orang dalam meniru gaya genre, dan lebih buruk dalam benar-benar berarti sesuatu yang tertentu.

Vokal bisa disetel ke Otomatis, pria, wanita, atau anak. Anda juga bisa merekam suara Anda sendiri sekali di aplikasinya dan membuat lagu dinyanyikan dengan suara itu. Itu sengaja dibatasi pada suara Anda sendiri — kami tidak membangun kloning suara orang lain, dan kami menganjurkan kehati-hatian yang sama di mana pun Anda menemukan fitur itu.

Kenapa hasil pertama bukan yang disimpan

Pembuatan punya variasi nyata: deskripsi yang sama dua kali memberi Anda dua lagu berbeda, keduanya sah. Itu bukan cacat yang harus disiasati lewat prompt, itu memang sifat mediumnya. Alur yang berhasil:

  1. Tulis kalimat tiga bahan itu. Pilih durasinya. Buat.
  2. Dengarkan sekali, sampai habis. Putuskan apa persisnya yang salah — tempo, energi, instrumentasi, vokal.
  3. Kalau tak ada yang salah secara spesifik tapi terasa hambar, buat ulang tanpa mengubah apa pun. Variasi saja sering sudah memperbaikinya.
  4. Kalau ada yang salah secara spesifik, ubah satu hal itu lalu buat ulang.
  5. Simpan yang bagus. Membuat itu murah; memutuskan itulah bagian yang lambat.

Kapan sebaiknya mulai dari templat saja

Untuk lagu momen — ulang tahun, lagu cinta, lagu tentang hewan peliharaan — templat di Lab menyetel genre dan suasana untuk Anda dan hanya menanyakan apa yang perlu diketahui momen itu. Jalurnya lebih cepat daripada menulis deskripsi dari nol, dan biasanya lebih baik, karena templatnya sudah tahu apa yang membuat lagu semacam itu berhasil. Lihat panduan lagu ulang tahun untuk melihat alur itu dari awal sampai akhir.

Begitu Anda punya trek yang Anda suka, lubang kelinci kerajinan prompt ada di prompt lagu yang berhasil.

Pertanyaan yang sering diajukan

Bagaimana cara kerjanya?

Anda mendeskripsikan lagunya; model menggubah dan membawakannya, lalu mengembalikan audio yang jadi. Di Musy AI sampai 150 karakter, pembuatan di latar, sekitar semenit.

Apa yang harus disebut deskripsinya?

Genre atau bunyi acuan, suasana, dan subjek konkret. "Beat lo-fi untuk malam hujan di Tokyo" memuat ketiganya.

Perlu mengatur genre, suasana, BPM?

Tidak pada percobaan pertama — kontrol yang bertentangan dengan teks menarik hasil ke dua arah. Pakailah di putaran kedua untuk menggeser satu hal tertentu.

Berapa panjang lagunya?

30 detik, 60, 90, atau 2 menit. Lebih pendek sering lebih baik: satu gagasan kuat mengalahkan dua menit pengulangan.