ساخت موسیقی و صدای پس‌زمینه با هوش مصنوعی

ویدیو آماده است و فقط یک موسیقی پس‌زمینه کم دارد که بابت آن اخطار کپی‌رایت نگیرید. اینجاست که ابزارهای تولید موسیقی واقعاً کار راه می‌اندازند.

🍊 تیم نارنگی ⏱ 4 دقیقه مطالعه
موج صوتی یک قطعه‌ی موسیقی در حال ساخته‌شدن روی نمایشگر

ویدیوی معرفی محصول آماده است. تدوین تمام شده، زیرنویس خورده، و حالا فقط یک موسیقی پس‌زمینه لازم دارد. آهنگی که دوست دارید کپی‌رایت دارد، آرشیوهای رایگان همه یک جنس تکراری دارند، و سفارش‌دادن به آهنگساز برای یک کلیپ چهل‌ثانیه‌ای منطقی نیست.

این تنگنا دقیقاً همان جایی است که ساخت موسیقی با هوش مصنوعی مسئله را حل می‌کند. نه برای ساختن آلبوم؛ برای پرکردن همین شکاف‌های کوچک که هر تولیدکننده‌ی محتوایی هفته‌ای چند بار با آن‌ها روبه‌رو می‌شود.

چه چیزی خوب درمی‌آید، چه چیزی نه

انتظار درست، نصف نتیجه است. این ابزارها در بعضی کارها واقعاً خوب‌اند و در بعضی هنوز نه:

خواستهکیفیت امروزتوضیح
موسیقی بی‌کلام پس‌زمینهخوبپرکاربردترین و مطمئن‌ترین کاربرد
لوگو صوتی و جینگل کوتاهخوبچند ثانیه، تکرارپذیر
افکت و صدای محیطخوبباران، بازار، قدم روی برف
قطعه با ساختار کاملمتوسطاوج و فرود اغلب سرجایش نیست
آواز فارسیضعیفتلفظ هنوز درست نیست
موسیقی دستگاهی ایرانیضعیفردیف را نمی‌شناسد
تقلید صدای خواننده‌ی مشخصنکنیدمسدود و مسئله‌دار

پرامپت موسیقی: توصیف کن، دستور نده

بیشتر آدم‌ها می‌نویسند «یک آهنگ شاد بساز» و از نتیجه ناامید می‌شوند. پرامپت موسیقی بیشتر شبیه بریف برای آهنگساز است تا سؤال. پنج چیز را مشخص کنید: ژانر، سازها، تمپو، حال‌وهوا، و کاربرد.

❌ یک موسیقی آرام بساز.

✅ instrumental, warm acoustic guitar and soft piano,
   light hand percussion, 85 BPM, calm and hopeful,
   no vocals, gentle build after 15 seconds,
   suitable for a 40-second product video, loopable ending

پرامپت را انگلیسی بنویسید. این سرویس‌ها فارسی را درست تفسیر نمی‌کنند و ترجمه‌ی واژه‌های موسیقایی هم دقیق‌تر جواب می‌دهد. اگر انگلیسی‌تان روان نیست، توصیف فارسی را در نارنگی بنویسید و بخواهید به بریف انگلیسی موسیقی تبدیلش کند.

💡 کلمه‌ای که بیشترین اثر را دارد

عبارت no vocals یا instrumental را حتماً بنویسید. بدون آن، مدل اغلب یک خط آواز مبهم انگلیسی اضافه می‌کند که زیر گفتار فارسی شما بدترین چیز ممکن است. برای پس‌زمینه‌ی روایت، هر صدای انسانی مزاحم است.

برای ویدیو

موسیقی پس‌زمینه‌ی ویدیو دو شرط دارد: نباید با صدای گوینده تداخل کند و باید بشود بی‌درز تکرارش کرد. در پرامپت هر دو را بخواهید. بعد در تدوین، حجم موسیقی را حدود پانزده تا بیست درصد صدای گفتار بگذارید — عددی که در عمل بیشتر مواقع درست است.

اگر خود ویدیو را هم با ابزار می‌سازید، ترتیب درست این است که اول تصویر و طول نهایی مشخص شود و بعد موسیقی ساخته شود؛ روش‌های تولید تصویر متحرک را در راهنمای ساخت ویدیو نوشته‌ایم.

برای پادکست

پادکست به سه قطعه نیاز دارد: تیتراژ ابتدایی حدود پانزده ثانیه، یک قطعه‌ی گذار چندثانیه‌ای بین بخش‌ها، و پایان‌بندی. هر سه باید یک هویت صوتی داشته باشند، پس از یک پرامپت پایه شروع کنید و فقط طول و شدت را تغییر بدهید. بقیه‌ی زنجیره‌ی تولید — ضبط، تمیزکردن صدا و تدوین — در راهنمای ساخت پادکست آمده است.

برای خود روایت، اگر می‌خواهید متن را به صدا تبدیل کنید یا برعکس، مقاله‌ی گفتار و متن وضعیت فعلی فارسی را توضیح داده است.

افکت صوتی: کاربرد دست‌کم‌گرفته‌شده

ساخت افکت کوتاه معمولاً بهتر از ساخت آهنگ جواب می‌دهد و کمتر کسی سراغش می‌رود. صدای در چوبی، خش‌خش کاغذ، همهمه‌ی بازار، باران روی شیروانی — این‌ها را می‌شود در چند ثانیه ساخت و برای انیمیشن، تیزر و حتی بازی استفاده کرد.

حق نشر: بخشی که نباید حدس بزنید

سه موضوع جدا را قاطی نکنید. اول، شرایط سرویسی که استفاده می‌کنید و اینکه اجازه‌ی استفاده‌ی تجاری می‌دهد یا نه. دوم، مالکیت خروجی که در بیشتر سرویس‌ها کامل به شما منتقل نمی‌شود. سوم، وضعیت حقوقی محتوای تولیدشده در ایران که هنوز رویه‌ی روشنی ندارد. این بحث را در مقاله‌ی حق نشر محتوای هوش مصنوعی باز کرده‌ایم.

نکته‌ی عملی: اگر ویدیو را در یوتیوب منتشر می‌کنید، ممکن است سامانه‌ی شناسایی محتوای یوتیوب روی قطعه‌ی تولیدشده هم ادعا ثبت کند. فایل و تاریخ ساخت را نگه دارید.

شروع عملی

یک ویدیوی قدیمی خودتان را بردارید که موسیقی‌اش راضی‌تان نکرده. یک پرامپت بنویسید، پنج نسخه بسازید، بدترین‌ها را حذف کنید و یکی را جایگزین کنید. همین یک تمرین، تمام آنچه را که باید بدانید نشان می‌دهد. سرویس‌هایی مثل Suno نقطه‌ی شروع رایجی هستند.

جمع‌بندی

این ابزارها آهنگساز نیستند. قطعه‌ای که واقعاً در ذهن می‌ماند هنوز از آدم درمی‌آید، و در موسیقی ایرانی فاصله بیشتر هم هست.

ولی برای آن چهل ثانیه موسیقی زیر ویدیو، آن جینگل پانزده‌ثانیه‌ای، و آن صدای بارانی که هیچ‌جا پیدا نمی‌کردید — کارشان تمام است. همان‌جا استفاده کنید و برای بقیه سراغ آدم بروید.

مطالب مرتبط:

پرسش‌های پرتکرار

موسیقی ساخته‌شده با هوش مصنوعی را می‌توانم تجاری استفاده کنم؟ +
به شرایط همان سرویس بستگی دارد و بین سرویس‌ها یکسان نیست. بعضی فقط در پلن پولی اجازه‌ی استفاده‌ی تجاری می‌دهند و بعضی در پلن رایگان هم اجازه می‌دهند اما مالکیت را واگذار نمی‌کنند. قبل از استفاده در تیزر یا محصول فروشی، صفحه‌ی شرایط را بخوانید؛ حدس زدن اینجا گران تمام می‌شود.
می‌شود آهنگی در سبک یک خواننده‌ی مشخص ساخت؟ +
اسم خواننده را در پرامپت نیاورید. بیشتر سرویس‌ها این را مسدود می‌کنند و اگر هم رد شود، خروجی از نظر حقوقی و اخلاقی مسئله‌دار است. کاری که مجاز و مؤثر است، توصیف ویژگی‌های موسیقایی است: ساز، ریتم، حال‌وهوا و دوره.
برای موسیقی سنتی ایرانی چقدر خوب کار می‌کند؟ +
ضعیف. مدل‌ها روی داده‌ی عمدتاً غربی آموزش دیده‌اند و مفهوم دستگاه و ردیف را نمی‌شناسند. اگر بخواهید چیزی در سه‌گاه یا شور بسازند، معمولاً چیزی می‌سازند که فقط رنگ‌وبوی شرقی دارد. برای سنتور و تار گاهی صدای قابل قبولی درمی‌آید، ولی نه اجرای درست ردیف.
آواز فارسی روی آهنگ چطور درمی‌آید؟ +
معمولاً بد. تلفظ فارسی در این مدل‌ها هنوز جا نیفتاده و کلمه‌ها کشیده یا اشتباه ادا می‌شوند. اگر به کلام فارسی نیاز دارید، فعلاً بهتر است موسیقی بی‌کلام بسازید و صدای انسان را جدا ضبط کنید.
چقدر طول می‌کشد تا به قطعه‌ی قابل استفاده برسم؟ +
برای یک قطعه‌ی پس‌زمینه‌ی ساده معمولاً چند دقیقه و چند بار تکرار. برای قطعه‌ای که ساختار مشخص و اوج و فرود درست داشته باشد، باید انتظار ده‌ها نسخه را داشته باشید. این ابزارها سریع‌اند، ولی بار اول کمتر چیز دقیقی می‌دهند.
#ساخت موسیقی با هوش مصنوعی #موسیقی بی‌کلام #صدای پس‌زمینه #آهنگسازی #افکت صوتی
به‌دردِ کسی می‌خورد؟ تلگرام واتساپ
🍊

خواندنش خوب بود — حالا امتحانش کن

هرچه در این صفحه خواندی، همین حالا داخلِ نارنگی قابلِ اجراست. ثبت‌نام با شماره‌ی موبایل، نارنگیِ رایگانِ شروع، بدونِ نیاز به کارت یا تحریم‌شکن.

بدونِ نصب هم کار می‌کند — ولی در اپ سریع‌تر است