آنچه در این مقاله میخوانید [پنهانسازی]
- ⭐ چطور لهجه فارسی سونو رو کمتر کنیم ؟
- ⭐ چرا سونو با لهجه میخونه؟
- ⭐ بهترین روش کاهش لهجه فارسی
- ⭐ چطور صدای ضبط شده به سونو بدیم؟
- ⭐ چرا آپلود صدا نتیجه بهتری از علامت گذاری میده؟
- ⭐ نکته مهم درمورد اجرای نمونه
- ⭐ اگه مدل Remi هست، فعالش کن
- ⭐ اگه نتیجه اول خوب نبود چیکار کنیم ؟
- ⭐ آیا میشه لهجه فارسی رو کامل حذف کرد؟
- ⭐ یک workflow ساده برای اجرای فارسی بهتر
- ⭐ مرحله اول : متن آهنگ رو آماده کن
- ⭐ مرحله دوم : همون متن رو به سونو بده + علامت گذاری درست
- ⭐ مرحله سوم : نمونه صوتی رو به سونو بده
- ⭐ مرحله چهارم : اگه مدل Remi در دسترسه فعال کن
- ⭐ مرحله پنجم : کلماتی که مشکل داره رو شناسایی کن
- ⭐ مرحله ششم : ورودی هارو اصلاح کن یا با گزینه های ادیت، اصلاحش کن
- ⭐ جمع بندی
چطور لهجه فارسی سونو رو کمتر کنیم ؟
اگه با سونو برای ساخت آهنگ فارسی کار کرده باشی، احتمالا متوجه شدی که یکی از مشکلات رایج، تلفظ بعضی کلمات با لهجه ای غیر طبیعیه.
مخصوصا وقتی میخوای یه آهنگ کاملا فارسی بسازی، ممکنه خواننده کلمات رو طوری اجرا کنه که حس کنی یه خواننده غیر ایرانی داره میخونه و خب خیلی غیر طبیعی به نظر میاد.
این مشکل میتونه حتی یه آهنگ خوب رو غیر طبیعی و آماتور نشون بده، اما نکته جالب اینجاست که برای کاهش لهجه فارسی همیشه لازم نیست پرامپت های پیچیده بنویسی یا ده ها بار آهنگ رو بسازی که یه نتیجه خوب بگیری. با چند نکته ساده میشه لهجه رو کمتر کرد.
چرا سونو با لهجه میخونه؟
مدل های هوش مصنوعی موسیقی برای تولید آواز و موسیقی از حجم بسیار زیادی از داده های صوتی و موسیقایی استفاده میکنن، بنابراین نحوه تلفظ کلمات میتونه به داده هایی که مدل از زبان ها و سبک های مختلف گرفته وابسته باشه.
وقتی یه متن فارسی رو فقط به صورت نوشته به مدل میدی، مدل باید خودش حدس بزنه که هر کلمه رو چطور تلفظ کنه، همین موضوع گاهی باعث گیج شدن مدل میشه و باعث میشه به صورت اشتباه تلفظ کنه، کم بودن دیتای موزیک فارسی نسبت به انگلیسی هم یکی از دلایل دیگه و مهمه که باعث میشه مدل ها تو ساخت موزیک فارسی ضعیف تر از انگلیسی باشن.
بهترین روش کاهش لهجه فارسی
اگه میخوای سونو متن فارسی رو طبیعی تر اجرا کنه، فقط متن رو بهش نده. متن رو به صورت صوت بخون و برای سونو آپلود کن که با آنالیز فایل صوتی لهجه و نوع تلفظ رو به خوبی متوجه بشه، اینکار باعث میشه مدل نتیجه بهتری بده، اینطوری مدل بهتر میتونه حدس بزنه.
تمام تکنیک ها و آموزش های مربوط به آهنگسازی با هوش مصنوعی رو از لینک زیر میتونی داشته باشی :
ورود به دوره آهنگسازی با هوش مصنوعی
چطور صدای ضبط شده به سونو بدیم؟
لازم نیست یه استودیو حرفه ای داشته باشی، کافیه از قسمت audio سونو صدای ضبط شده رو آپلود کنی یا اگه با گوشی میری همون لحظه متن رو به صورت دقیق و با لهجه ای که مد نظرته بخونی و تلفظ درست رو بهش بدی، اگه موقع آپلود صوت ارور دریافت میکنی، سعی کن از یه وی پی ان مناسب استفاده کنی مثل nord vpn یا hotspot shield که نتیجه بهتری میده.
چرا آپلود صدا نتیجه بهتری از علامت گذاری میده؟
فرض کن این جمله رو به صورت متنی به سونو بدی ( دوباره شب شد و نیستی ) مدل باید خودش تصمیم بگیره مدل تلفظ هر کلمه چیه و سعی کنه اون رو تولید کنه حتی اگه بنویسی ( دوبآرٍ شَب شُد و نیستی ) باز هم ممکنه دچار خطا بشه ولی وقتی فایل صوتی رو بشنوه و آنالیز کنه میتونه دقیقا همون فرکانس هارو درک کنه و دوباره تولید کنه در نتیجه میتونی خروجی بهتری ازش بگیری.
نکته مهم درمورد اجرای نمونه
یکی از اشتباهات اینه که نمونه صوتی رو بی دقت ضبط کنی و بعد انتظار داشته باشی نتیجه نهایی کاملا حرفه ای بشه، باید سعی کن فایل صوتی رو با مکث درست، تلفظ درست و واضح بیان کنی، ترجیحا صدا رو جایی ضبط کن که نویز و صدای بک گراند تو کمترین حالت خودشه، خش خش نداره و صدا قابل تشخیص باشه، رعایت همین چند نکته خروجی رو چندین برابر بهتر میکنه.
اگه مدل Remi هست، فعالش کن
طبق تست هایی که تیم ما انجام داده اگه مدل بتا رمی از سونو برات فعال شده حتما اون مدل رو انتخاب کن چون وقتی با رمی تولید موزیک کردیم لهجه فارسی رو خیلی بهتر و با تلفظ درست تری اجرا کرده، البته نباید انتظار داشته باشی صرفا با انتخاب یک مدل تمام مشکلات زندگیت حل بشه و بتونی ازش به راحتی استفاده کنی، همونطور که بالاتر گفتیم به دلیل دیتابیس محدود موزیک فارسی، همچنان ضعف وجود داره.
اگه نتیجه اول خوب نبود چیکار کنیم ؟
یکی از بزرگ ترین اشتباهات آهنگسازای تازه کار اینه که انتظار یه نتیجه پرفکت از اولین خروجی هوش مصنوعی دارن، شما باید سعی کنی با گزینه های مختلف اصلاحیه بزنی و جاهایی که اشتباه اجرا شده رو اصلاح کنی و بهتر کنی، نباید انتظار داشته باشی اولین نتیجه بهترین نتیجه باشه، نتایج خوب تو استفاده از هوش مصنوعی همیشه از اصلاحیه ۵م به بعد اتفاق میوفته.
آیا میشه لهجه فارسی رو کامل حذف کرد؟
نه، نباید انتظار داشته باشی یه ترفند همیشه و در همه شرایط لهجه رو کاملا حذف کنه، تولید صدای فارسی توسط مدل های هوش مصنوعی هنوز ممکنه تو بعضی از کلمات، حروف، کشش ها و جمله ها با اجرای طبیعی یه خواننده به زبان فارسی تفاوت داشته باشه، اما میتونی با دادن یه نمونه صوتی مناسب، احتمال گرفتن نتیجه بهتر رو بیشتر کنی و خروجی بهتری بگیری.
یک workflow ساده برای اجرای فارسی بهتر
اگه بخوایم این تکنیک رو تبدیل به یک ورک فلو قابل تکرار کنیم، میشه به این مراحل اشاره کرد :
مرحله اول : متن آهنگ رو آماده کن
مرحله دوم : همون متن رو به سونو بده + علامت گذاری درست
مرحله سوم : نمونه صوتی رو به سونو بده
مرحله چهارم : اگه مدل Remi در دسترسه فعال کن
مرحله پنجم : کلماتی که مشکل داره رو شناسایی کن
مرحله ششم : ورودی هارو اصلاح کن یا با گزینه های ادیت، اصلاحش کن
جمع بندی
اگه با سونو آهنگ فارسی میسازی و از تلفظ با لهجه فارسی خواننده راضی نیستی، اولین کاری که باید بکنی اینه که متن نوشته رو با علامت گذاری درست + فایل صوتی نمونه ارسال کنی، اگه مدل Remi بود فعال کنی و اصلاح و ادیت نتیجه بهتری ازش تحویل بگیری.
