گوگل Lyria 3.5 را به جمینای آورد؛ ساخت آهنگ کامل با هوش مصنوعی برای همه کاربران
Lyria 3.5 به Gemini رسید؛ مدل جدید گوگل موسیقی کامل با ورس و کورس تولید میکند
گوگل ساخت موسیقی با AI را عمومی کرد
گوگل Lyria 3.5 را به جمینای آورد؛ حالا میتوانید با هوش مصنوعی آهنگ کامل بسازید
گوگل مدل تولید موسیقی Lyria 3.5 را به اپلیکیشن Gemini اضافه کرد؛ مدلی که میتواند قطعات کامل موسیقی را با ساختارهایی مانند ورس، کورس و بریج تولید کند و تمامی خروجیهای آن با واترمارک نامرئی SynthID قابل شناسایی هستند.
گوگل سرانجام مدل Lyria 3.5، جدیدترین و پیشرفتهترین مدل تولید موسیقی خود، را از محیطهای تخصصیتر به اپلیکیشن Gemini آورد. این مدل که پیشتر در ابزارهای دیگری مانند Flow Music در دسترس قرار گرفته بود، اکنون در نسخه وب و اپلیکیشن موبایل جمینای برای کاربران سراسر جهان عرضه شده است. گوگل میگوید Lyria 3.5 در مقایسه با نسل قبلی، صدای خوانندگی بیانگرتر، تنظیمهای غنیتر و کیفیت صوتی بالاتری ارائه میکند.
این اتفاق اهمیت زیادی دارد، زیرا تولید موسیقی با هوش مصنوعی را از یک ابزار تخصصیتر به محیطی میآورد که میلیونها کاربر عادی روزانه از آن استفاده میکنند. کاربر میتواند ایده، سبک یا ژانر موردنظر خود را توضیح دهد و از جمینای بخواهد یک قطعه موسیقی متناسب با آن تولید کند؛ بدون اینکه برای ساخت آهنگ به نرمافزارهای حرفهای آهنگسازی یا دانش تخصصی موسیقی نیاز داشته باشد.
Lyria 3.5 چه چیزی تولید میکند؟
یکی از مهمترین تفاوتهای Lyria 3.5 با بسیاری از ابزارهای ساده تولید موسیقی، توانایی آن در ساخت قطعاتی با ساختار موسیقایی پیچیده و منسجم است. گوگل میگوید این مدل میتواند آهنگهایی شامل چند ورس، کورس و بریج تولید کند؛ بنابراین خروجی صرفاً یک لوپ کوتاه و تکرارشونده نیست، بلکه میتواند ساختار یک قطعه موسیقی کامل را دنبال کند.
Lyria 3.5 همچنین امکان تولید موسیقی از طریق پرامپت متنی یا ورودی تصویری را دارد. در نسخه API، این مدل خروجی استریوی با کیفیت 44.1 کیلوهرتز تولید میکند و برای ساخت آهنگهای کامل بهینه شده است.
در محیط Gemini نیز کاربران میتوانند ژانر موسیقی را بهصورت مستقیم انتخاب یا توصیف کنند و مشخص کنند که قطعه موردنظرشان وکال داشته باشد یا کاملاً بیکلام باشد. گوگل همچنین مجموعهای از قالبهای آماده را اضافه کرده است تا کاربران بتوانند سریعتر برای مواردی مانند موسیقی پسزمینه، آهنگ تولد یا حتی زنگ شخصی ایده بگیرند.
یکی دیگر از تغییرات مهم، امکان انتخاب بین قطعات کوتاه یا طولانیتر است؛ قابلیتی که استفاده از مدل را برای کاربردهای متنوعتری نسبت به تولید کلیپهای بسیار کوتاه ممکن میکند.
البته Lyria 3.5 همچنان یک ابزار تولید محتواست و قرار نیست تمام کنترلهای یک نرمافزار حرفهای آهنگسازی را در اختیار کاربر قرار دهد. در نتیجه، این مدل بیشتر برای تبدیل سریع یک ایده به قطعه موسیقی آماده کاربرد دارد تا جایگزینی کامل برای فرایند تولید حرفهای موسیقی.
Lyria 3.5 حالا در Gemini API هم قرار دارد
گوگل تنها به اضافهکردن Lyria 3.5 به اپلیکیشن Gemini بسنده نکرده و این مدل را از طریق Gemini API نیز در اختیار توسعهدهندگان قرار داده است. به این ترتیب، برنامهنویسان میتوانند قابلیت تولید موسیقی را مستقیماً وارد اپلیکیشنها و سرویسهای خود کنند.
در مستندات رسمی گوگل، Lyria 3.5 بهعنوان مدل پرچمدار تولید موسیقی معرفی شده است. این مدل ورودی متنی و تصویری دریافت میکند و خروجی آن شامل صوت و متن ترانه است. نسخه فعلی مدل نیز با شناسه lyria-3.5 در دسترس توسعهدهندگان قرار گرفته است.
این موضوع میتواند کاربردهای بسیار گستردهای ایجاد کند؛ از تولید موسیقی پسزمینه برای ویدیوها گرفته تا ساخت جینگل تبلیغاتی، موسیقی بازی، پادکست، محتوای شبکههای اجتماعی و حتی نمونههای اولیه برای آهنگسازی حرفهای.
به بیان ساده، گوگل تلاش دارد تولید موسیقی را به یک قابلیت عمومی و قابلاستفاده درون اکوسیستم هوش مصنوعی خود تبدیل کند.

یک ویژگی مهم: واترمارک نامرئی SynthID
ورود مدلهای قدرتمند تولید موسیقی به دست کاربران عمومی، یک نگرانی جدی را نیز پررنگتر میکند: چگونه میتوان تشخیص داد یک قطعه موسیقی توسط انسان ساخته شده یا هوش مصنوعی؟
گوگل برای پاسخ به این مسئله، خروجیهای موسیقی تولیدشده توسط Lyria را به SynthID مجهز میکند. SynthID یک واترمارک نامرئی است که برای شناسایی محتوای تولیدشده توسط هوش مصنوعی طراحی شده است. گوگل پیشتر نیز از همین فناوری برای شناسایی برخی دیگر از انواع محتوای تولیدشده با مدلهای مولد خود استفاده کرده بود.
اهمیت این فناوری زمانی بیشتر مشخص میشود که حجم موسیقی تولیدشده توسط AI بهسرعت در حال افزایش است. در چنین شرایطی، پلتفرمهای موسیقی و شرکتهای فعال در حوزه محتوا نیاز دارند بتوانند منشأ محتوای منتشرشده را بهتر تشخیص دهند.
به همین دلیل، SynthID را میتوان بخشی از تلاش گوگل برای ایجاد ردپای قابلشناسایی برای محتوای مصنوعی دانست؛ هرچند وجود واترمارک بهتنهایی مسئله مالکیت معنوی یا حق نشر یک اثر را حل نمیکند.
Lyria 3.5 در زمان حساسی وارد بازار موسیقی میشود
ورود Lyria 3.5 به Gemini در شرایطی اتفاق افتاده که صنعت موسیقی با یکی از جدیترین موجهای ورود هوش مصنوعی مولد مواجه است.
پلتفرمهای تولید موسیقی مانند Suno و دیگر سرویسهای مشابه در سالهای اخیر امکان ساخت آهنگ کامل با چند خط توضیح را فراهم کردهاند و همین موضوع باعث شده بحث درباره حق نشر، آموزش مدلها با آثار هنرمندان و شبیهسازی صدای خوانندگان به یکی از چالشهای اصلی صنعت تبدیل شود.
در اروپا نیز این مسئله وارد مرحله حقوقی جدی شده است. دادگاه منطقهای مونیخ در ژوئیه ۲۰۲۶ در پرونده GEMA علیه Suno، استفاده بدون مجوز از برخی آثار موسیقی برای آموزش مدل و بازتولید عناصر محافظتشده آنها را ناقض حقوق مؤلف تشخیص داد. این حکم هنوز نهایی نشده است، اما پیام مهمی برای صنعت موسیقی هوش مصنوعی دارد: تولید موسیقی با AI نمیتواند جدا از مسئله حقوق صاحبان آثار بررسی شود.
این فضای حقوقی احتمالاً یکی از دلایلی است که گوگل در کنار توسعه مدلهای قدرتمند تولید موسیقی، روی سازوکارهای شناسایی محتوای AI و محدودیتهای مربوط به خروجیهای مدل نیز تأکید میکند.
گوگل اجازه شبیهسازی آزادانه هنرمندان را نمیدهد
یکی از حساسترین بخشهای استفاده از مدلهای تولید موسیقی، امکان درخواست از AI برای ساخت قطعهای با صدای یک خواننده یا در سبک مشخص یک هنرمند است.
گوگل برای Lyria محدودیتهایی در نظر گرفته تا کاربران نتوانند بهسادگی صدای هنرمندان واقعی را شبیهسازی کنند یا محتوای دارای حق نشر را بازتولید کنند.
این محدودیتها اهمیت زیادی دارند، زیرا تفاوت میان «ساخت موسیقی در یک ژانر مشخص» و «تقلید مستقیم از یک هنرمند مشخص» از نظر حقوقی و اخلاقی بسیار مهم است.
برای مثال، درخواست ساخت یک قطعه پاپ الکترونیک یک مسئله است؛ اما درخواست تولید آهنگی با صدای دقیق یک خواننده زنده یا بازتولید متن یک ترانه شناختهشده، وارد قلمرو متفاوتی میشود.
بنابراین گوگل تلاش میکند Lyria 3.5 را بهگونهای عرضه کند که توانایی تولید موسیقی افزایش پیدا کند، بدون اینکه این مدل به ابزاری ساده برای تقلید مستقیم از هنرمندان تبدیل شود.

Lyria 3.5 میتواند رقابت تولید موسیقی با AI را جدیتر کند
رقابت در بازار موسیقی مولد اکنون تنها میان چند استارتاپ کوچک جریان ندارد. ورود مستقیم گوگل به این حوزه، آن هم با قرار دادن مدل درون Gemini، میتواند بازار را وارد مرحله جدیدی کند.
تا پیش از این، کاربر برای ساخت موسیقی با هوش مصنوعی معمولاً باید به یک سرویس تخصصی مراجعه میکرد. اما اکنون همان کاربر میتواند در محیطی که برای پرسشوپاسخ، تولید متن، تصویر و سایر فعالیتهای هوش مصنوعی استفاده میکند، موسیقی نیز تولید کند.
این یک تغییر مهم در رفتار کاربر است؛ زیرا فاصله میان «دستیار هوش مصنوعی» و «استودیو تولید محتوا» را کمتر میکند.
گوگل نیز به همین سمت حرکت کرده است. Lyria 3.5 اکنون علاوه بر Gemini، در محیطهایی مانند Flow Music، Google AI Studio و Google Vids نیز ارائه میشود و توسعهدهندگان نیز میتوانند از طریق API به قابلیتهای آن دسترسی پیدا کنند.
در نتیجه، Lyria 3.5 فقط یک مدل جدید تولید آهنگ نیست؛ بلکه بخشی از تلاش گوگل برای ساخت یک زنجیره کامل تولید محتوای چندرسانهای با هوش مصنوعی است.
آیا Lyria 3.5 آینده موسیقی را تغییر میدهد؟
احتمالاً هنوز برای چنین نتیجهگیری بزرگی زود است، اما مسیر کاملاً مشخص شده است.
مدلهایی مانند Lyria 3.5 نشان میدهند که تولید یک قطعه موسیقی با ساختار نسبتاً پیچیده دیگر الزاماً به استودیوی ضبط، نوازندگان، تجهیزات گرانقیمت یا حتی دانش تخصصی موسیقی نیاز ندارد. یک کاربر میتواند ایده خود را به زبان طبیعی توضیح دهد و در مدت کوتاهی به یک قطعه قابلاستفاده برسد.
از سوی دیگر، هرچه تولید موسیقی با AI آسانتر شود، مسئله مالکیت معنوی و تشخیص محتوای مصنوعی نیز جدیتر خواهد شد. به همین دلیل، آینده این فناوری فقط به کیفیت صدا و توانایی مدلها وابسته نیست؛ بلکه به نحوه تنظیم قوانین، شیوه آموزش مدلها و سازوکارهای تعیین مالکیت آثار تولیدشده نیز بستگی دارد.
گوگل اکنون Lyria 3.5 را برای همه کاربران جهانی Gemini در وب و اپلیکیشن موبایل عرضه کرده است.
بنابراین اگر نسلهای قبلی مدلهای موسیقی، هوش مصنوعی را به یک آهنگساز دیجیتال تبدیل کردند، Lyria 3.5 یک قدم دیگر برداشته و تلاش میکند این آهنگساز را مستقیماً داخل دستیار روزمره میلیونها کاربر قرار دهد؛ جایی که ساخت موسیقی میتواند به سادگی نوشتن یک درخواست متنی باشد.

منبع : اعلام رسمی Google درباره Lyria 3.5 در Gemini
منبع : مستندات رسمی Lyria 3.5 در Gemini API








