هوش مصنوعی
موضوعات داغ

گوگل Lyria 3.5 را به جمینای آورد؛ ساخت آهنگ کامل با هوش مصنوعی برای همه کاربران

Lyria 3.5 به Gemini رسید؛ مدل جدید گوگل موسیقی کامل با ورس و کورس تولید می‌کند

گوگل ساخت موسیقی با AI را عمومی کرد

گوگل Lyria 3.5 را به جمینای آورد؛ حالا می‌توانید با هوش مصنوعی آهنگ کامل بسازید

گوگل مدل تولید موسیقی Lyria 3.5 را به اپلیکیشن Gemini اضافه کرد؛ مدلی که می‌تواند قطعات کامل موسیقی را با ساختارهایی مانند ورس، کورس و بریج تولید کند و تمامی خروجی‌های آن با واترمارک نامرئی SynthID قابل شناسایی هستند.

گوگل سرانجام مدل Lyria 3.5، جدیدترین و پیشرفته‌ترین مدل تولید موسیقی خود، را از محیط‌های تخصصی‌تر به اپلیکیشن Gemini آورد. این مدل که پیش‌تر در ابزارهای دیگری مانند Flow Music در دسترس قرار گرفته بود، اکنون در نسخه وب و اپلیکیشن موبایل جمینای برای کاربران سراسر جهان عرضه شده است. گوگل می‌گوید Lyria 3.5 در مقایسه با نسل قبلی، صدای خوانندگی بیانگرتر، تنظیم‌های غنی‌تر و کیفیت صوتی بالاتری ارائه می‌کند.

این اتفاق اهمیت زیادی دارد، زیرا تولید موسیقی با هوش مصنوعی را از یک ابزار تخصصی‌تر به محیطی می‌آورد که میلیون‌ها کاربر عادی روزانه از آن استفاده می‌کنند. کاربر می‌تواند ایده، سبک یا ژانر موردنظر خود را توضیح دهد و از جمینای بخواهد یک قطعه موسیقی متناسب با آن تولید کند؛ بدون اینکه برای ساخت آهنگ به نرم‌افزارهای حرفه‌ای آهنگسازی یا دانش تخصصی موسیقی نیاز داشته باشد.

Lyria 3.5 چه چیزی تولید می‌کند؟

یکی از مهم‌ترین تفاوت‌های Lyria 3.5 با بسیاری از ابزارهای ساده تولید موسیقی، توانایی آن در ساخت قطعاتی با ساختار موسیقایی پیچیده و منسجم است. گوگل می‌گوید این مدل می‌تواند آهنگ‌هایی شامل چند ورس، کورس و بریج تولید کند؛ بنابراین خروجی صرفاً یک لوپ کوتاه و تکرارشونده نیست، بلکه می‌تواند ساختار یک قطعه موسیقی کامل را دنبال کند.

Lyria 3.5 همچنین امکان تولید موسیقی از طریق پرامپت متنی یا ورودی تصویری را دارد. در نسخه API، این مدل خروجی استریوی با کیفیت 44.1 کیلوهرتز تولید می‌کند و برای ساخت آهنگ‌های کامل بهینه شده است.

در محیط Gemini نیز کاربران می‌توانند ژانر موسیقی را به‌صورت مستقیم انتخاب یا توصیف کنند و مشخص کنند که قطعه موردنظرشان وکال داشته باشد یا کاملاً بی‌کلام باشد. گوگل همچنین مجموعه‌ای از قالب‌های آماده را اضافه کرده است تا کاربران بتوانند سریع‌تر برای مواردی مانند موسیقی پس‌زمینه، آهنگ تولد یا حتی زنگ شخصی ایده بگیرند.

یکی دیگر از تغییرات مهم، امکان انتخاب بین قطعات کوتاه یا طولانی‌تر است؛ قابلیتی که استفاده از مدل را برای کاربردهای متنوع‌تری نسبت به تولید کلیپ‌های بسیار کوتاه ممکن می‌کند.

البته Lyria 3.5 همچنان یک ابزار تولید محتواست و قرار نیست تمام کنترل‌های یک نرم‌افزار حرفه‌ای آهنگسازی را در اختیار کاربر قرار دهد. در نتیجه، این مدل بیشتر برای تبدیل سریع یک ایده به قطعه موسیقی آماده کاربرد دارد تا جایگزینی کامل برای فرایند تولید حرفه‌ای موسیقی.

Lyria 3.5 حالا در Gemini API هم قرار دارد

گوگل تنها به اضافه‌کردن Lyria 3.5 به اپلیکیشن Gemini بسنده نکرده و این مدل را از طریق Gemini API نیز در اختیار توسعه‌دهندگان قرار داده است. به این ترتیب، برنامه‌نویسان می‌توانند قابلیت تولید موسیقی را مستقیماً وارد اپلیکیشن‌ها و سرویس‌های خود کنند.

در مستندات رسمی گوگل، Lyria 3.5 به‌عنوان مدل پرچم‌دار تولید موسیقی معرفی شده است. این مدل ورودی متنی و تصویری دریافت می‌کند و خروجی آن شامل صوت و متن ترانه است. نسخه فعلی مدل نیز با شناسه lyria-3.5 در دسترس توسعه‌دهندگان قرار گرفته است.

این موضوع می‌تواند کاربردهای بسیار گسترده‌ای ایجاد کند؛ از تولید موسیقی پس‌زمینه برای ویدیوها گرفته تا ساخت جینگل تبلیغاتی، موسیقی بازی، پادکست، محتوای شبکه‌های اجتماعی و حتی نمونه‌های اولیه برای آهنگسازی حرفه‌ای.

به بیان ساده، گوگل تلاش دارد تولید موسیقی را به یک قابلیت عمومی و قابل‌استفاده درون اکوسیستم هوش مصنوعی خود تبدیل کند.

گوگل Lyria 3.5 را به جمینای آورد؛ حالا می‌توانید با هوش مصنوعی آهنگ کامل بسازید

یک ویژگی مهم: واترمارک نامرئی SynthID

ورود مدل‌های قدرتمند تولید موسیقی به دست کاربران عمومی، یک نگرانی جدی را نیز پررنگ‌تر می‌کند: چگونه می‌توان تشخیص داد یک قطعه موسیقی توسط انسان ساخته شده یا هوش مصنوعی؟

گوگل برای پاسخ به این مسئله، خروجی‌های موسیقی تولیدشده توسط Lyria را به SynthID مجهز می‌کند. SynthID یک واترمارک نامرئی است که برای شناسایی محتوای تولیدشده توسط هوش مصنوعی طراحی شده است. گوگل پیش‌تر نیز از همین فناوری برای شناسایی برخی دیگر از انواع محتوای تولیدشده با مدل‌های مولد خود استفاده کرده بود.

اهمیت این فناوری زمانی بیشتر مشخص می‌شود که حجم موسیقی تولیدشده توسط AI به‌سرعت در حال افزایش است. در چنین شرایطی، پلتفرم‌های موسیقی و شرکت‌های فعال در حوزه محتوا نیاز دارند بتوانند منشأ محتوای منتشرشده را بهتر تشخیص دهند.

به همین دلیل، SynthID را می‌توان بخشی از تلاش گوگل برای ایجاد ردپای قابل‌شناسایی برای محتوای مصنوعی دانست؛ هرچند وجود واترمارک به‌تنهایی مسئله مالکیت معنوی یا حق نشر یک اثر را حل نمی‌کند.

Lyria 3.5 در زمان حساسی وارد بازار موسیقی می‌شود

ورود Lyria 3.5 به Gemini در شرایطی اتفاق افتاده که صنعت موسیقی با یکی از جدی‌ترین موج‌های ورود هوش مصنوعی مولد مواجه است.

پلتفرم‌های تولید موسیقی مانند Suno و دیگر سرویس‌های مشابه در سال‌های اخیر امکان ساخت آهنگ کامل با چند خط توضیح را فراهم کرده‌اند و همین موضوع باعث شده بحث درباره حق نشر، آموزش مدل‌ها با آثار هنرمندان و شبیه‌سازی صدای خوانندگان به یکی از چالش‌های اصلی صنعت تبدیل شود.

در اروپا نیز این مسئله وارد مرحله حقوقی جدی شده است. دادگاه منطقه‌ای مونیخ در ژوئیه ۲۰۲۶ در پرونده GEMA علیه Suno، استفاده بدون مجوز از برخی آثار موسیقی برای آموزش مدل و بازتولید عناصر محافظت‌شده آن‌ها را ناقض حقوق مؤلف تشخیص داد. این حکم هنوز نهایی نشده است، اما پیام مهمی برای صنعت موسیقی هوش مصنوعی دارد: تولید موسیقی با AI نمی‌تواند جدا از مسئله حقوق صاحبان آثار بررسی شود.

این فضای حقوقی احتمالاً یکی از دلایلی است که گوگل در کنار توسعه مدل‌های قدرتمند تولید موسیقی، روی سازوکارهای شناسایی محتوای AI و محدودیت‌های مربوط به خروجی‌های مدل نیز تأکید می‌کند.

گوگل اجازه شبیه‌سازی آزادانه هنرمندان را نمی‌دهد

یکی از حساس‌ترین بخش‌های استفاده از مدل‌های تولید موسیقی، امکان درخواست از AI برای ساخت قطعه‌ای با صدای یک خواننده یا در سبک مشخص یک هنرمند است.

گوگل برای Lyria محدودیت‌هایی در نظر گرفته تا کاربران نتوانند به‌سادگی صدای هنرمندان واقعی را شبیه‌سازی کنند یا محتوای دارای حق نشر را بازتولید کنند.

این محدودیت‌ها اهمیت زیادی دارند، زیرا تفاوت میان «ساخت موسیقی در یک ژانر مشخص» و «تقلید مستقیم از یک هنرمند مشخص» از نظر حقوقی و اخلاقی بسیار مهم است.

برای مثال، درخواست ساخت یک قطعه پاپ الکترونیک یک مسئله است؛ اما درخواست تولید آهنگی با صدای دقیق یک خواننده زنده یا بازتولید متن یک ترانه شناخته‌شده، وارد قلمرو متفاوتی می‌شود.

بنابراین گوگل تلاش می‌کند Lyria 3.5 را به‌گونه‌ای عرضه کند که توانایی تولید موسیقی افزایش پیدا کند، بدون اینکه این مدل به ابزاری ساده برای تقلید مستقیم از هنرمندان تبدیل شود.

گوگل تولید موسیقی با هوش مصنوعی را برای کاربران جمینای آسان‌تر کرد؛ Lyria 3.5 از راه رسید

Lyria 3.5 می‌تواند رقابت تولید موسیقی با AI را جدی‌تر کند

رقابت در بازار موسیقی مولد اکنون تنها میان چند استارتاپ کوچک جریان ندارد. ورود مستقیم گوگل به این حوزه، آن هم با قرار دادن مدل درون Gemini، می‌تواند بازار را وارد مرحله جدیدی کند.

تا پیش از این، کاربر برای ساخت موسیقی با هوش مصنوعی معمولاً باید به یک سرویس تخصصی مراجعه می‌کرد. اما اکنون همان کاربر می‌تواند در محیطی که برای پرسش‌وپاسخ، تولید متن، تصویر و سایر فعالیت‌های هوش مصنوعی استفاده می‌کند، موسیقی نیز تولید کند.

این یک تغییر مهم در رفتار کاربر است؛ زیرا فاصله میان «دستیار هوش مصنوعی» و «استودیو تولید محتوا» را کمتر می‌کند.

گوگل نیز به همین سمت حرکت کرده است. Lyria 3.5 اکنون علاوه بر Gemini، در محیط‌هایی مانند Flow Music، Google AI Studio و Google Vids نیز ارائه می‌شود و توسعه‌دهندگان نیز می‌توانند از طریق API به قابلیت‌های آن دسترسی پیدا کنند.

در نتیجه، Lyria 3.5 فقط یک مدل جدید تولید آهنگ نیست؛ بلکه بخشی از تلاش گوگل برای ساخت یک زنجیره کامل تولید محتوای چندرسانه‌ای با هوش مصنوعی است.

آیا Lyria 3.5 آینده موسیقی را تغییر می‌دهد؟

احتمالاً هنوز برای چنین نتیجه‌گیری بزرگی زود است، اما مسیر کاملاً مشخص شده است.

مدل‌هایی مانند Lyria 3.5 نشان می‌دهند که تولید یک قطعه موسیقی با ساختار نسبتاً پیچیده دیگر الزاماً به استودیوی ضبط، نوازندگان، تجهیزات گران‌قیمت یا حتی دانش تخصصی موسیقی نیاز ندارد. یک کاربر می‌تواند ایده خود را به زبان طبیعی توضیح دهد و در مدت کوتاهی به یک قطعه قابل‌استفاده برسد.

از سوی دیگر، هرچه تولید موسیقی با AI آسان‌تر شود، مسئله مالکیت معنوی و تشخیص محتوای مصنوعی نیز جدی‌تر خواهد شد. به همین دلیل، آینده این فناوری فقط به کیفیت صدا و توانایی مدل‌ها وابسته نیست؛ بلکه به نحوه تنظیم قوانین، شیوه آموزش مدل‌ها و سازوکارهای تعیین مالکیت آثار تولیدشده نیز بستگی دارد.

گوگل اکنون Lyria 3.5 را برای همه کاربران جهانی Gemini در وب و اپلیکیشن موبایل عرضه کرده است.

بنابراین اگر نسل‌های قبلی مدل‌های موسیقی، هوش مصنوعی را به یک آهنگساز دیجیتال تبدیل کردند، Lyria 3.5 یک قدم دیگر برداشته و تلاش می‌کند این آهنگساز را مستقیماً داخل دستیار روزمره میلیون‌ها کاربر قرار دهد؛ جایی که ساخت موسیقی می‌تواند به سادگی نوشتن یک درخواست متنی باشد.

Lyria 3.5 به Gemini رسید؛ مدل جدید گوگل موسیقی کامل با ورس و کورس تولید می‌کند

منبع :  اعلام رسمی Google درباره Lyria 3.5 در Gemini
منبع : مستندات رسمی Lyria 3.5 در Gemini API

 

هوش مصنوعی | واقعیت مجازی | تکنولوژی در مجله خبری سایبرلایف

در مجله سایبرلایف بخوانید

دیدگاهتان را بنویسید

نشانی ایمیل شما منتشر نخواهد شد. بخش‌های موردنیاز علامت‌گذاری شده‌اند *

دکمه بازگشت به بالا