در عرصه فناوری، هوش مصنوعی هر روزه به حوزههای جدیدی نفوذ میکند و حالا نوبت به صنعت موسیقی رسیده است. شرکت گوگل با ادغام مدل تولید موسیقی Lyria 3.5 خود در اپلیکیشن هوش مصنوعی Gemini، گام بزرگی در این مسیر برداشته است. این ابتکار، فرآیند تولید موسیقی با استفاده از هوش مصنوعی را برای طیف وسیعتری از کاربران قابل دسترسی کرده و به آنها این امکان را میدهد تا تنها با چند دستور متنی یا حتی با تصاویر، قطعات صوتی حرفهای خلق کنند.
Lyria 3.5 چیست و چه قابلیتهایی دارد؟
Lyria 3.5، آخرین و پیشرفتهترین نسخه تولید موسیقی گوگل، در حال حاضر از طریق اپلیکیشن Gemini در دسترس قرار گرفته است. این مدل ایجاد آهنگ، قطعات بیکلام و موسیقی متن را به وسیله دستورات متنی یا تصاویر، بسیار آسان کرده است. گوگل اعلام کرده که Lyria 3.5 با تنظیمات غنیتر، آواهای شفافتر و درک بهتر از دستورات، قادر به تولید آهنگهای کامل با ورس، کورس و بریج است.

در گوگل جمنای میتوانید ژانر، سبک (با کلام یا بیکلام) و طول قطعه را انتخاب کنید؛ همچنین الگوهایی برای مبتدیان فراهم شده است. در حالی که قابلیت ویرایش قطعه در حین ایجاد وجود ندارد، این مدل موسیقی همچنین از طریق API Gemini نیز قابل دسترسی است.
چالشهای هوش مصنوعی در موسیقی و راهکارهای گوگل
راهاندازی Lyria 3.5 در شرایطی انجام میشود که موسیقی مبتنی بر هوش مصنوعی با مشکلاتی همچون حجم زیاد آپلودهای تقلبی مواجه است. برای مقابله با این چالشها، گوگل قطعات تولید شده توسط Lyria را با واترمارک نامرئی SynthID شناسایی میکند. در عین حال، قوانین حفاظتی این فناوری مانع از شبیهسازی صدا یا بازتولید اشعار با حق کپی رایت میشوند؛ این تدابیر در پاسخ به احکام قانونی اخیر (مثل پرونده Suno) اتخاذ شدهاند، هرچند که وضعیت حقوقی این حوزه هنوز به طور کامل مشخص نیست.