گوگل پیشرفتهترین مدل تولید موسیقی خود تا به امروز یعنی Lyria 3.5 را به اپلیکیشن جمینای اضافه کرده است. این مدل که پیشتر از طریق ابزار فیلمسازی هوش مصنوعی گوگل به نام Flow در دسترس بود، اکنون درحال انتشار برای تمامی کاربران Gemini است.
قابلیتهای مدل هوش مصنوعی Lyria 3.5 در جمینای
براساس اعلام گوگل، نسخه Lyria 3.5 در مقایسه با نسلهای قبل، ملودیهای کاملتری میسازد، صدای خوانندگی آن واضحتر است و دستورات کاربر را هم بهتر متوجه میشود. این مدل بهجای تکرار یک لوپ کوتاه ملودیک، قطعات کامل موسیقی را همراه با بخشهای واقعی شامل ورس، کورس و بریج خلق میکند. کاربران داخل محیط جمینای میتوانند سبک مورد نظر خود را توصیف و مشخص کنند که تمایل به دریافت یک کلیپ کوتاه دارند یا قطعه طولانیتری باید تولید شود.
برای افراد مبتدی نیز قالبهای آمادهای در نظر گرفته شده تا بتوانند بهراحتی اقدام به ساخت موسیقی کنند. بااینحال، باید در نظر داشت که پس از تولید یک قطعه، امکان ویرایش آن در میانه پرامپت وجود ندارد.
گوگل علاوهبر اپلیکیشن، مدل Lyria 3.5 را از طریق Gemini API نیز عرضه کرده است تا توسعهدهندگان بتوانند قابلیتهای ساخت موسیقی با هوش مصنوعی را به برنامهها و سرویسهای خود اضافه کنند.
ورود Lyria 3.5 در شرایطی پرچالش برای صنعت موسیقی هوش مصنوعی رقم میخورد. پلتفرمهایی مانند Deezer با موج بزرگی از آثار هوش مصنوعی مواجه شدهاند؛ بهطوریکه این آهنگها اکنون ۴۴ درصد از آپلودهای روزانه آن را تشکیل میدهند و بخش قابلتوجهی از استریمهای ثبتشده برای آنها نیز جعلی تشخیص داده شده است. به همین علت، تمامی قطعات تولیدشده توسط Lyria مجهز به واترمارک SynthID هستند؛ نشانهای نامرئی که برای شناسایی این آثار بهعنوان محتوای تولیدشده توسط هوش مصنوعی طراحی شده است.
همچنین پس از صدور حکم دادگاه اروپایی علیه شرکت Suno، یکی از رقبای حوزه موسیقی هوش مصنوعی پیرامون نقض حق نشر، گوگل محدودیتهای سختگیرانهای برای Lyria در نظر گرفته است. این تدابیر ایمنی بهطور ویژه مانع از شبیهسازی صدای هنرمندان یا بازتولید متنهای ترانه دارای حق کپیرایت میشوند.
