لیریا 3.5 چیست و چه تفاوتی با نسخه قبل دارد؟
گوگل نسخه جدید مدل تولید موسیقی خود را منتشر کرد تا کاربران بتوانند بدون شروع مجدد، بخشهای خاصی از یک قطعه را ویرایش کنند. این سیستم که لیریا 3.5 (Lyria 3.5) نامیده میشود، با بهبود چشمگیر در تولید ملودیهای طبیعیتر و متون آهنگ، تجربهای نزدیکتر به استانداردهای موسیقی واقعی ارائه میدهد. تلفظ خوانندگان توسط این مدل بهطور شفافتر اجرا میشود و کنترل روی تمپو و طول قطعات از پیش دقیقتر صورت میگیرد. سازندگان تأکید کردهاند که خروجیها میتوانند بین 30 ثانیه تا 3 دقیقه طول بکشند.
قابلیت «نقاشی انتخابی بخشها»؛ کنترل مهندسیشده روی آهنگها
دسترسی به لیریا 3.5 از طریق پلتفرم Google Flow Music امکانپذیر است. مهمترین ویژگی این بهروزرسانی یک متد جدید به نام Selective Section Painting است. این قابلیت مانند یک ابزار مهندسی دقیق عمل میکند. کاربران میتوانند یک ملودی کوتاه را بگیرند و آن را بدون نیاز به تولید مجدد، به یک اثر کامل تبدیل کنند. همچنین تنظیم زمانبندی، ریتم و مدت صدای خواننده، صدای درامز، بیس و سایر لایههای موسیقی به شکل مستقل انجام میشود. این سطح از کنترل جزئیات، چرخه تولید محتوا را برای کاربران عادی و حرفهای بهطرز محسوسی کوتاه میکند.
دادههای آموزشی و آینده مدلهای تولید موسیقی با هوش مصنوعی
هر مدل هوش مصنوعی مولدهایی مانند این، نیازمند مجموعه دادههای گستردهای برای یادگیری است. هنگام ارائه پیشین لیریا 3، گوگل اعلام کرد که از محتوایی استفاده کرده که یوتیوب و خودش دارای مجوز قانونی بهرهبرداری از آن هستند. جزئیات دقیق این مجموعه دادهها بازگو نشد و شرکت تاکنون پاسخی رسمی درباره لیست دقیق دادههای آموزشی نسخه 3.5 ارائه نکرده است. با این حال، پیشرفتهای اخیر نشان میدهد که رقابت بین شرکتهای فناوری در زمینه هوش مصنوعی مولد برای تولید رسانههای چندبعدی هر روز داغتر میشود. ابزارهایی که روی ترکیب دقیق صدا و متن تمرکز دارند، میتوانند آینده استودیوهای موسیقی مستقل و تولیدکنندگان محتوای دیجیتال را شکل دهند. توسعه این فناوری نشان میدهد که مرز بین ابزارهای تولیدکننده و سازندگان خلاق در حال محو شدن است و احتمالاً در آیندهای نزدیک، استودیوهای موسیقی مجازی بخش جداییناپذیری از نرمافزارهای کاربردی شخصی خواهند شد.





