لیریا 3.5 چیست و چه تفاوتی با نسخه قبل دارد؟

گوگل نسخه جدید مدل تولید موسیقی خود را منتشر کرد تا کاربران بتوانند بدون شروع مجدد، بخش‌های خاصی از یک قطعه را ویرایش کنند. این سیستم که لیریا 3.5 (Lyria 3.5) نامیده می‌شود، با بهبود چشمگیر در تولید ملودی‌های طبیعی‌تر و متون آهنگ، تجربه‌ای نزدیک‌تر به استانداردهای موسیقی واقعی ارائه می‌دهد. تلفظ خوانندگان توسط این مدل به‌طور شفاف‌تر اجرا می‌شود و کنترل روی تمپو و طول قطعات از پیش دقیق‌تر صورت می‌گیرد. سازندگان تأکید کرده‌اند که خروجی‌ها می‌توانند بین 30 ثانیه تا 3 دقیقه طول بکشند.

قابلیت «نقاشی انتخابی بخش‌ها»؛ کنترل مهندسی‌شده روی آهنگ‌ها

دسترسی به لیریا 3.5 از طریق پلتفرم Google Flow Music امکان‌پذیر است. مهم‌ترین ویژگی این به‌روزرسانی یک متد جدید به نام Selective Section Painting است. این قابلیت مانند یک ابزار مهندسی دقیق عمل می‌کند. کاربران می‌توانند یک ملودی کوتاه را بگیرند و آن را بدون نیاز به تولید مجدد، به یک اثر کامل تبدیل کنند. همچنین تنظیم زمان‌بندی، ریتم و مدت صدای خواننده، صدای درامز، بیس و سایر لایه‌های موسیقی به شکل مستقل انجام می‌شود. این سطح از کنترل جزئیات، چرخه تولید محتوا را برای کاربران عادی و حرفه‌ای به‌طرز محسوسی کوتاه می‌کند.

داده‌های آموزشی و آینده مدل‌های تولید موسیقی با هوش مصنوعی

هر مدل هوش مصنوعی مولدهایی مانند این، نیازمند مجموعه داده‌های گسترده‌ای برای یادگیری است. هنگام ارائه پیشین لیریا 3، گوگل اعلام کرد که از محتوایی استفاده کرده که یوتیوب و خودش دارای مجوز قانونی بهره‌برداری از آن هستند. جزئیات دقیق این مجموعه داده‌ها بازگو نشد و شرکت تاکنون پاسخی رسمی درباره لیست دقیق داده‌های آموزشی نسخه 3.5 ارائه نکرده است. با این حال، پیشرفت‌های اخیر نشان می‌دهد که رقابت بین شرکت‌های فناوری در زمینه هوش مصنوعی مولد برای تولید رسانه‌های چندبعدی هر روز داغ‌تر می‌شود. ابزارهایی که روی ترکیب دقیق صدا و متن تمرکز دارند، می‌توانند آینده استودیوهای موسیقی مستقل و تولیدکنندگان محتوای دیجیتال را شکل دهند. توسعه این فناوری نشان می‌دهد که مرز بین ابزارهای تولیدکننده و سازندگان خلاق در حال محو شدن است و احتمالاً در آینده‌ای نزدیک، استودیوهای موسیقی مجازی بخش جدایی‌ناپذیری از نرم‌افزارهای کاربردی شخصی خواهند شد.