واشنطن-سانا
وسعت شركة غوغل إتاحة نموذجها «Lyria 3.5» لتوليد الموسيقى بالذكاء الاصطناعي، ليصبح متاحاً ضمن تطبيق «جيميني»، ما يتيح للمستخدمين إنشاء أغانٍ ومقطوعات موسيقية ومؤثرات صوتية من خلال أوامر نصية، أو بالاستناد إلى صور.
وذكرت غوغل في مدونتها الرسمية أول أمس، أن «Lyria 3.5» أصبح متاحاً لجميع المستخدمين حول العالم عبر تطبيق «جيميني» على الويب والهواتف المحمولة، إضافة إلى إتاحته للمطورين عبر «Gemini API»، بعدما أطلقته الشركة في تموز الماضي ضمن خدمة «Flow Music».
ويتميز النموذج بتحسينات في البنية الموسيقية وجودة الكلمات والأداء الصوتي، مع قدرة أكبر على فهم التعليمات التي يقدمها المستخدم، فضلاً عن إتاحة تحكم أوسع في مدة المقطوعة وسرعتها وطابعها الموسيقي.
ويمكن للمستخدم إنشاء أغانٍ تتضمن مقاطع غنائية وجوقات وجسوراً موسيقية، إلى جانب اختيار النمط الموسيقي، سواء كان غنائياً أو آلياً، وتحديد مدة المقطع، كما توفر غوغل قوالب جاهزة تساعد في إنشاء موسيقا خلفية لمقاطع الفيديو ونغمات إعلانية ونغمات رنين مخصصة.
وأتاحت غوغل النموذج كذلك للمطورين عبر واجهة برمجة التطبيقات «Gemini API»، بما يسمح بدمج قدرات توليد الموسيقا في تطبيقات وخدمات مختلفة.
وفي إطار جهودها للحد من إساءة استخدام تقنيات توليد الموسيقا، تدمج غوغل في المقاطع التي ينتجها النموذج علامة مائية رقمية غير مرئية تعتمد تقنية «SynthID»، بما يساعد على التعرف على المحتوى المُنشأ بالذكاء الاصطناعي.
كما صممت غوغل النموذج لإنتاج أعمال أصلية بدلاً من تقليد الفنانين، وتستخدم أنظمة للحد من إعادة إنتاج المحتوى المحمي بحقوق الملكية الفكرية، في ظل تنامي الجدل حول استخدام الذكاء الاصطناعي في صناعة الموسيقا.
وتعكس إتاحة «Lyria 3.5» في «جيميني» توجه غوغل نحو توسيع أدوات إنتاج المحتوى الموسيقي بالذكاء الاصطناعي، وإتاحتها أمام المستخدمين والمطورين على نطاق أوسع.