مولّد أغاني بالذكاء الاصطناعي مجاني بصوتك: ما الذي ينجح فعلًا

هل تريد أن تسمع صوتك ولحنك وقد تحوّلا إلى مقطع موسيقي متكامل دون أن تدفع ثمن استوديو؟ يرسم هذا المقال مسار عمل مجانيًا للتجربة: أعِد توزيع أغنية انطلاقًا من وصف نصي، واستنسخ صوتك الكلامي للمقاطع المنطوقة، وحرّك صورة واحدة لتصبح فيديو يغنّي. ويشرح بوضوح ما يستطيع الذكاء الاصطناعي فعله بصوتك اليوم وما لا يستطيعه.

مولّد أغاني بالذكاء الاصطناعي مجاني بصوتك: ما الذي ينجح فعلًا
Cristian Da Conceicao
مؤسس Picasso IA

تدندن لحنًا على هاتفك في منتصف الليل، فتريد في الصباح أن تسمعه مقطعًا موسيقيًا مصقولًا، يُغنّى بأسلوب لم تكن لتستطيع تسجيله بنفسك. هذا هو الوعد الذي تقدمه كل أداة لتوليد الأغاني بالذكاء الاصطناعي تدّعي أنها مجانية وشخصية. الواقع أكثر إثارة للاهتمام، وأكثر تعقيدًا قليلًا، مما توحي به الإعلانات. بعض الأدوات تعيد بناء أغنية بنوع موسيقي جديد. وبعضها يستنسخ صوتك الكلامي. وأخرى تحرّك وجهك حتى يبدو أنك تغني كل سطر. لا يوجد زر واحد يفعل الأشياء الثلاثة بإتقان تام، لكن يمكنك ربطها معًا على PicassoIA والوصول إلى نتيجة قريبة جدًا بشكل مدهش دون أن تدفع ثمن استوديو.

يقدم هذا المقال خريطة صادقة لما ينجح اليوم، والإعدادات الدقيقة لكل نموذج، والأخطاء التي تضيّع أكبر قدر من الوقت. كل نموذج مذكور يحمل رابطًا إلى صفحته، فيمكنك فتحه وتجربته أثناء القراءة.

ماذا يعني "صوتك الخاص" فعلًا؟

عندما تبحث عن أداة أغاني مجانية بالذكاء الاصطناعي تستخدم صوتك، ستجد ثلاثة أنواع مختلفة جدًا من المنتجات. الخلط بينها هو السبب الأول لشعور الناس بخيبة الأمل بعد المحاولة الأولى، لذلك يستحق الأمر الفصل بينها قبل أن تضغط أي زر.

ثلاث مهام، ثلاث أنواع من الأدوات

المهمةما الذي تفعلهما الذي ينتقل منكالنموذج على PicassoIA
إعادة توزيع أغنيةتعيد بناء مقطع بنوع موسيقي جديد وصوت غنائي جديدلحنك، واختياريًا كلماتكنموذج إعادة التوزيع MiniMax Music
استنساخ صوتتقرأ أي نص بصوت مبني على عينتكنبرة كلامك ولهجتكVoice Cloning، Qwen3 TTS
تحريك وجهتزامن الشفاه في صورة مع صوتكوجهك وتعابيركOmni Human 1.5
كتابة أغنية جديدةتحوّل الكلمات وأمرًا نصيًا للأسلوب إلى مقطع كاملكلماتك وفكرتكMusic 2.6

لاحظ ما هو غائب عن هذا الجدول: زر واحد يستبدل صوت مغنٍّ مشهور ببصمة صوتك الغنائية بالضبط. توجد تطبيقات مخصصة لتحويل الصوت لهذه المهمة، وهي تتطلب إعدادًا أكثر بكثير. تسلك النماذج في هذا المقال طريقًا مختلفًا، يعمل بالكامل داخل المتصفح ويوصلك مع ذلك إلى أغنية جاهزة وطبقة صوت وفيديو.

أين يدخل صوتك في العملية؟

يدخل صوتك إلى العملية في ثلاثة مواضع:

  • لحنك. دندن لحنًا أو غنِّه على هاتفك. يحتفظ نموذج إعادة التوزيع بالخط اللحني ويعيد بناء كل ما حوله.
  • صوتك الكلامي. استنسخ عينة طولها بين 10 ثوانٍ و5 دقائق، ثم استخدمها في المقدمات المنطوقة أو الارتجالات الصوتية أو مقطع حواري.
  • وجهك. صورة واحدة مع الصوت النهائي تمنحك فيديو يبدو فيه أنت تغني.

💡 حدّد توقعاتك مبكرًا: نموذج إعادة التوزيع يغيّر المغنّي. إذا كنت تحتاج إلى أن يطابق الصوت النهائي بصمتك الغنائية نوتةً بنوتة، فسجّل هذا الجزء بنفسك ودع الذكاء الاصطناعي يتولى التوزيع والطبقات المنطوقة والفيديو.

رجل يرتدي سترة صوفية يدندن لحنًا في هاتف ذكي موضوع على كوب فوق طاولة مطبخ خشبية

ماذا تمنحك الخدمة المجانية فعلًا؟

كلمة "مجاني" تخفي الكثير من الشروط الصغيرة. تُوصف عدة نماذج أدناه بأنها متاحة للتجربة مجانًا في صفحات PicassoIA الخاصة بها، وهذا يعني أنه يمكنك تشغيل أول توليد، والاستماع إلى النتيجة، والقرار قبل الالتزام بأي شيء. لكن "التجربة المجانية" لا تعني "مجانًا إلى الأبد"، لذلك تحقق من تفاصيل الخطط على الموقع قبل أن تخطط لألبوم كامل.

تجربة مجانية مقابل مجانية دائمة

  • تجربة مجانية: شغّل النموذج مرة أو مرتين، واحكم على النتيجة بسماعاتك.
  • النقاط والخطط: قد تعتمد الجلسات الأطول والتشغيلات المتكررة على خطتك.
  • المدخلات المجانية: سير العمل بلا تكلفة يحتاج إلى مادة مصدر بلا تكلفة أيضًا. استخدم أغاني كتبتها أنت، أو ألحانًا في الملك العام، أو مقاطع تملك ترخيصًا لها.

النماذج الخمسة التي ستستخدمها

  1. نموذج إعادة التوزيع MiniMax Music: يعيد بناء أغنية بأسلوب جديد. استغرقت أمثلة التشغيل على صفحته ما بين 52 و85 ثانية.
  2. Music 2.6: يكتب أغنية أصلية كاملة من أمر نصي للأسلوب وكلمات اختيارية.
  3. Voice Cloning: يبني صوتًا قابلًا لإعادة الاستخدام من عينة قصيرة.
  4. Qwen3 TTS: أصوات جاهزة، وأصوات مستنسخة، وأصوات تصفها بكلمات بسيطة، عبر 10 لغات.
  5. Omni Human 1.5: يحوّل صورة واحدة ومقطعًا صوتيًا قصيرًا إلى فيديو بمزامنة الشفاه.

أيها تبدأ أولًا؟ إذا كان لديك لحن بالفعل، فابدأ بنموذج إعادة التوزيع. وإذا كان لديك كلمات فقط، فابدأ بالنموذج Music 2.6. يقبل النموذج كلمات مع وسوم بنيوية مثل [Intro]، [Verse]، [Chorus]، [Bridge]، و[Outro]، ويمكنه كتابة الكلمات لك انطلاقًا من أمر نصي للأسلوب عندما يكون حقل الكلمات فارغًا. كما يضم مفتاح "instrumental" للمقطع بلا غناء، وهو مفيد لمسار موسيقي نظيف خلف صوتك المستنسخ.

منظر من الأعلى لمكتب خشبي عليه حاسوب محمول وسماعات استوديو وجهاز واجهة صوتية ودفتر وفنجان قهوة

جهّز المقطع المصدر

المدخلات الرديئة تنتج مخرجات رديئة، والصوت أشد قسوة في ذلك من أي وسيط آخر تقريبًا. عشر دقائق من التحضير ستوفر عليك عشر إعادات توليد.

اختر أغنية يمكنك استخدامها

يحتاج نموذج إعادة التوزيع إلى أغنية مصدر. الخيارات الآمنة هي:

  • أغنيتك الأصلية، حتى لو كانت نسخة تجريبية خام مسجّلة بالهاتف.
  • لحن في الملك العام، مثل أغنية شعبية تقليدية أو ترنيمة قديمة.
  • مقطع تملك ترخيصًا لتكييفه.

تجنّب أي مقطع لا تستطيع تأكيد حقوقه إذا كنت تنوي نشر النتيجة علنًا. المزيد عن ذلك في قسم الحقوق أدناه. وأثناء اختبار الأوامر النصية، اعمل على مقطع قصير، ثم شغّل الأغنية كاملة مرة واحدة بعد أن يستقر الأسلوب.

سجّل أداءً صوتيًا نظيفًا

إذا كان غناؤك هو مرجع اللحن، فسجّله بصوت جاف:

  • غنِّ داخل خزانة ملابس مليئة بالمعاطف المعلّقة. تمتص الملابس الصدى أفضل من معظم غرف النوم.
  • أمسك الهاتف أو الميكروفون على بعد عرض كف تقريبًا من فمك.
  • أطفئ المراوح وأي موسيقى خلفية والإشعارات.
  • غنِّ اللحن بوضوح وثبات. إنه الشيء الوحيد الذي يحتفظ به النموذج، فاجعله يستحق ذلك.

امرأة ترتدي سماعات تغني أمام ميكروفون مكثف داخل خزانة مبطنة بمعاطف صوف معلّقة

ثم صدّر الملف بصيغة MP3 أو WAV. يقرأ نموذج إعادة التوزيع المقطع من رابط، ويجب أن يكون هذا الرابط متاحًا للعامة. ارفع الملف إلى مكان يستطيع أي شخص يملك الرابط فتحه، واختبر الرابط في نافذة متصفح خاصة قبل أن تلصقه.

💡 اختبار سريع: إذا طلب الرابط تسجيل الدخول، فلن يستطيع النموذج قراءته أيضًا.

كيف تستخدم MiniMax Music على PicassoIA

هذا هو المسار الدقيق لنموذج إعادة التوزيع MiniMax Music، وهو الذي يتولى معظم العمل في هذا السير. تصف صفحة النموذج الأمر ببساطة: ارفع مقطعًا، وصف الأسلوب الذي تريده، وستحصل على أغنية بصوت مختلف، وآلات مختلفة، ونوع موسيقي مختلف، بينما يبقى اللحن الأصلي سليمًا.

الإعدادات خطوة بخطوة

  1. افتح صفحة النموذج على PicassoIA.
  2. ألصق رابط MP3 أو WAV العام في حقل رابط الصوت.
  3. صف الأسلوب المطلوب في حقل الأمر النصي. يقبل حتى 2,000 حرف.
  4. اترك حقل الكلمات فارغًا للاحتفاظ بالكلمات الأصلية، أو ألصق كلماتك الخاصة حتى 3,000 حرف.
  5. اختر صيغة الإخراج: MP3 للمشاركة، وWAV عندما تنوي تحرير الصوت لاحقًا.
  6. أبقِ الإعدادات الافتراضية للحصول على أفضل دقة، وخفّض معدل البت فقط عندما يكون حجم الملف مهمًا.
  7. شغّل النموذج، واستمع بالسماعات، ثم غيّر شيئًا واحدًا في الأمر النصي وأعد التشغيل.
الإعدادالخياراتالافتراضيغيّره عندما
صيغة الإخراجMP3، WAV، PCMMP3تنوي تحرير الصوت في تطبيق آخر
معدل العينة16، أو 24، أو 32، أو 44.1 كيلوهرتز44.1 كيلوهرتزتحتاج إلى ملف مسودة أصغر
معدل البت32، أو 64، أو 128، أو 256 كيلوبت في الثانية256 كيلوبت في الثانيةتشارك معاينة سريعة
الأمر النصيحتى 2,000 حرفمطلوبفي كل تشغيل، لتوجيه الأسلوب
الكلماتحتى 3,000 حرففارغتريد كلمات جديدة بدلًا من الأصلية

لقطة مقرّبة ليدي المنتج على لوحة اللمس لحاسوب محمول مع شاشات استوديو غير واضحة في الخلفية

أوامر نصية تنجح

هذه الأوامر الخمسة مأخوذة مباشرة من أمثلة التشغيل على صفحة النموذج. يسمّي كل واحد منها نوعًا موسيقيًا، وآلة أو صوتًا رئيسيًا، ونوعًا صوتيًا.

الهدفالأمر النصي
إعادة صياغة هادئةLo-fi hip hop version, vinyl crackle, chill beat, warm midrange, dreamy reverb
ريمكس للرقصEDM remix, 128 BPM, heavy synth bass, atmospheric pads, driving four-on-the-floor beat, euphoric drop
أكوستيك عند الغروبBossa nova, nylon string guitar, soft brushed drums, warm female vocal, tropical sunset
طاقة الملاعبHard rock, distorted electric guitar riffs, powerful drums, raw male vocal, arena energy
نادٍ ليلي متأخرJazz arrangement, saxophone lead, smooth female vocal, mellow piano chords, late night club

الصيغة الموثوقة هي النوع الموسيقي + الإيقاع أو المزاج + الآلة الرئيسية + نوع الصوت + كلمة مشهد واحدة. التزم بنوع موسيقي واحد في كل تشغيل، لأن خلط أربعة أساليب في أمر نصي واحد هو الطريق إلى فوضى صوتية. ولتوجيه المغنّي، صف الصوت في الجملة نفسها: warm female vocal أو raw male vocal أو smooth female vocal أو soft intimate vocal.

عازف ساكسفون يعزف على ساكسفون تينور على مسرح صغير في نادي جاز مضاء بإضاءة دافئة

أضف كلماتك الخاصة

عندما يكون حقل الكلمات فارغًا، يؤدي المغنّي الكلمات المستخرجة من أغنيتك المصدر. ولكي يغني كلماتك، ألصقها مع وسوم الأقسام مثل [verse]، و[chorus]، و[bridge]:

[verse]
Morning light on the kitchen floor
I hum the tune I hummed before

[chorus]
This is my song, this is my sound

💡 طابق الإيقاع: اجعل كل سطر جديد قريبًا من عدد مقاطع السطر الأصلي. السطر الأطول يُضغط، فتخرج الكلمات متعجلة.

ضع صوتك الحقيقي في المزيج

يغني نموذج إعادة التوزيع بصوت جديد. ينضم صوتك الحقيقي إلى المقطع عبر نماذج الكلام، وهنا يأتي الاستنساخ.

استنسخ صوتًا منطوقًا

افتح Voice Cloning وارفع عينة نظيفة:

  • الصيغة والطول: MP3 أو M4A أو WAV، من 10 ثوانٍ إلى 5 دقائق، وبحجم أقل من 20 ميغابايت.
  • تقليل الضوضاء: فعّله إذا كان التسجيل يحتوي على همس خلفي.
  • تسوية مستوى الصوت: فعّلها إذا كانت مستويات صوتك تقفز بشكل متذبذب.
  • فئة الكلام: الافتراضي هو Speech 2.6 HD، مع خيارات turbo وخيارات HD أقدم متاحة.

تحصل على صوت قابل لإعادة الاستخدام يمكنك تطبيقه على أي عدد من تشغيلات الكلام. اكتب سطر مقدمة، أو جسرًا منطوقًا، أو مقطعًا حواريًا، وولّده بصوتك المستنسخ.

💡 الأصوات المستنسخة هنا تأتي من نماذج تحويل النص إلى كلام، لذا تعامل معها كطبقة للكلام المنطوق، وليست بديلًا عن أداء غنائي.

لقطة مقرّبة للغاية لمنظر جانبي لشابة تتحدث في الميكروفون مع فلتر البوب (pop filter)

استنسخ صوتك في خطوة واحدة

يقدم Qwen3 TTS بديلًا بخطوة واحدة. اختر وضع استنساخ الصوت، وارفع مقطعًا مرجعيًا قصيرًا، واكتب نص المقطع في حقل النص المرجعي، كما توصي صفحة النموذج. أضف تعليمات للأسلوب مثل speak slowly and calmly أو excited tone لتوجيه الأداء. استغرق مثال الاستنساخ في صفحة النموذج نحو 14 ثانية. وإذا كنت تريد خيارًا آخر للاستنساخ مع التحكم في المشاعر، فجرّب Chatterbox.

ضعها فوق المقطع المعاد توزيعه

حمّل الأغنية المعاد توزيعها وسطور صوتك المستنسخة، ثم ادمجها في أي محرر صوت مجاني:

  1. ضع الأغنية على مسار، وسطور صوتك على مسار آخر.
  2. خفّض الموسيقى بضع ديسيبلات أسفل الأجزاء المنطوقة.
  3. أضف لمسة من الصدى إلى الصوت ليبدو وكأنه في الغرفة نفسها مع الفرقة.
  4. امزج بين الأقسام بتلاشٍ تدريجي، وصدّر ملف MP3 نهائيًا واحدًا.

ترتيب بسيط يعمل جيدًا لأغنية مدتها ثلاث دقائق:

اللحظةالموسيقىالصوت
أول 8 ثوانٍموسيقى هادئة بلا غناء، من Music 2.6 أو المقطع المعاد توزيعهصوتك المستنسخ ينطق سطر العنوان
المقاطعالمقطع المعاد توزيعه بمستواه الكاملالمغنّي المعاد توزيعه
الكورسالمقطع المعاد توزيعه بمستواه الكاملالمغنّي المعاد توزيعه مع استطراد واحد بصوتك المستنسخ
الجسرتنخفض الموسيقى بضع ديسيبلاتصوتك المستنسخ ينطق سطرًا واحدًا
الخاتمةتلاشٍ على مدى 4 ثوانٍ تقريبًاصمت أو عبارة ختام قصيرة منطوقة

يدان تحركان أزرار التحكم في مزيج صوتي مدمج وسماعات مستريحة فوقه

أنشئ فيديو غنائيًا من صورة واحدة

المقطع الذي يحمل وجهًا ينتشر أبعد على منصات التواصل من ملف صوتي مجرد، ولا تحتاج إلا إلى صورة واحدة لصنعه.

صورة مع صوت تصبح فيديو

يأخذ Omni Human 1.5 صورة واحدة ومقطعًا صوتيًا أقصر من 35 ثانية، ثم يعيد فيديو بمزامنة الشفاه. يوضح الأمر النصي المثال الذي تقدمه صفحة النموذج، A woman sings and strums her guitar، حالة الاستخدام الغنائية.

  • استخدم بورتريهًا أماميًا بإضاءة متوازنة وخلفية بسيطة.
  • اقطع أغنيتك على الكورس أو الجملة الجذابة. الصوت الأطول من 35 ثانية يتسبب في فشل التوليد.
  • فعّل الوضع السريع أثناء الاختبار. استغرقت أمثلة التشغيل على الصفحة ما بين 3 و6 دقائق تقريبًا.
  • أضف أمرًا نصيًا قصيرًا إذا أردت توجيه الإيماءات أو حركة الكاميرا.

شاب مبتسم بشعر أسود مجعد يغني نحو الكاميرا أمام جدار رمادي بسيط

زامن فيديو موجودًا

إذا كان لديك مقطع مصور لنفسك بالفعل، فإن Lipsync 2 Pro يعيد كتابة حركات الشفاه لتطابق صوتًا جديدًا. يوفر خمسة أوضاع للمزامنة (تكرار، ارتداد، قطع، صمت، وإعادة تعيين) بالإضافة إلى عنصر تحكم في درجة التعبير من 0 إلى 1، ويقبل فيديو MP4 مع صوت WAV. وKling Lip Sync خيار آخر لمطابقة الفم مع الصوت في أي فيديو.

قبل أن تنشر أي شيء

مسائل الحقوق أهم من أي أمر نصي. هذه معلومات عامة، وليست نصيحة قانونية.

  • إعادة التوزيع لا تجعل الأغنية ملكًا لك. نشر نسخة معاد صياغتها من أغنية محمية بحقوق الطبع يتطلب عادة إذنًا من أصحاب حقوق التأليف الأصلية.
  • الملك العام يساعد، مع تحفّظ. قد تكون تأليف قديم مباحًا للاستخدام، لكن تسجيلًا معينًا له قد يظل محميًا.
  • استنسخ فقط الأصوات التي تملكها أو التي حصلت على إذن كتابي باستخدامها.
  • ضع وسمًا على المقاطع التي ساعد الذكاء الاصطناعي في إنتاجها حيثما تطلب المنصة ذلك.

بيانو عمودي عليه كتاب أغانٍ قديم مفتوح على الحامل ويداد مستريحتان فوق البيانو

ستة أخطاء تضيّع ساعات أكثر من أي خطأ آخر:

  1. رابط مصدر خاص. لن يستطيع النموذج فتحه، فيفشل التشغيل.
  2. عينة استنساخ مليئة بالضوضاء. فعّل تقليل الضوضاء أو أعد التسجيل داخل الخزانة.
  3. خمسة أنواع موسيقية في أمر نصي واحد. اختر نوعًا واحدًا ومزاجًا واحدًا.
  4. تغيير خمسة إعدادات دفعة واحدة. لن تعرف أي تغيير أفاد.
  5. توقّع بصمة غنائية لصوتك من إعادة التوزيع. خطط لطبقات الصوت بدلًا من ذلك.
  6. إرسال أغنية كاملة إلى نموذج الفيديو. اقطعها إلى أقل من 35 ثانية أولًا.

أنشئ أول مقطع لك اليوم

حان دورك الآن. اختر لحنًا تحبه، ودندن 30 ثانية منه في هاتفك، ثم شغّله عبر نموذج إعادة التوزيع MiniMax Music مع أمر نصي واحد واضح. جرّب أولًا أمر Lo-fi، ثم أمر الجاز، ولاحظ كيف يغيّر اللحن نفسه مزاجه. وإذا أردت أغنية جديدة تمامًا، فأعطِ كلماتك الخاصة إلى Music 2.6 ودعه يبني التوزيع.

تبدو الجلسة الأولى الواقعية هكذا:

  • 10 دقائق: سجّل اللحن في كابينة الخزانة.
  • 10 دقائق: نفّذ تشغيلين أو ثلاثة لإعادة التوزيع، وغيّر شيئًا واحدًا في كل مرة.
  • 10 دقائق: استنسخ صوتك وولّد سطرين منطوقين.
  • 15 دقيقة: ادمج الطبقات وصدّر ملف MP3 النهائي.
  • 10 دقائق: حوّل الجملة الجذابة إلى فيديو باستخدام Omni Human 1.5.

نماذج الموسيقى والصوت متاحة للتجربة مجانًا، لذلك لا تكلّف التجربة سوى بضع دقائق من الفضول. ويمكنك أيضًا إنشاء غلاف الألبوم بنماذج الصور على PicassoIA، فيجتمع الإصدار كله (الأغنية والصوت والفيديو والغلاف) في مكان واحد. تصفّح كل شيء عبر picassoia.com/en/all-models واصنع شيئًا يشبهك.

شارك هذا المقال

اختر لغتك

مقالات ذات صلة