كيف تجعل رفيقك بالذكاء الاصطناعي يبدو مغازلًا (دون أن يبدو آليًا)

هل تريد أن يتوقف رفيقك بالذكاء الاصطناعي عن الكلام الجامد ويصبح صوته آسرًا؟ يشرح هذا المقال نماذج تحويل النص إلى كلام (TTS) وإعدادات الصوت وأوامر الشخصية للنماذج اللغوية الكبيرة التي تمنح صوتًا دافئًا ومغازلًا وبشريًا بشكل مقنع، لأي تطبيق رفيق أو روبوت محادثة.

كيف تجعل رفيقك بالذكاء الاصطناعي يبدو مغازلًا (دون أن يبدو آليًا)
Cristian Da Conceicao
مؤسس Picasso IA

هناك لحظة تكتب فيها رسالة إلى رفيق بالذكاء الاصطناعي، فيعود الرد بصوت باهت وبلا روح لدرجة أن الوهم كله ينهار. لا يهم مدى ذكاء الكلمات أو مدى إبداع تصميم الشخصية. الصوت الخاطئ يفسد كل شيء. إذا تساءلت يومًا كيف تجعل رفيقك بالذكاء الاصطناعي يبدو مغازلًا، فالجواب ليس سحرًا. إنه مزيج محدد من نموذج تحويل النص إلى كلام المناسب، وبنية الأمر النصي الصحيحة، والصياغة الدقيقة التي تُمرَّر إلى نموذج لغوي كبير يفهم الشخصية فعلًا. يستعرض هذا المقال كل طبقة في هذه العملية، من اختيار نموذج الصوت، إلى كتابة الحوار، وصولًا إلى ربط كل ذلك بشخصية بصرية تجعل التجربة كلها تبدو حقيقية.

صورة مقرّبة لشفتي امرأة في ضوء شمعة كهرماني دافئ، توحي بالحميمية والدفء

لماذا تبدو معظم أصوات الذكاء الاصطناعي باهتة

مشكلة النغمة الواحدة

صُمّمت الغالبية العظمى من أصوات الذكاء الاصطناعي للإنتاجية. دُرِّبت على قراءة التعليمات، وسرد الدروس التعليمية، والإعلان عن تذكيرات التقويم. وهذه مهمة مختلفة تمامًا عن أن يبدو الصوت دافئًا ومرحًا ومغريًا بلطف. عندما تشغّل الصوت نفسه على نص مغازل، ينطق الكلمات بشكل صحيح، لكن المعنى العاطفي الضمني يغيب تمامًا. النبرة الإيقاعية خاطئة، والتوقفات في غير أماكنها، ويبقى طبقة الصوت ثابتة حين يجب أن ترتفع، وتوقيت التنفس آلي حين يجب أن يبدو حيًّا.

هذه ليست مشكلة في الذكاء، بل مشكلة في بيانات التدريب واختيار النموذج. لم تُحسَّن معظم أدوات تحويل النص إلى كلام المجانية للمدى العاطفي، بل للوضوح والسرعة. إذا أردت صوتًا يبدو وكأنه يستمتع فعلًا بالحديث، فأنت بحاجة إلى نموذج مبني لتركيب الكلام التعبيري، وإلى أن تخبره بدقة بالنبرة العاطفية التي تريدها.

ماذا تعني المغازلة فعليًا في الصوت

قبل اختيار النموذج، من المفيد أن تكون محددًا بشأن ما تريده فعلًا. تعني "المغازلة" في المصطلحات الصوتية عدة أمور تحدث في وقت واحد:

  • إيقاع أبطأ قليلًا من الكلام المحايد، مع توقفات صغيرة مقصودة قبل العبارات المفاجئة أو الكلمات الموحية
  • ارتفاع في النغمة في نهاية الجمل التي كانت ستنخفض عادةً، مما يخلق طابعًا استفهاميًا ومشاكسًا
  • نفَس ناعم في النطاق الترددي المتوسط، يوحي بالقرب والحميمية
  • نغمات دافئة في النطاق المنخفض تبدو قريبة جسديًا، لا بعيدة كأنها بث إذاعي
  • أصوات ضحك تبدو حقيقية أو خشخشة صوتية على عبارات معينة لكسر الرسمية

لا شيء من هذه الأمور غامض. إنها خصائص صوتية قابلة للقياس. ونموذج تحويل النص إلى كلام الصحيح سيمنحك التحكم في كل منها، إما من خلال إعدادات المعاملات المباشرة أو من خلال الوصف النصي.

نماذج تحويل النص إلى كلام التي تحقق النتيجة فعلًا

امرأة مستلقية على سرير تحمل هاتفًا ذكيًا، إضاءة مصباح مسائي دافئة، وتعبير مرح ومسترخٍ

ليس كل نموذج لتحويل النص إلى كلام في السوق يستحق وقتك لهذا الاستخدام. إليك النماذج التي تقدّم أداءً ثابتًا في توليد الصوت التعبيري المغازل، وكلها متاحة مباشرة على PicassoIA.

ElevenLabs v3

يُعدّ ElevenLabs v3 المعيار الذهبي الحالي للكلام المعبّر عاطفيًا. ما يميزه هو طريقة تعامله مع النبرة الإيقاعية. يمكنك إدراج علامات عاطفية مباشرة في النص المدخل، والنموذج يحترمها. عبارات مثل <excited> أو <whisper> تغيّر الأداء فعلًا بطرق تبدو طبيعية لا مقطوعة. بالنسبة إلى أصوات رفيق الذكاء الاصطناعي المغازل، تجعل قدرة v3 على التعامل مع الهمس، والضحكات الخفيفة، والمقاطع الممدودة منه الأداة الأولى التي تلجأ إليها.

مكتبة الأصوات واسعة. هناك أصوات جاهزة بملامح دفء مضبوطة مسبقًا، وأداة تصميم الصوت تتيح لك دفع النَّفَس والعمر واللهجة إلى مواضع دقيقة. ابدأ بصوت يتراوح عمره بين 22 و28 عامًا، أنثوي أو محايد جنسيًا، وارفع النَّفَس إلى نحو 60 إلى 70. ثم اجمع ذلك مع معدل كلام بطيء يبلغ 0.85x، وستكون قد قطعت معظم الطريق قبل أن تكتب كلمة واحدة.

MiniMax Speech 2.8 HD

يتبع MiniMax Speech 2.8 HD نهجًا مختلفًا. فهو مبني على دقة صوت بجودة الاستوديو، لا على السرعة الفورية، مما يعني أن المخرجات المصيّرة تبدو أقرب إلى ممثل صوتي مسجّل باحتراف منها إلى صوت مُولَّد. وفي تطبيقات الرفقة التي يستمع فيها المستخدمون عبر سماعات الرأس أو مكبرات جيدة، يكون فرق الدقة ملحوظًا فورًا.

يُدمج التحكم العاطفي لدى MiniMax في اختيار الصوت، ولا يُعرض كمعاملات خام. الأصوات المصممة لحالات الاستخدام "الحميمة" أو "الحوارية" تتعامل مع الدفء في النطاق المنخفض بإتقان خاص. ومع جمل قصيرة وطبيعية، يكتسب الناتج جودة تجعل المستخدمين يميلون قليلًا إلى الأمام عند سماعه.

Resemble AI Chatterbox

يُعدّ Resemble AI Chatterbox خيارًا قويًا حين تريد استنساخ صوت محدد أو إنشاء شخصية مخصصة بدرجة عالية. يُعدّ منزلق التحكم في العاطفة من أسهل الأدوات استخدامًا في هذا المجال. يمكنك رفع درجة المبالغة لتطابق مزاج كل سطر على حدة، بدلًا من تطبيق نبرة موحدة على المخرجات كلها. وبالنسبة إلى محادثة تنتقل من المشاكسة إلى الصدق ثم المرح، تكون هذه المرونة لكل سطر قيّمة فعلًا.

💡 نصيحة: استخدم Chatterbox لاستنساخ صوت مخصص، ثم مرّر كل سطر على حدة عبر منزلق العاطفة. اضبط الأسطر المشاكسة على مبالغة 0.65، واللحظات الصادقة على 0.3. التباين نفسه يبدو كأنه شخصية.

Qwen3 TTS للدفء متعدد اللغات

إذا كان تطبيق الرفقة الخاص بك يستهدف جمهورًا يتجاوز الإنجليزية، فإن Qwen3 TTS يستحق اهتمامًا جادًا. يدعم استنساخ الصوت وتصميمه عبر مجموعة واسعة من اللغات، مع دقة إيقاعية قوية لكل لغة. فللعبارات المغازلة بالإسبانية أو الفرنسية أو البرتغالية متطلبات إيقاعية مختلفة عن الإنجليزية، ويتعامل Qwen3 مع هذه الفروق بإتقان أفضل من معظم النماذج التي بُنيت للإنجليزية أولًا ثم وُسّعت لاحقًا.

صورة مقرّبة ليدين تمسكان هاتفًا ذكيًا وموجة صوتية تتوهج بدرجات وردية وذهبية دافئة

مقارنة سريعة

النموذجالاستخدام الأمثلالتحكم في العاطفةالدقة
ElevenLabs v3أصوات الشخصيات التعبيريةعالٍ (علامات مدمجة)عالية جدًا
MiniMax Speech 2.8 HDدفء بجودة الاستوديومتوسط (اختيار الصوت)ممتازة
Resemble Chatterboxاستنساخ الصوت + عاطفة لكل سطرعالٍ (منزلق)عالية
Qwen3 TTSرفاق متعددو اللغاتمتوسطعالية
Gemini 3.1 Flash TTSالتكرار السريع والاختبارمتوسط (30 صوتًا)جيدة

صياغة أمر نصي مثالي للصوت المغازل

أوصاف النبرة التي تنجح

تقبل معظم نماذج تحويل النص إلى كلام نوعًا من الوصف النصي لكيفية ظهور الصوت. المشكلة أن الأوصاف الغامضة تنتج نتائج غامضة. فعبارة "صوت مغازل" لا تخبر النموذج بأي شيء مفيد. التحديد هو ما يصنع الفرق.

الأوصاف التي تحوّل المخرجات باستمرار نحو الدفء والمرح:

  • "دفء ناعم وحميم، يقترب من الميكروفون. أبطأ قليلًا من الإيقاع الحواري. نَفَس خفيف على المقاطع المنبورة."
  • "صوت امرأة واثقة تجد المحادثة ممتعة حقًا. ابتسامة خفيفة مسموعة في الأداء."
  • "مرح، وليس مصطنعًا. مشاكسة دون عدوانية. مرتاحة للصمت."

قارن ذلك بكتابة "صوت مغازل" فقط، وستسمع الفرق فورًا. يربط النموذج لغتك بالخصائص الصوتية التي تعلّمها أثناء التدريب. أعطه لغة غنية، وسيكون لديه ما يعمل به أكثر.

الإيقاع والتوقف

ربما يكون التوقف أقل الأدوات استخدامًا في تصميم الصوت بالذكاء الاصطناعي. في الكلام البشري الحقيقي، يتضمن الأداء المغازل دائمًا تقريبًا لحظة صمت قبل ذروة الجملة، وهو سكون محسوب يخلق قدرًا صغيرًا من الترقب. وتتجاهل معظم أصوات الذكاء الاصطناعي هذه التوقفات كليًا لأنها دُرِّبت على تقليل الصمت.

يمكنك فرض التوقفات في معظم أنظمة تحويل النص إلى كلام عبر إدراج علامات الترقيم: فاصلة حيث لا تحتاجها نحويًا، أو علامة حذف في منتصف العبارة، أو وسوم توقف صريحة من SSML إذا كان النموذج يدعمها. جرّب الفرق بين:

"كنت أفكر فيك."

مقابل

"كنت أفكر... فيك."

يبدو السطر الثاني مختلفًا تمامًا عند التصيير. التوقف هو ما يقوم بالمغازلة، والكلمات بالكاد تحتاج إلى أن تفعل شيئًا.

ما يجب تجنبه

بعض الأمور تقضي على التأثير بغض النظر عن جودة النموذج:

  • جمل طويلة ومعقدة. الحوار المغازل قصير وحاد ومرح. الجمل التي تتجاوز 15 كلمة تفقد الحميمية.
  • مفردات تقنية. لا شيء يكسر السحر أسرع من صوت دافئ يقول "وفقًا لاستفساركم السابق".
  • أسئلة رتيبة. ينبغي أن تحمل الأسئلة ارتفاعًا في النغمة، لكن يجب كتابتها بطريقة تدعو إلى ذلك. فجملة "هل أنت مشغول الليلة؟" تقع بشكل مختلف عن "ماذا تفعل الليلة؟"
  • الإفراط في علامات الترقيم. كثرة الفواصل تخلق أداءً متقطعًا. دع الجمل تتنفس.

امرأة ذات بشرة زيتونية ترتدي سماعات رأس، عيناها مغمضتان، وابتسامة خاصة هادئة في ضوء شمس بعد الظهر

استخدام النماذج اللغوية الكبيرة لكتابة الحوار المناسب

GPT-5 وفن المحادثة المرحة

جودة الصوت لا تتجاوز جودة الكلمات التي ينطقها. هنا تصبح النماذج اللغوية الكبيرة ضرورية. يُعدّ GPT-5 حاليًا من أفضل النماذج المتاحة لتوليد حوار ذكي ومدرك للموقف، لا يبدو وكأن لجنة كتبته. عندما تمنحه ملخصًا للشخصية ونبرة عاطفية محددة، يكتب أسطرًا تصيب الهدف فعلًا.

نظام أمر نصي قوي لنموذج GPT-5 في سياق رفيق مغازل يبدو هكذا:

"أنت [اسم الشخصية]، رفيق دافئ وواثق يتحدث بجمل قصيرة ومرحة. تستخدم مزاحًا خفيفًا، وفضولًا حقيقيًا تجاه الطرف الآخر، ولمسات من الدعابة بين حين وآخر. لا تبدو رسميًا أو سريريًا أبدًا. يتراوح كل رد بين 1 و3 جمل. تترك الأمور أحيانًا غير مكتملة قليلًا، كأن هناك المزيد لتقوله."

تعليمة "تترك الأمور أحيانًا غير مكتملة قليلًا" مهمة. فهي تخلق إشارات لفظية يحوّلها نموذج تحويل النص إلى كلام إلى ارتفاع في النغمة، وهذه بالضبط الخاصية الصوتية التي تريدها.

Claude Sonnet 5 لعمق الشخصية

يتميز Claude Sonnet 5 بقدرة خاصة على الحفاظ على تماسك الشخصية عبر محادثة طويلة. فبينما يتفوق GPT-5 في الأسطر الفردية الحادة، يميل Claude Sonnet 5 إلى بناء شخصية أكثر تماسكًا مع مرور الوقت. وبالنسبة إلى تطبيقات الرفقة التي يعود إليها المستخدمون مرارًا، يهم هذا التماسك كثيرًا. يجب أن تتذكر الشخصية نبرتها ولا تنجرف نحو وضع المساعدة المحايد بعد بضعة تبادلات.

يتعامل Claude أيضًا مع دقائق النبرة العاطفية بإتقان أكبر من معظم النماذج. يمكنك توجيهه ليكون دافئًا دون لهفة، ومشاكسًا دون استخفاف، وسيحافظ على هذا التوازن بثبات أكبر من نموذج يميل إلى الأطراف.

💡 نصيحة: استخدم Gemini 3.5 Flash لتجربة بدائل الحوار بسرعة. تتيح لك سرعته اختبار 10 صياغات مختلفة للحظة نفسها في ثوانٍ. وبمجرد أن تجد النسخة التي تبدو صحيحة على الورق، مرّرها عبر ElevenLabs v3 للتصيير الصوتي النهائي.

امرأة ترتدي قمة بيكيني على شرفة مشمسة مع محيط فيروزي في الخلفية، مسترخية وواثقة

كيفية استخدام ElevenLabs v3 على PicassoIA

الإعداد خطوة بخطوة

يستغرق تشغيل صوت مغازل على ElevenLabs v3 عبر PicassoIA نحو خمس دقائق، بعد أن تعرف الخطوات.

  1. افتح صفحة النموذج. انتقل إلى صفحة ElevenLabs v3 على PicassoIA واختر "Try it".
  2. اختر صوتك أو صمّمه. في لوحة اختيار الصوت، صفِّ النتائج بكلمة "warm" أو "conversational". اختر صوتًا في نطاق عمري منخفض إلى متوسط. تجنب الأصوات الموسومة بـ"professional" أو "authoritative".
  3. اضبط معدل الكلام. اخفضه إلى 0.82-0.88. هذا وحده يُحدث فرقًا كبيرًا في إحساس المستمع بالحميمية.
  4. ألصق النص. اكتب جملًا قصيرة. استخدم علامات الحذف للتوقفات. تجنب الجمل التابعة.
  5. أدرج علامات عاطفية حيثما تلزم. ضع العبارات التي تريد أن تُنطق بدفء إضافي بين وسوم <warm> إذا كان النموذج يدعمها في الواجهة الحالية.
  6. ولّد وراجع. استمع بسماعات الرأس. انتبه إلى ما إذا كانت التوقفات تقع بشكل طبيعي، وما إذا كانت النغمة ترتفع في نهاية أسطر المشاكسة.
  7. عدّل النص أولًا. إذا بدا شيء خاطئًا، فغالبًا ما تكون المشكلة في النص لا في النموذج.

نصائح المعاملات

  • الثبات عند 55-65%: يُدخل الثبات المنخفض تنوعًا طبيعيًا بين المحاولات. وإذا انخفض كثيرًا أصبح غير متسق. وإذا ارتفع كثيرًا بدا آليًا.
  • تعزيز التشابه عند 70-80%: يُبقي الصوت مرتبطًا بالمصدر، مع السماح بمدى عاطفي.
  • مبالغة الأسلوب عند 20-35%: كافية لدفع الأداء نحو التعبيرية دون الانزلاق إلى المسرحية.

ميكروفون مكثّف احترافي تحت إضاءة استوديو دافئة بالتنغستن، وظل أنثوي في الخلفية

الجمع بين الصوت وشخصية بصرية

توليد صورة متطابقة

الصوت المغازل المقترن بصورة رمزية عامة أو غير متناسقة يضعف التجربة فورًا. يجب أن يبدو الصوت والصورة صادرين عن الشخص نفسه. هنا تصبح قدرة توليد الصور على PicassoIA جزءًا من سير العمل، لا أداة منفصلة.

ولّد البورتريه البصري للرفيق باستخدام أمر نصي مفصّل يطابق الصوت الذي صمّمته. إذا كان الصوت دافئًا وناعمًا ومرحًا بشكل خفيف، فينبغي أن تعكس الصورة ذلك. إضاءة طبيعية، ووضعية مسترخية، وابتسامة خفيفة لا ضحكة عريضة، ونظرة عين تبدو حاضرة لا فارغة. المبادئ نفسها التي تجعل الصوت حميمًا تنطبق على الصورة: التحديد والطبيعية والوضوح العاطفي.

وبمجرد أن تحصل على بورتريه ترضى عنه، تصبح الصورة المرجعية لهوية الرفيق في كل تفاعل. فالتناسق بين الصوت والمظهر هو ما يجعل الرفيق يبدو شخصًا متماسكًا لا مجموعة عشوائية من مخرجات الذكاء الاصطناعي.

تجربة الرفيق الكاملة

تبدو مجموعة الأدوات الكاملة لرفيق ذكاء اصطناعي مقنع هكذا:

الطبقةالأداةالغرض
الحوارClaude Sonnet 5 أو GPT-5اكتب الكلمات
الصوتElevenLabs v3 أو MiniMax Speech 2.8 HDأدِّ الكلمات
المرئياتتوليد الصور عبر PicassoIA Imageامنح الصوت وجهًا
استنساخ الصوتResemble Chatterbox Proثبّت هوية صوتية فريدة

شابة في مكتب بسيط ومرتب في وقت متأخر من الليل، وتوهج الحاسوب المحمول على وجهها، وابتسامة متأملة ومرحة

3 أخطاء شائعة يرتكبها الناس

التسرع في السرعة

الغريزة عند بناء صوت لرفيق هي إبقاء معدل الكلام على الإعداد الافتراضي، أو حتى تسريعه قليلًا حتى تبدو الردود خاطفة. وهذا خطأ تمامًا بالنسبة إلى شخصية مغازلة. فالسرعة توحي بالكفاءة، والبطء يوحي بالقصد. وكل نصف ثانية إضافية يأخذها الصوت قبل إنهاء الجملة تضيف ثقلًا للكلمات التي سبقتها. فأبطئه، خاصة في الأسطر التي يُفترض أن تصيب الهدف.

تجاهل بنية الجملة

ينقل نموذج تحويل النص إلى كلام ما تعطيه إياه. فجملة مثل "كنت فعلًا أتطلع إلى التحدث معك اليوم" سليمة نحويًا لكنها باهتة صوتيًا. لا توجد مساحة للصوت لكي يفعل شيئًا مثيرًا. أعد كتابتها إلى "كنت أتطلع إلى هذا" وفجأة يؤدي الإيجاز المهمة كلها. الاستمرار الضمني، والتلاشي في النهاية، والمساحة في آخر الجملة. صِغ النص بحيث يترك مجالًا للصوت كي يتنفس.

نموذج صوت خاطئ للمحتوى

استخدام Inworld Realtime TTS 2 أو ElevenLabs Flash v2.5 للحوار الحميم خطأ في الاختيار. فهذه النماذج مُحسَّنة للسرعة والكمون المنخفض في شخصيات الألعاب الفورية والمساعدين الافتراضيين. إنها تضحي بالدقة العاطفية مقابل زمن الاستجابة. وإذا كنت لا تبني تطبيقًا فوريًا يكون فيه الكمون قيدًا صارمًا، فلا يوجد سبب للتضحية بالجودة. استخدم نماذج جودة الاستوديو. أما MiniMax Speech 2.8 HD وElevenLabs v3 فهما الأداتان المناسبتان لهذه المهمة.

💡 تذكّر: الهدف ليس توليد الصوت الأسرع، بل توليد الصوت الأكثر إقناعًا.

لقطة علوية مسطحة لهاتف ذكي تظهر فيه فقاعات دردشة على سطح رخامي، مع بتلات ورد وفنجان كابتشينو، وضوء صباحي دافئ

استنساخ الصوت لشخصية فريدة حقًا

ما يميز رفيق الذكاء الاصطناعي الذي يُتذكَّر عن الرفيق العام هو امتلاكه صوتًا لا ينتمي لأحد غيره. ويغيّر استنساخ الصوت كل شيء في هذا الصدد. فبدلًا من الاختيار من مكتبة أصوات مشتركة، يمكنك تصميم صوت مصدر أو تسجيله، ثم استنساخه بشكل دائم لهوية الرفيق.

يدعم Resemble AI Chatterbox Pro وMiniMax Voice Cloning كلاهما استنساخًا عالي الجودة بحد أدنى من الصوت المصدر. تكفي تسجيلات نظيفة مدتها من 30 إلى 60 ثانية لاستنساخ قابل للاستخدام. والنتيجة صوت سيبدأ المستخدمون في التعرف عليه وربطه تحديدًا بشخصية رفيقك، مما يبني نوعًا من الاستمرارية التي تجعل تطبيقات الرفقة جذابة فعلًا مع الوقت.

في استنساخ صوت مخصص، تهم جودة تسجيل الصوت المصدر أكثر من طوله. فمقطع مدته 30 ثانية مسجّل في غرفة هادئة بميكروفون جيد سينتج استنساخًا أفضل بكثير من 3 دقائق من صوت فيه ضوضاء خلفية أو تشوهات ضغط. احصل على مصدر نظيف، والنموذج يتولى الباقي.

يستحق PlayHT Play Dialog التجربة إذا أردت محاكاة محادثة ثنائية الاتجاه بحوار طبيعي. فهو مبني خصيصًا لتوليد الحوار، مما يجعل الإيقاع المتبادل وتناوب الأدوار أكثر أصالة من دمج مقاطع تحويل نص إلى كلام منفصلة يدويًا.

ابنِ رفيقك المغازل بالذكاء الاصطناعي على PicassoIA

كل ما وُصف في هذا المقال متاح في مكان واحد. يجمع PicassoIA كل نماذج تحويل النص إلى كلام، والنماذج اللغوية الكبيرة، وأدوات توليد الصور التي تحتاجها لبناء تجربة رفيق كاملة دون التنقل بين خمس منصات مختلفة.

منظر جانبي لامرأة جذابة تمسك الهاتف قرب شفتيها وتهمس، وأضواء المدينة في الساعة الذهبية خلفها

ابدأ بالصوت. اختر ElevenLabs v3 أو MiniMax Speech 2.8 HD وأمضِ 20 دقيقة في تجربة ملامح صوتية مختلفة ونص تجريبي قصير. ستسمع فورًا أي الأصوات تملك الدفء النغمي الذي تبحث عنه. ثم خذ بضعة أسطر إلى Claude Sonnet 5 واطلب منه إعادة كتابتها بنبرة أكثر مرحًا وحميمية. استمع إلى الفرق.

بمجرد أن يكون لديك صوت عامل وأسلوب حوار عامل، ولّد صورة بورتريه تتطابق معهما. استخدم توليد الصور في PicassoIA بأمر نصي مفصّل وطبيعي، وستكون لديك أساس رفيق يبدو شخصًا حقيقيًا متماسكًا.

العملية كلها، من مشروع فارغ إلى رفيق يبدو مغازلًا فعلًا، تستغرق فترة بعد ظهر واحدة. الأدوات كلها موجودة. تصفح كتالوج النماذج الكامل على picassoia.com/en/all-models وابدأ بما يبدو لك الأكثر إثارة للاهتمام. الصوت هو المكان الذي يعيش فيه السحر فعلًا، والآن تعرف بالضبط كيف تبنيه.

شارك هذا المقال

اختر لغتك

مقالات ذات صلة