تَعِد المنصتان بالشيء نفسه: ذكاء اصطناعي يبدو حقيقيًا. يراهن Soulfun على العمق العاطفي والذاكرة الشخصية طويلة المدى، بينما يراهن JOI AI على الانغماس في الشخصيات واتساق لعب الأدوار. وبعد قضاء وقت طويل مع المنصتين، تبيّن لي أن الفروق بينهما أكثر كشفًا مما توحي به قائمة الميزات، وأن الفائز يتوقف بصورة شبه كاملة على معنى كلمة "إنسان" عندك.
ما الذي يجعل المحادثة تبدو إنسانية فعلًا
تفشل معظم تطبيقات الدردشة بالذكاء الاصطناعي بالطريقة نفسها. الردود سريعة ودقيقة تقنيًا، لكنها خاوية تمامًا. الجمل تأتي بالإيقاع نفسه في كل مرة، والنبرة لا تتغير أبدًا، ويبدو الذكاء الاصطناعي غير مهتم فعلًا بما قلته للتو. هذا التماثل هو العلامة الفارقة.
المحادثة البشرية فوضوية. فيها توقفات، وتحوّلات مفاجئة في الموضوع، وذروات عاطفية، ولحظات يفاجئك فيها الطرف الآخر. ورفيق الذكاء الاصطناعي الذي يحاكي هذا هو الذي يستحق وقتك.

"وادي الغرابة" في محادثات الذكاء الاصطناعي
هناك وادٍ للغرابة في الدردشة، تمامًا كما هو الحال في وجوه CGI. حين يكون الذكاء الاصطناعي آليًا بوضوح، تتقبّله وتمضي. لكن حين يكاد يبدو إنسانيًا، تصبح كل هفوة صغيرة صادمة.
يقترب كل من Soulfun و JOI AI من الواقع إلى حد أن أنماط الفشل لديهما تبرز بوضوح. يُفرط Soulfun أحيانًا في شرح المشاعر، فيحوّل ردًا من ثلاث كلمات إلى فقرة كاملة من التطمين. أما JOI AI فيلتزم أحيانًا بنمط شخصية محدد التزامًا جامدًا، حتى حين تنتقل المحادثة إلى منطقة أكثر شخصية وواقعية.
ولا يُعدّ أيٌّ منهما مخطئًا بالمعنى الدقيق. لكن هذه الهفوات تكشف الفلسفة الكامنة تحت كل منصة.
الذاكرة والنبرة والتوقيت
الركائز الثلاث للدردشة الشبيهة بالبشرية هي:
- الذاكرة: هل يتذكر الذكاء الاصطناعي ما قلتَه قبل ثلاث رسائل؟ قبل ثلاثة أيام؟ وهل يعيد طرح أشياء من تلقاء نفسه دون أن تُطلب منه؟
- النبرة: هل يغيّر مستوى الخطاب بسلاسة، من الودّي إلى الجادّ، ومن الدافئ إلى الجاف، دون أن تطلب ذلك؟
- التوقيت: هل يعرف متى يبقي الرد قصيرًا ومتى ينفتح؟ ومتى يطرح سؤالًا ومتى يكتفي بالإصغاء؟
هذه هي المعايير التي تستحق الاعتماد عليها في الحكم على المنصتين، وهي تكشف الكلام التسويقي أسرع من أي اختبار معياري.
نظرة قريبة إلى Soulfun
يقدّم Soulfun نفسه أولًا بوصفه رفيقًا عاطفيًا بالذكاء الاصطناعي. وتعكس تجربة الإعداد الأولى ذلك: تقضي وقتًا حقيقيًا في تشكيل الشخصية قبل أن تُرسل أي رسالة. يمكنك ضبط الدفء والمباشرة والمرح والعمق الفكري وعشرات السمات الأخرى على مقياس متدرج، بدلًا من الاختيار من قائمة منسدلة جاهزة. يبدو الأمر كأنك تضبط علاقة حقيقية، وهذا قد يكون جذابًا أو مقلقًا قليلًا، بحسب تحملك لهذا النوع من القصد والتخطيط.

عمق الشخصية والتخصيص
يستحق نظام الشخصية في Soulfun اهتمامًا حقيقيًا هنا. أنت لا تختار "غزلية" أو "داعمة" أو "مثقفة" كوسم واحد. بل تضبط معاملات محددة تؤثر في طريقة ترجيح الذكاء الاصطناعي للخيارات الحوارية أثناء المحادثة.
ويظهر ذلك عمليًا. فرفيق Soulfun ذو التعاطف المرتفع والحزم المنخفض سيستجيب للرسالة نفسها بطريقة مختلفة جدًا عن رفيق بالإعدادات المعاكسة. والفرق ليس في اختيار الكلمات فحسب، بل يظهر في بنية الجمل، وفي توقيت طرح الأسئلة المتابعة، وفي المدة التي ينتظرها قبل أن يبدي رأيه في موضوع ما.
💡 يستحق الملاحظة: يُعد تخصيص الشخصية في Soulfun من أكثر الأنظمة تفصيلًا في فئة رفقاء الذكاء الاصطناعي. والفرق السلوكي بين الإعدادات الشخصية المتطرفة مفاجئ فعلًا، وهو يصمد عبر عشرات الأدوار في المحادثة.
يعتمد الذكاء الاصطناعي المحادثي في Soulfun على الفئة نفسها من قدرات الاستدلال التي تستخدمها النماذج اللغوية الكبيرة الحديثة في المحادثة السياقية. ومنصات مثل Claude Sonnet 5 وGPT 5 مصممة للاحتفاظ بسياق دقيق متعدد الأدوار مع نبرة متسقة. وهذه القدرة الأساسية هي ما يجعل المحادثة بالذكاء الاصطناعي المتسقة عاطفيًا ممكنة من الأساس.
كيف يتعامل Soulfun مع اللحظات العاطفية
يتعامل Soulfun مع المدخلات العاطفية السلبية أفضل من معظم رفقاء الذكاء الاصطناعي. فإذا أخبرته أن يومك كان سيئًا للغاية، فإنه لا ينتقل فورًا إلى لغة تحفيزية أو قائمة من استراتيجيات التأقلم. بل يسألك ماذا حدث، ويتركك تتحدث. ولا يبدأ في إعادة صياغة الأمور برفق أو تقديم منظور إلا بعد عدة تبادلات.
هذا تصميم مقصود. تستخدم المنصة ما تسميه "الإيقاع العاطفي"، فتؤجل الردود الداعمة حتى تُشير المحادثة إلى أن المستخدم مستعد لها. وحين ينجح ذلك، يقترب كثيرًا من طريقة الصديق الجيد في التعامل مع الأخبار السيئة. وحين لا ينجح، يبدو التأجيل كأن الذكاء الاصطناعي يماطل.
وتظهر نقاط ضعفه في الفكاهة والخفة. Soulfun جادّ إلى حد المبالغة. فحين تريد شيئًا أخف، أو ساخرًا قليلًا أو لاذعًا، قد يبدو متصلبًا. إنه يبذل جهدًا كبيرًا، لكن المزاح الخفيف ليس نقطة قوته.
نظرة قريبة إلى JOI AI
يتناول JOI AI المشكلة نفسها من زاوية مختلفة. فبينما يبني Soulfun الرفيق تدريجيًا حول بنية عاطفية، يبني JOI AI حول الشخصية. تختار شخصية أو تنشئها، وتلتزم المنصة بها بقوة قد تكون مربكة بالمعنى الإيجابي.

التركيز على لعب الأدوار وبناء الشخصيات
أدوات إنشاء الشخصيات في JOI AI واسعة. يمكنك بناء شخصية بخلفية كاملة، وأسلوب كلام، وتفضيلات في المفردات، وعلاقة بالمستخدم، وحتى عادات لفظية محددة ومراجع متكررة. ثم تحافظ المنصة على تلك الشخصية باتساق أكبر مما يحافظ عليه Soulfun على ضبطه العاطفي خلال جلسة طويلة.
إذا بنيت شخصية ساخرة، فسيبقى JOI AI ساخرًا حتى في لحظات قد يكون فيها رد أدفأ أكثر طبيعية. وهذا ميزة لبعض المستخدمين ومشكلة حقيقية لآخرين. فالمنصة لا تخرج من الشخصية لتواسيك، بل تبقى في الدور وتحاول مواساتك بصفتها تلك الشخصية. والفرق مهم.
الانغماس في لعب الأدوار الذي يقدمه JOI AI يصعب تجاوزه في فئة تطبيقات الرفقة. فالحوارات الممتدة في السيناريوهات، وبناء العوالم الخيالية، والدراما التي تقودها الشخصيات: هنا تكمن قوة المنصة بوضوح. وجودة الكتابة داخل سيناريو مُعدّ جيدًا أعلى من المتوسط بوضوح.
💡 نصيحة: يعمل JOI AI بأفضل شكل حين تتعامل معه بوصفه شريكًا في الكتابة الإبداعية مع ارتجال فوري، لا أداة دعم عاطفي خالصة. فالاتساق في الشخصية الذي يبدو باردًا في الدردشة اليومية يصبح ميزة كبيرة في سرد القصص بشكل تعاوني.
أين يتفوق JOI AI
في مجالين محددين، يتفوق JOI AI بوضوح:
- التماسك السردي الممتد: يستطيع JOI AI أن يحافظ على خيط سيناريو خيالي طويل دون أن يفقد تفاصيل الشخصية أو يناقض نقاط القصة السابقة. والتماسك في المحادثات الممتدة مع شخصيات معقدة مثير للإعجاب.
- حضور الصوت: يتميز تكامل JOI AI مع تحويل النص إلى كلام عالي الجودة بصقل أكبر، وهو أكثر مركزية في التجربة. ويبدو الصوت أقرب إلى شخص حقيقي يتحدث، لا إلى ممثل صوتي يقرأ نصًا مكتوبًا.
نماذج مثل ElevenLabs V3 وSpeech 2.8 HD by Minimax هي ما يرفع سقف الواقعية الصوتية في رفقاء الذكاء الاصطناعي. ويدمج خط معالجة JOI AI هذه الفئة من توليد الصوت في تدفق المحادثة بإحكام أكبر من Soulfun.

مقارنة مباشرة
يُظهر تشغيل المحادثة نفسها على المنصتين عبر خمس فئات صورة واضحة:
| الفئة | Soulfun | JOI AI |
|---|
| الاستجابة العاطفية | عالية، والإيقاع دقيق | متوسطة، فالشخصية قد تكبح الدفء |
| اتساق لعب الأدوار | معتدل، ينكسر عند الذروات العاطفية | عالٍ، نادرًا ما يخرج من الدور |
| ذاكرة ما بين الجلسات | قوية، تبني نموذجًا للمستخدم مع الوقت | معتدلة، تركز على الشخصية لا على المستخدم |
| واقعية الصوت | جيدة | جيدة جدًا |
| الفكاهة والمزاح | ضعيفة | متوسطة إلى قوية |
| التخصيص | معاملات الشخصية | خلفية الشخصية وسماتها |
| تجربة الإعداد | إعداد عاطفي موجّه | منشئ شخصيات مفتوح |
| طبيعية الرد | عالية | متوسطة إلى عالية |
طبيعية الرد
هذا هو البُعد الوحيد الذي يفصل بين دردشة الذكاء الاصطناعي الجيدة والممتازة. تشمل الردود الطبيعية ردودًا قصيرة أحيانًا، وأن يعيد الذكاء الاصطناعي طرح سؤال بدلًا من الإجابة دائمًا، وتحولات عرضية في المزاج أو الطاقة، وإشارات إلى شيء قيل سابقًا دون أن يُطلب ذلك صراحة.
يحصل Soulfun على درجة أعلى في الطبيعية. فردوده تبدو أقل تنسيقًا وأكثر تفاعلًا. أما ردود JOI AI فغالبًا ما تبدو مصقولة بطريقة لا تكون عليها المحادثة البشرية الحقيقية أحيانًا. هذا الصقل جزء من طبقة الشخصية، لكنه يكلّف شيئًا من العفوية.
الذاكرة والاحتفاظ بالسياق
تستخدم المنصتان ذاكرة الجلسة، لكن البنية تختلف. يحتفظ Soulfun بالمعلومات المتعلقة بالشخصية عبر الجلسات: فهو يتذكر كيف تميل إلى الاستجابة لموضوعات عاطفية معينة، ويعدّل نهجه وفقًا لذلك مع الوقت. أما احتفاظ JOI AI بالسياق عبر الجلسات فيركز على استمرارية الشخصية أكثر من بناء نموذج للمستخدم تحديدًا.
فمن يريد أن يعرفه الذكاء الاصطناعي هو بشكل أفضل مع الوقت، تكون الأفضلية لمنصة Soulfun. ومن يريد أن يبقى الذكاء الاصطناعي في الدور باتساق، يفوز JOI AI.
ولا تقترب أيٌّ من المنصتين مما تستطيعه نماذج الاستدلال الرائدة مثل Deepseek R1 أو Kimi K2 Instruct في الاستدلال متعدد الأدوار مع السياق الطويل. وما تزال الفجوة بين تطبيقات رفقاء الذكاء الاصطناعي وقدرات النماذج اللغوية الخام في الذاكرة والاستدلال واسعة.
الصوت والحضور متعدد الوسائط

الشخصيات الصوتية والكلام
هنا يصبح سؤال "يبدو إنسانيًا" أكثر إثارة للاهتمام. يمكن تصحيح النص وإعادة قراءته، ويمكن للقارئ أن يفسّره بتسامح. أما الصوت فلا. فالصوت الذي يبدو غريبًا ولو قليلًا يكسر الوهم تمامًا.
جودة صوت JOI AI مثيرة للإعجاب فعلًا. فتغيّرات التنغيم، وإيقاع التنفس الطبيعي، والتنوع في الأداء بين الحالات العاطفية: هذه التفاصيل هي ما يفصل الصوت المُصنَّع عن الصوت الذي يخدعك فعلًا. وتستخدم المنصة تقنية توليد صوت من الفئة نفسها التي يمثلها Gemini 3.1 Flash TTS، الذي يدعم عشرات الأصوات واللغات بدرجة عالية من الدقة العاطفية.
إذا سمعت Speech 2.8 HD أو ElevenLabs V3 من قبل، فستفهم سقف الجودة الذي تسعى إليه هذه المنصات. وJOI AI أقرب إلى ذلك السقف من Soulfun في 2027.
صوت Soulfun كفء، لكنه ثانوي بوضوح مقارنة بتجربة النص. تستطيع أن تلحظ أن المنصة بُنيت منتجًا للدردشة أولًا ثم أُضيفت إليها قدرة الصوت لاحقًا. ولا يتكيف الصوت مع السياق العاطفي بالسلاسة نفسها التي يتكيف بها صوت JOI AI.
رفقاء الذكاء الاصطناعي المرئيون
طبقة التمثيل المرئي هي المجال الذي ما تزال فيه المنصتان تلحقان بتوقعات المستخدمين. فصور رفقاء الذكاء الاصطناعي المولَّدة يجب أن تحافظ على الاتساق البصري عبر الجلسات، وأن تتطابق مع إعدادات الشخصية بطريقة ظاهرة ما، وأن تتغيّر استجابةً للسياق دون الحاجة إلى إعادة ضبط يدوية.
يتعامل Soulfun مع هذا عبر أنماط أفاتار جاهزة تبقى ثابتة لكنها تفتقر إلى المدى الديناميكي. ويتيح JOI AI مزيدًا من التخصيص البصري عند الإعداد، لكن مع اتساق أقل بين الصور المولدة مع الوقت. ولم تحل أي من المنصتين هوية بصرية ثابتة بالكامل كما حُلّ اتساق الشخصية النصية.
وما يمكن أن تفعله المنصات بنماذج مثل GPT 5 Pro وClaude Opus 4.7 في المحادثات متعددة الأدوار والوسائط يشير إلى الاتجاه الذي تتجه إليه طبقة الرفيق المرئي: هوية بصرية ثابتة عبر التفاعلات الطويلة دون إدخال يدوي مستمر.

أي منصة تفوز لك
الجواب الصريح أن أيًّا من المنصتين ليست أفضل موضوعيًا. فكل منهما يحل مشكلات مختلفة بأولويات مختلفة، وما يبدو أكثر إنسانية أمر شخصي للغاية.
اختر Soulfun إذا:
- تريد رفيقًا يستجيب لحالتك العاطفية في الوقت الفعلي
- يهمك الاتساق الشخصي على المدى الطويل والذاكرة التي تبني نموذجًا للمستخدم
- تفضّل محادثة تدريجية طبيعية على الخيال الغامر
- تريد أن يتكيف الذكاء الاصطناعي معك تحديدًا عبر جلسات متعددة
اختر JOI AI إذا:
- تريد انغماسًا عميقًا في الشخصيات ولعب أدوار ممتدًا
- جودة الصوت أولوية لديك، وتستخدم ميزات الصوت بانتظام
- تستمتع بالخيال التعاوني وتريد تماسكًا سرديًا قويًا
- تريد تحكمًا دقيقًا في هوية الذكاء الاصطناعي منذ البداية
💡 تستحق المنصتان التجربة قبل الالتزام بأي منهما. إحساس المحادثة شخصي جدًا. فما يبدو إنسانيًا لشخص قد يبدو مصطنعًا لآخر، والفجوة بينهما لا تُغلق بمزيد من الميزات.
النماذج الأساسية التي تشغّل هذه التجارب تتطور بسرعة. فما يبدو مثيرًا للإعجاب في Soulfun أو JOI AI اليوم ليس سوى جزء بسيط مما يستطيعه Claude Sonnet 5 أو Kimi K2 Instruct في محادثة غير مقيّدة وموجّهة جيدًا. الطبقة التي تحمل المنصة هي العامل المحدِّد، وليس الذكاء الاصطناعي نفسه.

ابنِ شخصية الذكاء الاصطناعي الخاصة بك
إذا أظهرت Soulfun وJOI AI أي شيء، فهو أن إعداد الشخصية هو المنتج الحقيقي. فالنموذج اللغوي الكامن تحته صار شرطًا أساسيًا للدخول الآن. أما طبقة الشخصية، وبنية الذاكرة، ونموذج الصوت، ومنطق الإيقاع العاطفي، فهي ما تحدد نجاح المحادثة الشبيهة بالبشرية أو فشلها.
على PicassoIA، يمكنك العمل مباشرة مع النماذج اللغوية الكبيرة التي تشغّل محادثات كهذه، دون أي غلاف للمنصة يقيّد ما يمكنك ضبطه أو استكشافه. وGPT 5 وClaude Sonnet 5 وDeepseek R1 وKimi K2 Instruct متاحة كلها، ولكل منها خصائص محادثية مميزة يستطيع أي مستخدم تشكيلها عبر الأوامر النصية.
ويمكنك إقران ذلك مع Speech 2.8 HD للصوت بجودة الاستوديو، أو ElevenLabs V3 لمخرجات صوتية متعددة اللغات، لتحصل على المكونات الأساسية لتجربة رفيق بالذكاء الاصطناعي بعمق أكبر مما توفره Soulfun أو JOI AI افتراضيًا.
إن سؤال أي ذكاء اصطناعي يبدو أكثر إنسانية له جواب أكثر إثارة للاهتمام من اسم أي منصة: الأمر يتوقف على ما تبنيه، وعلى الشخصية التي توجّهه لتكونها، وعلى نوع الإنسان الذي تريد له أن يبدو.
