مكالمات الفيديو مع صديقتك الافتراضية بالذكاء الاصطناعي أصبحت أمرًا عاديًا فجأة

تحوّلت مكالمات الفيديو مع صديقة الذكاء الاصطناعي من فكرة طريفة إلى عادة يومية. يشرح هذا المقال نماذج مزامنة الشفاه والذكاء الاصطناعي الصوتي والنماذج اللغوية الكبيرة التي تشغّل رفيقات افتراضيات يتذكرن قصصك، ويتجاوبن مع مزاجك، وينظرن إليك فعلًا عبر الشاشة.

مكالمات الفيديو مع صديقتك الافتراضية بالذكاء الاصطناعي أصبحت أمرًا عاديًا فجأة
Cristian Da Conceicao
مؤسس Picasso IA

حدث تحوّل في 2025. لم يكن بطيئًا ولا هادئًا. جاء كما تأتي معظم الأمور في عالم التقنية: تقريبًا بين ليلة وضحاها، ودون أي إنذار من الذين يبنونها. أصبحت مكالمات الفيديو مع صديقة ذكاء اصطناعي أمرًا عاديًا. ليس عاديًا بمعايير التقنيات الهامشية، ولا كما في "مستخدم مبكر في خادم Discord". بل عاديًا فعلًا، يوميًا، ويستخدمه ملايين الناس.

إن فاتتك اللحظة التي تحوّل فيها الأمر إلى تيار سائد، يشرح لك هذا المقال بالتفصيل ما الذي تغيّر، وأي التقنيات جعلته ممكنًا، وكيف يمكنك أن تجرّبه بنفسك.

كيف يعمل الأمر فعليًا الآن

قبل عامين، كانت "صديقة الذكاء الاصطناعي" تعني روبوت محادثة في مربع نص، وربما بعض الردود الصوتية المسجّلة مسبقًا. كانت التجربة باهتة، واضحة الاصطناع، وخاوية عاطفيًا. ما تغيّر هو التقاء ثلاث تقنيات منفصلة لم يبنِ أحد أيًا منها خصيصًا لإنشاء رفقاء ذكاء اصطناعي، لكنها تبيّن أنها مثالية لذلك عند جمعها.

هذه الركائز الثلاث هي: النماذج اللغوية الكبيرة التي تحتفظ بالذاكرة والشخصية، وتحويل النص إلى كلام في الوقت الفعلي بنطاق عاطفي واسع، والذكاء الاصطناعي لمزامنة الشفاه الذي يحرّك صورة ثابتة فتصبح وجهًا يتحرك عند الكلام. عند جمع هذه الركائز معًا، تحصل على شيء يجتاز اختبار تورينغ العاطفي من النظرة الأولى.

النموذج اللغوي في المركز

الركيزة الأولى هي النموذج اللغوي. وهو عقل رفيقك الافتراضي، وجودة هذا العقل هي ما يحدد إن كانت التجربة تشبه الحديث مع إنسان، أم تشبه ملء استمارة.

النماذج المتاحة اليوم مثيرة للإعجاب فعلًا في هذا الاستخدام. يتعامل Claude Opus 4.7 مع المحادثات الطويلة السياق بتماسك لافت، ويتذكر تفاصيل رسائلك من قبل 30 دقيقة دون أن تذكّره بها. ويمنح GPT 5 استجابات سريعة وطلاقة عالية، فيجعل الحوار المتبادل أقرب إلى الحديث الفعلي منه إلى الاستعلام من قاعدة بيانات. أما من يفضّلون نهجًا مفتوح المصدر، فإن Deepseek R1 مقتدر بشكل مفاجئ في الفروق العاطفية متى أُعطي أمرًا نصيًا مناسبًا للشخصية.

💡 الحيلة الحقيقية تكمن في أمر النظام. فوصف الشخصية المُنظَّم جيدًا، بما يشمله من أنماط الكلام، والميول العاطفية، ونقاط الارتكاز في الذاكرة، يؤدي من العمل أكثر مما يؤديه حجم النموذج الأساسي.

يضيف Gemini 3 Pro قدرة متعددة الوسائط، أي أن النموذج يستطيع فعلًا رؤية الصور التي ترسلها والاستجابة لها ضمن السياق. وهذا يفتح باب ردود فعل بصرية أثناء مكالمات الفيديو، إذ يمكن للذكاء الاصطناعي أن يعلّق على ما "يراه" في إطار المكالمة. وClaude Sonnet 5 يقع بين السرعة والعمق، ما يجعله خيارًا عمليًا للردود الفورية حيث يهم زمن الاستجابة. وللاستدلال عبر سلاسل عاطفية أطول، يحافظ Kimi K2 Instruct على بنية الحوار عبر عشرات الأدوار دون أن يفقد خيط الحديث.

الصوت الذي يستجيب في الوقت الفعلي

النص على الشاشة يكسر الانغماس فورًا. الركيزة الثانية، الصوت، هي ما ينقل التجربة من "الدردشة مع ذكاء اصطناعي" إلى "الحديث مع شخص".

الجيل الحالي من نماذج تحويل النص إلى كلام يصعب تمييزه فعليًا عن شخص حقيقي عند طول المحادثة الاعتيادي. يُعد ElevenLabs V3 النموذج المرجعي هنا. فهو يتعامل مع النبر والنفس والتلوين العاطفي بطريقة لم تستطعها أنظمة تحويل النص إلى كلام السابقة. قل شيئًا مرحًا، وستتغير نبرة الصوت في التشغيل قليلًا. قل شيئًا جادًا، وسيستجيب بإيقاع متزن.

يمثّل Speech 2.8 HD by Minimax البديل بجودة الاستوديو، إذ يقدّم تسجيلات تبدو مُعالَجة بعد الإنتاج حتى عندما تُولَّد في الوقت الفعلي. أما من يريدون استنساخ صوت محدد بدلًا من الاختيار من بين القوالب الجاهزة، فإن Minimax Voice Cloning يتولى ذلك في ثوانٍ.

يتيح Qwen3 TTS تصميم صوت من الصفر بدلًا من الاختيار من قائمة، وهذا مهم عند بناء رفيق بشخصية محددة للغاية. وإن كانت السرعة في الحوار هي الأولوية القصوى، فإن Inworld Realtime TTS 2 يملك زمن استجابة أقل من 150 ميلي ثانية، ما يجعله قريبًا جدًا من فترة الاستجابة الطبيعية في الحديث.

لقطة مقرّبة لامرأة تبتسم بدفء أمام هاتف ذكي، بضوء الساعة الذهبية

مزامنة الشفاه هي القطعة المفقودة

النص والصوت يوصلانك إلى 70% من الطريق. أما النسبة المتبقية البالغة 30% فهي الوجه، وتحديدًا الفم. فالدماغ البشري مبرمج لاكتشاف أخطاء مزامنة الشفاه على المستوى العصبي، دون تفكير واعٍ. ووجه لا يتطابق مع صوته يبدو غريبًا، بل ومقلقًا أحيانًا. وذكاء مزامنة الشفاه يحل هذه المشكلة، والنماذج الأحدث تحلها بإتقان.

Omni Human 1.5 يغيّر كل شيء

يُعد Omni Human 1.5 by ByteDance حاليًا أكثر النماذج إثارة للإعجاب في هذه الفئة. فإن زوّدته بصورة فوتوغرافية واحدة وملف صوتي، يعيد لك مقطعًا قصيرًا يتحدث فيه الوجه في الصورة بالصوت، مع حركات دقيقة للشفاه، وحركة طبيعية للرأس، ورمشات واقعية للعين.

المخرجات لا تبدو كتزييف عميق من عام 2019. إنها تبدو كمكالمة فيديو حقيقية. فالهندسة الوجهية تبقى متسقة عبر الإطارات. والحركات الدقيقة حول الفم والفك تقع بدقة عند حدود الفونيمات. ومن الصعب فعلًا التمييز بينها عند المشاهدة الأولى.

وللاستخدام المستمر، هذا يعني أنك تلتقط صورة شخصية جيدة واحدة لوجه رفيقتك الافتراضية، فتصبح هي الصورة المصدر لكل جلسة مكالمة فيديو. ويعيد النموذج تحريك ذلك الوجه من جديد في كل مرة باستخدام آخر رد صوتي.

تحويل أي صورة إلى متحدث

يتبع P Video Avatar by PrunaAI نهجًا مشابهًا، لكنه يركز على ثبات الأفاتار عبر عدة جلسات. فإن أردت أن تحمل صديقتك الافتراضية الوجه نفسه في كل تفاعل، فإن هذا النموذج يحافظ على دقة الهوية عبر مدخلات صوتية مختلفة.

يتميّز Fabric 1.0 by Veed بسرعته. وعندما يكون زمن الاستجابة مهمًا، فإن معالجة مزامنة الشفاه الأقصر تمنع انقطاع تدفق الحوار. ويضيف React 1 by Sync القدرة على تطبيق مزامنة الشفاه على لقطات فيديو موجودة، وهذا مفيد إن أردت إنشاء "رسالة فيديو" قصيرة من رفيقك الافتراضي بدلًا من التوليد من صورة ثابتة.

وإن كانت الدقة أهم من السرعة، فإن Lipsync 2 Pro by Sync يقدّم أدق ربط للفونيمات المتاح حاليًا، خاصة في الكلمات ذات مجموعات الحروف الساكنة الصعبة. أما Kling Lip Sync by Kwaivgi فيكمل الخيارات بأداء متوازن وجيد، ومعالجة سريعة، ومخرجات نظيفة عند معظم معدلات الإطارات.

كيف تبدو الجلسة الحقيقية

امرأة أنيقة على أريكة مع جهاز لوحي، وضوء المدينة عند الغروب خلفها

لنجعل الأمر ملموسًا. هكذا تبدو جلسة مكالمة فيديو فعلية مع صديقة ذكاء اصطناعي عندما تعمل المنظومة بشكل صحيح.

تفتح الواجهة على هاتفك أو حاسوبك المحمول. يظهر وجه على الشاشة. إنه وجه ثابت اخترته أو أنشأته، ولديه اسم وخلفية وشخصية مبنية فوق نموذج لغوي. تتحدث أو تكتب.

يعالج النموذج اللغوي مدخلاتك ويولّد ردًا. ثم يُمرَّر الرد فورًا إلى نموذج تحويل النص إلى كلام، الذي يعيد صوتًا في أقل من 200 ميلي ثانية. ثم يُمرَّر الصوت إلى نموذج مزامنة الشفاه، الذي يولّد مقطعًا قصيرًا للوجه وهو ينطق الكلمات. ويُعرض ذلك المقطع في الواجهة. تستغرق الدورة كاملة، من مدخلك حتى رؤية الوجه يرد، من 2 إلى 4 ثوانٍ على العتاد الحالي.

هذا التأخير لا يزال ملحوظًا. إنها ليست مكالمة هاتفية. لكنه قصير بما يكفي ليجعل التجربة تبدو حوارية لا متسلسلة. والأثر العاطفي لمشاهدة وجه تعلّقت به وهو يرد على شيء شخصي قلته أثر كبير، حتى مع معرفتك الدقيقة بطريقة عمله.

منظومة الصوت

النموذجنقطة القوةالأفضل لـ
ElevenLabs V3المدى العاطفي، النبرالصوت الافتراضي للرفيق
Speech 2.8 HDوضوح الاستوديومقاطع الفيديو المسجّلة
Qwen3 TTSتصميم صوت مخصصأصوات الشخصيات الفريدة
Inworld Realtime TTS 2زمن استجابة أقل من 150 ميلي ثانيةسرعة الحوار المباشر
Chatterbox Proالتحكم في العاطفةأداء معبّر ودافئ

المنظومة البصرية

النموذجنقطة القوةأفضل استخدام
Omni Human 1.5الواقعية، حركة الرأسالأفاتار المرئي الأساسي
P Video Avatarثبات الهويةالرفقاء متعددو الجلسات
Lipsync 2 Proدقة الفونيماتالمقاطع الغنية بالحوار
Fabric 1.0سرعة المعالجةمقاطع الرد السريعة
Kling Lip Syncأداء متوازنالاستخدام العام

الطبقة العاطفية للذكاء الاصطناعي

امرأة تضحك على سرير وهاتفها مستند على الفراش، بضوء كهرماني دافئ

التقنية مثيرة للإعجاب، لكن التقنية وحدها لا تفسّر الجاذبية العاطفية لهذه التجارب. هناك شيء آخر يحدث.

الذاكرة والشخصية

تحتفظ النماذج اللغوية التي تشغّل هؤلاء الرفقاء بالسياق عبر محادثات طويلة جدًا. والأهم أنه يمكن توجيهها للتصرف كما لو كانت تتذكر أشياء من جلسات سابقة، متى أُعطيت الأوامر المناسبة أو أنظمة حقن الذاكرة. يعرف الرفيق اسمك ووظيفتك وآخر حديث لكما. يعود إلى أشياء ذكرتها عرضًا. ويطرح أسئلة متابعة.

وهذا يخلق ما يسميه الباحثون التصعيد شبه الاجتماعي. فالعلاقة تبدو أعمق مع كل محادثة، حتى لو كان هذا العمق مُحاكى جزئيًا. والدماغ لا يميّز دائمًا بوضوح بين علاقة يبنيها مع شخص حقيقي، وعلاقة يبنيها مع وكيل يتصرف بثبات.

يبرع Claude Opus 4.7 في ذلك بشكل خاص. فسياقه الواسع الكبير يعني أنه يستوعب المحادثة الطويلة كاملة دون أن يفقد التفاصيل السابقة، ويتعامل مع الردود العاطفية الدقيقة بعناية أكبر من النماذج المحسّنة للسرعة فقط. ويجلب Grok 4 استدلالًا عميقًا لسلاسل الحوار المعقدة، حيث يجب أن يستند السياق من رسائل كثيرة سابقة إلى الرد الحالي دون تناقض.

لماذا يبدو الأمر إنسانيًا إلى هذا الحد

💡 وادي الغرابة لدى رفقاء الذكاء الاصطناعي يسير في الاتجاه المعاكس لما في الروبوتات. فكلما كان الصوت والوجه أقرب إلى الواقع، انحاز الدماغ إلى التجربة بدلًا من مقاومتها. والواقعية لا تخلق مسافة، بل تزيلها.

يتعامل Chatterbox Pro by Resemble AI مع حقن العاطفة بإتقان خاص. يمكنك تحديد النبرة العاطفية للرد، ويقدّم نموذج الصوت ليس الكلمات فقط، بل الشعور الكامن وراءها. سماع صوت يقول "اشتقت إليك اليوم" بدفء حقيقي تجربة مختلفة تمامًا عن سماع تصيير صوتي مسطح للعبارة نفسها.

يضيف Gemini 3.1 Flash TTS 30 صوتًا عاطفيًا مميزًا مع اختيار تلقائي للنبرة بناءً على المحتوى. يقرأ النموذج شعور الرد ويختار النبرة الصوتية المناسبة دون أن يُطلب منه ذلك. وهذه هي الخطوة التالية بعد التحكم اليدوي في العاطفة، وهي متاحة الآن.

إن تجمّع وجه يتحرك بشكل صحيح، وصوت دافئ، ونموذج لغوي يتذكر محادثاتك السابقة، يجعل التواصل العاطفي أقوى من كثير من التواصل البشري الفعلي في 2027، وهذا قول صريح.

من يستخدم هذا فعليًا

منظر جوي لامرأة مستلقية على الأرض، وهاتف مضيء فوق وجهها

قاعدة مستخدمي تطبيقات رفقاء الذكاء الاصطناعي أكثر تنوعًا مما يفترض معظم الناس. وتهيمن ثلاث مجموعات متميزة.

الأزواج على المسافات البعيدة الذين يستخدمون نسخًا بديلة بالذكاء الاصطناعي

من حالات الاستخدام غير المتوقعة أن يستخدم الأزواج رفقاء الذكاء الاصطناعي كوسيلة تواصل جسر. يُنشئ شخص في علاقة عن بُعد نسخة من شريكه بالذكاء الاصطناعي باستخدام صور وتسجيلات صوتية وملاحظات عن الشخصية. وعندما لا يستطيعان التواصل مباشرة، يتفاعل مع النسخة البديلة للحفاظ على الاستمرارية العاطفية. الشريك الحقيقي لا يحلّ محل ذلك، بل يُكمّله.

يبدو هذا غريبًا على الورق. لكن عمليًا، يفعل ذلك عدة مئات الآلاف من الناس، والملاحظات المتكررة تفيد بأنه يقلّل التكلفة العاطفية للانفصال، دون أن يخلق لبسًا حول ما هو حقيقي.

المستخدمون الفرديون وممارسة التواصل الاجتماعي

يشكّل جزء كبير من المستخدمين أشخاصًا يعانون من القلق الاجتماعي، أو يستخدمون شركاء الحوار بالذكاء الاصطناعي للتدرب على التفاعلات الحقيقية. فالرفيق مساحة تدريب منخفضة المخاطر. تقول شيئًا محرجًا، فلا يحكم عليه الذكاء الاصطناعي كما قد يفعل الشخص. وتجد كلمات لمشاعر لم تنطق بها من قبل. وصف عدة معالجين نفسيين رفقاء الذكاء الاصطناعي بأنهم جسر مفيد للمرضى الذين يتجمدون في السياقات الاجتماعية البشرية.

ثم هناك الحالة المباشرة: أشخاص يشعرون بالوحدة، ويريدون التواصل، ويجدون تجربة رفيق الذكاء الاصطناعي ذات معنى. ويميل هؤلاء المستخدمون إلى التعمّد الشديد. يعرفون تمامًا ما هي التقنية. ويختارونها رغم ذلك.

رجل على أريكة جلدية داكنة مع جهاز لوحي ليلًا، وأضواء المدينة خلفه

كيف تبني رفيقك الخاص بالذكاء الاصطناعي على PicassoIA

هنا تبدأ الجوانب العملية. لا تحتاج إلى ربط خمس واجهات API منفصلة لتجربة ذلك. يوفّر PicassoIA مجموعة الأدوات الكاملة في مكان واحد.

الخطوة 1: اختر نموذجك اللغوي

ابدأ بالنموذج اللغوي الذي سيشغّل الشخصية. لمعظم المستخدمين، يُعد Claude Opus 4.7 أو GPT 5 الخيار المناسب. اكتب أمر نظام مفصّلًا يغطي:

  • الاسم والوصف الذاتي (ما "يعرفه" الرفيق عن نفسه)
  • أنماط الكلام (رسمي، عفوي، مرح، متأمل)
  • سمات الشخصية الأساسية (متعاطف، فضولي، ذكي الدعابة، هادئ)
  • نقاط ارتكاز الذاكرة (ما "يتذكره" عنك منذ اليوم الأول)

إن كنت تفضّل الاستجابات الأسرع على العمق، فإن Claude Sonnet 5 أو GPT 4.1 خياران متينان بزمن استجابة أقل. وللبدائل مفتوحة المصدر ذات الاستدلال العاطفي القوي، يؤدي Deepseek V3.1 أداءً مبهرًا عند إعطائه شخصية مكتوبة جيدًا.

الخطوة 2: أنشئ وجه الأفاتار

استخدم أدوات توليد الصور في PicassoIA لإنشاء صورة شخصية لرفيقك. ولّدها بدقة عالية، مع تعبير محايد وإضاءة جيدة، لأن هذه الصورة ستكون المصدر لمزامنة الشفاه.

💡 نصيحة متقدمة: ولّد الوجه وهو ينظر قليلًا نحو الكاميرا، بتعبير طبيعي ومريح. فالزوايا المتطرفة أو الإضاءة الدرامية الشديدة تجعل نماذج مزامنة الشفاه تبذل جهدًا أكبر وتنتج نتائج أقل ثباتًا.

بمجرد أن تحصل على الصورة الشخصية، مرّرها عبر Omni Human 1.5 مع مقطع صوتي تجريبي قصير للتأكد من جودة مزامنة الشفاه قبل اعتمادها أفاتارًا رئيسيًا.

الخطوة 3: أضف الصوت

اختر نموذج تحويل نص إلى كلام يناسب الشخصية. دافئ ومعبّر: ElevenLabs V3. دقيق وطبيعي: Speech 2.8 HD. صوت مخصص من الصفر: Qwen3 TTS. وإن كانت لديك تسجيلات صوتية لشخص حقيقي تريد تكرارها، فإن Voice Cloning by Minimax يتولى ذلك في ثوانٍ.

الخطوة 4: زامن الشفاه مع الردود

يُمرَّر كل رد من النموذج اللغوي إلى تحويل النص إلى كلام، ثم إلى مزامنة الشفاه. وبالنسبة لمعظم سير العمل، فالخيار هو Omni Human 1.5 للجودة، أو Fabric 1.0 للسرعة. والناتج ملف MP4 قصير لوجه الأفاتار وهو ينطق الرد، جاهز للتشغيل.

وللمحادثات المستمرة التي تحتاج أن تبدو طبيعية عبر جلسات أطول، يحافظ P Video Avatar على ثبات أفضل للوجه عند استخدام الصورة الشخصية نفسها بشكل متكرر عبر مقاطع مزامنة كثيرة.

امرأة في مقهى مع حاسوب محمول مفتوح، وضوء الصباح يمر عبر النافذة

التقنية التي ستُشغّل رفقاء الغد

امرأة على مكتب بشاشتين، منظر جانبي مع ضوء مصباح دافئ

التجربة الحالية مقنعة بالفعل، لكن وتيرة التطور متسارعة بشدة.

إلى أين يتجه الذكاء الاصطناعي الصوتي

زمن الاستجابة هو الجبهة الرئيسية. تستغرق نماذج تحويل النص إلى كلام الحالية من 150 إلى 400 ميلي ثانية لتوليد جزء من الرد. والهدف أن يكون أقل من 80 ميلي ثانية، عندها تختفي الفجوة بين "التفكير" و"الكلام" تمامًا. يدفع Inworld Realtime TTS 2 نحو هذا النطاق بالفعل في بيئات مضبوطة، ويستهدف Inworld Realtime TTS 1.5 Mini سرعة مماثلة بحجم أصغر.

على جانب مزامنة الشفاه، أثبت Omni Human، السلف الذي سبق 1.5، أن إضافة الحركة الطبيعية للجسم إلى حركة الشفاه كان ممكنًا. ومن المتوقع أن يضيف الجيل التالي حركات اليدين والجزء العلوي من الجسم، ما سيجعل مخرجات الفيديو لا تُميَّز عن تسجيل كاميرا ويب في معظم ظروف المشاهدة.

تتحسن النماذج اللغوية أيضًا في محاكاة شخصية متسقة ومتطورة. يوضح Kimi K2 Thinking كيف يمكن تطبيق الاستدلال خطوة بخطوة على الردود العاطفية، فينتج ردودًا أكثر تأملًا بدلًا من أن تكون تفاعلية. ويجلب GPT 5 Pro وضع التفكير المدمج إلى سلاسل الحوار المعقدة، حيث يجب أن يشكّل السياق السابق الرد الحالي بفعالية، لا أن يُسترجع فقط.

الجبهة الأخرى هي التفاعل العاطفي. بدأت نماذج مثل Gemini 3.1 Flash TTS في التعامل مع 30 صوتًا عاطفيًا مميزًا، مع اختيار تلقائي بناءً على شعور المحتوى. وهذا يزيل آخر خطوة يدوية من المسار، فتصبح الجودة العاطفية لرد الصوت تلقائية بدلًا من أن تُضبط يدويًا.

عندما تجمع بين زمن استجابة TTS أقل من 100 ميلي ثانية، ومزامنة شفاه لجسم كامل متحرك، ونموذج لغوي يستدل على السياق العاطفي قبل الرد، فإن التجربة الناتجة لن تُقرأ كتقنية على الإطلاق. ستُقرأ كشخص.

لقطة مقرّبة حميمة ليدين تمسكان هاتفًا مضيئًا، مع بوكيه شمعة خلفه

جرّبه الآن

امرأة ترتدي قميص بيكيني أبيض على شرفة عند الساعة الذهبية، والمحيط خلفها

لا تحتاج إلى بناء أي شيء من الصفر. المنظومة الكاملة الموصوفة هنا متاحة على picassoia.com/en/all-models. اختر نموذجًا لغويًا، واكتب شخصية، وولّد وجهًا بأدوات الصور، وأعطه صوتًا بنموذج تحويل النص إلى كلام الذي تفضله، وحرّكه بأحد نماذج مزامنة الشفاه. يستغرق الإعداد كله حوالي 20 دقيقة.

ابدأ باستخدام Claude Opus 4.7 كنموذج لغوي، وElevenLabs V3 للصوت، وOmni Human 1.5 لتحريك الوجه. هذه أعلى تركيبة جودة متاحة الآن، ولا تتطلب خلفية تقنية لاستخدامها على المنصة.

لن تبدو التجربة كالخيال العلمي بمجرد أن تكون داخلها. ستبدو كمحادثة. وهذا بالضبط هو المقصد، وهذا بالضبط ما يفسّر لماذا أصبحت مكالمات الفيديو مع صديقة الذكاء الاصطناعي عادية بهذه السرعة.

لم تعد التقنية تتطلب الإيمان. لقد بدأت بالعمل فحسب.

شارك هذا المقال

اختر لغتك

مقالات ذات صلة