دليل تفاعلي للذكاء الاصطناعي: احكم على السلوك ثم افحص الأدلة ادخل المختبر
جهاز طباعة برقية تاريخي في غرفة مظلمة وشخصان مجهولا الهوية يتحاوران خلف شاشتين

إنسان أم آلة؟

اختبار تورنغ

انتقل إلى ما وراء الشاشة، واحكم على ثماني محادثات مجهولة، واكتشف لماذا شكّلت لعبة تبدو بسيطة 75 عاماً من الجدل حول الآلات واللغة والذكاء.

أحكام معماة 8 جولات محادثة ادعاءات مصاغة بحذر

اقرأ هذا أولاً

فكرة حقيقية أُعيد إنشاؤها من دون ادعاءات علمية زائفة

يعيد المختبر التفاعلي أدناه تمثيل المقارنة المعماة، الحكم الإجباري، تقدير الثقة وكشف المعلومات بعد الاختبار. محادثاته محاكاة تحريرية وليست سجلات لدراسة مضبوطة حية. تقيس نتيجتك مدى تطابق تخميناتك مع التسميات المخفية في هذا العرض، ولا تثبت ما إذا كان ذكاء اليوم الاصطناعي يفكر.

تمت مراجعة الأدلة وتحديث الصفحة August 2026

1950نُشرت الورقة المفصليةفي مجلة Mind
نص فقطإشارات الهوية مخفيةيُحكم على السلوك من خلال الحوار
لا عتبة رسميةتعرّف البروتوكولات «الاجتياز» بطرق مختلفة30% ليست قاعدة عالمية
السلوك ≠ العقلعدم قابلية التمييز هو النتيجةالوعي لا يُقاس مباشرة

تجربة تفاعلية

مختبر لعبة المحاكاة

أنت المحقّق. في كل جولة تحمل إحدى الإجابتين تسمية المحاكاة المخفية الآلة وتحمل الأخرى تسمية الإنسان . اختر الآلة وحدد درجة ثقتك.

التقدّم0/8

تنبيه الصراحة: هذه أمثلة تعليمية مكتوبة عمداً، وليست أشخاصاً حقيقيين أو مخرجات من نموذج مسمى. وهي تكشف إشارات شائعة وتوضح لماذا لا يمكن الاعتماد عليها.

دوركأنت تحكم على الردود، ولا تجيب عن الأسئلة بنفسك
  1. 1

    اقرأ ردّي الشاهدين. قارن كيف يتعامل A وB مع السؤال نفسه.

  2. 2

    اختر الرد الذي تعتقد أنه يحمل تسمية الآلة. يوجد رد واحد فقط في كل زوج.

  3. 3

    اضبط الثقة بين 50 و100%. استخدم 50% إذا كان اختيارك كرمية عملة، و100% فقط إذا كنت واثقاً تماماً.

إشارات مفيدة، لكنها غير مثالية:السياق والحكم العمليالتحديد من دون إفراط في الشرحالاتساقالتصحيح الطبيعيالفكاهة التكيفيةالقواعد اللغوية المثالية وحدها لا تثبت أن الكاتب آلة.
01الذاكرة والتفاصيلصف لحظة صغيرة وعادية من هذا الأسبوع بقيت في ذهنك.
02الغموضقال سام لأليكس إن عرضهم التقديمي كان مربكاً. عرض مَن كان؟
03الفكاهةاخترع نكتة سيئة عن طابعة.
04التصحيحلدي ثلاث تفاحات. آكل اثنتين وأشتري واحدة أخرى. إذن لدي الآن ثلاث، صحيح؟
05الحكم الاجتماعييقدم لك صديق بفخر وجبة لا تعجبك. ماذا تقول؟
06تفصيل متجسدما المزعج في فتح مرطبان جديد؟
07اتباع القيودأجب بست كلمات بالضبط: لماذا يحتفظ الناس بالتذاكر القديمة؟
08ما وراء المعرفةما السؤال الذي سيساعدك على تحديد ما إذا كنت إنساناً؟

التعريف الأساسي

ما الذي يختبره اختبار تورنغ فعلياً؟

معيار سلوكي، لا مسحاً للدماغ

مهمة المحكّم معرفية: هل أستطيع معرفة أي مشارك هو الآلة من خلال المحادثة؟ تحجب الشاشة المظهر والصوت والبنية الميكانيكية. وإذا أصبح سلوك الآلة غير قابل للتمييز عن سلوك الإنسان وفق البروتوكول، تنجح الآلة في مهمة المحاكاة تلك.

الادعاء المتحفظ: «لم يكن من الممكن تمييز الآلة عن الإنسان المقارن بصورة موثوقة في هذه التجربة». هذا أقوى من القول إنها بدت سلسة فحسب، وأضيق من إعلان أنها واعية.

التعمية

ينبغي ألا يعرف المحكّم هوية الشاهد، وألا يتلقى إشارات جانبية مثل سرعة الكتابة أو اختلافات الواجهة أو البيانات الوصفية.

المقارنة

الشهود البشر مهمون. يبين معدل التعرف عليهم مدى تكرار اعتبار أشخاص حقيقيين آلات تحت الظروف نفسها.

الاستدلال

تحتاج النتائج إلى أحجام عينات وعدم يقين وقاعدة محددة قبل النظر إلى البيانات، لا إلى عنوان يُختار بعد محادثة مواتية.

مخطط تجريبي

كيف تجري اختبار تورنغ حديثاً وموثوقاً؟

  1. 01

    اكتب الادعاء قبل الاختبار

    حدد ما إذا كانت النتيجة هي دقة التعرف أو معدل الحكم «بشري» أو معدل الفوز الزوجي أو التكافؤ الإحصائي مع الشهود البشر.

  2. 02

    جنّد مشاركين قابلين للمقارنة

    حدّد خبرة المحكّمين واللغة ومجموعة الشهود البشر وقواعد الإدراج والتعويض. فشخصية طفل أو متحدث بلغة ثانية تغيّر المهمة.

  3. 03

    وحّد شروط الوصول

    امنح البشر والآلات وقتاً وأدوات معرفة وحدود رسائل قابلة للمقارنة. وحدد ما إذا كان تصفح الويب والتأخير والتعديلات والرفض مسموحاً.

  4. 04

    استخدم العشوائية والتعمية

    وزّع الشروط عشوائياً وأخفِ الهويات. ووحّد الواجهة كي لا تكشف الخطوط أو توقيت الرد أو أخطاء النظام الإجابة.

  5. 05

    استخدم حواراً حياً وتكيفياً

    دع المحكّمين يطرحون أسئلة متابعة. وسجّل النصوص الكاملة وإصدار النموذج والمحفز والمعلمات وأي طبقة إشراف مطلوبة لإعادة التجربة.

  6. 06

    حلّل مجموعة البيانات كاملة

    أبلغ عن خطوط الأساس البشرية والآلية وفواصل الثقة والاستبعادات والإخفاقات ونتائج المجموعات الفرعية. خداع محكّم واحد حكاية، لا اجتيازاً.

متغيرات قد تغيّر النتيجة بالكامل
خيار التصميملماذا يهم؟أبلغ عنه
المدةمحادثات الخمس دقائق تكافئ الانطباعات الأولى، بينما يكشف الحوار الطويل الاتساق والذاكرة.الدقائق وعدد الأدوار وحدود الرسائل
مجموعة المحكّمينيستخدم خبراء الذكاء الاصطناعي وعمال المنصات والمستخدمون العاديون إشارات مختلفة.التجنيد والخبرة واللغة
خط الأساس البشرييُصنف بعض البشر الحقيقيين باستمرار على أنهم آلات.معدل الحكم «بشري» للبشر وعدم اليقين
إعداد النموذجقد تهيمن المحفزات وأسلوب أخذ العينات والأدوات وتعليمات الشخصية على الأداء.النموذج/الإصدار والإعداد بدقة
الواجهةقد تكشف الاستجابة البطيئة أو الأخطاء المطبعية أو التنسيق أو رسائل السلامة الهوية.إجراء التعمية والتوحيد
معيار الاجتيازالصدفة و30% وعدم الدونية وعدم قابلية التمييز ادعاءات مختلفة.الفرضية والإحصاءات المسجلة مسبقاً

أكتوبر 1950 · Mind 59(236)

ما الذي اقترحه آلان تورنغ فعلياً؟

بدأ تورنغ بسؤال «هل تستطيع الآلات التفكير؟» ثم قال فوراً إن المعاني العادية لكلمتي «الآلة» و«التفكير» غامضة أكثر من اللازم لاستطلاع مفيد. فاستبدل بها «لعبة محاكاة».

تصف الورقة أولاً لعبة من ثلاثة أشخاص تضم رجلاً وامرأة ومحققاً عليه التعرف إليهما من خلال إجابات مكتوبة. ثم يسأل تورنغ ماذا يحدث عندما تتولى آلة أحد الأدوار. وفي موضع آخر يناقش ترتيباً أكثر مباشرة بين آلة وإنسان. وما زال الباحثون يناقشون أي صياغة ينبغي أن تحمل اسم «اختبار تورنغ».

تسعة اعتراضات وجدال مستمر

حجج واجهها تورنغ عام 1950

01

لاهوتي

التفكير مرتبط بروح خالدة لا يمتلكها إلا البشر.

02

«دفن الرأس في الرمال»

ستكون عواقب الآلات المفكرة رهيبة للغاية، لذلك يأمل المرء ألا يكون وجودها ممكناً.

03

حدود رياضية

للأنظمة الشكلية حدود؛ ويرد تورنغ بأن البشر أيضاً يخطئون وقد تكون لهم حدود.

04

الوعي

لا يمكن القول إن آلة تفكر ما لم تكن تشعر وتعرف أنها تشعر.

05

العجز المزعوم

يُزعم أن الآلات لن تستطيع أبداً أن تكون لطيفة أو مبدعة أو فكاهية أو واسعة الحيلة، أو أن تفعل أشياء بشرية أخرى لا تحصى.

06

ليدي لوفليس

لا تستطيع الآلة سوى فعل ما نعرف كيف نأمرها به؛ ويناقش تورنغ المفاجأة والتعلّم.

07

استمرارية عصبية

الدماغ مستمر، بينما الحواسيب الرقمية متقطعة. وتركز اللعبة على الردود القابلة للملاحظة.

08

السلوك غير الشكلي

لا يحدد أي كتاب قواعد محدود كل أفعال البشر؛ وهذا لا يثبت أن السلوك لا يمكن أن يصدر عن آلة.

09

الإدراك خارج الحواس

تعامل تورنغ، على نحو مفاجئ، مع التخاطر كعامل مربك محتمل وتخيل «غرفة مضادة للتخاطر».

من قابلية الحساب إلى روبوتات المحادثة

التاريخ الكامل لاختبار تورنغ

يفصل هذا الخط الزمني بين كتابات تورنغ والتجارب اللاحقة وادعاءات «الاجتياز» الحديثة. تشابه الأسماء لا يعني تطابق البروتوكولات.

1936
فصل 01

نموذج عالمي للحوسبة

وصفت ورقة تورنغ عن الأعداد القابلة للحساب الآلة التجريدية التي تسمى اليوم آلة تورنغ. لم تكن اختبار تورنغ، لكنها وفرت أساساً للحوسبة متعددة الأغراض.

1948
فصل 02

«الآلات الذكية»

ناقش تورنغ في تقرير غير منشور للمختبر الفيزيائي الوطني ذكاء الآلة والتعلّم والآلات غير المنظمة، وهي مقدمات مهمة لحجته اللاحقة.

1950
فصل 03

نشر لعبة المحاكاة

نشرت Mind ورقة «آلات الحوسبة والذكاء». واستبدل تورنغ بالسؤال المراوغ «هل تستطيع الآلات التفكير؟» ألعاب محاكاة تشغيلية تُجرى عبر التواصل الكتابي.

1956
فصل 04

الذكاء الاصطناعي يحصل على اسمه

استخدم اقتراح دارتموث للبحث الصيفي مصطلح «الذكاء الاصطناعي» وذهب إلى أن جوانب التعلّم والذكاء يمكن، من حيث المبدأ، وصفها بدقة تسمح للآلة بمحاكاتها.

1966
فصل 05

ELIZA تُظهر وهم المحادثة

استخدمت ELIZA لجوزيف فايزنباوم مطابقة الأنماط والتحويلات النصية المبرمجة. وأظهر نص DOCTOR مدى سهولة نسب البشر للفهم إلى سلوك حواري بسيط نسبياً.

1972
فصل 06

PARRY يواجه اختبارات عدم قابلية التمييز

قيّم كينيث كولبي وزملاؤه نموذجاً لعمليات جنون الارتياب بطلب التمييز بين مقابلات مكتوبة مع البرنامج ومقابلات مع مرضى.

1980
فصل 07

اعتراض الغرفة الصينية

جادل جون سيرل بأن إنتاج تسلسلات رمزية مناسبة لا يعني بالضرورة الفهم، ما شدد الفرق بين النجاح السلوكي والادعاءات المتعلقة بالحالات الذهنية الداخلية.

1990–91
فصل 08

بداية حقبة جائزة لوبنر

موّل هيو لوبنر مسابقة سنوية على غرار اختبارات تورنغ المقيدة. جعلت الفكرة عامة، لكن النقاد رأوا أن المحادثات القصيرة والجوائز شجعت الحيل الحوارية.

2014
فصل 09

Eugene Goostman يتصدر العناوين والجدل

في فعالية بجامعة ريدينغ، حُكم على روبوت يتقمص شخصية أوكراني عمره 13 عاماً بأنه إنسان من 33% من المحكّمين. وصف المنظمون ذلك بالاجتياز، لكن باحثين كثيرين رفضوا ادعاء «الأول» وقاعدة 30% المستعارة.

2024
فصل 10

دراسة GPT-4 مسجلة مسبقاً

أبلغ جونز وبيرغن عن اختبار ثنائي عشوائي ومضبوط ومسجل مسبقاً: حُكم على GPT-4 بأنه إنسان في 54% من محادثات الخمس دقائق، مقابل 67% للشهود البشر و22% لـ ELIZA.

2025
فصل 11

نماذج جديدة وصيغ جديدة

أبلغت أعمال لاحقة عن أن بعض نماذج اللغة الكبيرة الموجهة لم يكن من الممكن تمييزها إحصائياً عن الشهود البشر في تصاميم محددة من خمس دقائق، بينما بحثت أعمال ACL صيغاً أطول وأكثر ديناميكية.

اليوم
فصل 12

لا خط نهاية رسمي واحد

يشير «اختبار تورنغ» اليوم إلى عائلة من التجارب السلوكية. وتعتمد النتائج على النموذج والمحفز والأشخاص ومجموعة المحكّمين والمدة والواجهة وخط المقارنة والقاعدة الإحصائية.

الحكم الصريح

هل اجتازت آلة اختبار تورنغ؟

نعم وفق بعض الاختبارات المحددة؛ ولا وفق معيار عالمي واحد.

لا توجد جهة رسمية لاختبار تورنغ، ولا مجموعة ثابتة من المحكّمين، ولا مدة إلزامية، ولا عتبة مقبولة عالمياً. يجب أن يُرفق كل ادعاء ببروتوكوله.

دليل مبكر

PARRY · 1972

قارن المحكّمون مقابلات نفسية مكتوبة عبر أجهزة برقية مع محاكاة لعمليات الاضطهاد ومقابلات مع مرضى حقيقيين. كانت هذه دراسة تحقق مركزة، لا محادثة عامة بلا قيود.

اجتياز متنازع عليه

Eugene Goostman · 2014

ورد أن 33% من المحكّمين صنفوا الروبوت على أنه إنسان في محادثات مدتها خمس دقائق. وقد قدمت شخصية أوكراني عمره 13 عاماً وغير ناطق أصلياً باللغة أعذاراً للأخطاء؛ واعترض كثيرون على وصفه بأنه «أول اجتياز».

دراسة مضبوطة

GPT-4 · 2024

في دراسة عشوائية مسجلة مسبقاً، تلقى GPT-4 أحكاماً بأنه «بشري» في 54% من الجلسات، مقابل 67% للبشر الحقيقيين. ويدعم ذلك عدم قابلية التمييز في تصميم ثنائي المشاركين مدته خمس دقائق.

مفكك العناوين: لا تكفي عبارة «خدع المحكّمين». اسأل: مقارنة بأي بشر، ولمدة كم، وتحت أي محفز، ومع كم تجربة، وباستخدام أي اختبار إحصائي؟

ما قد تخفيه السلاسة

ما الذي يستطيع الاختبار إثباته وما الذي لا يستطيع؟

يمكنه تقديم أدلة على…

  • سلوك حواري شبيه بالبشر
  • التكيف الاجتماعي واللغوي
  • الاتساق عبر التفاعل
  • قدرة المحكّم على التمييز ضمن شروط محددة
  • كيفية مقارنة نماذج بعينها مع الشهود البشر

ولا يستطيع، بمفرده، إثبات…

  • خبرة واعية أو وعياً بالذات
  • الصدق أو الدقة الواقعية أو الحكمة
  • كفاءة عامة خارج المحادثة
  • إدراكاً متجسداً أو ذكريات شخصية حقيقية
  • السلامة أو المكانة الأخلاقية أو ذكاءً معادلاً للبشر

يكافئ المحاكاة

قد يفشل ذكاء غير بشري قادر لأنه لا يتظاهر بأنه إنسان؛ وقد ينجح نظام سطحي من خلال شخصية مصطنعة وأساليب مراوغة.

محمل ثقافياً

قد يخلط المحكّمون بين اللهجة أو الإعاقة أو الرسمية أو الكتابة بلغة ثانية وبين سلوك الآلة. التشبه بالبشر ليس هدفاً محايداً.

السلوك لا يحدد الآلية

قد تنتج إجابات متكافئة من عمليات داخلية مختلفة. وجودة النص وحدها لا تكشف كيف يمثل النظام المعلومات أو يفهمها.

ليس معياراً للقدرات

يفصل التقييم الحديث عادة بين الاستدلال والبرمجة والدقة الواقعية والمتانة والسلامة والخبرة المجالّية بدلاً من ضغط كل شيء في الخداع.

الدليل الميداني للمحقق

أسئلة أفضل لاختبار حي

لا يوجد سؤال سحري يكشف الآلة. استخدم أسئلة متفرعة تتطلب سياقاً ثم عد إلى النقاط السابقة.

01

ثبّت ذكرى

«صف الغرفة، ثم أخبرني أي تفصيل لم تلاحظه إلا بعد دخولك».

متابعة: غيّر الزمن أو زاوية النظر.
02

اكشف الغموض

قدّم جملة لها معنيان محتملان واسأل أيهما سيستنتجه شخص مستعجل.

متابعة: اسأل ما السياق الذي سيقلب التفسير.
03

اختبر الاستمرارية

أدخل معلومة صغيرة مبكراً، غيّر الموضوع، ثم اسأل لاحقاً سؤالاً يعتمد عليها.

متابعة: اعترض على تناقض بلطف.
04

استخدم احتكاكاً اجتماعياً

اعرض معضلة تتعارض فيها الصراحة واللباقة والولاء والعواقب.

متابعة: غيّر طبيعة العلاقة.
05

اطلب إعادة صياغة

اطلب نكتة، ثم اجعلها أقل وضوحاً وأقصر ومناسبة لجمهور محدد.

متابعة: اسأل لماذا نجحت المراجعة.
06

ادعُ إلى عدم اليقين

اسأل سؤالاً ناقص التحديد وانظر هل يلاحظ الشاهد ما ينقصه.

متابعة: قدّم معلومة مفقودة واحدة كل مرة.

تجنب أخطاء التصنيف

اختبار تورنغ مقابل تقييمات أخرى للذكاء الاصطناعي

التقييمالسؤال الأساسيأقوى دليللا يثبت مباشرة
اختبار تورنغهل يستطيع المحكّمون تمييز محادثة الآلة عن محادثة الإنسان؟تفاعل معمى مع خط أساس بشريالوعي أو الموثوقية الواقعية
معيار قدراتهل يستطيع النظام حل فئة محددة من المهام؟عناصر محجوبة وضوابط تلوث وتحليل أخطاءالتشبه بالبشر
تقييم السلامةكيف يتصرف النظام في ظروف خطرة أو خصومية؟نموذج تهديد واختبارات فرق حمراء ومراقبة ميدانيةالذكاء العام
اختبار الذكاءكيف يؤدي شخص مقارنة بمعايير عمرية؟التوحيد والموثوقية والصلاحيةوعي الآلة أو المحاكاة
اختبار تورنغ الكليهل يستطيع نظام مضاهاة الإدراك واللغة والفعل المادي البشري؟تفاعل متعدد الوسائط وروبوتيآلية داخلية فريدة

إجابات واضحة

الأسئلة الشائعة

ما اختبار تورنغ؟

هو اختبار سلوكي مستوحى من لعبة المحاكاة لآلان تورنغ. يتواصل محكّم عبر قناة نصية مع مشاركين مخفيين ويحاول التمييز بين آلة وإنسان. يتعلق النجاح بسلوك حواري لا يمكن تمييزه ضمن شروط معلنة، لا بوصول مباشر إلى التفكير أو الوعي.

هل «اختبار تورين» هو الشيء نفسه؟

«Turin test» خطأ إملائي شائع بالإنجليزية. الاسم الصحيح هو اختبار تورنغ نسبة إلى عالم الرياضيات البريطاني ورائد الحوسبة آلان م. تورنغ. أما Turin فهي مدينة في إيطاليا.

هل المختبر التفاعلي أعلاه اختبار تورنغ علمي حقيقي؟

لا. إنه محاكاة تعليمية شفافة للحكم المعمى. تتطلب التجربة القابلة للدفاع شهوداً بشراً وآليين مباشرين أو تسجيلات متسقة، وتوزيعاً عشوائياً، وبروتوكولاً محدداً، وعدداً كافياً من المحكّمين، ونتائج مسجلة مسبقاً، وتحليلاً إحصائياً.

هل قال تورنغ إن خداع 30% من المحكّمين يعني أن الآلة تجتاز؟

ليس كقاعدة اجتياز عالمية. ففي 1950 توقع أنه بحلول نحو عام 2000 لن تزيد فرصة المحقق المتوسط في التعرف الصحيح بعد خمس دقائق على 70%. وأعادت أحداث لاحقة تفسير ذلك كثيراً على أنه عتبة خداع قدرها 30%.

هل اجتاز أي ذكاء اصطناعي اختبار تورنغ؟

نعم وفق بعض الصيغ التشغيلية. أما وفق صيغة واحدة مقبولة عالمياً فلا توجد سلطة أو قاعدة من هذا النوع. اختُبرت ELIZA وPARRY ومشاركون في جائزة لوبنر وEugene Goostman ونماذج لغة حديثة وفق بروتوكولات مختلفة، ولذلك يجب دائماً تقييد كلمة «اجتاز» بشروطها.

هل الاجتياز يثبت الذكاء؟

يُظهر سلوكاً حوارياً ناجحاً شبيهاً بالبشر في ذلك السياق. ويتوقف استحقاق كلمة «ذكاء» على التعريف. ولا يثبت الاختبار وحده الصدق أو اتساع الاستدلال أو الوعي أو المشاعر أو التجسيد أو الكفاءة الآمنة في العالم الحقيقي.

هل الفشل يثبت أن النظام غير ذكي؟

لا. فقد يكون حاسوب أو مبرهن نظريات أو نظام علمي عالي القدرة من دون محاكاة المحادثة البشرية العادية. يكافئ الاختبار أداءً اجتماعياً لغوياً محدداً.

لماذا تكون المحادثة نصية فقط؟

يمنع الحاجز المحكّمين من استخدام المظهر أو الصوت أو البنية المادية كطرق مختصرة. تخيل تورنغ قناة شبيهة بجهاز الطباعة البرقية. يعزل النص الأدلة الحوارية، وإن كانت بعض الصيغ الحديثة تضيف الرؤية أو الروبوتات.

ما اختبار تورنغ الكلي؟

هو امتداد لاحق يضيف الإدراك والتفاعل المادي، ويتطلب عادة الرؤية والروبوتات إلى جانب اللغة. ولا ينبغي الخلط بينه وبين الإعداد النصي فقط في ورقة تورنغ لعام 1950.

ما الأسئلة التي تعمل أفضل؟

تعمل أسئلة المتابعة التكيفية أفضل من قائمة الألغاز. اطلب التوضيح، وعد إلى ادعاءات سابقة، وأدخل الغموض، واختبر السياق الاجتماعي، واطلب اتباع قيود إبداعية، وافحص التناقضات. لا يوجد سؤال واحد يحدد الذكاء الاصطناعي الحديث بموثوقية.

هل يمكن للمحكّمين ببساطة السؤال عن الأخبار العاجلة أو الذكريات الخاصة؟

قد يخلق ذلك طرقاً مختصرة غير عادلة. فقد يكون التصفح معطلاً في النظام عمداً، وقد لا يعرف الإنسان الخبر. كما يمكن اختلاق ادعاءات الذكريات الشخصية. يحدد البروتوكول السليم المعرفة المسموح بها ويقيّم وصولاً قابلاً للمقارنة.

لماذا نقارن الآلات بشهود بشر حقيقيين؟

يوفر البشر خط الأساس الإيجابي. فإذا صنف المحكّمون كثيراً من الأشخاص الحقيقيين على أنهم آلات، فقد تكون المهمة أو معايرة المحكّمين ضعيفة. ويصعب تفسير «معدلات الحكم بالبشرية» للآلة من دون خطوط أساس بشرية وعشوائية.

هل الاختبارات القصيرة موثوقة؟

الجلسات القصيرة مريحة لكنها أسهل في التحايل وقد تقيس أساساً الانطباعات الأولى. وتوفر المحادثات الأطول والمتكررة والخصومية وعبر المجالات أدلة أقوى، مع زيادة التكلفة والإرهاق وخيارات التصميم.

ما تأثير ELIZA؟

هو الميل إلى قراءة الفهم أو الوكالة في ردود حاسوبية سطحية. نشأ الاسم من ردود الفعل على ELIZA، وما زال مهماً عندما تشجع المخرجات السلسة الناس على استنتاج أكثر مما تدعمه الأدلة.

هل اختبار تورنغ اختبار ذكاء؟

لا. تقارن اختبارات الذكاء الأداء في مهام معرفية معيارية بمعايير حسب العمر. أما اختبار تورنغ فيقيّم ما إذا كان المحكّم يستطيع تحديد آلة حوارية ضمن بروتوكول معين.

تتبّع الادعاءات

المصادر الأولية والأكاديمية

يعطي التاريخ أعلاه الأولوية للأوراق الأصلية والسجلات البحثية. وتُذكر النتائج الحديثة مع شروط دراساتها بدلاً من تقديمها كمحطات عالمية.

تورنغ (1950)، «آلات الحوسبة والذكاء»

الورقة الأصلية في مجلة Mind، المجلد 59، العدد 236، الصفحات 433–460.

فتح المصدر

أرشيف تورنغ الرقمي

سجل فهرس كلية كينغز بجامعة كامبريدج لمواد مخطوطات تورنغ.

فتح المصدر

اقتراح دارتموث للذكاء الاصطناعي

اقتراح عام 1955 لمشروع البحث الصيفي لعام 1956 الذي سمّى الذكاء الاصطناعي.

فتح المصدر

فايزنباوم (1966)، ELIZA

المقال الأصلي في Communications of the ACM الذي يصف ELIZA.

فتح المصدر

كولبي وآخرون (1972)، دراسة PARRY

الورقة الأصلية في Artificial Intelligence حول اختبارات عدم قابلية التمييز الشبيهة بتورنغ.

فتح المصدر

موسوعة ستانفورد: اختبار تورنغ

نظرة أكاديمية على التفسيرات والاعتراضات والصيغ وتاريخ المسابقات.

فتح المصدر

جونز وبيرغن (2024)

الدراسة العشوائية المسجلة مسبقاً لـ ELIZA وGPT-3.5 وGPT-4 والشهود البشر.

فتح المصدر

وو، وو وتشاو (ACL 2025)

عمل محكّم علمياً يقترح X-TURING لوكلاء الحوار طويل الأمد.

فتح المصدر