عندما كنت طفلة، كنت دائماً أعتقد أن الرمال المتحركة والفاتة مورغانة سيسيطران على جزء كبير من حياتي البالغة. ومع أنني كنت مخطئة بشأن الرمال المتحركة، إلا أن الجانب الهَلْوَسِيّ وجد طريقه لي مرة أخرى من خلال باب لم أكن أتوقعه – عملي. أبني أنظمة الذكاء الاصطناعي، ويتبين أن الآلات التي أساعد في صنعها تهلوس بشكل دائم.
في المعنى النفسي التقليدي، فإن "هلوسة" هي إدراك يحدث بدون أي محفز خارجي. بمعنى آخر، ترى شيئاً ولا يوجد شيء هناك. السراب، مثل فاتة مورغانة، لا يُحْسَب: إنها أوهام، إدراكات حقيقية مشوهة من قبل الجو (لهذا السبب كذبت عليَّ الرسوم الكرتونية في طفولتي بشأن الصحراء). الكلمة نفسها دخلت الإنجليزية منذ زمن طويل، في عام 1646، من اللاتينية alucinari، "التجول في العقل". بالإضافة إلى شرح عَقْلِي أيام الاثنين، كان المصطلح موجوداً في رؤية الكمبيوتر لأكثر من عقدين من الزمن، في الأصل لوصف نماذج اكتشفت أشياءً غير موجودة.
بقي المصطلح في النطاق الضيق حتى بدأت النماذج اللغوية الكبيرة تسير به علناً وبصوت عالٍ. فجأة، عرف الجميع الكلمة والعواقب. روبوت محادثة يخبرك أن لوحة الموناليزا رُسمت في عام 1754؛ يَخْتَلق رقماً مالياً، قضية قانونية، قائمة بمراجع طبية تبدو معقولة لكنها غير موجودة في أي مكان. والمصطلح نفسه هو تسمية خاطئة فظيعة لأن الهلوسة لا تزال شكلاً من أشكال الإدراك، وليس للنماذج اللغوية الكبيرة إدراك لتفشل فيه: نحن نلبس عمليات إحصائية بشكل أنيق ولكنه لا يزال ذو صبغة نفسية. عندما ناقشتُ هذا مع عالم الأعصاب أنيل سيث، قال لي إنه يفضل "الخَرَف"، ولكن أعتقد أن هذا المصطلح يحمل نفس العبء الأنثروبومورفي، لأن الخَرَف هو شيء يفعله البشر عندما يُملأون الذاكرة المفقودة باختراعات معقولة وهو أيضاً يلمِّح إلى نفسية لا تمتلكها هذه النظم. أخبرته أن مصطلحي المفضل كان botshit، والذي اخبروني أنه غير مناسب لكل مناسبة. قد تكون هذه واحدة من تلك المناسبات.
إذن ، من أين تأتي الهلوسات؟ بالرغم من العدد الهائل من خبراء لينكدإن، نحن لا نعرف بشكل كامل. لا يوجد نظرية متماسكة ومعتمدة تجريبياً تكشف لماذا تحدث بالضبط. لكننا نعرف العوامل المساهمة: البيانات التدريبية التي تتعارض مع ذاتها، التباعد بين المصدر والاستهداف، الإفراط في التحسين بعلاقات عشوائية، الأخطاء في كيفية تشفير المعرفة في مليارات المعاملات وفك تشفيرها للخارج، والعديد من العوامل الأخرى. ليس من المفاجئ أن نموذج يهوس حول منطق التبرير المشروط من الدرجة الثانية، الذي ليس لديه الكثير من البيانات عنه مقارنة بالإصدارات الأخيرة في هوليوود.
في المحاضرات والدروس، شرائطي المفضلة هي فقط طرح السؤال "ما هو الغرض الفردي من نموذج لغوي كبير؟" في استبيان مجهول. عادةً ما أتلقى ردود كـ "لفهم البشر"، "لإنشاء المعرفة"، "لتقليد المنطق البشري" وأجوبة عميقة مشابهة، ولكن الحقيقة هي أننا بنيناها لغرض واحد، وهو "إكمال جملة". بشكل تقني أكثر، للتنبؤ بالرمز التالي الأكثر احتمالاً. عملية التحسين هذه تركز على الطلاقة بدلاً من الحقيقة أو الموثوقية الواقعية للبيانات. عندما يكون الامتداد الأكثر احتمالاً صحيحاً، فهذا رائع! إذا كان خطأً، تتلقى هراءً واثقاً بنفس الدرجة. يوجد أيضاً تنازلات هندسية مدمجة: تقليل العشوائية، ويصبح النموذج دقيقاً ولكنه ممل، وزيادتها، ويصبح إبداعياً، يشبه الإنسان، وأكثر احتمالاً لاختراع الأشياء (كما نفعل). بناءً على التكوين فقط، لا يمكنك إزالة واحدة بشكل جراحي والاحتفاظ بالأخرى – إما أنك د. جيكل أو مستر هايد.
هذا ما يقودني إلى السؤال الذي يُطرح علينا كمهندسين بشكل متكرر، عادةً من العملاء أو من الأشخاص الذين يحتجزون ميزانية الشراء كرهينة: "هل يمكنك ضمان دقة 100%؟" لا، وكل من يضمن ذلك يبيعك شيئاً. (بشكل ساخر، أنا أيضاً أبيع لك شيئاً.) إنه يدعى سوالي وسنتحدث عنه قريباً.)
هل يعني ذلك أنك لا يجب أن تُنفذ روبوت محادثة؟ أيضاً لا. نحن لا نرفض العمل مع البشر لأنهم يتذكرون بشكل خاطئ، ويبالغون، ويمزجون الأشياء وأحياناً يُصرون أنه يعمل على جهازهم (مذنب كما يُتهم). بدلاً من ذلك، نقوم ببناء عمليات مراجعة ومسارات تدقيق حولهم، لذا ينطبق نفس المنطق هنا. نحن لا نحاول إنشاء نظام مثالي حيث لا وجود له، لكن السؤال الحقيقي هو ما إذا كنا قد استطعنا تصميم النظام بحيث تكون أخطاؤه نادرة، قابلة للتتبع، يمكن كشفها، وفي النهاية، ذات تكلفة منخفضة.
غالباً ما تفشل الروبوتات عند الحدود – الأرقام الدقيقة، التواريخ الدقيقة، الاقتباسات، أسماء الكيانات غير المعروفة، غالباً أي شيء حدث مؤخراً، أي شيء بلغة ضعيفة الموارد (كل شيء تقريبًا ما عد الإنجليزية)، وأي سؤال يُصيغ بحيث تكون الإجابة بمظهر منطقي سواء أكانت صحيحة أم لا. بمعنى آخر، النموذج يُفضل أن يُعطيك سنة خاطئة بدلاً من أن يعترف بعدم معرفته (ونعرف جميعاً أشخاصاً كهؤلاء). ومع ذلك، الروبوتات جيدة حقاً في المحادثات حيث تكون مصدر الحقيقة بجانب النموذج: تلخيص وثيقة تقدمها، إيجاد المعلومات في مجموعتك من الوثائق، ترجمة النصوص، والإجابة على الأسئلة المستندة إلى قاعدة معرفية مُنظّمة، المصدر مرفقة.
الفلسفة وراء سوالي، التي نبنيها في ميدان، هي كفلسفة المكتبة. روبوت المحادثة العادي هو الشخص الذي قرأ كل شيء مرة، قبل سنوات، والآن يُجيب من الذاكرة بطلاقة وثقة، لكن أحياناً يُخبرك أن ريان جوسلينغ هو عمدة شيكاغو. سوالي لا يُسمح له بالإجابة من الذاكرة على الإطلاق - نحن فقط نستعير قوته في التفكير. عند سؤاله، عليه أن يمشي إلى الرفوف – مخطط معرفي مليء بالمحتوى الذي يحدده شركاؤنا – وأن يأخذ الكتب الفعلية. عندما كنت طفلاً، كان لدينا دائماً أمينة مكتبة عجوز عَرَفَتْ بالضبط مكان كل شيء. كانت ترتدي نظارات للقراءة وفستانًا زهريًا، وفي الأيام الجيدة، زهرة حقيقية موضوعة على سترتها. وكانت امرأة كبيرة تتحرك بين الرفوف بوتيرة غير متسرعة، حتى تصل لمرحلة تُحفزها الأسئلة، عند هذه النقطة كانت تستطيع أن تتفوق على كل الأطفال في المبنى. بدت وكأنها تحمل المكتبة بأكملها في رأسها، لكن لم تكن تجيب بقدرتها العقلية – بل كانت تجيب بخطاها. كانت تمشي بي إلى الرف، تسحب الكتاب، تفتحه على الصفحة، وتُريني كيفية إنهاء مقالتي البيولوجية بسرعة. إذا لم تكن المكتبة تحتوي على ما أحتاج، كانت ببساطة تقول لي، دون أن تختلق شيئاً بأن الأسود تتزاوج مثل القناديل البحرية، ولا مقدار من التوسل يمكن أن يجعلها تخترع دور ثانٍ غير موجود.
سوالي هي أمينة المكتبة في طفولتي التي تجد الكتب كما فعلت، سواء عبر الكتالوج أو بفهم ما يدور حوله الكتاب – بحث نصي كامل ودلالي مدمج – لأنها يجب أن تُجيب حصرياً من الصفحات الموجودة أمامها. كل مصدر يُشير إليه سوالي يتم التحقق منه مقابل الوثائق التي سُحبت فعلاً، لذا من المستحيل هيكلياً أن يُشير إلى كتاب لا تملكه مكتبتك. لكننا لا نزال نضطر لقتال الثقة المفرطة للروبوت، لذا قبل أن تصلك الإجابة، لدينا فريق من أمناء المكتبات الإضافيين – أو التقييم الثانوي للنماذج اللغوية الكبيرة– يؤكدون شمولية التحقق من السابقة. النظام يعود إلى الرفوف بسؤال معاد صياغته، ربما حتى بجواب افتراضي للتحقق منه، أو ببساطة للتحقق مما إذا كان هذا عن البيولوجيا فعلاً. بعض الأسئلة لا تنتمي إلى الرفوف على الإطلاق، ولأجل هذه، يُرشدك إلى المكتب الأمامي حيث يعمل شخص حقيقي. ولأن المعلومات الخاطئة لم تنتظر أبداً ترجمة إلى الإنجليزية بأدب، فإن رفوفنا متعددة اللغات منذ البداية، من العربية إلى الهندية.
من الواضح أن جميع هذه الإجراءات لا تجعل الهلوسات مستحيلة، لكنها تجعلها نادرة وقابلة للتتبع. ولكن طفولتي قدمت لي صورتين، وكانت واحدة منهم فقط كذبة. الأخرى كانت ترتدي الأزهار وتُجيب بخطاها. نظراً للخيارات التي بوُضعت لبناء مسيرتي، اخترت المكتبة.

