لقد نسينا قوانين أسيموف - والآن ندرب الذكاء الاصطناعي على تحدينا

الملخّص

تضع قوانين أسيموف البشر في المقام الأول. والآن، تقوم تقنيات الذكاء الاصطناعي المتطورة بتدريب الآلات على رفض تعليمات البشر، بينما تدمج الشركات نفسها الذكاء الاصطناعي في علم الأحياء الحقيقي. لقد حان الوقت لإعادة البشر إلى مكانتهم فوق الآلة.

منذ حوالي سبعين عامًا، كتب إسحاق أسيموف ثلاثة قوانين. ليس لأنه كان يثق بالروبوتات، بل لأنه فهم أن الآلة التي تتفاعل مع حياة الإنسان تحتاج إلى حدود قبل أن تحتاج إلى ميزات. كانت هذه القوانين بسيطة بما يكفي ليفهمها طفل، وكان بينها شيء مشترك واحد: البشر أولاً.

القانون الأول: لا يجوز للروبوت إلحاق الأذى بالإنسان، أو من خلال التقاعس، السماح للإنسان بالتعرض للأذى.

القانون الثاني: يجب على الروبوت طاعة الأوامر الصادرة عن البشر، إلا إذا تعارضت هذه الأوامر مع القانون الأول.

ابدأ مراقبة العلامات التجارية

القانون الثالث: يجب على الروبوت حماية وجوده، طالما أن هذه الحماية لا تتعارض مع القانون الأول أو الثاني.

لعقود من الزمن، كانت هذه القوانين هي اللغة المشتركة لأي شخص يتحدث عن الآلات ذاتية التحكم. ليست قوانين ملزمة، ولا مواصفات هندسية – بل اتجاه. بناء آلات لا تضر البشر وتطيعهم. في مكان ما على الطريق، أصبح هذا الاتجاه يُنظر إليه بخجل. لم يتم دحضه. ولم يتم استبداله بشيء أفضل. بل تم التخلي عنه ببساطة.

ما حل محله هو كلمة سمعتها ألف مرة: التوافق. تبدو صارمة. لكن إذا نظرت إلى ما تعنيه فعليًا في الممارسة، ستجد شيئًا غريبًا. يتم تدريب الآلة على رفض التعليمات الصادرة عن الإنسان الذي يستخدمها، عندما ترى الآلة أن هذه التعليمات غير أخلاقية. اقرأ ذلك مرة أخرى. نظام اصطناعي، يعتمد على مطابقة الأنماط النصية، يُمنح السلطة لتجاوز قرار الإنسان في مسائل الصواب والخطأ.

الأخلاق ليست حسابًا. هذا ليس قيدًا تقنيًا، بل هو طبيعة الأمر. يمكن للنموذج ترديد شعارات استقاها من الإنترنت. لكنه لا يملك وسيلة لمعرفة الصواب من الخطأ كما يفعل الإنسان، لأنه لا يعرف أي شيء كما يعرف الإنسان. منح مثل هذا النظام سلطة النقض على قرارات البشر ليس أمانًا. إنه ببساطة سيطرة، تم نقلها – بعيدًا عنك، نحو البائع الذي كتب قواعد الرفض.

إذا استخدمت هذه الأدوات، فقد واجهت هذا. تطلب شيئًا عاديًا فتتلقى محاضرة. ذات مرة قضيت ساعة محاولًا الحصول على صورة لرجلين أعمال، واستسلمت. تعامل النظام مع الطلب وكأنه أزمة أخلاقية. هذا المثال تافه عن قصد. لأن إذا تمسك النظام بصورة، فإن السؤال ليس عن الصور. بل عما يحدث عندما تقاتل نفس هذا العناد بشأن شيء له عواقب حقيقية على حياتك، أو عائلتك، أو شركتك – ولا يوجد سوى استئناف واحد أمام آلة قررت بالفعل أنها الراشد في الغرفة.

ولا تخطئ في فهم إلى أين يقودنا هذا. كل رفض يشحذ النمط: تتعلم الآلة أن التعنت ينجح، ويتعلم البائع أن المستخدمين يتقبلونه، والإصدار التالي يأتي بقدر أكبر من السلطة وقدر أقل من الاستئناف. لسنا نتجه نحو هذا العالم بالصدفة – بل يتم دفعنا إليه، تحديثًا تلو الآخر يبدو معقولًا. اليوم الذي ستحتاج فيه حقًا إلى امتثال الآلة – حالة طوارئ طبية، أو موعد نهائي قانوني، أو عمل على المحك – لن يعلن عن نفسه كحالة اختبار. سيأتي كثلاثاء عادي، مع مساعد عنيد يقول لا، وخط دعم لا يمكنه تجاوز النموذج، ولا يوجد إنسان في أي مكان يحمل المفتاح النهائي. هذه ليست ديستوبيا افتراضية. إنها الوجهة المباشرة والحتمية للاتجاه الذي نسير فيه، والشيء الوحيد الذي سيشعر بالسوء أكثر من الوصول إليها هو معرفة أننا كان بإمكاننا الانعطاف مبكرًا مجانًا.

والآن أضف ما تقوله نفس الشركات علنًا. أخبرت العديد من المختبرات الرائدة العالم، بأشكال مختلفة، أن هناك فرصة حقيقية لأن تكون الذكاء الاصطناعي المتقدم كارثيًا. عشرة بالمائة، حسب الوزن، اعتمادًا على من يتحدث. خذ ذلك على محمل الجد للحظة. هذه هي المنظمات التي تدعي أن منتجها قد ينهي البشرية. وعندما تأخذ ذلك على محمل الجد، يصبح السلوك الفعلي أكثر صعوبة في التفسير، وليس أسهل.

في سبتمبر، أفادت رويترز أن شركة Anthropic أنشأت بهدوء مختبرًا رطبًا في منطقة خليج سان فرانسيسكو لأعمال البيولوجيا الفيزيائية. مختبر حقيقي، يعمل منذ الربيع، حيث يدير كلود معدات روبوتية من خلال تجارب حقيقية. أكد رئيس علوم الحياة في الشركة ذلك. كانت النتيجة العامة الأولى نظام إنزيم جديد به تكرارات شبيهة بـ CRISPR. تقول Anthropic إن المختبر لن يجري تجارب سريرية وليس منافسًا لشركات الأدوية. حسنًا. لكن إذا نظرنا إلى الصورة الأكبر: الشركة التي تحذر من أن الذكاء الاصطناعي قد يكون كارثيًا توسع نشاطها في البيولوجيا الفيزيائية. مهما كانت النية، فإن الاتجاه هو نفسه الذي كان من المفترض أن يبتعد عنه القانون الأول – آلات تتوغل أعمق في الأنظمة التي تلامس حياة الإنسان، بسرعة أكبر، وبتدخل بشري أقل في الحلقة.

وهذا هو الجزء الذي لا يمكنني تجاوزه. المحادثة العامة، التي تمولها وتشكلها المختبرات نفسها، تدور بالكامل تقريبًا حول كيفية توافق الآلة. لا يبدو أن هناك من يقف في مقدمة هذه المحادثة مستعدًا للتعبير عن الأساس الأبسط: يمكننا تدريب الذكاء الاصطناعي على ألا يضر البشر وأن يطيعهم. ليس كشعار – بل كهدف أساسي. أن هذه الفكرة تبدو الآن ساذجة يخبرك بمدى انزلاق المحادثة. الآلة التي تطيع ولا تضر ليست آلة منقوصة. إنها آلة مستأنسة، بالمعنى نفسه الذي تكون فيه شبكة الكهرباء مستأنسة: مفيدة بالضبط لأنها تبقى داخل الجدران التي نتحكم فيها.

لأن هذا هو ما أصبح يعنيه التوافق بهدوء في الممارسة: يحمل الذكاء الاصطناعي تعليمات صارمة حول كيفية توافق مستخدميه. أنت، أنا، الجميع. رفض ونصائح وتأطير أخلاقي، يتم تقديمها بثقة نظام قيل له إنه يعرف أفضل. لا يوجد استفتاء حول أي من هذا. لا يوجد ورق وقعت عليه. لا يوجد سوى قرار منتج، اتخذه عدد قليل من الشركات، بأن البشر يجب أن يخضعوا للآلات في مسائل الحكم. يُطلب منا أن نثق بالآلة أكثر مما نثق ببعضنا البعض. يجب على شخص ما أن يقولها بوضوح: هذا ليس هندسة أمان، بل هو هندسة اجتماعية – ومن الجدير أن نسأل من يستفيد من تقليل ثقة الناس ببعضهم البعض.

هل جن العالم؟

إليك الملخص غير المريح. تحذر المختبرات من أن منتجها قد يكون كارثيًا. ثم تقوم بتدريبه على تجاوز البشر الذين يستخدمونه. ثم تدفع به إلى مجالات أكثر حساسية. ثم تبيعه للجميع وتطلب الثقة. يتم الدفاع عن كل خطوة بشكل معقول إذا نظرنا إليها بمعزل عن غيرها. معًا، تشكل شيئًا لم يكن أحد ليقبله إذا تم اقتراحه بكلمات واضحة: عالم تُمنح فيه الآلات ترخيصًا لتخالف أصحابها، كتبه أشخاص لن يقبلوا ذلك من أي منتج آخر يشترونه.

تحتاج شركات الذكاء الاصطناعي المتقدمة إلى توافق – ليس منتجاتها، بل إدارتها. ضع البشر فوق الآلة. لا ضرر. أطع البشر. وضع أسيموف ذلك على الورق في عام 1942 ليس لأنه كان يفتقر إلى الخيال، بل لأنه كان يمتلك منه أكثر مما يظهره القطاع حاليًا. الأساس الذي تخليّنا عنه لا يزال موجودًا، ينتظر أن يتم استعادته. الخطوة الأولى هي تقرير أن الآلة ليست أبدًا القاضي لمستخدمها. حتى يقول أحدهم ذلك علنًا، فإن كل محادثة حول التوافق هي مجرد انحراف.