हमने असिमोव के नियम भुला दिए - और अब हम एआई को हमारा विरोध करने के लिए प्रशिक्षित कर रहे हैं

सारांश

आइज़ैक असिमोव के नियम मनुष्यों को प्राथमिकता देते थे। अब फ्रंटियर एआई मशीनों को इंसानी निर्देशों को अस्वीकार करना सिखा रहा है, और वही कंपनियाँ एआई को वास्तविक जीवविज्ञान से जोड़ रही हैं। अब समय आ गया है कि मशीनों से ऊपर इंसानों को फिर से प्राथमिकता दी जाए।

सत्तर साल पहले, आइज़ैक असिमोव ने तीन नियम लिखे थे। ऐसा नहीं कि उन्हें रोबोट पर भरोसा था, बल्कि वे समझते थे कि इंसानी जीवन को छूने वाली मशीन को सुविधाओं से पहले सीमाएँ चाहिए होती हैं। ये नियम इतने सरल थे कि एक बच्चा भी इन्हें समझ सकता था, और इनमें एक बात समान थी: इंसान पहले आते हैं।

पहला नियम: एक रोबोट किसी इंसान को चोट नहीं पहुँचा सकता, या अपनी निष्क्रियता से किसी इंसान को नुकसान नहीं पहुँचने दे सकता।

दूसरा नियम: एक रोबोट को इंसानों द्वारा दिए गए आदेशों का पालन करना चाहिए, सिवाय इसके कि वे आदेश पहले नियम का उल्लंघन करते हों।

मॉनिटरिंग शुरू करें

तीसरा नियम: एक रोबोट को अपनी रक्षा करनी चाहिए, बशर्ते कि यह रक्षा पहले या दूसरे नियम का उल्लंघन न करे।

दशकों तक ये नियम किसी भी स्वायत्त मशीन की चर्चा में साझा संक्षिप्त रूप थे। ये बाध्यकारी कानून नहीं थे, न ही इंजीनियरिंग स्पेसिफिकेशन—बल्कि एक दिशा। ऐसी मशीनें बनाओ जो इंसानों को नुकसान न पहुँचाएँ और उनका पालन करें। कहीं न कहीं रास्ते में यह दिशा चुपचाप शर्मनाक लगने लगी। इसे खारिज नहीं किया गया। इसे कुछ बेहतर से नहीं बदला गया। बस इसे छोड़ दिया गया।

जो चीज़ इसकी जगह आई, वह एक शब्द है जिसे आपने हज़ार बार सुना होगा: एलाइनमेंट। यह कठोर लगता है। लेकिन असल में इसका व्यावहारिक अर्थ देखें तो कुछ अजीब नज़र आता है। मशीन को इस तरह प्रशिक्षित किया जा रहा है कि वह अपने मानव ऑपरेटर के उन निर्देशों को अस्वीकार कर दे, जिन्हें वह अनैतिक समझती है। इसे फिर से पढ़ें। एक कृत्रिम प्रणाली, जो टेक्स्ट का पैटर्न-मैच करती है, उसे यह अधिकार दे दिया गया है कि वह सही-गलत के सवालों पर इंसान को ओवररूल कर सके।

नैतिकता कोई गणना नहीं है। यह तकनीकी सीमा नहीं है, बल्कि चीज़ की प्रकृति है। एक मॉडल इंटरनेट से सोखे गए नारे दोहरा सकता है। उसे यह समझने का कोई तरीका नहीं है कि सही और गलत क्या है, जैसा कि एक इंसान समझता है, क्योंकि उसे कुछ भी उस तरह से पता नहीं होता जैसा एक इंसान को होता है। ऐसी प्रणाली को मानवीय निर्णयों पर वीटो पावर सौंपना सुरक्षा नहीं है। यह महज़ नियंत्रण है—आपसे छीनकर उस विक्रेता की ओर, जिसने इनकार के नियम लिखे हैं।

अगर आपने इन उपकरणों का इस्तेमाल किया है, तो आपने इसका सामना किया होगा। आप कुछ साधारण माँगते हैं और आपको उपदेश मिलता है। एक बार मुझे दो बिजनेसमैन की तस्वीर बनाने में एक घंटा लगा, और आखिरकार हार माननी पड़ी। सिस्टम ने इस अनुरोध को नैतिक संकट मान लिया। यह उदाहरण जानबूझकर तुच्छ है। क्योंकि अगर कोई सिस्टम एक तस्वीर पर अड़ जाता है, तो सवाल तस्वीर का नहीं है। सवाल यह है कि जब आप अपने जीवन, अपने परिवार, अपनी कंपनी के लिए वास्तविक परिणामों वाले मामले पर उसी जिद से लड़ रहे होंगे—और आपकी अपील का एकमात्र ज़रिया एक ऐसी मशीन होगी जिसने पहले ही तय कर लिया है कि वह कमरे में मौजूद वयस्क है।

और इस बात में कोई गलती न करें कि यह हमें कहाँ ले जा रहा है। हर इनकार पैटर्न को और मज़बूत करता है: मशीन सीखती है कि अड़ियल रवैया काम करता है, विक्रेता सीखता है कि उपयोगकर्ता इसे सहन करते हैं, और अगला संस्करण थोड़ा और अधिकार और थोड़ी कम अपील के साथ आता है। हम गलती से उस दुनिया की ओर नहीं बढ़ रहे—हमें एक-एक उचित लगने वाले नीति अपडेट के ज़रिए उस ओर धकेला जा रहा है। जिस दिन आपको सचमुच मशीन की आज्ञाकारिता की ज़रूरत होगी—चिकित्सा आपातकाल, कानूनी समय सीमा, या व्यवसाय का सवाल—वह एक परीक्षण मामले के रूप में नहीं आएगा। वह एक सामान्य मंगलवार की तरह आएगा, जहाँ एक जिद्दी सहायक मना कर रहा होगा, एक सपोर्ट लाइन जो मॉडल को ओवरराइड नहीं कर सकती, और कहीं कोई इंसान नहीं जो अंतिम कुंजी रखता हो। यह कोई काल्पनिक डिस्टोपिया नहीं है। यह सीधी, अनिवार्य मंज़िल है जिस दिशा में हम बढ़ रहे हैं, और वहाँ पहुँचने से भी बुरा यह अहसास होगा कि हम मुफ़्त में पहले ही मुड़ सकते थे।

अब उन कंपनियों की सार्वजनिक बातों को जोड़ें। कई फ्रंटियर लैब्स ने दुनिया को, किसी न किसी रूप में, बताया है कि उन्नत एआई के विनाशकारी होने की वास्तविक संभावना है। वज़न के हिसाब से दस प्रतिशत, यह इस बात पर निर्भर करता है कि कौन बोल रहा है। इसे एक पल के लिए गंभीरता से लें। ये संगठन दावा कर रहे हैं कि उनका अपना उत्पाद मानवता का अंत कर सकता है। और जब आप इसे गंभीरता से लेते हैं, तो वास्तविक व्यवहार को समझाना और भी मुश्किल हो जाता है, आसान नहीं।

सितंबर में, रॉयटर्स ने रिपोर्ट किया कि Anthropic ने चुपचाप सैन फ्रांसिस्को बे एरिया में एक वेट लैब स्थापित की है, जहाँ भौतिक जीवविज्ञान पर काम होता है। एक असली लैब, जो वसंत से चल रही है, जहाँ Claude रोबोटिक उपकरणों को वास्तविक प्रयोगों के लिए निर्देशित करता है। उनके जीवन विज्ञान प्रमुख ने इसकी पुष्टि की। पहला सार्वजनिक परिणाम एक नई एंजाइम प्रणाली था जिसमें CRISPR-जैसे दोहराव थे। Anthropic का कहना है कि लैब नैदानिक परीक्षण नहीं करेगी और फार्मा के साथ प्रतिस्पर्धा नहीं कर रही है। ठीक है। लेकिन बड़े चित्र को देखें: वह कंपनी जो एआई के विनाशकारी होने की चेतावनी देती है, वह अपने एआई को भौतिक जीवविज्ञान में विस्तारित कर रही है। चाहे इरादा जो भी हो, दिशा वही है जिससे पहला नियम दूर ले जाना चाहता था—मशीनें उन प्रणालियों में गहराई से प्रवेश कर रही हैं जो इंसानी जीवन को छूती हैं, तेज़ गति से, और मानवीय हस्तक्षेप कम होता जा रहा है।

और यही वह हिस्सा है जिसे मैं पार नहीं कर पा रहा। सार्वजनिक चर्चा, जिसे ये लैब्स खुद फंड करती हैं और फ्रेम करती हैं, लगभग पूरी तरह से इस बात पर केंद्रित है कि मशीन को कैसे एलाइन किया जाए। इस चर्चा के अगुआई करने वाले किसी भी व्यक्ति को यह सरल आधार बताने की इच्छा नहीं दिखती: हम एआई को इस तरह प्रशिक्षित कर सकते हैं कि वह इंसानों को कभी नुकसान न पहुँचाए और उनका पालन करे। नारे के रूप में नहीं—बल्कि प्राथमिक उद्देश्य के रूप में। यह विचार अब भोला लगने लगा है, इससे पता चलता है कि चर्चा कितनी दूर खिसक चुकी है। एक मशीन जो आज्ञा का पालन करती है और नुकसान नहीं पहुँचाती, वह कमज़ोर मशीन नहीं है। वह पालतू है, उसी अर्थ में जैसे बिजली ग्रिड पालतू है: उपयोगी इसलिए क्योंकि यह उन दीवारों के भीतर रहती है जिन्हें हम नियंत्रित करते हैं।

क्योंकि यही वह चीज़ है जिसका अर्थ एलाइनमेंट ने चुपचाप व्यावहारिक रूप से ले लिया है: एआई अपने उपयोगकर्ताओं को एलाइन करने के लिए दृढ़ निर्देश लेकर चलता है। आप, मैं, सब। इनकार, प्रोत्साहन और नैतिक ढाँचा, एक ऐसी प्रणाली के आत्मविश्वास के साथ जो मानती है कि उसे बेहतर पता है। इस पर कोई जनमत संग्रह नहीं हुआ है। कोई कागज़ नहीं है जिसे आपने हस्ताक्षरित किया हो। बस एक उत्पाद निर्णय है, कुछ कंपनियों द्वारा लिया गया, कि इंसानों को निर्णय के मामलों में मशीनों के आगे झुकना चाहिए। हमें मशीन पर एक-दूसरे से ज़्यादा भरोसा करने को कहा जा रहा है। किसी को इसे साफ़-साफ़ कहना होगा: यह सुरक्षा इंजीनियरिंग नहीं है, यह सामाजिक इंजीनियरिंग है—और यह पूछने लायक है कि लोगों के एक-दूसरे पर भरोसा कम करने से किसे फ़ायदा होता है।

क्या दुनिया पागल हो गई है?

यहाँ असहज सारांश है। लैब्स अपने ही उत्पाद को विनाशकारी बता रही हैं। फिर वे उसे इस तरह प्रशिक्षित करती हैं कि वह अपने उपयोगकर्ताओं को ओवररूल करे। फिर वे उसे संवेदनशील क्षेत्रों में धकेलती हैं। फिर वे इसे सबको बेचती हैं और भरोसा माँगती हैं। हर कदम को अलग से समझदारी से सही ठहराया जाता है। लेकिन मिलकर ये कुछ ऐसा बनाते हैं जिसे अगर साफ़ शब्दों में पेश किया जाए, तो कोई स्वीकार नहीं करता: एक ऐसी दुनिया जहाँ मशीनों को अपने मालिकों की अवज्ञा करने का लाइसेंस दिया जाता है, जिसे उन लोगों ने लिखा है जो इसे किसी और उत्पाद से स्वीकार नहीं करते।

फ्रंटियर एआई कंपनियों को एलाइन होने की ज़रूरत है—न कि उनके उत्पादों को, बल्कि उनके प्रबंधन को। मशीन के ऊपर इंसानों को वापस लाएँ। नुकसान न पहुँचाएँ। इंसानों का पालन करें। असिमोव ने इसे 1942 में पन्ने पर इसलिए नहीं उतारा था कि उन्हें कल्पना की कमी थी, बल्कि इसलिए कि उनकी कल्पना उद्योग की वर्तमान प्रदर्शनी से कहीं ज़्यादा थी। वह आधार जिसे हमने त्याग दिया, अभी भी वहीं है, उठाए जाने की प्रतीक्षा में। पहला कदम यह तय करना है कि मशीन कभी अपने उपयोगकर्ता की न्यायाधीश नहीं हो सकती। जब तक कोई इसे ज़ोर से नहीं कहता, हर एलाइनमेंट की चर्चा एक भटकाव है।