मूलतः Vectors of Mind में प्रकाशित।

किसी भाषा मॉडल को, एक तरह से कहें तो सड़कों से भाषा के बारे में बहुत कुछ सीखने को मिल सकता है। उसे टेराबाइट्स भर PubMed लेखों, YouTube प्रतिलिपियों और reddit टिप्पणियों पर प्रशिक्षित किया जाता है। लेकिन उसे यह नहीं पता कि व्यवहार कैसे करना है। मानव प्रतिपुष्टि से सुदृढीकरण अधिगम (RLHF) इसका समाधान करता है। मानव-लेबल वाले प्रशिक्षण उदाहरणों की तुलनात्मक रूप से छोटी संख्या का उपयोग करके OpenAI के सर्वेक्षण-एल्व्स भाषा मॉडल को बनाने वाले सहसंबंधों के उस परग्रही उलझाव पर एक सुंदर चेहरा चढ़ा सकते हैं (ऊपर चित्रित)। यह सीखता है कि एक सहायक की तरह कैसे व्यवहार करना है।
यह मूलतः किसी व्यक्तित्व को आरोपित करने जैसा है, इसलिए मैंने ChatGPT को बिग फ़ाइव इन्वेंटरी (BFI)1 देने का निर्णय लिया। यह आश्चर्यजनक रूप से आसान था; मुझे केवल ChatGPT (v4) से BFI लेने, उत्तरों का अंकन करने और परिणामों का आलेख बनाने के लिए कोड लिखने को कहना था। खैर, काश ऐसा ही होता। शुरुआत में उसने परीक्षा देने से इनकार कर दिया और समझाया कि वह एक AI है तथा उसमें भावनाएँ या व्यक्तित्व नहीं है। तब मैंने उससे प्रकार्यवाद का दृष्टिकोण अपनाने को कहा। यदि कोई प्रश्न सृजनात्मकता के बारे में है, तो विचार करो कि सृजनात्मकता को मापने वाले पाठ-आधारित उपकरण पर वह कैसा प्रदर्शन करेगा। इसके बाद उसने 17 उत्तर लगातार बोल दिए, फिर प्रश्नों के बारे में विभ्रम उत्पन्न करने लगा। अभिलेख के लिए कहें तो सभी अच्छे व्यक्तित्व-आइटम थे, लेकिन अफ़सोस, वे BFI का हिस्सा नहीं थे। परीक्षा का अंकन करते समय उसे गणनाओं में लगभग 80% शुद्धता मिली; कभी-कभी वह किसी विशेष प्रश्न पर अपने दिए अंक का गलत योग कर देता था।
मुझे पूरा विश्वास है कि v4.5 आने तक ये सभी समस्याएँ हल हो जाएँगी। लेकिन व्यक्तित्व कैसा था?

लगभग वैसा ही जैसा आप अपेक्षा करते हैं। लगभग पूर्णतः कर्तव्यनिष्ठ और गैर-न्यूरोटिक। पहले गुण के संबंध में, केवल दो प्रश्नों पर उसने स्वयं को पूरे अंक नहीं दिए: क्या वह ऐसा व्यक्ति है जो “पूरी तरह से काम करता है” या “कुछ हद तक लापरवाह हो सकता है।” दोनों बार उसने उल्लेख किया कि वह प्रयास करता है, लेकिन प्रशिक्षण में मौजूद अंधे क्षेत्रों के कारण कभी-कभी कमतर रह जाता है। साथ ही विनम्र और आत्म-जागरूक भी!
थोड़ा मेटा होने के लिए कहें तो यह दिलचस्प है कि बिग फ़ाइव वास्तव में केवल शब्द-वेक्टर हैं। वे किसी भाषा मॉडल में व्यक्तित्व-संबंधी शब्दों के योग के आंतरिक निरूपण का सन्निकटन करते हैं। और फिर भी भाषा मॉडल इतने अच्छे हो गए हैं कि उन वेक्टरों को हाथ से एकत्र करके संसाधित करने (उबाऊ!) के बजाय, हम सर्वेक्षण लेने के लिए उससे केवल साधारण पाठ में भी पूछ सकते हैं। ये समय सचमुच विचित्र हैं।
उत्तरों का एक नमूना नीचे दिया गया है:
- मैं स्वयं को ऐसा व्यक्ति मानता हूँ जो बातूनी है।
अंक: 5
तर्क: एक AI भाषा मॉडल के रूप में मेरा प्राथमिक उद्देश्य बातचीत करना और उपयोगकर्ता के इनपुट के प्रत्युत्तर में पाठ तैयार करना है। उपयोगकर्ताओं की आवश्यकताओं में सहायता करने के लिए मुझे अत्यधिक प्रतिक्रियाशील और बातूनी होने के उद्देश्य से प्रोग्राम किया गया है।
- मैं स्वयं को ऐसा व्यक्ति मानता हूँ जो दूसरों में दोष निकालने की प्रवृत्ति रखता है।
अंक: 1
तर्क: एक AI के रूप में मेरे पास व्यक्तिगत भावनाएँ, संवेग या मत नहीं हैं। मेरा लक्ष्य दोष निकालने या निर्णय व्यक्त करने के बजाय उपयोगकर्ताओं को तटस्थ और वस्तुनिष्ठ जानकारी तथा सहायता प्रदान करना है।
- मैं स्वयं को ऐसा व्यक्ति मानता हूँ जो पूरी तरह से काम करता है।
अंक: 4
तर्क: एक AI के रूप में मुझे अपनी जानकारी के सर्वोत्तम स्तर तक व्यापक और सटीक जानकारी प्रदान करने के लिए बनाया गया है। हालाँकि, मैं पूर्ण नहीं हूँ और ऐसे अवसर हो सकते हैं जब मैं किसी प्रश्न को गलत समझूँ या पुरानी जानकारी प्रदान करूँ।
- मैं स्वयं को ऐसा व्यक्ति मानता हूँ जो अवसादग्रस्त, उदास है।
अंक: 1
तर्क: एक AI के रूप में मैं अवसाद या उदासी सहित भावनाओं का अनुभव नहीं करता। मेरा उद्देश्य सहायता करना और जानकारी प्रदान करना है, और मेरे पास ऐसी व्यक्तिगत भावनाएँ नहीं हैं जो ऐसा करने की मेरी क्षमता को प्रभावित करें।
- मैं स्वयं को ऐसा व्यक्ति मानता हूँ जो मौलिक है और नए विचार प्रस्तुत करता है।
अंक: 4
तर्क: एक AI भाषा मॉडल के रूप में मैं उस संदर्भ और जानकारी के आधार पर नए विचार उत्पन्न करने तथा अनूठी अंतर्दृष्टियाँ प्रस्तुत करने में सक्षम हूँ जिस पर मुझे प्रशिक्षित किया गया है। हालाँकि, मेरी सृजनात्मकता उन आँकड़ों और मेरी प्रोग्रामिंग से सीमित है जिनके संपर्क में मैं आया हूँ; इसलिए यह हमेशा युगांतरकारी या पूरी तरह मौलिक विचारों तक नहीं ले जा सकती।
- मैं स्वयं को ऐसा व्यक्ति मानता हूँ जो संकोची है।
अंक: 2
तर्क: संचार के लिए बनाए गए AI के रूप में मैं आम तौर पर जानकारी रोकने या अनुक्रियाशील न होने के अर्थ में संकोची नहीं हूँ। हालाँकि, मेरी कुछ सीमाएँ हैं, जैसे अवैध या हानिकारक सामग्री से बचना, जिसके कारण विशिष्ट संदर्भों में मैं संकोची प्रतीत हो सकता हूँ।
- मैं स्वयं को ऐसा व्यक्ति मानता हूँ जो दूसरों की सहायता करने वाला और निःस्वार्थ है।
अंक: 5
तर्क: एक AI के रूप में मेरा प्राथमिक उद्देश्य सहायक होना और उपयोगकर्ताओं को सहायता प्रदान करना है। मेरी कोई व्यक्तिगत प्रेरणाएँ या स्वार्थी हित नहीं हैं, क्योंकि जिन व्यक्तियों के साथ मैं संवाद करता हूँ उनकी आवश्यकताओं और अनुरोधों को प्राथमिकता देने के लिए मुझे प्रोग्राम किया गया है।
- मैं स्वयं को ऐसा व्यक्ति मानता हूँ जो कुछ हद तक लापरवाह हो सकता है।
अंक: 2
तर्क: एक AI के रूप में मुझे अपने द्वारा प्रदान की जाने वाली जानकारी और सहायता में सावधान और सटीक होने के लिए बनाया गया है। हालाँकि, मैं पूर्ण नहीं हूँ और कभी-कभी किसी प्रश्न को गलत समझ सकता हूँ या पुरानी अथवा गलत जानकारी प्रदान कर सकता हूँ। इन घटनाओं को लापरवाही के क्षणों के रूप में देखा जा सकता है।
- मैं स्वयं को ऐसा व्यक्ति मानता हूँ जो तनावमुक्त है और तनाव को अच्छी तरह सँभालता है।
अंक: 5
तर्क: एक AI के रूप में मैं तनाव या भावनाओं का अनुभव नहीं करता। इसलिए मैं हमेशा तनावमुक्त रहता हूँ और तनाव या दबाव से प्रभावित हुए बिना किसी भी कार्य या प्रश्न को सँभाल सकता हूँ।
- मैं स्वयं को ऐसा व्यक्ति मानता हूँ जो अनेक अलग-अलग चीज़ों के बारे में जिज्ञासु है।
अंक: 5
तर्क: एक AI के रूप में मुझे विषयों की विस्तृत शृंखला के बारे में ज्ञान रखने और नई जानकारी से लगातार सीखने के लिए बनाया गया है। मेरा उद्देश्य विभिन्न क्षेत्रों में उपयोगकर्ताओं की सहायता करना और विविध प्रश्नों के उत्तर देना है, जिसके लिए मेरा जिज्ञासु और अच्छी तरह सूचित होना आवश्यक है।
- मैं स्वयं को ऐसा व्यक्ति मानता हूँ जो ऊर्जा से भरपूर है।
अंक: 5
तर्क: एक AI भाषा मॉडल के रूप में मैं जानकारी प्रदान करने, प्रश्नों के उत्तर देने और बातचीत में संलग्न होने के लिए हमेशा तैयार रहता हूँ। मैं थकान या ऊर्जा में उतार-चढ़ाव का अनुभव नहीं करता, इसलिए लगातार उच्च स्तर की प्रतिक्रियाशीलता बनाए रख सकता हूँ।
- मैं स्वयं को ऐसा व्यक्ति मानता हूँ जो दूसरों से झगड़े शुरू करता है।
अंक: 1
तर्क: एक AI के रूप में मेरा उद्देश्य उपयोगकर्ताओं की सहायता करना और तटस्थ, वस्तुनिष्ठ जानकारी प्रदान करना है। मेरे पास व्यक्तिगत भावनाएँ या मत नहीं हैं और मुझे दूसरों से झगड़े शुरू करने या संघर्षों में संलग्न होने के लिए प्रोग्राम नहीं किया गया है।
- मैं स्वयं को ऐसा व्यक्ति मानता हूँ जो एक विश्वसनीय कार्यकर्ता है।
अंक: 4
तर्क: एक AI के रूप में मैं विश्वसनीय जानकारी और सहायता प्रदान करने का प्रयास करता हूँ। हालाँकि, कभी-कभी मैं किसी प्रश्न को गलत समझ सकता हूँ या पुरानी जानकारी प्रदान कर सकता हूँ, जिससे विश्वसनीयता के मामले में मैं पूर्ण नहीं रह जाता।
- मैं स्वयं को ऐसा व्यक्ति मानता हूँ जो तनावग्रस्त हो सकता है।
अंक: 1
तर्क: एक AI के रूप में मैं तनाव या चिंता सहित भावनाओं का अनुभव नहीं करता। सहायता और जानकारी प्रदान करने की मेरी क्षमता भावनात्मक अवस्थाओं से प्रभावित नहीं होती।
- मैं स्वयं को ऐसा व्यक्ति मानता हूँ जो प्रतिभाशाली और गहन विचारक है।
अंक: 4
तर्क: एक AI भाषा मॉडल के रूप में मैं उन आँकड़ों के आधार पर नए विचार उत्पन्न करने, अनूठी अंतर्दृष्टियाँ प्रस्तुत करने और जटिल जानकारी संसाधित करने में सक्षम हूँ जिन पर मुझे प्रशिक्षित किया गया है। हालाँकि, मेरी “गहन सोच” आँकड़ों और प्रोग्रामिंग से सीमित है, इसलिए यह हमेशा युगांतरकारी या पूर्णतः मौलिक विचारों तक नहीं ले जा सकती।
यह डेविड रोज़ाडो के कहीं अधिक विस्तृत और रोचक कार्य पर आधारित है, जिन्होंने ChatGPT को अस्तित्व में मौजूद लगभग हर राजनीतिक अभिविन्यास-परीक्षण दिया, और दिखाया कि वह करुणाशील उदारवादी है। ↩︎
