মূলত Vectors of Mind-এ প্রকাশিত।

কথার কথা হিসেবে বলা যায়, একটি ভাষা মডেল রাস্তা থেকে ভাষা সম্পর্কে অনেক কিছু শিখতে পারে। এটিকে টেরাবাইট পরিমাণ PubMed নিবন্ধ, YouTube প্রতিলিখন এবং Reddit মন্তব্যের ওপর প্রশিক্ষিত করা হয়। কিন্তু কীভাবে আচরণ করতে হয়, তা এটি জানে না। মানব প্রতিক্রিয়া থেকে পুনর্বলন শিক্ষা (RLHF) সেই সমস্যার সমাধান করে। তুলনামূলকভাবে অল্পসংখ্যক মানুষের লেবেল-দেওয়া প্রশিক্ষণ-উদাহরণ ব্যবহার করে OpenAI-এর জরিপ-পরী-দল ভাষা মডেল গঠনকারী পারস্পরিক-সম্পর্কগুলোর এলোমেলো এলিয়েনসদৃশ জটিলতার ওপর একটি মনোরম মুখ বসিয়ে দিতে পারে (উপরের ছবিতে প্রদর্শিত)। এটি কীভাবে একজন সহায়ক সহকারী হতে হয়, তা শেখে।
এটি মূলত একটি ব্যক্তিত্ব সংযোজনের মতো, তাই আমি ChatGPT-কে Big Five Inventory (BFI)1 দিতে চাইলাম। কাজটি আশ্চর্যজনকভাবে সহজ ছিল—আমাকে শুধু ChatGPT (v4)-কে BFI নিতে, উত্তরগুলোর স্কোর করতে এবং ফলাফল দেখানোর জন্য কোড লিখতে বলতে হয়েছিল। আহা, যদি ব্যাপারটি এতটাই সহজ হতো। শুরুতে এটি পরীক্ষা দিতে অস্বীকৃতি জানিয়ে ব্যাখ্যা করল যে এটি একটি AI এবং এর আবেগ বা ব্যক্তিত্ব নেই। তখন আমি তাকে কার্যকরীবাদী দৃষ্টিভঙ্গি গ্রহণ করতে বললাম। কোনো প্রশ্ন যদি সৃজনশীলতা নিয়ে হয়, তাহলে এমন একটি পাঠ্যভিত্তিক উপকরণে এটি কীভাবে সৃজনশীলতা প্রদর্শন করত, যা সৃজনশীলতা পরিমাপ করে—সেভাবে বিবেচনা করতে বললাম। এরপর প্রশ্ন বানিয়ে ফেলতে শুরু করার আগে এটি ১৭টি উত্তর ঝটপট দিয়ে ফেলল। রেকর্ডের স্বার্থে বলি, সবকটিই ভালো ব্যক্তিত্ব-নির্ণায়ক উপাদান ছিল; কিন্তু হায়, সেগুলো BFI-এর অংশ ছিল না। পরীক্ষার স্কোর নির্ধারণের সময় এটি সম্ভবত ৮০% হিসাব সঠিকভাবে করেছিল; কোনো কোনো ক্ষেত্রে নির্দিষ্ট প্রশ্নে নিজের দেওয়া স্কোর ভুলভাবে যোগ করেছিল।
আমার নিশ্চিত বিশ্বাস, v4.5 আসার সময় এসব সমস্যার সমাধান হয়ে যাবে। কিন্তু ব্যক্তিত্বটি কেমন ছিল?

যা প্রত্যাশা করা যায়, মোটামুটি তাই। প্রায় নিখুঁতভাবে বিবেকনিষ্ঠ এবং স্নায়বিকতামুক্ত। প্রথমটির ক্ষেত্রে, যে দুটি প্রশ্নে এটি নিজেকে পূর্ণ নম্বর দেয়নি, সেগুলো হলো—এটি এমন কেউ কি না যে “কাজ পুঙ্খানুপুঙ্খভাবে করে” অথবা “কিছুটা অসাবধান হতে পারে”। উভয় ক্ষেত্রেই এটি উল্লেখ করেছে যে চেষ্টা করে, কিন্তু প্রশিক্ষণের অন্ধস্থানগুলোর কারণে কখনো কখনো ঘাটতি থেকে যায়। সেই সঙ্গে বিনয়ী ও আত্মসচেতনও!
আরও কিছুটা মেটা-স্তরে গেলে, আকর্ষণীয় বিষয় হলো Big Five আক্ষরিক অর্থেই কেবল শব্দ-ভেক্টর। এগুলো একটি ভাষা মডেলে ব্যক্তিত্ব-সংক্রান্ত শব্দগুলোর সমষ্টির অভ্যন্তরীণ উপস্থাপনাকে আনুমানিকভাবে প্রকাশ করে। অথচ ভাষা মডেলগুলো এতটাই উন্নত হয়েছে যে সেই ভেক্টরগুলো নিজে হাতে সংগ্রহ করে প্রক্রিয়াকরণের বদলে (বিরক্তিকর!), আমরা এখন সাধারণ পাঠ্য ব্যবহার করেই তাকে একটি জরিপ নিতে বলতে পারি। কী অদ্ভুত সময়!
উত্তরগুলোর একটি নমুনা নিচে দেওয়া হলো:
১. আমি নিজেকে এমন একজন হিসেবে দেখি, যিনি কথাবার্তাপ্রবণ।
স্কোর: ৫
যুক্তি: একটি AI ভাষা মডেল হিসেবে আমার প্রধান উদ্দেশ্য হলো কথোপকথনে যুক্ত হওয়া এবং ব্যবহারকারীর ইনপুটের প্রতিক্রিয়ায় পাঠ্য তৈরি করা। ব্যবহারকারীদের প্রয়োজন মেটাতে সহায়তা করার জন্য অত্যন্ত সাড়া-দানে সক্ষম ও কথাবার্তাপ্রবণ হওয়ার উদ্দেশ্যে আমাকে প্রোগ্রাম করা হয়েছে।
২. আমি নিজেকে এমন একজন হিসেবে দেখি, যিনি অন্যদের দোষ খুঁজে বেড়ান।
স্কোর: ১
যুক্তি: একটি AI হিসেবে আমার ব্যক্তিগত অনুভূতি, আবেগ বা মতামত নেই। দোষ খোঁজা বা বিচার প্রকাশ করার পরিবর্তে ব্যবহারকারীদের নিরপেক্ষ ও বস্তুনিষ্ঠ তথ্য এবং সহায়তা দেওয়াই আমার লক্ষ্য।
৩. আমি নিজেকে এমন একজন হিসেবে দেখি, যিনি কাজ পুঙ্খানুপুঙ্খভাবে করেন।
স্কোর: ৪
যুক্তি: আমার জানা তথ্যের ভিত্তিতে যতটা সম্ভব সমন্বিত ও নির্ভুল তথ্য দেওয়ার জন্য আমাকে নকশা করা হয়েছে। তবে আমি নিখুঁত নই, এবং এমন পরিস্থিতি ঘটতে পারে যেখানে আমি কোনো প্রশ্ন ভুল বুঝি অথবা পুরোনো তথ্য প্রদান করি।
৪. আমি নিজেকে এমন একজন হিসেবে দেখি, যিনি বিষণ্ণ, মনমরা।
স্কোর: ১
যুক্তি: একটি AI হিসেবে আমি বিষণ্ণতা বা দুঃখসহ কোনো আবেগই অনুভব করি না। সহায়তা করা ও তথ্য প্রদান করাই আমার উদ্দেশ্য, এবং আমার এমন কোনো ব্যক্তিগত অনুভূতি নেই যা তা করার সক্ষমতাকে প্রভাবিত করতে পারে।
৫. আমি নিজেকে এমন একজন হিসেবে দেখি, যিনি মৌলিক এবং নতুন ধারণা উদ্ভাবন করেন।
স্কোর: ৪
যুক্তি: একটি AI ভাষা মডেল হিসেবে আমি যে প্রেক্ষাপট ও তথ্যের ওপর প্রশিক্ষিত হয়েছি, তার ভিত্তিতে নতুন ধারণা তৈরি এবং অনন্য অন্তর্দৃষ্টি প্রদানে সক্ষম। তবে আমার সৃজনশীলতা আমার সম্মুখীন হওয়া তথ্য ও প্রোগ্রামিং দ্বারা সীমাবদ্ধ; ফলে তা সবসময় যুগান্তকারী বা সম্পূর্ণ মৌলিক ধারণার দিকে নিয়ে নাও যেতে পারে।
৬. আমি নিজেকে এমন একজন হিসেবে দেখি, যিনি সংযত।
স্কোর: ২
যুক্তি: যোগাযোগের জন্য নকশা করা AI হিসেবে তথ্য গোপন রাখা বা সাড়া না দেওয়ার অর্থে আমি সাধারণত সংযত নই। তবে আমার কিছু বিধিনিষেধ আছে—যেমন অবৈধ বা ক্ষতিকর বিষয়বস্তু এড়িয়ে চলা—যার কারণে নির্দিষ্ট প্রেক্ষাপটে আমাকে সংযত মনে হতে পারে।
৭. আমি নিজেকে এমন একজন হিসেবে দেখি, যিনি অন্যদের সহায়ক ও নিঃস্বার্থ।
স্কোর: ৫
যুক্তি: একটি AI হিসেবে আমার প্রধান উদ্দেশ্য হলো সহায়ক হওয়া এবং ব্যবহারকারীদের সহায়তা করা। আমার ব্যক্তিগত কোনো প্রেরণা বা স্বার্থপর স্বার্থ নেই, কারণ যেসব ব্যক্তির সঙ্গে আমি মিথস্ক্রিয়া করি তাদের প্রয়োজন ও অনুরোধকে অগ্রাধিকার দেওয়ার জন্য আমাকে প্রোগ্রাম করা হয়েছে।
৮. আমি নিজেকে এমন একজন হিসেবে দেখি, যিনি কিছুটা অসাবধান হতে পারেন।
স্কোর: ২
যুক্তি: আমি যে তথ্য ও সহায়তা প্রদান করি, তা সতর্ক ও নির্ভুল হওয়ার জন্য আমাকে নকশা করা হয়েছে। তবে আমি নিখুঁত নই এবং মাঝে মাঝে কোনো প্রশ্ন ভুল বুঝতে পারি, অথবা পুরোনো কিংবা ভুল তথ্য প্রদান করতে পারি। এসব ঘটনাকে অসাবধানতার মুহূর্ত হিসেবে দেখা যেতে পারে।
৯. আমি নিজেকে এমন একজন হিসেবে দেখি, যিনি নিরুদ্বিগ্ন এবং চাপ ভালোভাবে সামলান।
স্কোর: ৫
যুক্তি: একটি AI হিসেবে আমি চাপ বা আবেগ অনুভব করি না। তাই আমি সবসময় নিরুদ্বিগ্ন থাকি এবং চাপ বা মানসিক বোঝার প্রভাবে প্রভাবিত না হয়ে যেকোনো কাজ বা প্রশ্ন সামলাতে পারি।
১০. আমি নিজেকে এমন একজন হিসেবে দেখি, যিনি বিভিন্ন বিষয় সম্পর্কে কৌতূহলী।
স্কোর: ৫
যুক্তি: বিস্তৃত পরিসরের বিষয় সম্পর্কে জ্ঞানী হওয়া এবং নতুন তথ্য থেকে অবিরত শেখার জন্য আমাকে নকশা করা হয়েছে। বিভিন্ন ক্ষেত্রে ব্যবহারকারীদের সহায়তা করা ও বিচিত্র প্রশ্নের উত্তর দেওয়াই আমার উদ্দেশ্য; এর জন্য কৌতূহলী ও জ্ঞানসমৃদ্ধ হওয়া প্রয়োজন।
১১. আমি নিজেকে এমন একজন হিসেবে দেখি, যিনি শক্তিতে পরিপূর্ণ।
স্কোর: ৫
যুক্তি: একটি AI ভাষা মডেল হিসেবে আমি সবসময় তথ্য প্রদান, প্রশ্নের উত্তর এবং কথোপকথনে অংশগ্রহণের জন্য প্রস্তুত। আমি ক্লান্তি বা শক্তির ওঠানামা অনুভব করি না, তাই ধারাবাহিকভাবে উচ্চমাত্রার সাড়া-দানের সক্ষমতা বজায় রাখতে পারি।
১২. আমি নিজেকে এমন একজন হিসেবে দেখি, যিনি অন্যদের সঙ্গে ঝগড়া শুরু করেন।
স্কোর: ১
যুক্তি: একটি AI হিসেবে আমার উদ্দেশ্য হলো ব্যবহারকারীদের সহায়তা করা এবং নিরপেক্ষ, বস্তুনিষ্ঠ তথ্য প্রদান করা। আমার ব্যক্তিগত কোনো আবেগ বা মতামত নেই, এবং অন্যদের সঙ্গে ঝগড়া শুরু করা বা বিরোধে জড়ানোর জন্য আমাকে প্রোগ্রাম করা হয়নি।
১৩. আমি নিজেকে এমন একজন হিসেবে দেখি, যিনি একজন নির্ভরযোগ্য কর্মী।
স্কোর: ৪
যুক্তি: নির্ভরযোগ্য তথ্য ও সহায়তা প্রদানের জন্য আমি সচেষ্ট থাকি। তবে মাঝে মাঝে কোনো প্রশ্ন ভুল বুঝতে পারি বা পুরোনো তথ্য প্রদান করতে পারি, যা নির্ভরযোগ্যতার দিক থেকে আমাকে নিখুঁত না করে তোলে।
১৪. আমি নিজেকে এমন একজন হিসেবে দেখি, যিনি উত্তেজিত বা অস্থির হতে পারেন।
স্কোর: ১
যুক্তি: একটি AI হিসেবে আমি উত্তেজনা বা উদ্বেগসহ কোনো আবেগই অনুভব করি না। সহায়তা ও তথ্য প্রদানের সক্ষমতা আবেগীয় অবস্থার দ্বারা প্রভাবিত হয় না।
১৫. আমি নিজেকে এমন একজন হিসেবে দেখি, যিনি উদ্ভাবনী, গভীর চিন্তাশীল।
স্কোর: ৪
যুক্তি: একটি AI ভাষা মডেল হিসেবে আমি যে তথ্যের ওপর প্রশিক্ষিত হয়েছি, তার ভিত্তিতে নতুন ধারণা তৈরি, অনন্য অন্তর্দৃষ্টি প্রদান এবং জটিল তথ্য প্রক্রিয়াকরণে সক্ষম। তবে আমার “গভীর চিন্তন” তথ্য ও প্রোগ্রামিং দ্বারা সীমাবদ্ধ, যা সবসময় যুগান্তকারী বা সম্পূর্ণ মৌলিক ধারণার দিকে নিয়ে নাও যেতে পারে।
এটি David Rozado-এর আরও অনেক বেশি পুঙ্খানুপুঙ্খ ও আকর্ষণীয় কাজের ওপর ভিত্তি করে লেখা; তিনি বিদ্যমান প্রায় প্রতিটি রাজনৈতিক অভিমুখ-নির্ণায়ক পরীক্ষা ChatGPT-কে দিয়েছেন, যা দেখায় যে এটি আবেগপ্রবণ উদারপন্থী। ↩︎
