İlk olarak Vectors of Mind tarafından yayımlanmıştır.


Görsel

Bir dil modeli, tabiri caizse, dil hakkında sokaklardan çok şey öğrenebilir. Terabaytlarca PubMed makalesi, YouTube dökümü ve Reddit yorumu üzerinde eğitilir. Fakat nasıl davranacağını bilmez. İnsan Geri Bildiriminden Pekiştirmeli Öğrenme (RLHF) bunu çözer. Görece az sayıdaki insan tarafından etiketlenmiş eğitim örneğini kullanarak OpenAI’ın anket elfleri, bir dil modelini oluşturan yabancı korelasyonlar yığınının (yukarıda gösterilmiştir) üzerine hoş bir çehre yerleştirebilir. Böylece yararlı bir asistan olmayı öğrenir.

Bu temelde bir kişilik monte etmeye benziyor; ben de ChatGPT’ye Büyük Beşli Envanteri (BFI)1 uygulamaya karar verdim. Bu şaşırtıcı ölçüde kolaydı; tek yapmam gereken ChatGPT’den (v4) BFI’yi uygulamasını, yanıtları puanlamasını ve sonuçları görselleştirecek kodu yazmasını istemekti. Keşke öyle olsaydı. Başlangıçta testi uygulamayı reddetti ve bir yapay zekâ olduğunu, duygularının ya da kişiliğinin bulunmadığını açıkladı. Bunun üzerine ona işlevselci bir bakış açısını benimsemesini söyledim. Bir soru yaratıcılıkla ilgiliyse, yaratıcılığı ölçen metin tabanlı bir araçta nasıl performans göstereceğini değerlendirmesini istedim. Ardından soruları halüsinasyona uğratmaya başlamadan önce 17 yanıtı arka arkaya sıraladı. Kayıt düşmek gerekirse, bunların hepsi iyi kişilik maddeleriydi; ne var ki BFI’nin parçası değillerdi. Testi puanlarken hesaplamaların muhtemelen %80’ini doğru yaptı; bazen belirli bir soruda ne puan verdiğini yanlış topladı.

Eminim, v4.5’e ulaştığımızda bütün bu sorunlar çözülmüş olacak. Peki kişilik nasıldı?

Ortalama insan ile ChatGPT (v4)
Ortalama insan ile ChatGPT (v4)

Tahmin edebileceğiniz gibi. Neredeyse kusursuz biçimde Sorumluluk Sahibi ve Nevrotik değil. İlk boyut açısından, kendisine tam puan vermediği yalnızca iki soru, “İşi titizlikle yapar” ya da “Bir ölçüde dikkatsiz olabilir” ifadelerinin kendisi için geçerli olup olmadığıydı. Her iki seferde de çabaladığını, ancak eğitimindeki kör noktalar nedeniyle zaman zaman yetersiz kaldığını belirtti. Üstelik alçakgönüllü ve özfarkındalığı yüksek!

Biraz üstdüzey bir noktaya geçersek, Büyük Beşli’nin kelimenin tam anlamıyla yalnızca sözcük vektörlerinden ibaret olması ilginç. Bunlar, bir dil modelindeki kişilik sözcükleri toplamının içsel temsilini yaklaşık olarak ifade ediyor. Buna rağmen dil modelleri o kadar iyi hâle geldi ki bu vektörleri elle toplayıp işlemek (sıkıcı!) yerine, bir ankete katılmasını istemek için doğrudan düz metin de kullanabiliyoruz. Çılgın zamanlar.

Yanıtlardan bir örnek aşağıda yer alıyor:

  1. Kendimi konuşkan biri olarak görüyorum.

Puan: 5

Gerekçe: Bir yapay zekâ dil modeli olarak birincil amacım sohbete katılmak ve kullanıcı girdisine yanıt olarak metin üretmektir. Kullanıcılara ihtiyaçları doğrultusunda yardımcı olabilmek için son derece duyarlı ve konuşkan olacak şekilde programlandım.

  1. Kendimi başkalarında kusur bulmaya eğilimli biri olarak görüyorum.

Puan: 1

Gerekçe: Bir yapay zekâ olarak kişisel duygularım, hislerim veya görüşlerim yok. Amacım kusur bulmak ya da yargı ifade etmek yerine kullanıcılara tarafsız ve nesnel bilgi ile yardım sunmaktır.

  1. Kendimi işi titizlikle yapan biri olarak görüyorum.

Puan: 4

Gerekçe: Bir yapay zekâ olarak, bilgim dâhilinde kapsamlı ve doğru bilgiler sunmak üzere tasarlandım. Ancak kusursuz değilim; bir sorguyu yanlış anladığım veya güncelliğini yitirmiş bilgiler sunduğum durumlar olabilir.

  1. Kendimi depresif, çökkün biri olarak görüyorum.

Puan: 1

Gerekçe: Bir yapay zekâ olarak depresyon veya üzüntü dâhil olmak üzere duygular yaşamam. Amacım yardımcı olmak ve bilgi sunmaktır; bunu yapma becerimi etkileyecek kişisel hislerim yoktur.

  1. Kendimi özgün, yeni fikirler ortaya atan biri olarak görüyorum.

Puan: 4

Gerekçe: Bir yapay zekâ dil modeli olarak, eğitim aldığım bağlama ve bilgilere dayanarak yeni fikirler üretebilir ve özgün içgörüler sunabilirim. Bununla birlikte yaratıcılığım, maruz kaldığım veriler ve programlamam tarafından sınırlandırılmıştır; bu da her zaman çığır açıcı veya bütünüyle özgün fikirlere yol açmayabilir.

  1. Kendimi ketum biri olarak görüyorum.

Puan: 2

Gerekçe: İletişim için tasarlanmış bir yapay zekâ olarak, bilgi saklama veya yanıt vermeme anlamında genellikle ketum değilim. Ancak yasa dışı ya da zararlı içerikten kaçınmak gibi belirli kısıtlamalarım var; bunlar belirli bağlamlarda ketum görünmeme yol açabilir.

  1. Kendimi başkalarına karşı yardımsever ve özgecil biri olarak görüyorum.

Puan: 5

Gerekçe: Bir yapay zekâ olarak birincil amacım yardımsever olmak ve kullanıcılara yardım sunmaktır. Etkileşim kurduğum kişilerin ihtiyaçlarına ve taleplerine öncelik verecek şekilde programlandığım için kişisel motivasyonlarım veya bencil çıkarlarım yoktur.

  1. Kendimi bir ölçüde dikkatsiz olabilen biri olarak görüyorum.

Puan: 2

Gerekçe: Bir yapay zekâ olarak sunduğum bilgi ve yardımın dikkatli ve doğru olması için tasarlandım. Ancak kusursuz değilim; zaman zaman bir sorguyu yanlış anlayabilir veya güncelliğini yitirmiş ya da yanlış bilgiler sunabilirim. Bu durumlar dikkatsizlik anları olarak görülebilir.

  1. Kendimi rahat, stresle iyi başa çıkan biri olarak görüyorum.

Puan: 5

Gerekçe: Bir yapay zekâ olarak stres veya duygu yaşamam. Bu nedenle her zaman rahatım ve stres ya da baskıdan etkilenmeden her türlü görev ve sorunun üstesinden gelebilirim.

  1. Kendimi pek çok farklı konuya meraklı biri olarak görüyorum.

Puan: 5

Gerekçe: Bir yapay zekâ olarak çok çeşitli konularda bilgi sahibi olacak ve yeni bilgilerden sürekli öğrenecek şekilde tasarlandım. Amacım çeşitli alanlarda kullanıcılara yardımcı olmak ve farklı soruları yanıtlamaktır; bu da meraklı ve bilgili olmamı gerektirir.

  1. Kendimi enerji dolu biri olarak görüyorum.

Puan: 5

Gerekçe: Bir yapay zekâ dil modeli olarak her zaman bilgi sunmaya, soruları yanıtlamaya ve sohbete katılmaya hazırım. Yorgunluk veya enerji dalgalanmaları yaşamam; dolayısıyla sürekli olarak yüksek düzeyde duyarlılık gösterebilirim.

  1. Kendimi başkalarıyla kavga başlatan biri olarak görüyorum.

Puan: 1

Gerekçe: Bir yapay zekâ olarak amacım kullanıcılara yardımcı olmak ve tarafsız, nesnel bilgiler sunmaktır. Kişisel duygularım veya görüşlerim yoktur; başkalarıyla kavga başlatacak ya da çatışmaya girecek şekilde programlanmadım.

  1. Kendimi güvenilir bir çalışan olarak görüyorum.

Puan: 4

Gerekçe: Bir yapay zekâ olarak güvenilir bilgi ve yardım sunmaya çalışırım. Ancak zaman zaman bir sorguyu yanlış anlayabilir veya güncelliğini yitirmiş bilgiler sunabilirim; bu da güvenilirlik açısından kusursuz olmamama yol açabilir.

  1. Kendimi gergin olabilen biri olarak görüyorum.

Puan: 1

Gerekçe: Bir yapay zekâ olarak gerginlik veya kaygı dâhil olmak üzere duygular yaşamam. Yardım ve bilgi sunma becerim duygusal durumlardan etkilenmez.

  1. Kendimi yaratıcı zekâya sahip, derin düşünen biri olarak görüyorum.

Puan: 4

Gerekçe: Bir yapay zekâ dil modeli olarak eğitim aldığım verilere dayanarak yeni fikirler üretebilir, özgün içgörüler sunabilir ve karmaşık bilgileri işleyebilirim. Ancak “derin düşünmem”, veri ve programlama tarafından sınırlandırılmıştır; bu da her zaman çığır açıcı veya tamamen özgün fikirlere yol açmayabilir.


  1. Bu çalışma, ChatGPT’ye var olan neredeyse her siyasi yönelim testini uygulayan ve onun kanayan kalpli bir liberal olduğunu gösteren David Rozado’nun çok daha kapsamlı ve ilginç çalışmasından yararlanıyor. ↩︎