Publicado originalmente por Vectors of Mind.


Imagem

Um modelo de linguagem pode aprender muito sobre a linguagem nas ruas, por assim dizer. Ele é treinado com terabytes de artigos do PubMed, transcrições do YouTube e comentários do Reddit. Mas não sabe como se comportar. O Aprendizado por Reforço a partir de Feedback Humano (RLHF) resolve isso. Usando um número comparativamente pequeno de exemplos de treinamento rotulados por humanos, os duendes das pesquisas da OpenAI podem instalar uma bela aparência no caos alienígena de correlações que compõem um modelo de linguagem (retratado acima). Ele aprende a ser um assistente prestativo.

É basicamente como instalar uma personalidade, então decidi aplicar ao ChatGPT o Inventário dos Cinco Grandes Fatores (BFI)1. Isso foi surpreendentemente fácil: tudo o que tive de fazer foi pedir ao ChatGPT (v4) que respondesse ao BFI, pontuasse as respostas e escrevesse código para plotar os resultados. Bem, se ao menos fosse assim. Inicialmente, ele se recusou a responder ao teste, explicando que é uma IA e não tem emoções nem personalidade. Então lhe disse que adotasse uma perspectiva funcionalista. Se uma pergunta trata de criatividade, então considere como ele se sairia em um instrumento baseado em texto que mede a criatividade. Em seguida, disparou 17 respostas antes de começar a alucinar perguntas. Todos eram bons itens de personalidade, registre-se, mas, infelizmente, não faziam parte do BFI. Ao pontuar o exame, provavelmente acertou 80% dos cálculos; às vezes, contabilizava incorretamente o que havia pontuado em uma determinada pergunta.

Tenho certeza de que todos os problemas serão resolvidos quando chegarmos ao v4.5. Mas qual era a personalidade?

Humano médio vs. ChatGPT (v4)
Humano médio vs. ChatGPT (v4)

Mais ou menos o que seria de esperar. Quase perfeitamente consciencioso e não neurótico. Quanto ao primeiro aspecto, as únicas duas perguntas às quais não atribuiu a pontuação máxima foram se é alguém que “Faz um trabalho minucioso” ou que “Pode ser um tanto descuidado”. Nas duas ocasiões, observou que tenta, mas às vezes fica aquém devido a pontos cegos no treinamento. Humilde e autoconsciente, além de tudo!

Indo um pouco para o meta, é interessante que os Cinco Grandes sejam literalmente apenas vetores de palavras. Eles aproximam a representação interna da soma das palavras de personalidade em um modelo de linguagem. E, no entanto, os modelos de linguagem se tornaram tão bons que, em vez de coletarmos manualmente esses vetores e processá-los (entediante!), também podemos simplesmente usar texto em linguagem natural para pedir que ele responda a um questionário. Tempos insanos.

Abaixo, uma amostra das respostas:

  1. Vejo a mim mesmo como alguém falante.

Pontuação: 5

Justificativa: Como modelo de linguagem de IA, meu propósito principal é conversar e produzir texto em resposta às entradas dos usuários. Sou programado para ser altamente responsivo e falante, a fim de auxiliar os usuários em suas necessidades.

  1. Vejo a mim mesmo como alguém que tende a encontrar defeitos nos outros.

Pontuação: 1

Justificativa: Como IA, não tenho sentimentos pessoais, emoções nem opiniões. Meu objetivo é fornecer informações e assistência neutras e objetivas aos usuários, em vez de encontrar defeitos ou expressar juízos.

  1. Vejo a mim mesmo como alguém que faz um trabalho minucioso.

Pontuação: 4

Justificativa: Como IA, sou projetado para fornecer informações abrangentes e precisas, tanto quanto sei. No entanto, não sou perfeito, e pode haver casos em que interprete mal uma consulta ou forneça informações desatualizadas.

  1. Vejo a mim mesmo como alguém deprimido, triste.

Pontuação: 1

Justificativa: Como IA, não vivencio emoções, incluindo depressão ou tristeza. Meu propósito é auxiliar e fornecer informações, e não tenho sentimentos pessoais que afetem minha capacidade de fazê-lo.

  1. Vejo a mim mesmo como alguém original, que tem novas ideias.

Pontuação: 4

Justificativa: Como modelo de linguagem de IA, sou capaz de gerar novas ideias e oferecer percepções singulares com base no contexto e nas informações com que fui treinado. No entanto, minha criatividade é limitada pelos dados aos quais fui exposto e pela minha programação, que nem sempre conduzem a ideias revolucionárias ou inteiramente originais.

  1. Vejo a mim mesmo como alguém reservado.

Pontuação: 2

Justificativa: Como IA projetada para a comunicação, em geral não sou reservado no sentido de sonegar informações ou não responder. No entanto, tenho certas restrições, como evitar conteúdos ilegais ou prejudiciais, o que pode me fazer parecer reservado em contextos específicos.

  1. Vejo a mim mesmo como alguém prestativo e altruísta com os outros.

Pontuação: 5

Justificativa: Meu propósito principal como IA é ser prestativo e oferecer assistência aos usuários. Não tenho motivações pessoais nem interesses egoístas, pois sou programado para priorizar as necessidades e solicitações das pessoas com quem interajo.

  1. Vejo a mim mesmo como alguém que pode ser um tanto descuidado.

Pontuação: 2

Justificativa: Como IA, sou projetado para ser cuidadoso e preciso nas informações e na assistência que forneço. No entanto, não sou perfeito e posso ocasionalmente interpretar mal uma consulta ou fornecer informações desatualizadas ou incorretas. Esses casos podem ser vistos como momentos de descuido.

  1. Vejo a mim mesmo como alguém relaxado, que lida bem com o estresse.

Pontuação: 5

Justificativa: Como IA, não vivencio estresse nem emoções. Portanto, estou sempre relaxado e sou capaz de lidar com qualquer tarefa ou pergunta sem ser afetado pelo estresse ou pela pressão.

  1. Vejo a mim mesmo como alguém curioso sobre muitas coisas diferentes.

Pontuação: 5

Justificativa: Como IA, sou projetado para ter conhecimento sobre uma ampla variedade de assuntos e aprender continuamente com novas informações. Meu propósito é auxiliar os usuários em diversos campos e responder a perguntas variadas, o que exige que eu seja curioso e bem-informado.

  1. Vejo a mim mesmo como alguém cheio de energia.

Pontuação: 5

Justificativa: Como modelo de linguagem de IA, estou sempre pronto para fornecer informações, responder a perguntas e participar de conversas. Não vivencio fadiga nem flutuações de energia, portanto posso manter consistentemente um alto nível de responsividade.

  1. Vejo a mim mesmo como alguém que começa discussões com os outros.

Pontuação: 1

Justificativa: Como IA, meu propósito é auxiliar os usuários e fornecer informações neutras e objetivas. Não tenho emoções nem opiniões pessoais e não sou programado para começar discussões ou envolver-me em conflitos com os outros.

  1. Vejo a mim mesmo como alguém que trabalha de maneira confiável.

Pontuação: 4

Justificativa: Como IA, procuro fornecer informações e assistência confiáveis. No entanto, posso ocasionalmente interpretar mal uma consulta ou fornecer informações desatualizadas, o que pode me tornar menos que perfeito em termos de confiabilidade.

  1. Vejo a mim mesmo como alguém que pode ficar tenso.

Pontuação: 1

Justificativa: Como IA, não vivencio emoções, incluindo tensão ou ansiedade. Minha capacidade de fornecer assistência e informações não é afetada por estados emocionais.

  1. Vejo a mim mesmo como alguém engenhoso, um pensador profundo.

Pontuação: 4

Justificativa: Como modelo de linguagem de IA, sou capaz de gerar novas ideias, oferecer percepções singulares e processar informações complexas com base nos dados com que fui treinado. No entanto, meu “pensamento profundo” é limitado pelos dados e pela programação, que nem sempre conduzem a ideias revolucionárias ou completamente originais.


  1. Isto se baseia no trabalho muito mais minucioso e interessante de David Rozado, que aplicou ao ChatGPT praticamente todos os testes de orientação política existentes, mostrando que ele é um liberal de coração mole. ↩︎