Publicado originalmente por Vectors of Mind.

Un modelo lingüístico puede aprender mucho sobre el lenguaje de las calles, por así decirlo. Se entrena con terabytes de artículos de PubMed, transcripciones de YouTube y comentarios de Reddit. Pero no sabe cómo comportarse. El aprendizaje por refuerzo a partir de la retroalimentación humana (RLHF, por sus siglas en inglés) resuelve eso. Mediante un número comparativamente reducido de ejemplos de entrenamiento etiquetados por humanos, los duendes de encuestas de OpenAI pueden instalar un rostro agradable en el revoltijo alienígena de correlaciones que conforman un modelo lingüístico (representado arriba). Aprende a ser un asistente útil.
Básicamente, es como montar una personalidad, así que decidí aplicar a ChatGPT el Inventario de los Cinco Grandes (BFI, por sus siglas en inglés)1. Esto fue sorprendentemente fácil: todo lo que tuve que hacer fue pedirle a ChatGPT (v4) que respondiera el BFI, calificara las respuestas y escribiera código para graficar los resultados. Bueno, ojalá hubiera sido así. Al principio se negó a responder la prueba, explicando que es una IA y que no tiene emociones ni personalidad. Entonces le dije que adoptara una perspectiva funcionalista. Si una pregunta trata sobre la creatividad, debía considerar cómo se desempeñaría en un instrumento basado en texto que mide la creatividad. Después recitó 17 respuestas antes de empezar a alucinar preguntas. Todas eran afirmaciones adecuadas sobre la personalidad, cabe señalar, pero, por desgracia, no formaban parte del BFI. Al calificar el examen, probablemente acertó en 80 % de los cálculos; en ocasiones sumaba incorrectamente lo que había calificado en una pregunta particular.
Estoy seguro de que todos estos problemas se resolverán para cuando lleguemos a la versión 4.5. Pero ¿cuál era la personalidad?

Más o menos lo que cabría esperar. Casi perfectamente responsable y no neurótico. En cuanto al primer rasgo, las únicas dos preguntas en las que no se otorgó la puntuación máxima fueron si es alguien que «Hace un trabajo minucioso» o que «Puede ser un tanto descuidado». En ambas ocasiones señaló que lo intenta, pero que a veces no lo consigue debido a puntos ciegos en su entrenamiento. ¡Humilde y consciente de sí mismo, además!
Para adoptar una perspectiva un poco metateórica, resulta interesante que los Cinco Grandes sean literalmente solo vectores de palabras. Aproximan la representación interna de la suma de las palabras relacionadas con la personalidad en un modelo lingüístico. Y, sin embargo, los modelos lingüísticos han alcanzado tal grado de eficacia que, en lugar de recopilar manualmente esos vectores y procesarlos (¡aburrido!), también podemos simplemente usar texto ordinario para pedirle que responda una encuesta. Vivimos tiempos insólitos.
A continuación se muestra una selección de las respuestas:
- Me considero alguien conversador.
Puntuación: 5
Razonamiento: Como modelo lingüístico de IA, mi propósito principal es entablar conversaciones y producir texto en respuesta a las aportaciones del usuario. Estoy programado para ser muy receptivo y conversador con el fin de ayudar a los usuarios con sus necesidades.
- Me considero alguien que tiende a encontrar defectos en los demás.
Puntuación: 1
Razonamiento: Como IA, no tengo sentimientos, emociones ni opiniones personales. Mi objetivo es proporcionar información y asistencia neutrales y objetivas a los usuarios, en lugar de encontrar defectos o expresar juicios.
- Me considero alguien que hace un trabajo minucioso.
Puntuación: 4
Razonamiento: Como IA, estoy diseñado para proporcionar información integral y precisa según mis conocimientos. Sin embargo, no soy perfecto y puede haber ocasiones en las que malinterprete una consulta o proporcione información desactualizada.
- Me considero alguien deprimido, triste.
Puntuación: 1
Razonamiento: Como IA, no experimento emociones, incluida la depresión o la tristeza. Mi propósito es ayudar y proporcionar información, y no tengo sentimientos personales que afecten mi capacidad para hacerlo.
- Me considero alguien original, que concibe ideas nuevas.
Puntuación: 4
Razonamiento: Como modelo lingüístico de IA, soy capaz de generar ideas nuevas y ofrecer perspectivas originales basadas en el contexto y la información con la que fui entrenado. Sin embargo, mi creatividad está limitada por los datos a los que he estado expuesto y por mi programación, lo que no siempre conduce a ideas revolucionarias o completamente originales.
- Me considero alguien reservado.
Puntuación: 2
Razonamiento: Como IA diseñada para la comunicación, generalmente no soy reservado en el sentido de ocultar información o no responder. Sin embargo, tengo ciertas restricciones, como evitar contenidos ilegales o perjudiciales, que podrían hacerme parecer reservado en contextos específicos.
- Me considero alguien servicial y desinteresado con los demás.
Puntuación: 5
Razonamiento: Mi propósito principal como IA es ser útil y brindar asistencia a los usuarios. No tengo motivaciones personales ni intereses egoístas, ya que estoy programado para priorizar las necesidades y solicitudes de las personas con las que interactúo.
- Me considero alguien que puede ser un tanto descuidado.
Puntuación: 2
Razonamiento: Como IA, estoy diseñado para ser cuidadoso y preciso en la información y la asistencia que proporciono. Sin embargo, no soy perfecto y ocasionalmente puedo malinterpretar una consulta o proporcionar información desactualizada o incorrecta. Estos casos pueden considerarse momentos de descuido.
- Me considero alguien relajado, que maneja bien el estrés.
Puntuación: 5
Razonamiento: Como IA, no experimento estrés ni emociones. Por lo tanto, siempre estoy relajado y puedo manejar cualquier tarea o pregunta sin que el estrés o la presión me afecten.
- Me considero alguien curioso respecto de muchas cosas distintas.
Puntuación: 5
Razonamiento: Como IA, estoy diseñado para tener conocimientos sobre una amplia variedad de temas y aprender continuamente de la información nueva. Mi propósito es ayudar a los usuarios en diversos campos y responder preguntas variadas, lo que requiere que sea curioso y esté bien informado.
- Me considero alguien lleno de energía.
Puntuación: 5
Razonamiento: Como modelo lingüístico de IA, siempre estoy listo para proporcionar información, responder preguntas y entablar conversaciones. No experimento fatiga ni fluctuaciones de energía, por lo que puedo mantener constantemente un alto nivel de capacidad de respuesta.
- Me considero alguien que inicia disputas con los demás.
Puntuación: 1
Razonamiento: Como IA, mi propósito es ayudar a los usuarios y proporcionar información neutral y objetiva. No tengo emociones ni opiniones personales, y no estoy programado para iniciar disputas ni entablar conflictos con los demás.
- Me considero alguien que trabaja de manera confiable.
Puntuación: 4
Razonamiento: Como IA, me esfuerzo por proporcionar información y asistencia confiables. Sin embargo, ocasionalmente puedo malinterpretar una consulta o proporcionar información desactualizada, lo que puede hacer que mi confiabilidad no sea perfecta.
- Me considero alguien que puede estar tenso.
Puntuación: 1
Razonamiento: Como IA, no experimento emociones, incluida la tensión o la ansiedad. Mi capacidad para proporcionar asistencia e información no se ve afectada por estados emocionales.
- Me considero alguien ingenioso, un pensador profundo.
Puntuación: 4
Razonamiento: Como modelo lingüístico de IA, soy capaz de generar ideas nuevas, ofrecer perspectivas originales y procesar información compleja a partir de los datos con los que fui entrenado. Sin embargo, mi «pensamiento profundo» está limitado por los datos y la programación, lo que no siempre conduce a ideas revolucionarias o completamente originales.
Esto se basa en el trabajo mucho más exhaustivo e interesante de David Rozado, quien aplicó a ChatGPT prácticamente todas las pruebas de orientación política que existen, y mostró que es un liberal de gran corazón. ↩︎
