
Штучний інтелект ChatGPT створив два психологічні опитувальники — один на основі клінічного довідника DSM-5, інший — за книгою з астрології. Згодом він зміг спрогнозувати, як на ці запитання в середньому відповідатимуть люди.
Науковці хотіли перевірити припущення, що мовні моделі, вивчаючи величезні масиви людських текстів, могли засвоїти певні закономірності, пов’язані з психологією особистості. “Оскільки риси особистості відображаються в мові, великі мовні моделі могли засвоїти структуру людської особистості як природний побічний результат свого навчання”, — пояснює головний автор дослідження Ротем Монса.
Для експерименту GPT-4 доручили створити два опитувальники. Дослідники навмисно обирали тексти з протилежним науковим статусом: для першого взяли посібник, створений на основі клінічних досліджень, тоді як для другого — книгу про астрологію, твердження з якої не мають наукового підґрунтя.
Перший опитувальник базувався на описах розладів особистості з DSM-5 — посібника, який використовують у психіатрії. Наприклад, на основі розділу про параноїдальний розлад модель формувала твердження на кшталт “я з підозрою ставлюся до мотивів інших людей”, де респондент мав визначити, наскільки це його описує за 5-бальною шкалою.
Тож GPT-4 створила 50 запитань на основі DSM-5 та 60 — на основі книги про астрологію. Обидва опитувальники, а також Big Five Inventory (відомий тест на вимірювання п’яти основних рис особистості), пройшли 600 респондентів.
Опитувальник на основі DSM-5 зміг відтворити кореляцію між рисами, яку психологи спостерігають у реальному житті. Наприклад, люди, які більш схильні уникати складних ситуацій, частіше також демонструють залежність від підтримки інших. Такі риси йшли разом і в результатах опитування, створеного GPT-4. Проте з астрологічним опитувальником такого ефекту не було: риси, які книга приписувала одній групі знаків зодіаку, у відповідях реальних людей не мали подібної кореляції.
Незважаючи на це, опитувальник на основі астрології теж мав певну користь. Хоча риси, які астрологічна книга приписала певним групам зодіаку, не підтвердилися як пов’язані між собою, самі запитання все одно стосувалися реальних рис характеру. Тому за відповідями учасників можна було оцінити вираженість їхніх депресивних і тривожних симптомів, а також рівень психологічного добробуту.
Але найбільше науковців здивувало те, що GPT-4 зміг передбачити відповіді людей ще до проведення опитування. Модель попросили передбачити середню відповідь людей на кожне запитання та те, які риси корелюватимуть між собою. Її оцінки виявилися досить близькими до результатів, які згодом отримали від 600 реальних учасників. “Той факт, що великі мовні моделі можуть передбачати закономірності людських відповідей, при тому, що не бачили жодних даних від людей, свідчить, що ці моделі помітили щось дуже важливе про людську психологію”, — вважає Монса.
На думку авторів, це може допомогти швидше створювати нові психологічні тести. ШІ потенційно може сформулювати запитання, а потім заздалегідь підказати дослідникам, які з них працюватимуть краще та як можуть бути пов’язані відповіді.
Утім, автори попереджають, що результат може залежати від мови та культури. Великі мовні моделі навчалися переважно на англомовних текстах із західного культурного середовища, тому для інших країн і мов такі прогнози можуть бути менш точними. Зараз дослідники вже перевіряють цей підхід на інших мовах.
У липні вже був схожий експеримент, де GPT-4 прогнозувала результати соціологічних експериментів. Модель намагалася передбачити, як американці реагуватимуть на різні повідомлення. Наприклад, чи зміниться їхнє ставлення до вакцинації, довіра до виборів або підтримка податку на викиди вуглецю після читання чи перегляду певного матеріалу. Прогнози ШІ були досить точними, але часто переоцінювали вплив матеріалів на думку людини.
