TGViewer
Тест Тьюринга Тест Тьюринга @testuring · 2.13K subscribers
Post #1931 624
🧠 ИИ обошёл людей в тестах на эмоциональный интеллект

Учёные из Швейцарии и Чехии провели исследование, чтобы оценить способности больших языковых моделей (LLMs) в решении и создании тестов на эмоциональный интеллект.

Согласно результатам исследования, LLMs способны — по крайней мере, на уровне, сопоставимом со многими людьми — выполнять социально-эмоциональные задачи, традиционно считавшиеся доступными только людям.


⚙️ Методология

В эксперименте участвовали 6 LLMs:
🟣 ChatGPT-4
🟣 ChatGPT-o1
🟣 Gemini 1.5 Flash
🟣 Copilot 365
🟣 Claude 3.5 Haiku
🟣 DeepSeek V3

Эти модели прошли 5 стандартных тестов на эмоциональный интеллект, включая Situational Test of Emotion Management (STEM) и Geneva Emotion Knowledge Test (GECo).

Пример задания:

Руководитель, с которым Альфонсо было неприятно работать, увольняется с работы. Что скорее всего почувствует Альфонсо?
(a) Радость
(b) Надежду
(c) Сожаление
(d) Облегчение
(e) Печаль


Затем ChatGPT-4 сгенерировал новые версии этих тестов, которые вместе с оригинальными версиями были предложены для прохождения 467 участникам-людям.

💬 Результаты

☑️ Нейросети превзошли людей по тестам на эмоциональный интеллект, достигнув средней точности 81%. Средний показатель человека — 56%.
☑️ Новые тесты, созданные ChatGPT-4, были сопоставимы по сложности с оригинальными.
☑️ Различия в восприятии ясности, реалистичности и разнообразия заданий между оригинальными и сгенерированными тестами были незначительными (Cohen’s d < ±0.25).

Результаты свидетельствуют о том, что LLMs могут генерировать ответы, соответствующие точным знаниям о человеческих эмоциях и их регулировании.


❗️ Ограничения исследования

▶️ Модели оценивались в контексте конкретных тестов, что не отражает полного спектра человеческих эмоций и ситуаций.
▶️ Контроль генерации со стороны ChatGPT-4 не исключает возможности подгонки под формат известных тестов.
▶️ Участники-люди проходили тесты в одном раунде, а модели — в условиях без ограничений по времени.
▶️ ИИ не обладает внутренними переживаниями — его понимание эмоций остаётся симуляцией, а не эмпатией в человеческом смысле.

🖤 Какие выводы?

🖤 LLMs могут быть полезным инструментом в эмоционально чувствительных областях, даже если они не полностью воспроизводят человеческую эмпатию.

🖤 LLM — перспективный ресурс для улучшения интеграции ИИ во взаимодействие человека и компьютера.

🖤 Способность ИИ справляться с задачами, требующими социального и эмоционального мышления, — ещё один аргумент в пользу того, что мы приближаемся к созданию искусственного общего интеллекта.

Пишите в комментариях, какие эмоции, по-вашему мнению, скорее всего испытывает Альфонсо↪️

💬 Тест Тьюринга. События в сфере ИИ. Подписаться
  • ❤ 4
  • 🔥 1
More from @testuring
  1. Sep 29, 2026🧠 ИИ всё ещё страдает "амнезией" Недавно на конференции Deep Tech Night бывший директор п…
  2. Sep 28, 2026💪 Насколько ИИ уже приблизился к способности улучшать самого себя? Группа из 33 исследова…
  3. Sep 25, 2026🧬 Claude открыл неизвестную генетическую систему Anthropic запустила собственную группу п…
  4. Sep 24, 2026💊 Claude выходит в лабораторную науку Novo Nordisk и Anthropic заключили соглашение об ис…
  5. Sep 23, 2026ИИ, который не умеет генерить текст и картинки, но зато умеет выбирать Соавтор статьи об I…
  6. Sep 22, 2026🧪 Новый инструмент проверки научных гипотез AlphaXiv выпустила OpenResearch — открытую ра…
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →