ИИ переоценил логику человека: нейросети привлекли к эксперименту — в игре они ждали от людей большего и ошибались
ChatGPT-4o и Claude-Sonnet-4 переоценивают способности людей
ИИ выбирает «слишком умные» стратегии
Суть эксперимента в исследовании НИУ ВШЭ проста: в игре «Угадай число» участники называют число от 0 до 100, а выигрывает тот, кто назвал значение ближе к половине или трети среднего результата всех игроков. Чтобы победить, нужно не только выбрать число, но и понять, как будут действовать остальные.
Учёные НИУ ВШЭ привлекли к игре нейросети ChatGPT-4o и Claude-Sonnet-4. Им давали правила игры и описания участников: от первокурсников-экономистов до специалистов по теории игр. Каждую модель просили объяснить, почему она выбрала именно это число.
Во всех сериях эксперимента НИУ ВШЭ нейросети ChatGPT-4o и Claude-Sonnet-4 предполагали, что люди будут играть логичнее, чем это было в реальных замерах. Поэтому ИИ часто уходил в более «глубокие» стратегии и выбирал меньшие числа — в теории выигрышные, но никак не соответствующие поведению живых игроков.
Модели подстраиваются под разные группы
Несмотря на ошибки, аналитики НИУ ВШЭ отметили, что ИИ демонстрировал способность менять стратегию под профиль соперников. В партиях со специалистами по теории игр модели выбирали числа, близкие к нулю, — такие ответы обычно выигрывают у профессионалов, которые много рассуждают.
В играх с первокурсниками-экономистами ChatGPT-4o и Claude-Sonnet-4 выбирали заметно более высокие значения: такие варианты соответствовало ожиданию, что неопытные игроки не проводят глубокий стратегический анализ. ИИ также реагировал на заданный возраст, опыт и даже эмоциональное состояние участников, если оно описывалось в условиях — например, злость или грусть.
Гибкость, по выводам авторов исследования НИУ ВШЭ, показывает элементы стратегического мышления: модели ChatGPT-4o и Claude-Sonnet-4 не повторяют один шаблон, а меняют логику под ситуацию.
Игры вдвоём оказались проблемой
При этом ИИ не справился с более простой задачей — определением наилучшей стратегии в игре с двумя участниками. Исследователи НИУ ВШЭ отмечают, что нейросети не смогли выбрать оптимальный вариант, хотя ситуация с двумя игроками проще массовой игры.
Заведующий Научно-учебной лабораторией исследований спорта факультета экономических наук НИУ ВШЭ Дмитрий Дагаев по итогам исследования подчеркнул, что сегодня ИИ-модели уже берут на себя многие операции, которые раньше выполняли люди. По его словам, это повышает эффективность, но не отменяет необходимости контролировать, как именно алгоритмы принимают решения. В ситуациях, где требуется выбор стратегии или оценка поведения других участников, важно быть уверенными, что модель действует так, как действовал бы человек, и не уходит в нереалистичные рассуждения.
Контекст
По данным исследователей НИУ ВШЭ, экономисты давно используют игру «Угадай число» как модель реальных рынков: предсказать других участников — главная часть игры. Сейчас ИИ-модели, такие как ChatGPT-4o и Claude-Sonnet-4, тестируют не только на людях, но и на нейросетевых алгоритмах — чтобы понять, насколько ИИ умеет думать «как человек». Но, судя по результатам эксперимента НИУ ВШЭ, ИИ-модели пока уверены, что мы умнее, чем есть на самом деле.
-
Партнёрский материал Компании научились собирать данные. Принимать решения — нет: почему цифры не помогают сами по себе 21 июля 2026, 16:04
-
Игры Аша Шарма. Как дочь индийских иммигрантов возглавила Xbox, не проработав ни дня в играх 04 августа 2026, 23:04
-
IT Как построить технологическую империю, когда против тебя весь рынок: история Huawei 03 августа 2026, 18:27
-
Автомобили Как из чужих технологий сделать собственный бизнес: история Changan 31 июля 2026, 16:40
-
Автомобили От «народного автомобиля» до гаража с Bentley и Lamborghini: история Volkswagen 28 июля 2026, 21:46
-
Бизнес Что останется после финиша: как топ-пилоты «Формулы‑1» превращают славу в бизнес 28 июля 2026, 21:23
-
Искусственный интеллект GenAI меняет бизнес-процессы: как компании внедряют генеративный ИИ и измеряют эффект инноваций 28 июля 2026, 17:46
-
Личное Ван Чуаньфу. Как химик без денег на оборудование построил автомобильную империю BYD 27 июля 2026, 22:13
-
Бизнес В работе сервисов «Яндекса» произошёл сбой 5 августа — пользователи жалуются на работу Поиска, Go и Навигатора 05 августа 2026, 13:44
-
Бизнес SpaceX раскрыла финансовые результаты после IPO: выручка компании выросла на 92% — до $7,8 млрд 05 августа 2026, 13:20
-
Искусственный интеллект «КИОН Музыка» начал фильтровать нейросетевой контент — сервис запустил отдельный чарт, в котором нет ИИ-треков 05 августа 2026, 08:00
-
Автомобили BMW разместила промо «Человека-паука» в салоне автомобилей — ранее компания обещала не показывать рекламу водителям 04 августа 2026, 19:30
-
Искусственный интеллект Alibaba представила ИИ-модель Qwen3.8-Max — нейросеть бросает вызов Claude от Anthropic 03 августа 2026, 19:45
-
Бизнес ФАС возбудила дело против Apple — из-за отсутствия MAX и магазина приложений RuStore на iPhone 03 августа 2026, 17:42
-
Автомобили Hongqi установила мировой рекорд по зарядке батареи электромобиля — до 70% менее чем за четыре минуты 05 августа 2026, 15:00
-
Россия Улицы Москвы будут патрулировать робособаки от Сбера — пока в тестовом режиме 05 августа 2026, 14:10