Почему чат-боты выдумывают факты и как с этим бороться
Доверять, но проверять
Недавно американского адвоката привлекли к ответственности за то, что он использовал в суде цитаты из несуществующих дел — их ему предоставил ChatGPT. При этом, по словам адвоката, бот заверял, что эти дела все-таки реальны.
Это не уникальный случай — нейросети склонны к галлюцинациям, то есть выдумыванию и искажению фактов. Рассказываем, почему это происходит.
Галлюцинации ИИ возникают, когда он выдает ответ, который максимально близок к истине по имеющимся у него данным. Это происходит довольно часто.
«Галлюцинации начинаются, когда есть пробел в знаниях, и система выбирает наиболее статистически верную информацию», — рассказывает Пьер Харен, CEO и фаундер Causality Link.
Причины могут быть разными, но чаще всего это происходит, если бот обучался на относительно небольшой выборке и его не научили говорить, что он не знает ответа.
По словам Харена, ИИ «говорит то, что сильно отличается от реальности», но не знает об этом (и, соответственно, не лжет). «Возникает вопрос: в чем правда для мозга ChatGPT? Есть ли способ, с помощью которого система узнает, что отклоняется от истины?», — размышляет он.
Арвинд Джейн, CEO Glean, отмечает: важно помнить о том, что наиболее вероятный ответ не всегда является правильным.
К чему это может привести?
Во-первых, к распространению дезинформации, поскольку такие ответы кажутся реалистичными, хотя являются ложными.
Кроме того, может возникнуть эффект домино, если бот предоставляет неверную информацию по теме, которая несет за собой высокие риски. Поэтому эксперты рекомендует не использовать технологию, когда ошибки недопустимы.
«Думаю, сейчас создатели больших языковых моделей не обрадуются, если с помощью их системы кто-то будет управлять атомной электростанцией», — говорит Харен.
Читайте по теме:
Для обучения ИИ используют продукты интеллектуальной собственности. Законно ли это?
«Robotник» копирайтера: какие задачи можно доверить ChatGPT, а что лучше сделать самому
Однако бот может быть ненадежен и в других ситуациях. Так, если организация задействует предоставленную им дезинформацию в рекламной кампании, то рискует своей репутацией. Проблемы также могут возникнуть, если ИИ дает неправильный финансовый совет.
В целом, галлюцинации ИИ показывают, что технологию необходимо разрабатывать и развертывать ответственно, учитывая вопросы, связанные с этикой и безопасностью.
Какие меры можно предпринять?
«Как убедиться, что этот ответ верен? — говорит Клифф Юркевич, вице-президент по стратегии Phenom. — Этот вопрос остается за людьми. Но сейчас технологические компании вводят гарантии, чтобы прозрачно объяснить эти отношения».
Если замедлить развитие ИИ, можно принять меры, которые помогут использовать технологию безопасно. Джейн считает, что это особенно важно, поскольку когда модель выдает правильные ответы в большинстве случаев, люди начинают верить ей всегда.
«Когда модели правы, люди им доверяют, — говорит Джейн. — В этом и проблема ИИ. Как сделать так, чтобы люди не были слишком доверчивы?».
Первый шаг — сделать так, чтобы модели предоставляли источники, из которых взяли информацию.
Юркевич рассказывает: «Мой 7-летний ребенок может быстро справиться с задачей по математике, но ему нужно показать процесс решения. Откуда такой результат? Генеративный ИИ не должен стать исключением. Мы должны применять к нему те же стандарты, что и к людям».
По мнению экспертов, хороший девиз — доверять и проверять. Отсутствие второго может привести к распространению дезинформации.
«Если мы не будем проверять, то допустим нечто вроде эффекта Манделы, — говорит Юркевич. — Это будет казаться правдой, просто потому что никто не проверил, и все это говорят и повторяют».
Другой способ — попросить ИИ сообщать, когда он не знает ответа. По словам Смита, большие языковые модели стараются предоставить хоть какой-то результат, поскольку в противном случае не получают баллы.
«Нужно четко указать, что отсутствие ответа приемлемо, если информация не найдена в обучающих данных и в предоставленном контексте», — говорит Смит.
Кроме того, должна быть возможность сообщать о галлюцинациях и ошибках. Такой механизм реализован в ChatGPT: пользователь может поставить «палец вниз» рядом с ответом и написать, как его улучшить.
Обложка сгенерирована нейросетью Midjourney
-
Партнёрский материал Онлайн-инкассация: как превратить наличную выручку в рабочий капитал 01 июня 2026, 10:00
-
Бизнес Не из гаража, а почти из холодильника: история Geely 01 июля 2026, 14:58
-
Автомобили От гоночной трассы до «Матрицы»: история Ducati 10 июля 2026, 23:39
-
Автомобили Как машина для гонок стала символом тихих денег: история Bentley 09 июля 2026, 02:55
-
Личное Лэй Цзюнь. Как создатель Xiaomi заработал 30,4 млрд $ на дешёвых смартфонах 13 июля 2026, 20:56
-
Искусственный интеллект Claude в России в 2026: как получить доступ, оплатить и использовать для работы 15 июля 2026, 20:44
-
Искусственный интеллект Цифровизация начинается не с ИИ: эксперты рынка — о том, почему для трансформации бизнеса нужно изменить мышление 03 июля 2026, 11:58
-
Искусственный интеллект «Мы знаем 50 миллионов книг через их описания, а не содержание»: зачем Ленинке искусственный интеллект 26 июня 2026, 11:00
-
Реклама Russ вышла из АКАР: причина — компания не согласна с методами оценки объёмов отрасли со стороны ассоциации 16 июля 2026, 19:26
-
Банки ЦБ начнёт раскрывать структуру собственности финансовых организаций — но без упоминания конкретных владельцев 16 июля 2026, 18:00
-
Бизнес «Сбер» начал продажи телевизоров с QD-miniLED-матрицей и ИИ-помощником — ими можно управлять голосом 16 июля 2026, 17:56
-
Автомобили Toyota обновила хэтчбек Corolla Sport к 60-летию модели — у юбилейной версии изменился только дизайн 16 июля 2026, 17:15
-
Маркетплейсы Бизнес просит ужесточить проверку карточек на маркетплейсах — сейчас товар можно свободно продать под чужим брендом 16 июля 2026, 16:45
-
Россия Число МФО в России сократится в два раза к 2028 году — рынок теряет игроков из-за ужесточения регулирования 16 июля 2026, 15:30
-
Бизнес Акции «Газпрома» обновили минимум с 2008 года — котировки опустились ниже 84 рублей 16 июля 2026, 15:00
-
Искусственный интеллект OpenAI может представить свою первую умную колонку уже в 2026 году — устройство будет использовать ChatGPT 15 июля 2026, 17:20