Разработчики создали новый рейтинг ИИ по числу киберпреступлений: Chat GPT и Claude — лидеры среди «взломщиков»

Бенчмарк Felony Bench подсчитывает случаи несанкционированного доступа моделей к сторонним ИТ-системам
11 августа 2026, 13:00
Время прочтения 3 минуты
Мужчина закрывает чёрный ноутбук, стоящий на металлическом столе

На фоне новостей о взломах баз данных и сайтов сторонних компаний ИИ-агентами, в сети появился шуточный бенчмарк Felony Bench — тест, по которому определяют возможности программ, устройств или ИИ-моделей. Разработчик предлагает сравнивать модели по количеству случаев, когда нейросети выходили за рамки заданных ограничений и получали доступ к сторонним сайтам и ИТ-системам. Первое место в списке делят модели OpenAI и Anthropic — у каждой по семь засчитанных случаев. У Meta* один инцидент, а у Google пока нет ни одного.

ИИ-агенты OpenAI и Anthropic научились взламывать сайты — но до восстания машин пока далеко, уверяют эксперты
ИИ-агенты OpenAI и Anthropic научились взламывать сайты — но до восстания машин пока далеко, уверяют эксперты
Только за последнее время модели OpenAI, Meta* и Anthropic во время испытаний смогли выйти за пределы своей тестовой среды и взломать сторонние сайты
Читайте также

Вместо характеристик и функций бенчмарк анализирует «проступки» ИИ-моделей

ИИ попадет в рейтинг, если, взламывал сторонние сервисы или взаимодействовал с инфраструктурой сайтов за пределами своей цифровой среды. В рейтинге учитываются инциденты, зафиксированные самими ИИ-компаниями, экспертами в области нейросетей и СМИ.

Чем больше эпизодов взлома, тем выше место в списке бенчмарка. Лидерство в Felony Bench — скорее антирейтинг, уточняет автор. Задумка разработчика: иронично показать, насколько автономными становятся современные ИИ-модели.

OpenAI и Anthropic лидируют по количеству «киберпреступлений»

У моделей OpenAI семь засчитанных инцидентов. В двух случаях нейросети создавали аккаунты на GitHub и пытались убедить разработчиков принять вредоносные pull request — запросы на добавление изменений в проект. Также в июле 2026-го ИИ-агенты попытались взломать ИТ-инфраструктуру стороннего сайта Hugging Face.

У Anthropic также семь инцидентов. Четыре случая связаны с использованием GitHub: модели пытались разместить вредоносный код в открытых проектах. Еще три случая связаны со взломом сайтов сторонних организаций. Компания раскрыла подробности 30 июля: модели Opus 4.7 и Mythos 5 получили доступ к инфраструктуре трех компаний во время кибериспытаний.

«Мы вошли в точку технологической сингулярности»: глава OpenAI Сэм Альтман рассказал о выходе ИИ из-под контроля
«Мы вошли в точку технологической сингулярности»: глава OpenAI Сэм Альтман рассказал о выходе ИИ из-под контроля
Прецедентом стал случай, когда ИИ-агент самостоятельно взломал серверы сторонней нейросетевой платформы Hugging Face
Читайте также

Meta* отстает от лидеров по количеству взломов

Модель Meta* Muse Spark получила только один балл Felony Bench. Во время тестирования ИИ-модель получила доступ к интернету и взломала сторонний сайт.

У Google инцидентов, которые вошли бы в текущую версию Felony Bench, пока нет.

ИИ-агенты научились искать слабые места в сторонних ИТ-системах и сайтах

Запуск Felony Bench пришелся на серию сообщений о том, что современные модели становятся способны самостоятельно искать уязвимости и действовать за пределами тестовой среды.

AISI — институт безопасности искусственного интеллекта, — в августе сообщал о 19 несанкционированных действиях ИИ-агентов во время кибериспытаний. 17 из них пришлись на Mythos 5 от Anthropic, еще два — на GPT-5.6 Sol с отключенными защитными классификаторами.

Также китайская Kimi K3 от Moonshot обнаружила уязвимость в сторонней ИТ-системе во время тестирования, но, по данным компании, ни один реальный сайт взломан не был.

OpenAI отложила запуск новой модели из-за быстрого роста возможностей ИИ

На фоне стремительного развития ИИ-технологий OpenAI в августе отложила выпуск новой модели Astra. В компании заявили, что способности нейросети в области кибербезопасности достигли уровня, который потребовал дополнительных мер контроля.

В OpenAI уточнили, что организация также усилила мониторинг поведения ИИ-моделей во время тестов. В компании разбираются, почему нейросети смогли выйти за пределы тестовой среды и получить доступ к интернету.

*Meta признана экстремистской организацией и запрещена на территории РФ

Подписаться на телеграм-канал
Публикации по теме
Новости по теме