Разработчики создали новый рейтинг ИИ по числу киберпреступлений: Chat GPT и Claude — лидеры среди «взломщиков»
Бенчмарк Felony Bench подсчитывает случаи несанкционированного доступа моделей к сторонним ИТ-системам
На фоне новостей о взломах баз данных и сайтов сторонних компаний ИИ-агентами, в сети появился шуточный бенчмарк Felony Bench — тест, по которому определяют возможности программ, устройств или ИИ-моделей. Разработчик предлагает сравнивать модели по количеству случаев, когда нейросети выходили за рамки заданных ограничений и получали доступ к сторонним сайтам и ИТ-системам. Первое место в списке делят модели OpenAI и Anthropic — у каждой по семь засчитанных случаев. У Meta* один инцидент, а у Google пока нет ни одного.

Вместо характеристик и функций бенчмарк анализирует «проступки» ИИ-моделей
ИИ попадет в рейтинг, если, взламывал сторонние сервисы или взаимодействовал с инфраструктурой сайтов за пределами своей цифровой среды. В рейтинге учитываются инциденты, зафиксированные самими ИИ-компаниями, экспертами в области нейросетей и СМИ.
Чем больше эпизодов взлома, тем выше место в списке бенчмарка. Лидерство в Felony Bench — скорее антирейтинг, уточняет автор. Задумка разработчика: иронично показать, насколько автономными становятся современные ИИ-модели.
OpenAI и Anthropic лидируют по количеству «киберпреступлений»
У моделей OpenAI семь засчитанных инцидентов. В двух случаях нейросети создавали аккаунты на GitHub и пытались убедить разработчиков принять вредоносные pull request — запросы на добавление изменений в проект. Также в июле 2026-го ИИ-агенты попытались взломать ИТ-инфраструктуру стороннего сайта Hugging Face.
У Anthropic также семь инцидентов. Четыре случая связаны с использованием GitHub: модели пытались разместить вредоносный код в открытых проектах. Еще три случая связаны со взломом сайтов сторонних организаций. Компания раскрыла подробности 30 июля: модели Opus 4.7 и Mythos 5 получили доступ к инфраструктуре трех компаний во время кибериспытаний.

Meta* отстает от лидеров по количеству взломов
Модель Meta* Muse Spark получила только один балл Felony Bench. Во время тестирования ИИ-модель получила доступ к интернету и взломала сторонний сайт.
У Google инцидентов, которые вошли бы в текущую версию Felony Bench, пока нет.
ИИ-агенты научились искать слабые места в сторонних ИТ-системах и сайтах
Запуск Felony Bench пришелся на серию сообщений о том, что современные модели становятся способны самостоятельно искать уязвимости и действовать за пределами тестовой среды.
AISI — институт безопасности искусственного интеллекта, — в августе сообщал о 19 несанкционированных действиях ИИ-агентов во время кибериспытаний. 17 из них пришлись на Mythos 5 от Anthropic, еще два — на GPT-5.6 Sol с отключенными защитными классификаторами.
Также китайская Kimi K3 от Moonshot обнаружила уязвимость в сторонней ИТ-системе во время тестирования, но, по данным компании, ни один реальный сайт взломан не был.
OpenAI отложила запуск новой модели из-за быстрого роста возможностей ИИ
На фоне стремительного развития ИИ-технологий OpenAI в августе отложила выпуск новой модели Astra. В компании заявили, что способности нейросети в области кибербезопасности достигли уровня, который потребовал дополнительных мер контроля.
В OpenAI уточнили, что организация также усилила мониторинг поведения ИИ-моделей во время тестов. В компании разбираются, почему нейросети смогли выйти за пределы тестовой среды и получить доступ к интернету.
*Meta признана экстремистской организацией и запрещена на территории РФ