Anthropic запретила издеваться над Claude — чат-бот может самостоятельно прекратить оскорбительные диалоги
Новая редакция правил использования Claude вступит в силу 12 ноября
Anthropic выпустила новую редакцию правил использования своих моделей искусственного интеллекта. Согласно документу, пользователям запрещено систематически и неоправданно жестоко обращаться с моделями ИИ, в том числе неоднократно оскорблять их без очевидной цели.

Обычная критика Claude всё ещё разрешена
Правила не запрещают негативно оценивать ответы чат-бота, обсуждать мрачные темы в творческих проектах, а также тестировать и исследовать модели.
По данным Anthropic, запрет рассчитан только на крайние случаи систематического и неоправданного жестокого обращения с ИИ, когда пользователи неоднократно оскорбляют модель без очевидной цели.
Ранее нейросеть научили прекращать оскорбительные разговоры
Ранее Anthropic предоставила Claude возможность самостоятельно завершать диалоги с пользователями, которые систематически ведут себя оскорбительно. Механизм действует в Claude.ai и Claude Code.
Компания уточнила, что прекращение подобных разговоров останется основным способом применения запрета.
Контекст
Обновление стало частью пересмотра политики использования Anthropic. Помимо правил обращения с моделями, компания уточнила ограничения на использование ИИ для манипулятивных кампаний, вмешательства в выборы, разработки оружия и слежки.
Новая редакция вступит в силу 12 ноября 2026 года
