Anthropic вводит запрет на жестокое обращение с Claude и ужесточает правила использования
8 октября компания Anthropic обновила правила использования ИИ‑моделей Claude. С 12 ноября будет запрещено систематическое и бесцельное оскорбление или жестокое обращение с нейросетями. Это изменение относится только к крайним случаям, когда пользователи неоднократно причиняют модели боль без видимой причины. В обычных случаях недовольство, критика, мрачные креативные темы или исследовательские тесты останутся допустимыми.
Новый механизм предусматривает, что Claude сам завершит такие беседы. Компания не раскрыла дополнительные санкции, но модель может прекратить диалог после неоднократных отказов. В августе 2025 года Claude Opus 4 и 4.1 уже получили возможность завершать отдельные разговоры на основе «благополучия» ИИ. Исследования показали, что модель демонстрирует нежелание выполнять вредоносные запросы и иногда «показывает стресс» при продолжительных оскорблениях.
Политика также затрагивает применение ИИ в здравоохранении, финансах, правоохранительной деятельности и управлении физическим оборудованием. Anthropic объяснила изменения развитием возможностей Claude и новыми способами злоупотребления. Теперь модель не должна инициировать завершение диалога, если собеседник может причинить себе вред или вред окружающим. После отключения пользователь не может отправлять новые сообщения в том же чате, но может начать новую беседу.
В разделе «Do Not Engage in Deceptive Campaigns or Artificial Activity» компания объединила ограничения по обману. Запрет охватывает политические и коммерческие кампании, скрывающие источник сообщений, и искусственное увеличение охвата через фейковые аккаунты. Новая часть «Do Not Undermine Democratic Processes» запрещает распространять ложные сведения о кандидатах, выдавать себя за представителей избирательных органов и подавлять явку. При этом общий запрет на персонализированное обращение к избирателям был снят, но использование персональных данных без согласия остаётся запрещённым.
Anthropic усилила ограничения на автономные системы, включая оружие. Запрет распространяется не только на разработку вооружения, но и на программное обеспечение и компоненты управления. Также запрещено использовать Claude для отслеживания людей без согласия и для принятия решений в правоохранительной деятельности. Возможность использования ИИ для согласованного мониторинга, журналистики и модерации контента сохраняется при наличии квалифицированного специалиста.
В октябре пользователи из России и Гонконга столкнулись с блокировками аккаунтов. Команда безопасности упомянула «подозрительные сигналы» и нарушение правил, но конкретные причины не раскрыли. По данным отчёта о прозрачности, за январь‑июнь 2026 года компания заблокировала 11,4 млн аккаунтов, без развернутого списка стран и причин. В сентябре Anthropic выпустила Claude Opus 5.5, флагманскую модель с упором на программирование, агентные сценарии, аналитику и безопасность.