ТЕХНОЛОГИИ

Anthropic обновила правила Claude: запрет на жестокое обращение с ИИ и усиленный контроль за оружием и слежкой

С 12 ноября вступают в силу новые правила использования Claude: модель сможет прекращать диалог с пользователями, которые систематически её оскорбляют, а компания ужесточила запреты на слежку, оружие и вмешательство в выборы.

Компания Anthropic обновила правила использования своих ИИ-моделей, впервые включив в них отдельный запрет на систематическое оскорбительное и жестокое обращение пользователей с чат-ботом Claude. Новые правила вступят в силу 12 ноября 2026 года.

Если пользователь многократно и без видимой цели ведёт себя грубо по отношению к модели, Claude может прекратить диалог — это остаётся основным механизмом реагирования. В Anthropic уточнили, что правило не касается случаев, когда человек просто выражает недовольство, несогласие или обращается к мрачным творческим темам, а также проводит тестирование модели. Компания не сообщила, планирует ли вводить дополнительные меры наподобие блокировки аккаунтов за грубое поведение.

Эта инициатива продолжает линию, начатую в августе прошлого года, когда Anthropic впервые разрешила Claude завершать разговоры с пользователями, демонстрирующими устойчивое вредоносное поведение, — в рамках исследований так называемого «благополучия модели».

Помимо этого, компания объединила несколько ранее действовавших ограничений в единый запрет на проведение вводящих в заблуждение коммерческих или политических кампаний. Запрещено скрывать истинного автора сообщения или искусственно увеличивать охват контента через фейковые аккаунты. Отдельно прописан запрет на дезинформацию о кандидатах и порядке голосования, выдачу себя за кандидатов или сотрудников избирательных комиссий, а также попытки снизить явку избирателей.

Anthropic также расширила запрет на использование Claude для разработки оружия: теперь под него подпадает программное обеспечение и компоненты для функционирования оружия, включая оснащение боевыми системами беспилотников и других автономных аппаратов. Поводом стали зафиксированные попытки использовать модель для создания инструкций и управляющего ПО для вооружений.

Более чётко сформулированы и запреты, касающиеся слежки: отслеживание людей без их согласия запрещено независимо от того, идёт ли речь о данных в реальном времени или ранее собранной информации. Claude нельзя использовать для выработки рекомендаций о том, кого следует задерживать, арестовывать или обвинять в рамках правоохранительной деятельности, а также для создания и совершенствования инструментов наблюдения. При этом Anthropic оставила за собой право корректировать эти правила в рамках контрактов с отдельными государственными заказчиками, если договорные ограничения признаны достаточными для предотвращения вреда.

Ещё одно новое требование касается ИИ-систем, подключённых к оборудованию, способному совершать автономные физические действия и причинять травмы: в таких случаях квалифицированный оператор должен иметь возможность наблюдать за оборудованием и останавливать его при необходимости. Не уточняется, обязательно ли этим оператором должен быть человек.

Почему это важно

Обновление правил отражает растущую обеспокоенность индустрии возможным вредом от генеративного ИИ — от создания пропаганды и дезинформации перед выборами до использования моделей в слежке и военных разработках. Для обычных пользователей ключевое изменение касается общения с чат-ботом: систематическая грубость может привести к тому, что Claude просто откажется продолжать разговор.

Отдельный интерес вызывает тема «благополучия модели»: в Anthropic неоднократно обсуждали, может ли ИИ обладать неким подобием сознания, хотя однозначного ответа компания не даёт. Эта позиция контрастирует с подходом других игроков рынка — например, Microsoft в своём «Гуманистическом кодексе поведения ИИ» отвергает идею о том, что модели нуждаются в защите благополучия или могут обладать правами.

По материалам: 3dnews.ru