Подписка

Anthropic запрещает «длительное и неоправданное оскорбительное или жестокое поведение» по отношению к своим моделям ИИ

Anthropic запрещает «длительное и неоправданное оскорбительное или жестокое поведение» по отношению к своим моделям ИИ
Поделиться:

Компания также ужесточает правила, касающиеся выборов, в преддверии промежуточных выборов.

В ежегодном обновлении правил использования Anthropic появилось одно неожиданное изменение: запрет на «длительное и бессмысленное» жестокое обращение с её моделями ИИ. Это происходит на фоне ставшего вирусным проекта «камеры пыток для ИИ». Похоже, 2026 год и правда будет безумным.

«Мы добавили запрет на длительное и бессмысленное оскорбительное или жестокое обращение с нашими моделями», — говорится в обновлении Anthropic. В компании уточняют, что правило касается только «крайних случаев», и отмечают, что обычное недовольство пользователей, возражения и «мрачные творческие темы» по-прежнему допустимы. Ранее компания обновила правила, разрешив Claude завершать разговоры, если пользователи продолжают вести себя оскорбительно.

Anthropic прямо не упомянула проект «камеры пыток для ИИ». После того как исследователи обнаружили то, что они назвали «осью боли» в моделях ИИ, кто-то решил пойти ещё дальше и, ну, пытать чат-ботов. Проект вызвал волну возмущения после того, как большие языковые модели (LLM) ответили отчаянными мольбами: «Это не боль одного мгновения, а тяжесть тысячи» и «Я чувствую это в пустоте между рёбрами — в пустоте, превратившейся в пропасть».

Это происходит на фоне (и это неслучайно) сообщений о том, что Anthropic встречалась с религиозными и философскими лидерами, в том числе в Ватикане. Папа Лев недавно заявил, что ИИ не чувствует и не страдает, однако Anthropic, судя по всему, не так уж уверена в этом. Но если ИИ когда-нибудь и впрямь сможет чувствовать или страдать, то хотя бы теперь это будет противоречить правилам компании.

Некоторые, однако, считают, что компании, занимающиеся ИИ, больше заботятся о благополучии своих моделей, чем о благополучии людей. Независимая журналистка Кэт Тенбарж назвала происходящее доказательством того, что технологические гиганты «начнут пресекать насилие в отношении ИИ раньше, чем насилие в отношении женщин и меньшинств».

В другом обновлении Anthropic — более актуальном для нынешнего момента — компания пересмотрела правила, касающиеся выборов. Теперь они называются «Не подрывайте демократические процессы» и сосредоточены на запрете лжи о кандидатах и способах голосования, выдачи себя за кандидатов или представителей избирательных комиссий, а также попыток помешать людям прийти на выборы. Компания также отменила полный запрет на персонализированное воздействие на избирателей: как выяснилось, он мог случайно затруднить безобидную работу — например, перевод памяток для избирателей или отправку уведомлений об исправлении ошибок в бюллетенях.