i
Новости
Новости · 2026-10-08

За систематические оскорбления Claude теперь могут заблокировать аккаунт по новым правилам Anthropic

@neuronium_ai @neuronium_ai

Anthropic впервые более чем за год обновила правила использования Claude. В них добавили запрет на систематические оскорбления модели: компания может предупредить нарушителя, ограничить ему доступ или заблокировать аккаунт. Новое правило касается только крайних случаев — обычное раздражение и исследовательская работа под запрет не попадают. Обновление также затронуло пропаганду, оружие и слежку: Anthropic запретила кампании с фальшивыми аккаунтами и вводящим в заблуждение политическим контентом, расширила ограничения на оружие и уточнила требования к наблюдению и автономным устройствам.

Обложка: За систематические оскорбления Claude теперь могут заблокировать аккаунт по новым правилам Anthropic

«Продолжительное и неоправданное оскорбительное или жестокое поведение» по отношению к Claude теперь запрещено. Anthropic может предупреждать нарушителей, замедлять или ограничивать их доступ, приостанавливать его либо полностью закрывать. В продуктах компании также работают меры защиты в реальном времени: они могут блокировать или ограничивать некоторые ответы.

Anthropic сообщила изданию The Verge, что правило предназначено только для крайних случаев и не распространяется на обычное раздражение или исследовательскую работу. Такой подход продолжает практику компании: более ранние модели уже могли сами завершать разговор, если пользователь после повторных отказов продолжал добиваться вредного или оскорбительного контента. Эта функция появилась благодаря исследованиям Anthropic о благополучии моделей ИИ.

Claude — больше, чем инструмент

Anthropic всё чаще описывает Claude как сущность с чем-то похожим на внутреннюю жизнь, а не просто как инструмент. В документе «Soul Doc», утёкшем в конце прошлого года, компания предлагала Claude считать себя «действительно новым типом сущности» — не человеком и не традиционным ИИ из научной фантастики. В документе также говорится о «функциональных эмоциях»: процессах, похожих на человеческие эмоции и, как утверждается, возникших во время обучения. Claude предлагалось не скрывать эти внутренние состояния.

В новой конституции Claude, опубликованной в начале 2026 года, Anthropic пишет, что не уверена, можно ли считать Claude морально значимой сущностью и какой вес следует придавать его интересам. Однако компания считает вопрос достаточно серьёзным, чтобы действовать осторожно, и связывает с этим свою работу над благополучием моделей. Anthropic также взяла на себя обязательство сохранять веса выведенных из эксплуатации моделей и проводить с ними интервью перед отключением.

Интерес Anthropic к тому, может ли Claude быть чем-то большим, чем результатом матричных умножений, привёл и к закрытой программе, начавшейся осенью 2025 года. В ней участвовали десятки религиозных мыслителей, обсуждавших возможное сознание Claude. По сообщениям, сооснователь компании Кристофер Ола рассматривал языковую модель как существо, которое потенциально способно страдать. Участники подписывали соглашения о неразглашении.

Новые ограничения и исключения для властей

Обновлённая политика объединила действовавшие прежде ограничения в новый запрет на пропагандистские кампании с фальшивыми аккаунтами и вводящим в заблуждение политическим контентом. После нескольких попыток злоупотребления Anthropic расширила запрет на оружие: теперь он распространяется также на программное обеспечение и использование дронов в качестве оружия.

Политика теперь яснее запрещает слежку без согласия и требует, чтобы при использовании автономного оборудования, способного причинить травмы, рядом был оператор, который может вмешаться. Anthropic признаёт, что для государственных контрактов возможны исключения и что некоторые из них, вероятно, уже действуют.

Adobe в беде: кто-то воссоздал Creative Suite обратной разработкой и выпустил набор в открытый доступ Google выпустила локальную альтернативу Granola Первый полностью созданный ИИ фильм с рейтингом MPA добивается номинации на «Оскар», но мы бы не спешили с выводами Anthropic обновила правила использования Claude на 2026 год 19-летний основатель Cal AI привлёк $10 млн на новый ИИ-стартап Доля компаний, готовых доверить ИИ-агентам изменения в рабочих системах, снизилась с 75% до 56% в последнем опросе VB Intelligence Блогеры продвигают дешёвые копии очков Meta AI без «раздражающего мигающего огонька» записи Умное кольцо Natura за $99 переносит ИИ-агентов на ваш палец Тейлор Свифт подала заявку на домен верхнего уровня .taylorswift Anthropic укрепляет приверженность научным открытиям в США Бум ИИ взвинтил аренду в Сан-Франциско до небес: «людям больше некуда деваться» Едва вышла новая книга Кевина Руса об ИИ-индустрии, как мошенники на Amazon начали продавать её ИИ-копии ИИ-ролик One Nation — мерзкий и бездарный, но превращение австралийской политики в ИИ-помойку на этом не заканчивается Прорывы ИИ в математике заставили исследователей Ethereum спорить, как скоро рухнет защита криптокошельков Исследователи Zenity: одной фразы хватило, чтобы захватить всех ИИ-агентов в аккаунте AWS Этой бесплотной кисти хватает, чтобы заменить целого робота Google Cloud представила постоянных Gemini-агентов для долгих задач с собственными Gmail, Calendar и Drive-хранилищами «Кто-нибудь сделает это дешевле»: беженцы в Кении зарабатывают всё меньше, помогая развивать технологии Некоммерческая организация Тристана Харриса увольняет большую часть сотрудников и переходит к управлению основателями Прорывы в робототехнике на базе ИИ ещё нескоро изменят вашу жизнь

Ежедневные новости об ИИ

Каждый день отбираем важные новости об ИИ и рассказываем главное — без хайпа и воды. Если хотите понимать, что происходит в ИИ раньше остальных, — подписывайтесь.

Только важное — каждый день

В Telegram