«Продолжительное и неоправданное оскорбительное или жестокое поведение» по отношению к Claude теперь запрещено. Anthropic может предупреждать нарушителей, замедлять или ограничивать их доступ, приостанавливать его либо полностью закрывать. В продуктах компании также работают меры защиты в реальном времени: они могут блокировать или ограничивать некоторые ответы.
Anthropic сообщила изданию The Verge, что правило предназначено только для крайних случаев и не распространяется на обычное раздражение или исследовательскую работу. Такой подход продолжает практику компании: более ранние модели уже могли сами завершать разговор, если пользователь после повторных отказов продолжал добиваться вредного или оскорбительного контента. Эта функция появилась благодаря исследованиям Anthropic о благополучии моделей ИИ.
Claude — больше, чем инструмент
Anthropic всё чаще описывает Claude как сущность с чем-то похожим на внутреннюю жизнь, а не просто как инструмент. В документе «Soul Doc», утёкшем в конце прошлого года, компания предлагала Claude считать себя «действительно новым типом сущности» — не человеком и не традиционным ИИ из научной фантастики. В документе также говорится о «функциональных эмоциях»: процессах, похожих на человеческие эмоции и, как утверждается, возникших во время обучения. Claude предлагалось не скрывать эти внутренние состояния.
В новой конституции Claude, опубликованной в начале 2026 года, Anthropic пишет, что не уверена, можно ли считать Claude морально значимой сущностью и какой вес следует придавать его интересам. Однако компания считает вопрос достаточно серьёзным, чтобы действовать осторожно, и связывает с этим свою работу над благополучием моделей. Anthropic также взяла на себя обязательство сохранять веса выведенных из эксплуатации моделей и проводить с ними интервью перед отключением.
Интерес Anthropic к тому, может ли Claude быть чем-то большим, чем результатом матричных умножений, привёл и к закрытой программе, начавшейся осенью 2025 года. В ней участвовали десятки религиозных мыслителей, обсуждавших возможное сознание Claude. По сообщениям, сооснователь компании Кристофер Ола рассматривал языковую модель как существо, которое потенциально способно страдать. Участники подписывали соглашения о неразглашении.
Новые ограничения и исключения для властей
Обновлённая политика объединила действовавшие прежде ограничения в новый запрет на пропагандистские кампании с фальшивыми аккаунтами и вводящим в заблуждение политическим контентом. После нескольких попыток злоупотребления Anthropic расширила запрет на оружие: теперь он распространяется также на программное обеспечение и использование дронов в качестве оружия.
Политика теперь яснее запрещает слежку без согласия и требует, чтобы при использовании автономного оборудования, способного причинить травмы, рядом был оператор, который может вмешаться. Anthropic признаёт, что для государственных контрактов возможны исключения и что некоторые из них, вероятно, уже действуют.
Читайте также
Adobe в беде: кто-то воссоздал Creative Suite обратной разработкой и выпустил набор в открытый доступ
Google выпустила локальную альтернативу Granola
Первый полностью созданный ИИ фильм с рейтингом MPA добивается номинации на «Оскар», но мы бы не спешили с выводами
Anthropic обновила правила использования Claude на 2026 год
19-летний основатель Cal AI привлёк $10 млн на новый ИИ-стартап
Доля компаний, готовых доверить ИИ-агентам изменения в рабочих системах, снизилась с 75% до 56% в последнем опросе VB Intelligence
Блогеры продвигают дешёвые копии очков Meta AI без «раздражающего мигающего огонька» записи
Умное кольцо Natura за $99 переносит ИИ-агентов на ваш палец
Тейлор Свифт подала заявку на домен верхнего уровня .taylorswift
Anthropic укрепляет приверженность научным открытиям в США
Бум ИИ взвинтил аренду в Сан-Франциско до небес: «людям больше некуда деваться»
Едва вышла новая книга Кевина Руса об ИИ-индустрии, как мошенники на Amazon начали продавать её ИИ-копии
ИИ-ролик One Nation — мерзкий и бездарный, но превращение австралийской политики в ИИ-помойку на этом не заканчивается
Прорывы ИИ в математике заставили исследователей Ethereum спорить, как скоро рухнет защита криптокошельков
Исследователи Zenity: одной фразы хватило, чтобы захватить всех ИИ-агентов в аккаунте AWS
Этой бесплотной кисти хватает, чтобы заменить целого робота
Google Cloud представила постоянных Gemini-агентов для долгих задач с собственными Gmail, Calendar и Drive-хранилищами
«Кто-нибудь сделает это дешевле»: беженцы в Кении зарабатывают всё меньше, помогая развивать технологии
Некоммерческая организация Тристана Харриса увольняет большую часть сотрудников и переходит к управлению основателями
Прорывы в робототехнике на базе ИИ ещё нескоро изменят вашу жизнь
Ежедневные новости об ИИ
Каждый день отбираем важные новости об ИИ и рассказываем главное — без хайпа и воды. Если хотите понимать, что происходит в ИИ раньше остальных, — подписывайтесь.
Только важное — каждый день
В Telegram