Запрет на обманные кампании
За последний месяц Anthropic рассказывала о случаях, когда государственные СМИ, правительственные пропагандистские ведомства и коммерческие компании использовали Claude для создания сетей поддельных аккаунтов и фальшивых новостных сайтов. Такие действия уже запрещались правилами, но ограничения были разбросаны по разделам о выборах, мошенничестве, приватности и дезинформации.
Теперь их собрали в новый раздел «Не участвуйте в обманных кампаниях и искусственной активности». Он распространяется на обман любого рода — политический и коммерческий. Запрещено скрывать, кто стоит за сообщением, распространять материалы через поддельные аккаунты и публикации, а также создавать инструменты и инфраструктуру для кампаний влияния.
Правила о выборах
Anthropic уточняла ограничения на политический контент в каждой версии правил, чтобы модели можно было надлежащим образом использовать в демократических процессах. Новая редакция точнее очерчивает запрет: Claude нельзя использовать для обмана избирателей или срыва выборов. В числе примеров — распространение ложных сведений о кандидатах или голосовании, выдача себя за кандидатов и сотрудников избирательных органов, а также попытки помешать людям прийти на выборы. Раздел переименовали в «Не подрывайте демократические процессы».
Компания также сняла общий запрет на персонализированный таргетинг избирателей и политических кампаний. Он затрагивал и законную общественную работу: например, подготовку некоммерческими организациями информации для избирателей на других языках и отправку сотрудниками избирательных органов уведомлений о необходимости исправить бюллетени. При этом прежние основания для запрета — обманный таргетинг избирателей и неправомерное использование их персональных данных — по-прежнему охвачены разделами об обманных кампаниях, слежке и приватности.
Что изменилось в запрете на оружие
Правила Anthropic всегда запрещали использовать Claude для разработки оружия. В последнее время компания заметила попытки получать от моделей инструкции и программное обеспечение для управления оружием.
Обновлённый раздел уточняет, что запрет распространяется на программы и компоненты, необходимые для работы оружия, а также на такие действия, как вооружение дронов и других автономных транспортных средств. По словам Anthropic, эти уточнения отражают то, как компания применяла прежние правила.
Слежка и работа правоохранительных органов
В сентябрьском отчёте об угрозах Anthropic описала, как ИИ всё чаще используют для создания систем слежки, способных выявлять и отслеживать политических диссидентов. Компания переписала раздел о слежке и уголовном правосудии, чтобы точнее обозначить запреты.
Нельзя отслеживать людей без их согласия — в реальном времени или по ранее собранным данным. Claude также нельзя использовать, чтобы решать или рекомендовать, кого следует расследовать, арестовать или обвинить в рамках работы правоохранительных органов или уголовного правосудия. Запрещено и создавать или улучшать инструменты для слежки.
Как и уточнения в разделе об оружии, эти изменения не меняют того, как Anthropic применяет правила на практике: они делают их яснее. В новом разделе также перечислены разрешённые сценарии: слежка, на которую люди согласились, например мониторинг мошенничества, модерация контента, журналистика и юридические исследования.
Требования к высокорисковым сценариям
Если использование продуктов Anthropic может повлиять на здоровье человека, его юридические права, финансы, средства к существованию или доступ к важным услугам, необходим квалифицированный специалист, который контролирует работу системы и вправе пересмотреть или изменить рекомендации Claude. Также человека, которого затрагивает решение, нужно уведомить об использовании ИИ.
Эти требования не изменились, но пользователи часто спрашивали, распространяются ли они на конкретные случаи. Поэтому Anthropic переписала раздел о высокорисковых сценариях: в нём теперь прямо перечислено, какие виды рекомендаций подпадают под требования, а какие — нет.
После запуска стандарта Anthropic для оборудования в раздел добавили требования к моделям, подключённым к устройствам, способным самостоятельно совершать физические действия и причинить травму. Квалифицированный оператор должен иметь возможность наблюдать за оборудованием и при необходимости остановить его. Если Claude отключится, оборудование должно перейти в безопасное состояние.
Злоупотребления в общении с моделями
Anthropic добавила запрет на продолжительное и бессмысленное жестокое или оскорбительное обращение с моделями. Он рассчитан только на крайние случаи, когда пользователи раз за разом проявляют жестокость без понятной цели. Обычное недовольство, несогласие, мрачные творческие темы, тестирование и исследования под запрет не подпадают.
Это правило продолжает практику, которую компания уже ввела: модели Claude могут завершать редкие разговоры с пользователями, которые постоянно ведут себя оскорбительно, на Claude.ai и Claude Code. Обновление посвящено именно таким случаям, а возможность Claude прекратить разговор останется основным способом применять запрет.
Доступ из поддерживаемых регионов
В прошлом году Anthropic ограничила доступ к Claude для компаний, контрольный пакет которых принадлежит организациям из неподдерживаемых регионов. Теперь компания уточнила на странице поддерживаемых регионов, как применяет это правило.
Claude нельзя использовать людям, которые физически находятся в неподдерживаемом регионе, организациям, зарегистрированным или расположенным там, а также организациям, которыми преимущественно владеют или которые контролируют физические лица либо организации из таких регионов.
Дальнейшие изменения
Anthropic намерена и дальше обновлять правила по мере изменения возможностей Claude и связанных с ними рисков. Как и при подготовке этой и предыдущих редакций, компания будет собирать мнения сотрудников Anthropic, представителей органов власти, профильных экспертов, гражданского общества и пользователей своих продуктов.
Читайте также
19-летний основатель Cal AI привлёк $10 млн на новый ИИ-стартап
Доля компаний, готовых доверить ИИ-агентам изменения в рабочих системах, снизилась с 75% до 56% в последнем опросе VB Intelligence
Блогеры продвигают дешёвые копии очков Meta AI без «раздражающего мигающего огонька» записи
Умное кольцо Natura за $99 переносит ИИ-агентов на ваш палец
Тейлор Свифт подала заявку на домен верхнего уровня .taylorswift
Anthropic укрепляет приверженность научным открытиям в США
Бум ИИ взвинтил аренду в Сан-Франциско до небес: «людям больше некуда деваться»
Едва вышла новая книга Кевина Руса об ИИ-индустрии, как мошенники на Amazon начали продавать её ИИ-копии
ИИ-ролик One Nation — мерзкий и бездарный, но превращение австралийской политики в ИИ-помойку на этом не заканчивается
Прорывы ИИ в математике заставили исследователей Ethereum спорить, как скоро рухнет защита криптокошельков
Исследователи Zenity: одной фразы хватило, чтобы захватить всех ИИ-агентов в аккаунте AWS
Этой бесплотной кисти хватает, чтобы заменить целого робота
Google Cloud представила постоянных Gemini-агентов для долгих задач с собственными Gmail, Calendar и Drive-хранилищами
«Кто-нибудь сделает это дешевле»: беженцы в Кении зарабатывают всё меньше, помогая развивать технологии
Некоммерческая организация Тристана Харриса увольняет большую часть сотрудников и переходит к управлению основателями
Прорывы в робототехнике на базе ИИ ещё нескоро изменят вашу жизнь
Co-op Legal Services оценивает с помощью ИИ звонки сотрудников клиентам
Microsoft выпускает новые ИИ-ПК на чипах Nvidia с обновлённой Windows 11
Healthleap привлекла $38 млн на ИИ-платформу, которая выявляет пациентов, требующих внимания врачей
Завышенная оценка Firmus может снизиться перед ожидаемым выходом на ASX
Ежедневные новости об ИИ
Каждый день отбираем важные новости об ИИ и рассказываем главное — без хайпа и воды. Если хотите понимать, что происходит в ИИ раньше остальных, — подписывайтесь.
Только важное — каждый день
В Telegram