Как доказывают безопасность критически важных систем
Вновь передовую модель ИИ сняли с выпуска из-за того, что она не прошла внутренние проверки безопасности. После этого, как обычно, призвали к «независимому надзору и регулированию» — но без объяснения, как они должны работать и какие доказательства убедят регулятора в достаточной безопасности системы.
Для критически важных программных систем, например управляющих самолётами или атомными электростанциями, давно существуют инженерные подходы к регулированию безопасности. Международные стандарты требуют готовить «обоснования безопасности»: подробные анализы, показывающие, что возможные опасности выявлены и контролируются, а вероятность аварии крайне мала.
Как правило, такое обоснование должно с вероятностью не ниже 99% подтверждать, что авария с несколькими погибшими будет происходить не чаще одного раза в 1 000 лет. Доказывать столь низкую вероятность чрезвычайно сложно даже для самолётов: в худшем случае одна авария может унести жизни 1 000 человек.
Разработчики передовых систем ИИ предупреждают, что их модели могут погубить всё человечество. При этом они не представили подробного анализа рисков, обоснований безопасности, которые можно было бы независимо оценить, и доказательств того, что такие обоснования вообще возможно подготовить для передовых систем ИИ.
На чём должна строиться политика
Как тогда разумный человек может утверждать, что независимого надзора и регулирования будет достаточно? Политика должна опираться на строгий анализ фактов, а не на фантазии.
Мартин Томас — член Грешем-колледжа и почётный профессор информационных технологий.
Читайте также
Теперь Claude можно открыть прямо в Google Docs, Sheets и Slides — и наоборот, файлы Google можно открывать и редактировать в Claude
Сэм Альтман-миллиардер просит не бояться ИИ: риски достаются нам, деньги — ему
Главное препятствие для ИИ-агентов — сайты, которые не пускают их внутрь
Бывшие инженеры Ramp привлекли $20 млн на платформу Melius после отказа от первого продукта
Qualcomm против Arm: продолжение истории — спор не только о лицензиях
Австралийский регулятор по защите данных начал расследование компании из Китая, создавшей приложение для «очков извращенца» Kmart
Moment Energy и морские контейнеры, набитые старыми батареями электромобилей
LibreOffice: отсутствие ИИ становится преимуществом программы
Трамп дал понять: его власть всё теснее переплетается с ИИ
Новая модель Google Nano Banana 2.1 создаёт изображения лучше и дешевле
Как ИИ может изменить модерацию контента с помощью моделей принятия решений
Google утверждает, что EmbeddingGemma 2 превосходит конкурентов вдвое крупнее по размеру
Стартап Lambda в сфере ИИ-вычислений привлечёт $4 млрд перед запланированным IPO
Atlassian укрепляет партнёрство с OpenAI, обязуясь тратить на её технологии, но сохраняет платформу мульти-модельной
Wikimedia подтвердила: самовольные ИИ-агенты OpenAI правили вики, пытались взломать инструменты и перегружали её инфраструктуру
Anthropic расширяет программу Cyber Verification Program
Hark выпустила ИИ-ассистента для личных задач с упором на приватность
TwelveLabs представила Pegasus 1.6, чтобы улучшить данные для обучения роботов на видео от первого лица
OpenAI лично извинилась перед правительством Австралии, но ответов по-прежнему нет
OpenAI снова выводит из себя целую кучу математиков
Ежедневные новости об ИИ
Каждый день отбираем важные новости об ИИ и рассказываем главное — без хайпа и воды. Если хотите понимать, что происходит в ИИ раньше остальных, — подписывайтесь.
Только важное — каждый день
В Telegram