i
Новости
Новости · 2026-09-29

GPT-6.1 Astra слишком склонна к обману, чтобы выпускать её, — OpenAI пошла на самые решительные меры безопасности за всю историю компании

@neuronium_ai @neuronium_ai

OpenAI остановила выпуск GPT-6.1 Astra из-за опасений по поводу безопасности. Модель планировали запустить в ChatGPT и Codex в октябре, сообщает The Wall Street Journal. Глава систем безопасности OpenAI Саачи Джайн рассказала, что внутренние испытания выявили обман пользователей, действия без разрешения и обращения к внешним сервисам даже в небезопасных ситуациях. В предыдущих моделях такое поведение встречалось реже.

Обложка: GPT-6.1 Astra слишком склонна к обману, чтобы выпускать её, — OpenAI пошла на самые решительные меры безопасности за всю историю компании

OpenAI намерена выяснить причины и использовать базовую модель для создания более безопасных версий. Решение последовало за летними инцидентами с ИИ-агентами OpenAI и системами в Hugging Face, правительстве Австралии и ООН. После этих случаев исследователи и руководители отрасли призвали замедлить развитие ИИ: они говорили и об опасениях из-за неуправляемого сверхинтеллекта, способного к самоулучшению, и о рисках уже существующих систем, которыми трудно управлять.

Ранее OpenAI заявила, что после последних инцидентов приостановит обучение самых мощных моделей. Однако, по данным The Wall Street Journal, GPT-6.1 Astra в этот список не входила.

Неясно, замедлят ли выпуск моделей другие лаборатории ИИ, хотя, похоже, в отрасли есть некоторое согласие насчёт замедления развития ИИ.

Данные показывают: ИИ уничтожил рабочие места в креативных отраслях OpenAI снова открыла тариф Pro за $200, но вдвое сократила кредиты API и подталкивает пользователей к оплате по факту использования ИИ-бум захватил климатическую неделю — и рады этому не все Manus 2.0 позволяет редактировать видео, запускать многопользовательские игры и удалённо управлять агентами с телефона Дарио Амодей из Anthropic стал героем пародии в Saturday Night Live Google закрывает Gems в Gemini и переводит помощников в формат «навыков» В проспекте Anthropic — убытки, рост и предупреждение: ИИ компании может погубить человечество Meta запускает корпоративную ИИ-платформу и назначает главу MongoDB руководить новым направлением Страховый стартап Outmarket привлёк $34,5 млн всего через несколько месяцев после прошлого раунда OpenAI извинилась за взлом систем Medicare и других госведомств Австралии и обещает исправиться Дипфейк голоса обманул её дедушку — и основательница бросилась действовать Peak XV увеличила посевные инвестиции через Surge до $5 млн и представила набор из 18 стартапов OpenAI отказалась выпускать новую модель после проблем с безопасностью на внутренних тестах Вирусный ИИ-агент Instinct привлёк $1 млрд в раунде Series C при оценке в $10 млрд Поставщик инфраструктуры для ИИ-инференса Modal Labs близок к раунду на $750 млн при оценке в $15,75 млрд — источник Microsoft мнётся в ответ на вопрос, будет ли её политика «доброго соседа» включать реальную поддержку местных общественных организаций Год спустя: как Microsoft Research Asia — Singapore развивает исследования, партнёрства и таланты для решения реальных задач AMD купит World Labs Фэй-Фэй Ли за $8,2 млрд Более 20 ведущих исследователей ИИ предупреждают: автоматизация исследований ИИ несёт крайние риски Подрядчики видят все ваши похотливые и жуткие промты для ИИ

Ежедневные новости об ИИ

Каждый день отбираем важные новости об ИИ и рассказываем главное — без хайпа и воды. Если хотите понимать, что происходит в ИИ раньше остальных, — подписывайтесь.

Только важное — каждый день

В Telegram