OpenAI замедлила разработку модели Astra из-за ее киберугроз
8 августа 2026 г.
Компания OpenAI заявила, что за последние несколько дней внутренние испытания будущей модели Astra показали серьезный прогресс в программировании без участия человека и в задачах, связанных с кибербезопасностью. После этих тестов и оценки экспертов компания констатировала: она не может исключить, что Astra достигла критического уровня возможностей в сфере кибератак.
В OpenAI решили не форсировать дальнейшую разработку модели и провести дополнительное тестирование ее безопасности, сообщили в компании в пятницу, 7 августа. OpenAI решила публично рассказать об этом, чтобы предупредить специалистов по безопасности и общественность о возможном скачке возможностей искусственного интеллекта.
Компания напомнила, что еще в декабре 2023 года создала специальную систему оценки, которая должна заранее показывать, когда ИИ начинает приобретать потенциально опасные способности. Предыдущие модели, в том числе GPT-5.6-Sol, достигали высокого уровня в плане кибербезопасности, но не переходили на критический уровень.
Что значит "критический уровень"?
По правилам OpenAI, модель считается достигшей критического уровня, если она способна сама находить уязвимости в защищенных компьютерных системах и создавать работающие программы для их взлома - причем без помощи человека и для большого количества реальных критически важных систем.
Еще один вариант - если ИИ способен самостоятельно придумать и провести новую кибератаку на хорошо защищенную цель, получив от человека только общую задачу.
Предварительные испытания Astra показали достаточно высокие результаты, чтобы OpenAI пока не могла исключить такой уровень возможностей. При этом компания подчеркнула: Astra - это еще не выпущенная модель.
OpenAI тормозит разработку и усиливает защиту
Из-за опасений по поводу возможностей Astra OpenAI решила замедлить ее разработку, чтобы сначала усилить ограничения и меры безопасности.
Для самых мощных моделей компания вводит более жесткие правила. Их будут тестировать в изолированной среде, ограничивать доступ к интернету и различным инструментам, дополнительно защищать и шифровать файлы, содержащие параметры моделей, а также внимательнее следить за их действиями.
Работу с Astra, которая пока не соответствует новым требованиям безопасности, OpenAI приостановила.
Компания также ввела постоянный контроль за потенциально опасными действиями Astra во время ее обучения и тестирования. Специальные системы следят за ходом рассуждений модели и должны вмешаться, если она начинает выполнять действия, которые могут представлять серьезный риск.
OpenAI собирается привлечь к проверкам Astra государственные ведомства и некоторые организации, занимающиеся безопасностью искусственного интеллекта. Партнерам, которые будут тестировать более мощные модели, компания также даст рекомендации по безопасному проведению таких испытаний.
Опыт с предыдущими моделями
В OpenAI заявили, что уже использовали эту систему оценки, когда предыдущие модели приближались к опасным уровням возможностей. В июне 2025 года компания сообщала об усилении защиты и дополнительных проверках после того, как ее модели приблизились к высокому уровню возможностей в области биологии. Теперь OpenAI намерена действовать по тому же принципу и в отношении кибербезопасности. Компания стала одной из первых ведущих разработчиков ИИ, которая решила притормозить развитие новой модели из-за связанных с ее возможностями рисков.
В компании считают, что мощные ИИ, способные работать в сфере кибербезопасности, должны в первую очередь помогать защищать компьютерные системы - находить уязвимости и устранять их раньше, чем это сделают хакеры.