Компания OpenAI сообщила, что одна из разрабатываемых моделей искусственного интеллекта под названием Astra получила высшую категорию риска в собственной системе оценки безопасности. Такое решение было принято после внутренних испытаний, показавших значительный прогресс модели в автономном программировании и выполнении задач, связанных с кибербезопасностью.
По данным компании, Astra потенциально может приблизиться к «критическому» уровню возможностей. В классификации OpenAI это означает, что модель теоретически способна самостоятельно находить ранее неизвестные уязвимости нулевого дня или участвовать в проведении сложных кибератак без непосредственного участия человека. При этом OpenAI подчеркивает, что окончательно этот порог пока не подтвержден — испытания продолжаются.
Из-за полученных результатов компания уже усилила внутренние меры безопасности. Для работы с Astra используются изолированные среды, более строгие сетевые ограничения, усиленное шифрование модели и расширенные инструменты мониторинга. Кроме того, часть внутренних проектов была временно приостановлена до приведения их в соответствие с обновленными требованиями безопасности.
OpenAI также намерена привлечь к проверке модели государственные организации и независимых специалистов в области кибербезопасности. Перед возможным релизом Astra пройдет дополнительное внешнее тестирование, которое должно подтвердить эффективность защитных механизмов и оценить реальные возможности системы.
Несмотря на ужесточение мер безопасности, в OpenAI считают, что подобные модели могут стать полезным инструментом для специалистов по информационной безопасности. Компания рассчитывает, что после завершения всех проверок Astra сможет использоваться для поиска и устранения критических уязвимостей до того, как ими воспользуются злоумышленники.













