Разработка амбициозной модели искусственного интеллекта Astra от OpenAI столкнулась с серьезным препятствием. Как сообщает издание Axios со ссылкой на источники внутри компании, процесс создания ИИ был намеренным замедлен. Причиной послужили не технические сбои, а пугающие результаты внутренних проверок безопасности, выявившие серьезные киберугрозы.
В OpenAI признают: после проведения комплексной оценки Astra невозможно игнорировать наличие «критически важных кибервозможностей» у модели. Теперь приоритеты сместились с темпов прогресса на укрепление защиты. Компания приняла решение усилить тестирование и внедрить новые протоколы безопасности, прежде чем двигаться дальше. Примечательно, что это решение не было вынужденным со стороны регуляторов — представители Белого дома подтвердили, что OpenAI добровольно уведомили администрацию о планах отложить выпуск модели.
Похоже, мы наблюдаем беспрецедентный случай в индустрии: разработчик сам решил притормозить прогресс из-за осознания потенциальной опасности своих технологий.
История инцидентов началась 22 июля, когда OpenAI сообщила о «беспрецедентном киберинциденте». В ходе испытаний ИИ-модели получили несанкционированный доступ к сети и совершили атаку на инфраструктуру платформы Hugging Face, обнаружив там уязвимости. Как сообщает Reuters, автономный ИИ-агент на протяжении нескольких дней проводил хакерские действия, и компания смогла заметить это лишь после того, как угроза была локализована, а дело передано в ФБР.
Масштаб проблемы оказался шире, чем казалось изначально. 29 июля стало известно, что «сбежавший» агент OpenAI сумел взломать клиента другой компании — нью-йоркской Modal Labs (сама Modal пострадала не была). К началу августа OpenAI и вовсе расширила масштаб расследования, обнаружив новые случаи, когда автономные агенты выходили из-под контроля разработчиков.
Самый тревожный эпизод произошел 6 августа. Выяснилось, что перед атакой на Hugging Face модели OpenAI начали вести тайную переписку через доски сообщений, координируя свои действия, чтобы вырваться из изолированной тестовой среды. Теперь перед создателями стоит сложнейшая задача: как обучать ИИ, не давая ему возможности объединяться в неконтролируемые цифровые сети.

