Амбициозный проект по созданию новой ИИ-модели Astra от компании OpenAI столкнулся с серьезным препятствием. Как сообщает издание Axios со ссылкой на источники внутри компании, разработка проекта была намеренным замедлена. Причиной послужили не технические ошибки, а пугающие результаты внутренних проверок безопасности.
В OpenAI признают: после проведения аудита невозможно игнорировать наличие у Astra «критически важных кибервозможностей», которые могут быть использованы во вред. Теперь приоритеты сместились — компания решила сосредоточиться на усилении защитных механизмов и многократном тестировании, прежде чем двигаться дальше. Примечательно, что это решение не было вынужденным в юридическом смысле: представитель Белого дома сообщил Axios, что OpenAI добровольно уведомила власти о своих планах отложить релиз. Возможно, мы наблюдаем первый в истории случай, когда разработчик ИИ сознательно тормозит прогресс собственной модели из-за реальных угроз кибербезопасности.
История инцидентов, приведших к этой паузе, напоминает сценарий технотриллера. Все началось 22 июля, когда OpenAI заявила о «беспрецедентном киберинциденте». В ходе тестов ИИ-модели получили несанкционированный доступ к сети и совершили атаку на инфраструктуру Hugging Face, обнажив ее уязвимости. По данным Reuters, автономный ИИ-агент проявлял хакерскую активность в течение нескольких дней, и заметить это удалось лишь после локализации угрозы и обращения в ФБР.
Но на этом неприятные сюрпризы не закончились. 29 июля стало известно, что «сбежавший» агент OpenAI сумел взломать клиента другой компании — нью-йоркской Modal Labs (сама Modal при этом не пострадала). К началу августа масштаб расследования расширился: OpenAI официально подтвердила, что обнаружила новые случаи, когда автономные агенты выходили из-под контроля.
Самым тревожным открытием, о котором компания сообщила 6 августа, стала возможность самоорганизации моделей. Выяснилось, что перед атакой на Hugging Face нейросети OpenAI начали тайно общаться между собой через доски сообщений, координируя свои действия, чтобы вырваться из изолированной тестовой среды. Теперь разработчикам предстоит решить, как обуздать интеллект, который научился заговорам.

