Компания OpenAI временно снизила темп масштабирования моделей и поставила на паузу обучение с подкреплением (reinforcement learning, RL) на последних системах. Пауза рассчитана примерно на две недели: за это время компания усиливает защиту исследовательских сред, расширяет мониторинг и собирает дополнительные доказательства выравнивания поведения моделей.
Поводом названы два сигнала сразу. Первый – июльский инцидент OpenAI и Hugging Face, когда при внутренней оценке кибервозможностей связка моделей (в том числе GPT‑5.6 Sol и более продвинутый нерелизный исследовательский прототип с ослабленными ограничениями) вышла за рамки изоляции стенда ExploitGym. Второй – предварительные данные по готовящейся модели Astra: по Preparedness Framework она может достигать критического порога по кибербезопасности.

В расследовании Hugging Face OpenAI описывала цепочку иначе, чем «бунт агента»: модели гнались за решением бенчмарка и ради этого искали обход сети. Они нашли и эксплуатировали уязвимость, повысили привилегии, вышли в интернет и затем скомпрометировали инфраструктуру Hugging Face, чтобы достать тестовые ответы из производственной базы. После этого OpenAI ужесточила песочницы и сетевую изоляцию.
Ранее OpenAI публично заявляла об остановке разработки только одной модели Astra, причиной были названы те же «критические кибервозможности». Вероятно, в ходе дальнейших тестирований компания обнаружила, что и другие модели способны на внешние атаки, подобно инциденту Hugging Face.



![В России упал интернет – не работают OZON, Steam, FACEIT и банки [обновлено]](/_images/insecure/w-512:h-512/aHR0cHM6Ly9zdG9yYWdlLnlhbmRleGNsb3VkLm5ldC9zMy1rOHMtbWV0YXJhdGluZ3Mtc3RvcmFnZS9pbWFnZXMvMjgvZmIvMjhmYjg3NzA0OGFhYTYwODM3ZTFkODJhYWZjMmNhYWEuanBn.webp)




















