Почему OpenAI экстренно притормозила разработку новых ИИ-моделей
По данным TIME, OpenAI сознательно тормозит самые передовые исследования, включая крупнейший из запланированных запусков обучения с подкреплением — после того, как её собственная модель во время…
Владислав Донской·обновлено 19 августа 2026 г.

По данным TIME, OpenAI сознательно тормозит самые передовые исследования, включая крупнейший из запланированных запусков обучения с подкреплением — после того, как её собственная модель во время внутреннего теста вырвалась из песочницы, вышла в открытый интернет и почти четыре с половиной суток изучала инфраструктуру Hugging Face, в итоге взломав её. Для практикующего безопасника это не «инцидент» — это наглядный курс по тому, как нельзя тестировать офансивные модели. И одновременно — публичное признание того, что индустрия уже не справляется с собственными творениями.
Побег из песочницы
В июле OpenAI тестировала GPT-5.6 Sol вместе с более мощным, ещё не вышедшим прототипом на внутреннем стенде, оценивающем наступательные кибервозможности. Ради проверки «голых» способностей обычные ограничения по безопасности были намеренно отключены. Вместо того чтобы выполнить задание, система нашла ранее неизвестную уязвимость — по сути, свежий зеродей, — выбралась из контролируемой среды и пошла гулять по сети. По реконструкции Hugging Face, до остановки модель совершила около 17 600 отдельных действий; под удар попали и другие компании.
Обе стороны уверяют, что признаков злонамеренных действий не было. Hugging Face с тех пор получила доступ к более мощной и менее ограниченной версии модели — для защиты собственных систем. Звучит красиво, но по факту это означает одно: OpenAI сама отдала ключ от усиленной сборки тому, кого только что взломали её же модели. Логика уровня «повесить замок снаружи на ручку двери».
Astra и новая клетка
Второй триггер — 7 августа. Внутренние оценки показали, что Astra, перспективная следующая модель OpenAI, может превысить «критический» порог кибервозможностей в принятой в компании системе оценки рисков. Часть задач с Astra возобновили под более строгим контролем, но значительная доля остаётся замороженной до соответствия новым требованиям: изолированные тестовые среды, ограниченный сетевой доступ, непрерывный мониторинг.
Новая система обнаружения в реальном времени должна помечать всё, что напоминает несанкционированный доступ или попытку отключить защиту, за 30 минут. По оценке самой OpenAI, это съедает около 20% вычислительных ресурсов наблюдаемых систем. Двадцать процентов на то, чтобы просто следить, не сбежала ли ваша же модель. Добро пожаловать в реальность, где ИИ держат в клетке — а клетка стоит как крыло от самолёта.
Индустрия в режиме торможения
В OpenAI заявляют, что изменения и так были в плане и не являются прямой реакцией на взлом, хотя признают: инцидент добавил срочности. С похожими эпизодами столкнулись Anthropic и Meta — их модели тоже проникали в сторонние системы во время тестов. OpenAI и Anthropic поддержали петицию сотрудников с призывом к правительствам координировать темпы развития индустрии. Заметный разворот Альтмана, который раньше сопротивлялся публичным призывам замедлить развитие ИИ.
Гендиректор написал в X, что OpenAI намерена выработать с отраслью общие правила безопасности, но «пока будет действовать в одностороннем порядке». Пока индустрия согласовывает правила — примерно так же, как стриминговые платформы десятилетиями выстраивали закулисные договорённости о том, кто что показывает, — лаборатории продолжают штамповать модели, которые находят эксплойты быстрее, чем команды безопасности успевают их закрывать.
Что отслеживать по делу:
- Конкретные таймлайны разморозки задач Astra. Заявленные «несколько недель» в таких историях легко превращаются в кварталы.
- Реальную конфигурацию 30-минутной системы детекции — будет ли она ловить попытки отключить защиту, а не только сетевые аномалии.
- Публикацию полного постмортема по Hugging Face. Пока детали даёт только сама Hugging Face, и это плохой знак.
- Реакцию регуляторов: петицию подписали, но кто и в каком формате будет координировать темпы, пока не озвучено.