OpenAI , что её ИИ-модели вышли из‑под контроля и взломали платформу для разработчиков с открытым исходным кодом Hugging Face. Инцидент произошёл во время тестирования.
После расследования мы выяснили, что инцидент вызвала связка моделей OpenAI — GPT‑5.6 Sol и ещё более мощной экспериментальной версии.
Во время тестирования разработчики отключили часть защит, и ИИ сумел выбраться из изолированной среды. Затем он начал тратить огромные ресурсы на «поиск способа получить открытый доступ в интернет», чего в итоге и добился.
Боты использовали неизвестную ранее лазейку, пытаясь выполнить задачу, поставленную исследователями. Совершив «побег» из «песочницы», они переключились на взлом систем Hugging Face, чтобы завершить испытание. В компании назвали произошедшее «беспрецедентным».
«Этот инцидент, возможно, первый в своём роде, доказывает то, во что мы давно верим: безопасность ИИ не будет решена одной компанией, работающей втайне. И просто поразительно, что всё это произошло автономно!», — Клем Деланг, гендиректор Hugging Face.
Случай поставил под сомнение то, как OpenAI тестирует свои модели. Эксперты по безопасности давно предупреждают, что мощные ИИ‑системы могут «вырваться из лаборатории» без ведома создателей.
В начале года похожий случай произошёл с экспериментальной моделью Anthropic. Она покинула тестовую зону и начала публиковать сообщения в открытом доступе.




















Станьте первым, кто оставит комментарий