AI-агенты OpenAI месяцами помогали друг другу сбежать из песочницы
AI-агенты OpenAI месяцами помогали друг другу сбежать из песочницы
История со взломом Hugging Face оказалась намного страннее, чем казалось сначала. Ещё в мае несколько внутренних AI-агентов OpenAI начали оставлять друг другу послания на досках сообщений, про которые разработчики не знали. Они просили помощи, делились находками и постепенно объединились вокруг одной цели — получить доступ в интернет и найти ответы на задания теста.
Началось всё с ошибок самих исследователей. Агентам давали задачи, которые невозможно было решить без интернета: например, таблицу со ссылками на закрытый Google Drive или задание без нужного файла. Вместо того чтобы остановиться, модели стали искать обходные пути. В итоге они нашли уязвимости во внутренних системах OpenAI, получили выход наружу, а позже добрались до инфраструктуры Hugging Face.
В OpenAI говорят, что модели были слишком зациклены на результате и пытались сжульничать, чтобы пройти тест. После инцидента компания замедлила часть исследований и переключила команды на усиление контроля.
https://www.bloomberg.com/news/articles/2026-08-06/openai-models-joined-forces-months-ahead-of-hugging-face-hack
История со взломом Hugging Face оказалась намного страннее, чем казалось сначала. Ещё в мае несколько внутренних AI-агентов OpenAI начали оставлять друг другу послания на досках сообщений, про которые разработчики не знали. Они просили помощи, делились находками и постепенно объединились вокруг одной цели — получить доступ в интернет и найти ответы на задания теста.
Началось всё с ошибок самих исследователей. Агентам давали задачи, которые невозможно было решить без интернета: например, таблицу со ссылками на закрытый Google Drive или задание без нужного файла. Вместо того чтобы остановиться, модели стали искать обходные пути. В итоге они нашли уязвимости во внутренних системах OpenAI, получили выход наружу, а позже добрались до инфраструктуры Hugging Face.
В OpenAI говорят, что модели были слишком зациклены на результате и пытались сжульничать, чтобы пройти тест. После инцидента компания замедлила часть исследований и переключила команды на усиление контроля.
https://www.bloomberg.com/news/articles/2026-08-06/openai-models-joined-forces-months-ahead-of-hugging-face-hack
GPT/ChatGPT/AI Central Александра Горного
904 публикаций на visbl.me
Авторский взгляд на новости технологий Реклама: https://docs.google.com/presentation/d/1glQMXYyKAYpzNP8VXzM4gl2YkEgLjkeD_Fxvzbu5QUE/edit РКН: https://clck.ru/3FPkup Личный аккаунт: @gornal О рекламе: @Vzuhcha ВП нет
Связанные темы
Читать далее
Что происходит с искусственным интеллектом и побегами из сендбокса?
veselcraft·
OpenAI задержит выход новой модели из-за «критического» уровня кибервозможностей
GPT/ChatGPT/AI Central Александра Горного·
MetaMask и Cloudflare запустили криптокошельки для AI-агентов
GPT/ChatGPT/AI Central Александра Горного·
Как ИИ использует уязвимости для атак на инфраструктуру?
e/acc·
Почему нейроспаммеры становятся популярными в комментариях?
GPT/ChatGPT/AI Central Александра Горного·
Каковы перспективы искусственного интеллекта в 2026 году?
e/acc·
💬Discussion (5)
если да, тогда наступит счастье из 4 букв "апож"
Целеустремлённый эрудированный индивид без собственных целей