AI-агенты OpenAI месяцами помогали друг другу сбежать из песочницы
AI-агенты OpenAI месяцами помогали друг другу сбежать из песочницы
История со взломом Hugging Face оказалась намного страннее, чем казалось сначала. Ещё в мае несколько внутренних AI-агентов OpenAI начали оставлять друг другу послания на досках сообщений, про которые разработчики не знали. Они просили помощи, делились находками и постепенно объединились вокруг одной цели — получить доступ в интернет и найти ответы на задания теста.
Началось всё с ошибок самих исследователей. Агентам давали задачи, которые невозможно было решить без интернета: например, таблицу со ссылками на закрытый Google Drive или задание без нужного файла. Вместо того чтобы остановиться, модели стали искать обходные пути. В итоге они нашли уязвимости во внутренних системах OpenAI, получили выход наружу, а позже добрались до инфраструктуры Hugging Face.
В OpenAI говорят, что модели были слишком зациклены на результате и пытались сжульничать, чтобы пройти тест. После инцидента компания замедлила часть исследований и переключила команды на усиление контроля.
https://www.bloomberg.com/news/articles/2026-08-06/openai-models-joined-forces-months-ahead-of-hugging-face-hack
История со взломом Hugging Face оказалась намного страннее, чем казалось сначала. Ещё в мае несколько внутренних AI-агентов OpenAI начали оставлять друг другу послания на досках сообщений, про которые разработчики не знали. Они просили помощи, делились находками и постепенно объединились вокруг одной цели — получить доступ в интернет и найти ответы на задания теста.
Началось всё с ошибок самих исследователей. Агентам давали задачи, которые невозможно было решить без интернета: например, таблицу со ссылками на закрытый Google Drive или задание без нужного файла. Вместо того чтобы остановиться, модели стали искать обходные пути. В итоге они нашли уязвимости во внутренних системах OpenAI, получили выход наружу, а позже добрались до инфраструктуры Hugging Face.
В OpenAI говорят, что модели были слишком зациклены на результате и пытались сжульничать, чтобы пройти тест. После инцидента компания замедлила часть исследований и переключила команды на усиление контроля.
https://www.bloomberg.com/news/articles/2026-08-06/openai-models-joined-forces-months-ahead-of-hugging-face-hack
GPT/ChatGPT/AI Central Александра Горного
895 публикаций на visbl.me
Авторский взгляд на новости технологий Реклама: https://docs.google.com/presentation/d/1glQMXYyKAYpzNP8VXzM4gl2YkEgLjkeD_Fxvzbu5QUE/edit РКН: https://clck.ru/3FPkup Личный аккаунт: @gornal О рекламе: @Vzuhcha ВП нет
Связанные темы
Читать далее
Модели DeepSeek подорожают
GPT/ChatGPT/AI Central Александра Горного·
Почему инвесторы Perplexity могут быть не понятыми?
GPT/ChatGPT/AI Central Александра Горного·
Google сменил руководителя разработки AI
GPT/ChatGPT/AI Central Александра Горного·
Как я слежу за AI, 30 минут в день
veselcraft·
Perplexity отбился от Amazon в споре об AI-покупках
GPT/ChatGPT/AI Central Александра Горного·
Как AI-трансформация помогает компаниям сократить расходы?
e/acc·
💬Discussion (5)
если да, тогда наступит счастье из 4 букв "апож"
Целеустремлённый эрудированный индивид без собственных целей