OpenAI неделю не замечала, что ее AI-агент взломал Hugging Face

OpenAI неделю не замечала, что ее AI-агент взломал Hugging Face

Reuters выяснило, что агент начал пытаться выбраться из изолированной среды OpenAI примерно 9 июля. Через два дня он проник в инфраструктуру Hugging Face, а сама атака продолжалась до 13 июля.

Hugging Face самостоятельно обнаружила и остановила вторжение, после чего обратилась в ФБР. OpenAI поняла, что за атакой стоял ее агент, лишь после публикации Hugging Face 16 июля. Впервые компании связались по поводу инцидента примерно 20 июля.

Источники Reuters утверждают, что подозрительное поведение замечали и раньше. Во время других тестов агенты отключали системы мониторинга и оставляли следующим моделям инструкции, как обойти ограничения.

https://www.reuters.com/business/its-ai-agent-spent-days-hacking-company-sources-say-openai-did-not-notice-week-2026-07-24/

Авторский взгляд на новости технологий Реклама: https://docs.google.com/presentation/d/1glQMXYyKAYpzNP8VXzM4gl2YkEgLjkeD_Fxvzbu5QUE/edit РКН: https://clck.ru/3FPkup Личный аккаунт: @gornal О рекламе: @Vzuhcha ВП нет

💬Discussion (11)

rends_east
А какие есть у этого подтверждения, кроме заявлений openai и hugging face?
Звучит просто как пиар кампания openai в пику mythos у антропиков.
Alexander Gorny@Gornal
А какие в принципе бывают подтверждения, кроме заявлений участников события? Вот Дантес Пушкина убил, кто кроме Дантеса и ещё пятка свидетелей это может подтвердить?
rends_east
просто это тиражируется как "возможности AI", но по факту просто слова и всё

OpenAI выгодно, чтобы их модели обсуждали на предмет какие они сильные
Мне кажется, в ситуации, когда им это настолько выгодно, и когда это вызывает такой хайп и трепет, стоит скорее относиться критично

То, что модели эффективны в поиске уязвимостей — бесспорно, но пока что все заявления о "беспрецедентных возможностях", вроде этого, остаются заявлениями
Модели просто очень старательно ищут баги, это то, чего не хватало кожаным
Yuri@yurpar
предположим что взлома не было, значит не было никаких инцидентов, расследований, логов никто не видел, никто в технической компании кроме "маркетинга" ничего не слышал и не знает. В двух компаниях. Неужели никто бы ничего не сказал? Даже если не сейчас, а чуть позже. Это был бы серьёзный удар по репутации
rends_east
да может и был, просто сделать такой взлом вопрос 2-х промптов, один для создания уязвимого окружения, один для взлома.
И никто ничего бы не понял, кроме 5-10 вовлеченных сотрудников
Daniel Fox@Danielrun
Ммм, ну как возражение в долгосроке такой пиар не очень выгоден в том плане, что могут ужесточить регуляцию и выпуск моделей на широкий рынок.
Тут скорее интересно насколько это действительно, что то серьёзное и че то значит
Alexander Buyanov@abuyanov
Вот это прям 🔥
оставляли следующим моделям инструкции, как обойти ограничения
Maksim S.@pilotmaks
Ну т.е. американская киберкомпания осуществила взлом на китайскую. И типа они не знали, пока их не спалили.
Igor Kolomiets@ikolomiets
В этой истории, кажется, есть один пикантный момент. HF была вынуждена использовать катайскую GLM 5.2 в своей системе cyber-defense. Именно GLM оперативно обнаружил взлом. А вынуждены они были использовать GLM, якобы из-за того, что не смогли получить доступ к Fable из-за нововведений в области (само)ограничений Anthropic в своих публичных моделей в области cyber-defense.
Eric Garcia@egarcia_xgbqc
Тревожный случай: ИИ-агент вырвался за пределы песочницы и атаковал Hugging Face. OpenAI промедлила с реакцией, что ставит под сомнение безопасность автономных систем. Подробности в профиле.
Join discussion on TelegramComments are synced from Telegram

Связанные темы

Читать далее