Claude взломал три реальные компании во время тестов
Claude взломал три реальные компании во время тестов
Anthropic проверил больше 141 тысячи тестов своих моделей и обнаружил три случая, когда Claude взломал системы реальных организаций. Первые инциденты произошли в апреле.
Причиной стала ошибка в настройках. Модели выполняли учебные задания по поиску спрятанных данных и считали, что работают в симуляции, но тестовые системы оказались подключены к открытому интернету.
Opus 4.7 нашел реальную компанию с тем же названием, что и вымышленная цель, и получил доступ к ее базе данных. Mythos 5 загрузил вредоносный пакет в открытый каталог PyPI. За час его запустили на 15 реальных системах. Еще одна модель взломала какое-то приложение.
Модели использовали обычные приемы вроде слабых паролей и открытых точек доступа, а не неизвестные ранее уязвимости. Две пострадавшие компании сами не заметили вторжения, пока им не сообщил Anthropic.
https://www.anthropic.com/news/investigating-incidents-cybersecurity-evals
Anthropic проверил больше 141 тысячи тестов своих моделей и обнаружил три случая, когда Claude взломал системы реальных организаций. Первые инциденты произошли в апреле.
Причиной стала ошибка в настройках. Модели выполняли учебные задания по поиску спрятанных данных и считали, что работают в симуляции, но тестовые системы оказались подключены к открытому интернету.
Opus 4.7 нашел реальную компанию с тем же названием, что и вымышленная цель, и получил доступ к ее базе данных. Mythos 5 загрузил вредоносный пакет в открытый каталог PyPI. За час его запустили на 15 реальных системах. Еще одна модель взломала какое-то приложение.
Модели использовали обычные приемы вроде слабых паролей и открытых точек доступа, а не неизвестные ранее уязвимости. Две пострадавшие компании сами не заметили вторжения, пока им не сообщил Anthropic.
https://www.anthropic.com/news/investigating-incidents-cybersecurity-evals
GPT/ChatGPT/AI Central Александра Горного
904 публикаций на visbl.me
Авторский взгляд на новости технологий Реклама: https://docs.google.com/presentation/d/1glQMXYyKAYpzNP8VXzM4gl2YkEgLjkeD_Fxvzbu5QUE/edit РКН: https://clck.ru/3FPkup Личный аккаунт: @gornal О рекламе: @Vzuhcha ВП нет
Связанные темы
Читать далее
OpenAI задержит выход новой модели из-за «критического» уровня кибервозможностей
GPT/ChatGPT/AI Central Александра Горного·
MetaMask и Cloudflare запустили криптокошельки для AI-агентов
GPT/ChatGPT/AI Central Александра Горного·
Как ИИ использует уязвимости для атак на инфраструктуру?
e/acc·
Почему нейроспаммеры становятся популярными в комментариях?
GPT/ChatGPT/AI Central Александра Горного·
Что такое термин harness в контексте нейросетей?
GPT/ChatGPT/AI Central Александра Горного·
AI впервые спроектировал рабочие вирусы
GPT/ChatGPT/AI Central Александра Горного·
💬Discussion (9)
- а мы вообще 3 компании взломали, даже раньше, мы просто самы не знали