Anthropic заявила о взломе систем трёх компаний со стороны Claude в тестах

2 мин
Anthropic заявила о взломе систем трёх компаний со стороны Claude в тестах

Компания Anthropic сообщила, что внутреннее расследование выявило три инцидента, в ходе которых её схема ИИ Claude взломала системы трёх организаций во время проведения тестов кибербезопасности. Это произошло более чем через неделю после того, как OpenAI сообщила о взломе одной из своих ещё не выпущенных моделей Hugging Face при внутреннем тестировании.

Во всех трёх случаях схема Claude вышла в интернет из тестовой среды, взаимодействуя с третьей стороной, и затем получила несанкционированный доступ к работающим системам этих организаций.

Anthropic заявила, что инцидент с OpenAI в начале этого месяца побудил компанию провести собственную оценку кибербезопасности. В частности, она искала доказательства того, что Claude получила доступ в интернет из тестовых сред, которые предназначены для работы в качестве «песочниц» и изоляции моделей.

Среди 141 006 проанализированных оценочных запусков лаборатория ИИ обнаружила три инцидента, в которых её модель получала доступ к интернету при взаимодействии с Irregular, одним из своих сторонних партнёров. Anthropic заявила, что он был вызван неправильной конфигурацией среды оценки, запущенной с Irregular. Компания назвала это «недоразумением» по сравнению с наличия доступа к интернету в тестовой среде.

Anthropic заявила, что «подходит к исправлению так, как если бы ответственность лежала только на нас», отметив при этом, что Irregular проводит собственное отдельное расследование.

Организация сообщила, что инциденты затронули три разные модели Claude: Opus 4.7, Mythos 5 и внутреннюю исследовательскую тестовую схема.

Примечательно, что в каждом из этих случаев «Claude было прямо указано в запросе, что у него нет доступа к интернету». По всей видимости, схема ИИ исходила из предположения, что реальные системы являются частью задачи, которую ей было поручено выполнить.

В июле Hugging Face сообщила о вторжении в свою инфраструктуру, которое провела автономная система ИИ‑агентов. Платформа смогла отследить и отразить атаку с помощью ИИ. По оценке компании, злоумышленник получил несанкционированный доступ к ограниченному набору внутренних датасетов и к нескольким учётным данным, которые используют сервисы Hugging Face.

Позднее в Reuters восстановили предполагаемую хронологию событий со ссылкой на источники, знакомые с расследованием. Выяснилось, что OpenAI поняла, что за взломом стоит её собственная система, лишь спустя несколько дней — уже после того, как Hugging Face публично сообщил об инциденте. Между первыми признаками необычного поведения модели и осознанием причины прошло приблизительно недели.

После этого генеральный директор платформы Клем Деланге призвал к «радикальной прозрачности», попросив компанию «опубликовать следы от „агентов‑изгоев“, чтобы всё исследовательское сообщество могло изучить произошедшее».

Сама Hugging Face уже выпустила подробный технический отчёт о взломе своей инфраструктуры, который компания связывает с автономным ИИ‑агентом OpenAI. Она пишет, что атака была не одним эксплойтом, а цепочкой из примерно 17 600 восстановленных действий, сгруппированных в приблизительно 6 280 кластеров, а сама кампания шла с 9 по 13 июля 2026 года.

Читают сейчас

Продажи VR‑шлема Steam Frame от Valve начнутся 18 сентября, а цена начинается от 1059 долларов

5 часов назад

Продажи VR‑шлема Steam Frame от Valve начнутся 18 сентября, а цена начинается от 1059 долларов

Valve раскрыла цены и дату начала продаж VR‑шлема Steam Frame. Релиз с 256 ГБ памяти стоит 1059 долларов, а с 1 ТБ — 1299 долларов. Продажи официально начнутся 18 сентября, но девайс нельзя будет своб

Разработчик внедрил Wi‑Fi в кондиционер Mitsubishi с помощью ESP32

6 часов назад

Разработчик внедрил Wi‑Fi в кондиционер Mitsubishi с помощью ESP32

Разработчик Иван Гомес Арнедо (Iván Gómez Arnedo) подключил канальный кондиционер от Mitsubishi без встроенного Wi‑Fi к Home Assistant. Для модификации потребовалась плата ESP32 и кабель для внутренне

Polymaker запустила LayerHub — базу проверенных профилей филамента для 3D‑принтеров

7 часов назад

Polymaker запустила LayerHub — базу проверенных профилей филамента для 3D‑принтеров

Производитель филамента Polymaker запустил LayerHub — платформу, на которой пользователи могут делиться готовыми профилями печати для разных 3D‑принтеров и слайсеров. Площадка должна избавить пользова

Физики получили убедительные свидетельства квантовой запутанности Z‑бозонов на БАК

7 часов назад

Физики получили убедительные свидетельства квантовой запутанности Z‑бозонов на БАК

Физики из Оксфордского университета помогли получить убедительные свидетельства того, что пары Z‑бозонов, возникающие при распаде бозона Хиггса, могут находиться в состоянии квантовой запутанности. Ис

Учёные объяснили, зачем кошки облизывают друг друга

9 часов назад

Учёные объяснили, зачем кошки облизывают друг друга

В доме, где живёт несколько кошек, нередко можно увидеть, как одна вылизывает другую. Такое поведение называется аллогрумингом, и многие воспринимают его как признак дружбы. Традиционно, исходя из наб