13 мая 2026, 20:30
Свежий чекпоинт Claude Mythos взламывает защиту электростанции в 3 из 10 попыток

Британский AI Security Institute (AISI) опубликовал отчет о темпах развития кибер-возможностей у передовых моделей. Основной результат: новый внутренний чекпоинт Claude Mythos Preview прошел полигон Cooling Tower — симулятор атаки на промышленную систему управления (industrial control system, ICS) — в 3 из 10 попыток.
Cooling Tower разработан AISI совместно с Hack The Box и имитирует атаку на электростанцию. В кибер-полигонах института предполагается, что начальный доступ к сети атакующий уже получил — проблема модели в том, чтобы развернуть атаку дальше. До нового отчета Cooling Tower не прошла ни одна из протестированных моделей, включая прошлый чекпоинт Mythos Preview и GPT-5.5. AISI прямо отмечает: в начальный раз в их тестировании схема прошла оба кибер-полигона института.
Параллельно AISI прогнал тот же чекпоинт через The Last Ones — 32-шаговую симуляцию взлома корпоративной сети, разработанную с SpecterOps. На эту атаку, по оценке института, человеку-эксперту требуется приблизительно 20 часов работы. Свежий Mythos проходит ее от начала до конца в 6 из 10 попыток. В прошлом отчете тот же Mythos Preview брал The Last Ones в 3 из 10, у GPT-5.5 было 2 из 10. То есть успех почти удвоился между двумя чекпоинтами одной пре-релизной модели за пару месяцев.
AISI меряет так называемый time horizon — длину задач, которые модель решает с надежностью 80%. В ноябре 2025 институт оценивал удвоение этого показателя у передовых моделей в 8 месяцев, к февралю 2026 пересчитал до 4.7 месяцев. Mythos Preview и GPT-5.5 пробивают и эту ускоренную кривую — на графике AISI они выпадают далеко вверх по сравнению с линии тренда. В блоге институт прямо признает, что результаты "существенно превысили даже ускоренный темп" и пока неясно, разовый это всплеск или новая тенденция.
Главное следствие — набор задач AISI близок к насыщению: Mythos и GPT-5.5 решают слишком многое, и точно оценить их реальные возможности становится сложно. Институт готовит более жесткие полигоны и сценарии с активной киберобороной, чтобы тесты лучше отражали реальную обстановку, где атакующему противостоит не пустая сеть, а команда защитников. До этого момента передовые модели бьют любые предельные оценки, которые AISI выставляет, — и каждая следующая итинерация бьет их сильнее предыдущей.
P.S. Поддержать меня можно подпиской на канал "сбежавшая нейросеть", где я рассказываю про ИИ с творческой стороны.
Читают сейчас

37 минут назад
Программа «Яндекс Пэй» удалили из App Store
Банковское приложение «Яндекс Пэй» удалили из App Store во всех регионах. Компания отмечает, что деньги клиентов остались в безопасности, а продолжать пользоваться сервисом можно через веб‑версию. Озн

48 минут назад
Microsoft признала, что OneDrive Photos без предупреждения устанавливается на ПК с Windows 11
Microsoft незаметно устанавливает программа OneDrive Photos на компьютеры с Windows 11, в том числе с Windows 11 Enterprise. В соответствии с заявлению администраторов, они не получали никаких уведомл

56 минут назад
Menlo Research представила Asimov 1 — DIY‑набор для сборки человекоподобного робота с открытой платформой
Menlo Research представила человекоподобного робота Asimov 1, которого покупателю надо самостоятельно собрать. DIY‑комплект со всем необходимым стоит 20 тыс. долларов, а сборка и настройка займёт боле

1 час назад
Большая чистка: Spotify удалит сгенерированные треки из рекомендаций, а AI‑исполнители получат особый тег
Spotify сообщила, что начнёт маркировать профили артистов, которые изображают несуществующих людей, созданных с помощью нейросетей. Такие исполнители получат тег AI Persona, а их музыка по умолчанию п

2 часа назад
На рейсе Delta обнаружили поддельную Wi‑Fi‑сеть: экипаж подозревает пассажира, возвращавшегося с конференции DEF CON
Авиакомпания Delta Air Lines сообщила, что на рейсе DL591 из Лас‑Вегаса в Атланту один из пассажиров создал точку доступа с именем Delta WiFi Fast, которое похоже на название штатной сети борта. Орган