ИИ нашел критический дефект в шифровании Cloudflare — любой ключ открывал все

2 мин
ИИ нашел критический дефект в шифровании Cloudflare — любой ключ открывал все

Аудиторская компания zkSecurity направила свой ИИ-пайплайн на CIRCL — экспериментальную криптографическую библиотеку Cloudflare. Итог: семь подтвержденных багов, все уже исправлены, за большинство организация получила выплаты по баунти-программе Cloudflare. Разбор находок zkSecurity опубликовала 7 июля — и самое интересное в нем не сами баги, а то, как повели себя нашедшие их модели.

Главная находка — критическая. В CIRCL есть модель шифрования, где доступ к сообщению определяется правами: расшифровать его должен только тот, чей ключ соответствует политике вроде "финансовый отдел И офис в США". Что-то вроде замка, который открывается только двумя ключами сразу. В связи с ошибки в одной строке кода замок собирался неправильно: первого ключа хватало, чтобы открыть его в одиночку. А поскольку служебная метка, играющая роль этого "первого ключа", была в каждом выданном ключе, любой потребитель мог расшифровать любое сообщение — политика доступа просто не работала. Cloudflare подтвердила критический уровень.

Этот дефект нашел zkao, собственный ИИ-агент zkSecurity для аудита кода. Остальные шесть попроще: пять обнаружил Claude Opus 4.6 в связке с экспертными скиллами команды, один — GPT-5.3. Люди одновременно оставались в цикле: каждую находку исследователи проверяли на эксплуатируемость и сами вели раскрытие. Авторы честно признают: кандидаты от ИИ дешевы, доверие к отчетам — нет.

Дальше начинаются странности в поведении моделей. Во-первых, ИИ плохо оценивает серьезность собственных находок, причем в обе стороны: большинство багов он переоценил, а вот атаку на агрегированные подписи BLS, наоборот, занизил до среднего уровня . В zkSecurity пока доверяют оценку серьезности людям — правда, оговариваются, что и рейтинги Cloudflare отражают прежде всего влияние на ее собственные сервисы, а для других проектов на базе CIRCL те же баги могут быть куда опаснее.

Во-вторых, связки моделей нестабильны. В первом прогоне баги находил главным образом Opus 4.6, а GPT-5.3 только проверял чужие находки. Через несколько недель организация повторила сканирование на Opus 4.7 и GPT-5.4 — роли развернулись: теперь баги находил GPT, а Claude только подтверждал их. Вывод авторов: не привязывайтесь к имени модели, лидер меняется от релиза к релизу.

P.S. Поддержать меня можно подпиской на канал "сбежавшая нейросеть", где я рассказываю про ИИ с творческой стороны.

Читают сейчас

Нобелевскую премию по физике вручили руководителю проекта нейтринного детектора

3 часа назад

Нобелевскую премию по физике вручили руководителю проекта нейтринного детектора

Нобелевская премия по физике 2026 года присуждена исследователю, который превратил огромный массив льда на Южном полюсе в детектор неуловимых частиц, называемых нейтрино, прилетающих на Землю из космо

В ЕС введут штрафы до 15 млн евро за публикацию нейрослопа без маркировки

7 часов назад

В ЕС введут штрафы до 15 млн евро за публикацию нейрослопа без маркировки

OpenAI объявила, что добавит в генерации текста ChatGPT и Codex невидимые водяные знаки. Мы с вами их не заметим. Особый механизм меняет статистику набора слов, для того чтобы детектор вотермарок смог

Сравнили 461 тысячу AI-ответов: упоминание бренда не коррелирует с цитированием источника

9 часов назад

Сравнили 461 тысячу AI-ответов: упоминание бренда не коррелирует с цитированием источника

Организация MarketScale, которая развивает B2B-платформу для создания и распространения экспертного контента, вчера обновила B2B Marketing Index — регулярно пересчитываемый набор данных о том, как пят

Что ждет российский сегмент ПО в 2027 году: обсудим на GuardConf

9 часов назад

Что ждет российский сегмент ПО в 2027 году: обсудим на GuardConf

Российский ИТ-рынок вступает в фазу жесткой конкуренции: импортозамещение теряет роль драйвера, клиент выбирает решения по эффективности и совместимости, а отрасль ищет новые точки роста. Куда движетс

Моушн-дизайн за копейки: Grom Motion создаёт инфографику и рилсы одной кнопкой

9 часов назад

Моушн-дизайн за копейки: Grom Motion создаёт инфографику и рилсы одной кнопкой

Моушн-дизайн традиционно остается одной из самых ресурсоемких задач в продакшене. Написание сценария, подбор футажей, анимация инфографики, синхронизация звука – всё это требует часов рутинной работы