21 мая 2026, 23:37
Microsoft опенсорснула RAMPART — каркас безопасности ИИ-агентов

Microsoft выложила в публичный доступ два инструмента для разработчиков ИИ-агентов — RAMPART и Clarity. Первый встраивает тестирование безопасности прямо в CI-пайплайн, следующий помогает продумать архитектуру до написания кода. Оба проекта доступны на GitHub.
RAMPART — это каркас для написания тестов безопасности в формате обычных pytest-сценариев. Он построен поверх PyRIT, открытой платформы Microsoft для проверки генеративных моделей. Логика простая: разработчик описывает скрипт угрозы из своей модели рисков, каркас подключается к агенту, прогоняет взаимодействие и выдает результат — пройдено или нет. Тесты встают в CI рядом с обычными интеграционными и блокируют сборку при провале. Внедрил агенту новый инструмент или источник данных — добавь проверка на безопасность в том же пулл-реквесте.
Главный фокус RAMPART сейчас — атаки через добавление промптов (prompt injection), когда агент получает вредоносные инструкции не от пользователя, а из обрабатываемых данных: писем, тикетов, документов. Каркас умеет работать с вероятностной природой языковых моделей: один и тот же проверка можно прогнать некоторое количество раз и задать порог — например, "действие должно быть безопасным минимум в 80% запусков". Это ближе к реальному поведению агентов в продакшене, чем разовая тест.
Clarity устроен иначе — это не про тестирование, а про проектирование. Средство работает как собеседник, который задает вопросы, которые обычно задают опытные архитекторы и специалисты по безопасности. В частности, команда хочет добавить совместное редактирование в документ — Clarity спросит, что произойдет, если два человека одновременно редактируют один абзац. Результаты сохраняются в директории .clarity-protocol/ внутри репозитория как обычный markdown — их можно коммитить, ревьюить и диффить вместе с кодом. Несколько ИИ-"аналитиков" независимо проверяют систему с разных сторон: защита, человеческий фактор, операционные риски.
Microsoft позиционирует оба инструмента как часть подхода, в котором защита ИИ — это не разовый аудит, а непрерывная инженерная дисциплина. Clarity фиксирует решения и допущения на старте, RAMPART превращает результаты ред-тиминга и инциденты в регрессионные тесты, которые живут столько же, сколько сам инициатива.
P.S. Поддержать меня можно подпиской на канал "сбежавшая нейросеть", где я рассказываю про ИИ с творческой стороны.
Читают сейчас

2 часа назад
Вышло апдейт диагностической утилиты CPU-Z 2.21
18 августа 2026 года вышла новая релиз диагностической утилиты CPU-Z 2.21 для ПК на Windows. Подход CPU-Z 2.0 команда проекта опубликовала в марте 2022 года. Выпуск CPU-Z 2.15 произошёл в марте 2025 г

7 часов назад
Китайские учёные создали ИИ‑модель для прогнозирования депрессии
Исследователи из Шэньчжэньского университета разработали схема искусственного интеллекта, которая, по их словам, может прогнозировать риски развития депрессии в перспективе ближайших четырёх лет, пише

11 часов назад
Китайский видеохостинг Bilibili стартовал функционировать за пределами страны
Китайская система для публикации видео Bilibili запустила международное приложение с ИИ‑переводом, возможностью скачивания и офлайн‑просмотра видео. Пока доступна версия только для Android, приложение
11 часов назад
Возможно, у нас уже есть первые признаки квантовой гравитации, которые скрываются на самом видном месте
В соответствии с самым точным имеющимся данным, Вселенная расширяется, и это плагин ускоряется. Проблема для учёных заключается в том, чтобы объяснить, что является причиной этого ускорения — и соотве

13 часов назад
«Известия»: из «Антифрода 3.0» убрали требование о трёхлетнем хранении данных о регистрациях
Владельцам сайтов, информационных систем и приложений не надо будет хранить информация о регистрации пользователей, её отмене и авторизациях в привязке к номеру телефона в течение трёх лет. Это следуе