InfoWatch Data Discovery меняет решение к файловому аудиту

2 мин

В обновлении InfoWatch Data Discovery 2.2 появился модуль ML‑кластеризации, который автоматически систематизирует 100% файлов и может многократно ускорить файловый аудит.

В рамках цикла обновлений продуктов по защите данных ГК InfoWatch выпустила апдейт решения для аудита хранения данных InfoWatch Data Discovery 2.2. Ключевое нововведение — модуль машинного обучения (ML) на основе запатентованной технологии потоковой кластеризации. В отличие от классических решений, требующих ручной настройки словарей и политик, ML‑модуль работает без предварительного обучения: система сама анализирует 100 процентов документов, группирует их по тематике, выделяет ключевые термины и демонстрирует, какие данные реально хранятся в ИТ‑инфраструктуре компании. ML‑модуль кардинально меняет подход к проведению аудита документов и полностью исключает «серые зоны» — до 70% неконтролируемых данных, которые при традиционном подходе остаются вне фокуса из‑за сложности и дороговизны настройки политик.

По оценкам InfoWatch, аудит рабочей станции или файлового хранилища с помощью кластеризации может быть ускорен в 30 раз по сравнению с ручным перебором или анализом через классические инструменты. Вместо того чтобы тратить недели на создание словарей и пересканирование файлов при появлении новых категорий документов, специалист получает уже систематизированную картину: все документация автоматически разложены по смысловым группам, снабжены тегами и готовы к фильтрации. Индексация всех файлов выполняется в фоновом режиме, поэтому поиск по тегам и категориям происходит мгновенно, без повторного сканирования.

Такой подход позволяет быстро получать информацию о любых типах файлов и местах их хранения. Фильтр редких тегов помогает быстро находить «экзотические» документация, не соответствующие должностным обязанностям сотрудника, а фильтр по дате создания кластера даёт возможность систематически отслеживать выход новых категорий, не похожих ни на что ранее найденное. Если в рамках расследования на рабочей станции найдена подозрительная категория документов, платформа моментально показывает, где еще в компании хранятся такие же файлы. Из любого кластера можно сформировать коллекцию документов и одной кнопкой создать словарь для автолингвиста в InfoWatch Traffic Monitor, что сокращает настройку DLP‑системы для новой категории данных с 3–5 дней до нескольких минут.

Традиционный подход к аудиту данных требует от ИБ‑специалиста описывать категории документов вручную — создавать словари, политики, регулярные выражения. Это трудоемкий процесс, который может занимать недели и оставляет до 70% данных в «серой зоне». При появлении новых типов документов приходится все переделывать заново. Кластеризация работает иначе: платформа сама анализирует 100 процентов файлов, группирует их по смыслу, выделяет ключевые термины и показывает реально хранящиеся данные. Это не просто ускорение, это принципиально иной подход — от ручного описания к исследовательскому анализу

Александр Цветков

Ведущий менеджер по развитию продуктов для защиты данных ГК InfoWatch.

Читают сейчас

Выпуск языка программирования Julia 1.13

2 часа назад

Выпуск языка программирования Julia 1.13

10 сентября 2026 года состоялся выпуск языка программирования Julia 1.13. Проект сочетает в себе такие качества как высокая производительность, поддержка динамической типизации и встроенные средства д

Версия GIMP 3.2.6

3 часа назад

Версия GIMP 3.2.6

10 сентября 2026 года состоялся версия открытого графического редактора GIMP 3.2.6 (release GIMP 3.2.6). Открытый редактор GIMP создаётся уже более 29 лет в качестве альтернативы программному обеспече

Международная съезд «Искусственный интеллект в нейронауках» в Плехановском университете

10 часов назад

Международная съезд «Искусственный интеллект в нейронауках» в Плехановском университете

исходная гиперссылка на официальную новость. Идет трехдневный форум на стыке промышленности, медицины и искусственного интеллекта. Съезд объединила исследователей динамики сложных систем, математиков,

Anthropic раскрыла сеть из дейтинговых приложений с ИИ‑персонажами, работающими на Claude

14 часов назад

Anthropic раскрыла сеть из дейтинговых приложений с ИИ‑персонажами, работающими на Claude

Anthropic раскрыла детали масштабной мошеннической сети (инициатива получил кодовое имя GTG-15001) из дейтинг‑приложений, построенной на базе нескольких ИИ-систем. Студия из Китая развернула более 20 

В Москве появился памятник кнопке «Пауза», пропавшей с ноутбуков

15 часов назад

В Москве появился памятник кнопке «Пауза», пропавшей с ноутбуков

Ко Дню программиста наша ИТ-команда 2ГИС в коллаборации с уличным художником Иваном Серым и Музеем криптографии установили в Москве интерактивный арт-объект в виде клавиши Pause/Break. Найти объект мо