Discord признала ошибочную блокировку пользователей ИИ из-за безобидных изображений

2 мин
Discord признала ошибочную блокировку пользователей ИИ из-за безобидных изображений

Discord заявила, что ошибка в системе модерации с использованием ИИ ошибочно заблокировала более 8000 пользователей за последние два месяца, пометив безобидные изображения — в том числе электронные таблицы, шахматные доски, игровые текстуры, а также белые и серые прозрачные фоны — как вредоносный контент.

Организация подтвердила, что задача затрагивала учётные записи с мая, и ещё 200 пользователей были заблокированы в выходные, прежде чем команда выявила и исправила дефект. В настоящее время все затронутые аккаунты находятся в процессе восстановления.

Этот инцидент подчёркивает одну из растущих проблем, связанных с модерацией ИИ, поскольку многие платформы всё чаще полагаются на автоматизированные системы для выявления незаконного или оскорбительного контента.

В подробном обсуждении на X в Discord объяснили, что автоматизированная система безопасности работает путём сопоставления загруженного контента с базами данных известных вредоносных картинок и шаблонов. Компания признала, что иногда она может выдавать ложные срабатывания. Человек-модератор проверяет контент, но сбой приводит к тому, что система немедленно блокирует затронутые учётные записи.

«Мы работаем над улучшением мер безопасности, чтобы это больше не повторилось», — написали в Discord.

На X и Reddit пользователи утверждали, что их навсегда заблокировали просто за загрузку изображений, содержащих квадратные сетчатые узоры. Некоторое количество пользователей предположили, что инструменты модерации Discord на основе ИИ стали более чувствительны к сеткам, поскольку ранее они использовались для сокрытия или маскировки контента NSFW и детской порнографии от автоматизированных систем обнаружения.

Пока проблема не решена, юзерам рекомендуется воздержаться от отправки любых изображений с сеткой даже в личных сообщениях.

Зимой этого года Discord после негативной реакции пользователей отменил свою угрозу с начала марта сделать «детскими» все аккаунты без верификации возраста.

Ранее Discord показал новые правила пользования платформой, которые предполагали, что все аккаунты пользователей в мире автоматически сделают «детскими», пока их владельцы не подтвердят свой возраст. Предполагалось, что без подтверждения нельзя будет заходить на сервера 18+, а если потребитель уже состоит в таких серверах, доступ к ним заблокируют. Личные сообщения для незнакомых пользователей также будут закрыты. Подтвердить свой возраст планировалось разрешить только паспортом и видеосканом лица.

Читают сейчас

В ЕС введут штрафы до 15 млн евро за публикацию нейрослопа без маркировки

1 час назад

В ЕС введут штрафы до 15 млн евро за публикацию нейрослопа без маркировки

OpenAI объявила, что добавит в генерации текста ChatGPT и Codex невидимые водяные знаки. Мы с вами их не заметим. Особый механизм меняет статистику набора слов, для того чтобы детектор вотермарок смог

Сравнили 461 тысячу AI-ответов: упоминание бренда не коррелирует с цитированием источника

3 часа назад

Сравнили 461 тысячу AI-ответов: упоминание бренда не коррелирует с цитированием источника

Организация MarketScale, которая развивает B2B-платформу для создания и распространения экспертного контента, вчера обновила B2B Marketing Index — регулярно пересчитываемый набор данных о том, как пят

Что ждет российский сегмент ПО в 2027 году: обсудим на GuardConf

3 часа назад

Что ждет российский сегмент ПО в 2027 году: обсудим на GuardConf

Российский ИТ-рынок вступает в фазу жесткой конкуренции: импортозамещение теряет роль драйвера, клиент выбирает решения по эффективности и совместимости, а отрасль ищет новые точки роста. Куда движетс

Моушн-дизайн за копейки: Grom Motion создаёт инфографику и рилсы одной кнопкой

3 часа назад

Моушн-дизайн за копейки: Grom Motion создаёт инфографику и рилсы одной кнопкой

Моушн-дизайн традиционно остается одной из самых ресурсоемких задач в продакшене. Написание сценария, подбор футажей, анимация инфографики, синхронизация звука – всё это требует часов рутинной работы

3 часа назад

Mistral выпустила Le Chonk — открытую схема на 1,05 трлн параметров

Le Chonk — мультимодальная MoE-модель на 1,05 трлн параметров, из которых при одном проходе активны 49 млрд. В модели также есть vision-энкодер на 1,6 млрд параметров. Схема уже доступна в public prev