2 апреля 2026, 19:21
Подрядчик OpenAI и Anthropic разрабатывает средство для работы с признаками онлайн-радикализации


Новозеландский стартап-компания ThroughLine, который уже сотрудничает с OpenAI, Anthropic и Google по кризисным сценариям, хочет расширить свою систему поддержки и добавить в неё работу с признаками насильственного экстремизма. По данным Reuters, речь идёт о новом инструменте, который должен сочетать чатбота и перенаправление пользователя к реальным службам помощи.
Сейчас ThroughLine известна как служба, который подключается в тех случаях, когда AI-платформа видит возможный риск селфхарма, домашнего насилия или расстройств пищевого поведения. У компании есть постоянно обновляемая сеть из 1600 горячих линий в 180 странах, и в таких сценариях пользователя направляют к подходящей локальной службе поддержки.
Теперь организация рассматривает следующий шаг — работу с пользователями, которые проявляют признаки радикализации или интерес к насильственному экстремизму. Для этого ThroughLine ведёт обсуждения с The Christchurch Call — международной инициативой, созданной после теракта в Крайстчерче в 2019 году для противодействия онлайн-экстремизму. Предполагается, что эта формат будет давать экспертные рекомендации, а ThroughLine — создавать сам инструмент вмешательства.
Другие новости и материалы по AI — в Telegram-канале NH | Новости технологий, AI и будущее.
По словам основателя ThroughLine Эллиота Тейлора, речь идёт не о несложный блокировке пользователя или автоматическом отключении диалога, а о более мягкой модели вмешательства. В основе должен быть гибридный подход: специализированный чатбот, обученный работать с чувствительными кейсами, плюс функция вывести человека на живую помощь в офлайне или через профильные службы. Сроки запуска пока не объявлены, продукт всё ещё тестируется.
Идея выглядит как попытка уйти от привычной логики “обнаружили риск — забанили”. В Reuters отмечают, что у платформ уже растёт давление из-за исков и претензий, связанных с тем, что чатботы могут не остановить опасное поведение или даже косвенно его поддержать. На этом фоне ThroughLine предлагает схема, где проблема рассматривается не только как вопрос модерации контента, но и как вопрос кризисной помощи человеку.
В статье отдельно подчёркивается, что у такого подхода остаются сложные вопросы: как строить follow-up, когда и нужно ли уведомлять власти, и не приведёт ли слишком жёсткое вмешательство к обратному эффекту — например, к уходу пользователей на менее регулируемые площадки. Но сам факт появления таких инструментов показывает, что AI-компании всё чаще вынуждены думать не только о генерации текста, но и о том, что создавать с опасными сценариями в живом общении с пользователем.
Читают сейчас

1 час назад
Сооснователь Anthropic опасается, что Claude постоянно страдать
Сооснователь Anthropic и один из ключевых исследователей интерпретируемости моделей Кристофер Олах обсудил с религиозными и философскими исследователями вопрос: может ли современная языковая схема обл

3 часа назад
NVIDIA представила AI-компьютер за $4999
NVIDIA анонсировала новую версию настольного AI-компьютера DGX Spark с 64 ГБ объединённой памяти. Продажи начнутся 23 октября через Acer, ASUS, Dell, Gigabyte, HP и MSI. Цена стартует с $4999. Аннотац

3 часа назад
Tesla снижает объем RAM в чипах AI5 и AI6
Илон Маск сообщил о пересмотре технических характеристик для своих вычислительных платформ AI5 и AI6. Изменения затронули объем внешней оперативной памяти: чип AI5 получит 72 ГБ LPDDR5 вместо ранее за

3 часа назад
Выпущен порт файлового менеджера DOS Navigator на Free Pascal
Разработчик Иван Сорокин представил порт файлового менеджера DOS Navigator (оригинальному проекту в этом году исполнилось 35 лет) на Free Pascal. Читать далее

5 часов назад
В OpenIDE Pro появилась публичная бета поддержки C#
Выпустили публичную бета-версию C#-плагина для OpenIDE Pro. Теперь в IDE можно редактировать и анализировать C#-код, функционировать с .NET-решениями и проектами, собирать, запускать и отлаживать прил