Глава Anthropic: ИИ нужно регулировать как авиацию — с правом блокировать модели

3 мин
Глава Anthropic: ИИ нужно регулировать как авиацию — с правом блокировать модели

Гендиректор Anthropic Дарио Амодеи опубликовал эссе Policy on the AI Exponential, в котором призвал перейти к жесткому госрегулированию ИИ по образцу авиационной отрасли. Передовые модели, как самолеты, должны проходить обязательное тестирование и аудит перед релизом, а государство должно иметь право заблокировать или отозвать модель, не отвечающую стандартам безопасности. Эссе вышло 10 июня — на следующий день после релиза Claude Fable 5.

Предложение Anthropic выглядит так: модели выше определенного порога вычислений проходят обязательную проверку квалифицированной третьей стороной по четырем категориям рисков — кибербезопасность, угроза создания биологического оружия, потеря контроля над ИИ-системами и автоматизированные исследования, способные ускорить остальные три. Проверкой может заниматься госагентство по образцу FAA или авторизованные государством частные организации. Компании обязаны защищать веса моделей от утечек, проводить регулярные проверки имитацией атак и оперативно сообщать об инцидентах. Право блокировки должно быть ограничено четырьмя названными рисками и защищено от политического произвола.

Это разворот в позиции Anthropic. Раньше организация продвигала законы о прозрачности в разработке ИИ, как достаточную меру контроля. Теперь Амодеи прямо пишет, что прозрачности больше нев достаточной степени: риски перестали быть гипотетическими. Главным доказательством он называет Claude Mythos Preview, который "перетряхнул глобальный ландшафт кибербезопасности" и показал, что передовые модели стали инструментами стратегического значения. Следом, по его прогнозу, придут биологические риски и риски автономии ИИ.

Экономический блок эссе посвящен вытеснению рабочих мест. Амодеи предлагает страхование зарплат (доплату тем, кто вынужденно перешел на менее оплачиваемую работу), налоговые льготы для работодателей за отказ от сокращений, гранты на переобучение, а если вытеснение окажется устойчивым — безусловный базовый доход за счет налогов на ИИ-компании или повышения налога на прирост капитала. По данным VentureBeat, под эти инициативы Anthropic выделяет 350 миллионов долларов.

Отдельный раздел — о защите граждан от самого государства. Амодеи предлагает запретить полностью автономное оружие в полиции, обязать военные автономные системы подчиняться механизмам конституционного контроля — от судебных приказов до старших офицеров, а не слепо исполнять команды, — и закрыть лазейку с дата-брокерами, через которую спецслужбы скупают данные американцев для массовой слежки. Еще одна идея: человек, против которого государство ведет разбирательство, должен иметь доступ к ИИ не слабее того, которым пользуется само государство, — иначе нарушается право на защиту.

Критики уже назвали предложение попыткой захвата регулирования в свою пользу (regulatory capture): обязательные аудиты проще всего пройти крупным игрокам, которые уже выстроили под них инфраструктуру. На Hacker News отмечают, что требования практически означают запрет открытых моделей — отозвать опубликованные веса невозможно. Порог вычислений, с которого начинается регулирование, в предложении не назван, так что где именно пройдет граница, пока неясно.

P.S. Поддержать меня можно подпиской на канал "сбежавшая нейросеть", где я рассказываю про ИИ с творческой стороны.

Читают сейчас

OpenAI обновила генератор изображений в ChatGPT — вышла Images 2.5

7 часов назад

OpenAI обновила генератор изображений в ChatGPT — вышла Images 2.5

OpenAI представила новую версию своей модели для генерации и редактирования изображений. ChatGPT Images 2.5 стала быстрее, точнее следует инструкциям и лучше справляется с серией последовательных прав

Энтузиаст опубликовал android‑клавиатуру, которая предупреждает, за какую фразу можно получить дедлайн

9 часов назад

Энтузиаст опубликовал android‑клавиатуру, которая предупреждает, за какую фразу можно получить дедлайн

Пользователь GitHub под ником MShverdiakov опубликовал open-source проект под названием «Соучастник». Он представляет собой android-клавиатуру, которая с помощью локальной языковой модели анализирует

Atlas представила носимый ЭЭГ‑датчик, который отслеживает стресс и концентрацию на протяжении дня

9 часов назад

Atlas представила носимый ЭЭГ‑датчик, который отслеживает стресс и концентрацию на протяжении дня

Организация Atlas открыла предзаказы на миниатюрный носимый датчик электроэнцефалографии (ЭЭГ), который крепится на кожу за ухом и непрерывно собирает информация о работе мозга. Гаджет должен помочь в

11 часов назад

OpenAI только что решили задачу тысячелетия и представили подход задачи Навье — Стокса

OpenAI заявила о решении задачи Навье - Стокса! OpenAI опубликовала 165-страничное доказательство по одной из семи задач тысячелетия - существованию и гладкости решений уравнений Навье - Стокса. Ознак

Новое исследование демонстрирует, что чёрные дыры растут следом за Вселенной

11 часов назад

Новое исследование демонстрирует, что чёрные дыры растут следом за Вселенной

Мы знаем, что Вселенная постоянно расширяется. Одновременно считается, что гравитационно связанные системы, такие как планетные системы и чёрные дыры, в значительной степени не участвуют в этом расшир