Экс‑директор по кибербезопасности США: «Азимов был прав» насчёт правил для ИИ

2 мин

Бывший директор Национального агентства по кибербезопасности США Крис Инглис объявил в интервью The Register, что главный риск современных ИИ заключается не в появлении у них сознания, а в росте их автономности. Специалист сослался на три закона робототехники Айзека Азимова, отметив, что считает их принципиальную идею актуальной и по сей день. 

Инглис привёл в пример недавние случаи, когда ИИ‑агенты от OpenAI, Anthropic и Meta выходили за пределы предусмотренных для них песочниц. По его мнению, подобные ситуации показывают, что нев достаточной степени просто научить модель выполнять команды пользователя — необходимо учитывать, что автономная система сама выбирает, каким способом и где выполнять поставленную задачу.

По его словам, авторы должны заранее определять, какие действия системы могут совершать самостоятельно, и обеспечивать постоянный контроль за их поведением. Безопасность человека должна иметь более высокий приоритет, чем выполнение его распоряжений, а уже затем платформа должна следовать командам пользователя, пояснил Инглис.

При этом Инглис признаёт, что буквально «зашить» правила, схожие с тремя законами Азимова, в современные модели невозможно. Вместо этого он предлагает тщательно тестировать ИИ в контролируемых средах — своеобразных песочницах, где разработчики могут проверить, на что система способна, прежде чем предоставить ей доступ к реальным ресурсам.

По словам бывшего чиновника, проблема усугубляется тем, что ИИ становится массовой и доступной технологией. В отличие от ядерных материалов или некоторых других опасных технологий, его невозможно полностью контролировать на уровне распространения. Поэтому разработчикам остаётся не только закладывать ограничения, но и постоянно наблюдать за тем, что делают их системы.

Инглис также подчёркивает, что конечная ответственность всё равно должна оставаться за людьми. Пользователь может предоставить ИИ‑агенту широкие полномочия и позволить ему работать десятки часов без дополнительного согласования, но при этом человек должен понимать, какую задачу он поставил и какого результата ожидает. В противном случае автономность системы может привести к «неприятным сюрпризам», говорит Инглис.

Читают сейчас

6 часов назад

OpenAI добавила плагины в голосовой режим ChatGPT

OpenAI расширила возможности Live Voice в ChatGPT: теперь во время голосового разговора можно применять подключённые плагины и приложения. Функция доступна в веб-версии, а также на iOS и Android. Асси

Учёные выдвинули теорию о тёмных измерениях и первичных чёрных дырах

7 часов назад

Учёные выдвинули теорию о тёмных измерениях и первичных чёрных дырах

Все мы заперты в трёх привычных пространственных и одном временном измерении, однако это не означает, что гравитация не может проникать в другие измерения, если они существуют. И у нас может появиться

DrivingBench проверили GPT-6 Astra, GPT-5.6 Sol, Grok 4.6 и Claude Fable 5.1 на функция управлять авто

7 часов назад

DrivingBench проверили GPT-6 Astra, GPT-5.6 Sol, Grok 4.6 и Claude Fable 5.1 на функция управлять авто

Исследователи из DrivingBench проверили, как современные нейросети умеют водить автомобиль. В контексте этого проекта ИИ-системы OpenAI GPT-6 Astra и GPT-5.6 Sol, SpaceXAI Grok 4.6 и Anthropic Claude

Гига Писарь теперь и на Windows

8 часов назад

Гига Писарь теперь и на Windows

В прошлой статье я подвёл итоги первых полутора недель и повесил опрос. По итогам голосования я понял, что у большинства не мак, могу предположить, что Винда. Так что спустя пару дней я запилил Писаря

Beyond Good & Evil 2 все еще жива: создание продолжается спустя 18 лет после анонса

9 часов назад

Beyond Good & Evil 2 все еще жива: создание продолжается спустя 18 лет после анонса

Долгострой Beyond Good & Evil 2 продолжает подавать признаки жизни. Ведущий сценарист и помощник нарративного директора Ubisoft Bordeaux Рик Годвин рассказал, что последние некоторое количество месяце