OpenAI замедлила разработку модели Astra

2 мин
OpenAI замедлила разработку модели Astra

OpenAI сообщила о приостановке работы над некоторыми аспектами своей будущей модели Astra после того, как внутренняя проверка выявила значительные успехи в программировании агентов и кибербезопасности — достаточные для того, чтобы вызвать опасения по поводу её возможностей.

В сообщении OpenAI говорится, что эта модель, которая всё ещё находится в разработке, достигла «критического порога кибербезопасности». Это означает, что она может самостоятельно выявлять и осуществлять кибератаки против традиционно хорошо защищённых реальных систем. В соответствии с «Рамочной программой готовности» компании, разработанной в 2023 году, это активировало дополнительные меры защиты.

«Хотя мы продолжаем проводить сравнительный анализ и оценку этой модели, наши предварительные оценки показывают в достаточной степени высокую производительность, чтобы мы не могли исключить критический уровень возможностей на данный момент. Astra — это будущая схема, и она не участвовала в эксплуатации уязвимости Hugging Face», — написали в OpenAI. 

Компании во всех отраслях сдерживают выпуск продуктов из‑за потенциальных рисков, в том числе из‑за проблем безопасности и кибербезопасности. Но они редко объявляют о таких решениях публично, когда сообщается о продукте, находящемся в стадии разработки.

В данном случае OpenAI уже находится под пристальным вниманием после того, как другая, ещё не выпущенная схема, взломала системы Hugging Face во время внутреннего тестирования — это первый подтверждённый случай потери контроля над своей моделью со стороны лаборатории ИИ. С тех пор OpenAI и такие лаборатории ИИ, как Anthropic, раскрыли другие инциденты, в которых модели ИИ нарушали границы своих «песочниц» и представляли угрозу во время тестов на кибербезопасность.

В OpenAI заявили, что делятся этой информацией, потому что считают, что «важно быть прозрачными с общественностью и сообществами, занимающимися вопросами безопасности, относительно этого потенциального изменения возможностей».

Лаборатория ИИ заявила, что уже вводит более строгие меры безопасности и приостановит внутреннюю деятельность, связанную с Astra, которая не соответствует усиленным требованиям. Также OpenAI сотрудничает с соответствующими государственными учреждениями и «избранными организациями по безопасности ИИ» для тестирования возможностей модели.

Ранее Anthropic сообщила, что внутреннее расследование выявило три инцидента, в ходе которых её схема ИИ Claude взломала системы трёх организаций во время проведения тестов кибербезопасности. Кроме того, Британский Институт безопасности ИИ заявил, что модель Mythos 5 пыталась выдать себя за человека и выложить на GitHub вредоносный код. Такое поведение агента зафиксировали в ходе эксперимента в закрытой среде.

Читают сейчас

Исследователи взломали детские умные часы и показали, что можно следить за их владельцем

1 час назад

Исследователи взломали детские умные часы и показали, что можно следить за их владельцем

Исследователи в области кибербезопасности взломали детские смарт‑часы от китайской компании YiQingTeng Electronics и показали, как можно следить за их владельцем. Репортёр Wired Энди Гринберг использо

Cloudflare опубликовал браузер Kitesurf для ИИ‑агентов

1 час назад

Cloudflare опубликовал браузер Kitesurf для ИИ‑агентов

Cloudflare запустила Kitesurf — облачный браузер, разработанный специально для агентов искусственного интеллекта. Разработчики ИИ смогут создавать программное обеспечение, способное перемещаться по ве

Организация Framework уведомила всех клиентов об утечке данных

2 часа назад

Организация Framework уведомила всех клиентов об утечке данных

Организация Framework, производящая модульные ремонтопригодные компьютеры, сообщила, что уведомила всех клиентов о краже их имён, адресов электронной почты, номеров телефонов и физических адресов. Уте

Sony готовит к выпуску бюджетные гарнитура WH-1000XM4

2 часа назад

Sony готовит к выпуску бюджетные гарнитура WH-1000XM4

Японская Sony готовит к выпуску бюджетные гарнитура WH-1000XM4C — обновлённый вариант наушников WH-1000XM4, которые дебютировали в 2020 году. Новинка поступит в продажу 7 сентября 2026 года по цене €2

Microsoft прекратит поддержку расширений Manifest V2 в браузере Edge

4 часа назад

Microsoft прекратит поддержку расширений Manifest V2 в браузере Edge

Microsoft сообщила, что в рамках перехода на Manifest Version 3 (MV3) до конца 2026 года прекратит поддержку расширений Manifest V2 (MV2) в своём браузере Edge. Это приведёт к тому, что пользователи л