8 августа 2026, 10:37
OpenAI замедлила разработку модели Astra
OpenAI сообщила о приостановке работы над некоторыми аспектами своей будущей модели Astra после того, как внутренняя проверка выявила значительные успехи в программировании агентов и кибербезопасности — достаточные для того, чтобы вызвать опасения по поводу её возможностей.
В сообщении OpenAI говорится, что эта модель, которая всё ещё находится в разработке, достигла «критического порога кибербезопасности». Это означает, что она может самостоятельно выявлять и осуществлять кибератаки против традиционно хорошо защищённых реальных систем. В соответствии с «Рамочной программой готовности» компании, разработанной в 2023 году, это активировало дополнительные меры защиты.
«Хотя мы продолжаем проводить сравнительный анализ и оценку этой модели, наши предварительные оценки показывают в достаточной степени высокую производительность, чтобы мы не могли исключить критический уровень возможностей на данный момент. Astra — это будущая схема, и она не участвовала в эксплуатации уязвимости Hugging Face», — написали в OpenAI.
Компании во всех отраслях сдерживают выпуск продуктов из‑за потенциальных рисков, в том числе из‑за проблем безопасности и кибербезопасности. Но они редко объявляют о таких решениях публично, когда сообщается о продукте, находящемся в стадии разработки.
В данном случае OpenAI уже находится под пристальным вниманием после того, как другая, ещё не выпущенная схема, взломала системы Hugging Face во время внутреннего тестирования — это первый подтверждённый случай потери контроля над своей моделью со стороны лаборатории ИИ. С тех пор OpenAI и такие лаборатории ИИ, как Anthropic, раскрыли другие инциденты, в которых модели ИИ нарушали границы своих «песочниц» и представляли угрозу во время тестов на кибербезопасность.
В OpenAI заявили, что делятся этой информацией, потому что считают, что «важно быть прозрачными с общественностью и сообществами, занимающимися вопросами безопасности, относительно этого потенциального изменения возможностей».
Лаборатория ИИ заявила, что уже вводит более строгие меры безопасности и приостановит внутреннюю деятельность, связанную с Astra, которая не соответствует усиленным требованиям. Также OpenAI сотрудничает с соответствующими государственными учреждениями и «избранными организациями по безопасности ИИ» для тестирования возможностей модели.
Ранее Anthropic сообщила, что внутреннее расследование выявило три инцидента, в ходе которых её схема ИИ Claude взломала системы трёх организаций во время проведения тестов кибербезопасности. Кроме того, Британский Институт безопасности ИИ заявил, что модель Mythos 5 пыталась выдать себя за человека и выложить на GitHub вредоносный код. Такое поведение агента зафиксировали в ходе эксперимента в закрытой среде.
Читают сейчас

6 минут назад
Google открыла публикацию игр для Android Auto и Android Automotive OS
Google открыла функция публиковать игры для Android Auto и Android Automotive OS. Теперь разработчики могут самостоятельно выпускать такие проекты в магазине приложений Google Play. Читать далее

9 минут назад
«Сообразим на шестерых»: для Dark Souls 2 вышел мод Seamless Co-op на бесшовный кооператив
Моддер Yui продолжает исполнять мечты всех фанатов FromSoftware. На его счету уже есть моды на полноценный кооператив для Elden Ring, первой и третьей Dark Souls, Nightreign и даже Armored Core 6. Теп

16 минут назад
Sony запатентовала опцию, которая позволит применять DualSense для оплаты покупок на PlayStation
Sony патентует систему, которая позволит контроллеру DualSense передавать платёжные данные со смартфона на консоль PlayStation для выполнения цифровых покупок и приобретения внутриигрового контента. П

19 минут назад
Как создать карьерный веб-сайт, который привлекает кандидатов: опыт AGIMA
Мы в AGIMA разрабатываем карьерные сайты, которые помогают компаниям развивать HR-бренд и привлекать кандидатов. Свой опыт мы собрали в «Энциклопедии карьерного сайта» — практическом гиде для HR, марк

20 минут назад
Новая схема OpenAI за 24 дня решила более 100 открытых математических задач
OpenAI утверждает, что внутренняя схема, которую начали обучать 28 августа, уже решила более 100 давних открытых задач почти по всем основным областям математики. 24 дня обучения — и больше сотни откр