Claude Mythos: Anthropic случайно слила информация о своей мощнейшей модели

2 мин
Claude Mythos: Anthropic случайно слила информация о своей мощнейшей модели

Anthropic разрабатывает и уже тестирует с доверенными клиентами новую ИИ-модель, которую называет самой мощной в своей истории. О ее существовании выяснилось из-за утечки данных: черновик блог-поста с описанием модели оказался в публично доступном память, откуда его извлекли журналисты Fortune и независимые исследователи — Рой Паз из LayerX Security и Александр Повельс из Кембриджского университета.

Модель получила название Claude Mythos, а вместе с ней Anthropic вводит новый уровень — Capybara. По задумке компании, Capybara крупнее и мощнее Opus, который до сих пор был верхней планкой линейки Claude. В слитом черновике говорится, что модель значительно превосходит Claude Opus 4.6 в тестах на программирование, академические рассуждения и кибербезопасность. Представитель Anthropic подтвердил Fortune разработку модели и назвал ее "качественным скачком возможностей".

Главная интрига — кибербезопасность. Согласно черновику, Anthropic считает, что схема далеко опережает все существующие ИИ-системы по кибервозможностям и предвещает волну моделей, способных эксплуатировать уязвимости быстрее, чем защитники успевают их закрывать. Именно поэтому организация планирует начать с ограниченного доступа для организаций, занимающихся киберзащитой, — чтобы дать им фору.

Утечка произошла в связи с ошибки конфигурации CMS — системы управления контентом для блога Anthropic. Создаваемые в ней материалы по умолчанию получали публичный URL, если пользователь не менял настройку приватности вручную. В итоге наружу попали около 3000 ранее не публиковавшихся файлов: черновики постов, изображения, PDF-документы — включая информацию о закрытом саммите для европейских CEO с участием Дарио Амодеи. Anthropic признала проблему, назвав ее "человеческой ошибкой", и подчеркнула, что утечка не связана с Claude или другими ИИ-инструментами компании.

Тревога вокруг кибервозможностей ИИ нарастает по всей индустрии. В феврале OpenAI при выпуске GPT-5.3-Codex впервые присвоила своей модели рейтинг High по кибербезопасности, а Claude Opus 4.6, вышедший в тот же день, уже демонстрировал способность обнаруживать ранее неизвестные уязвимости в рабочем коде. В ноябре 2025 года Anthropic раскрыла первую задокументированную масштабную кибератаку с использованием ИИ: китайская группировка применяла Claude Code для атак на приблизительно 30 организаций, и ИИ автономно выполнял 80–90% операций. Claude Mythos, судя по всему, делает второй шаг — и Anthropic сама об этом предупреждает, пусть и не совсем так, как планировала.

P.S. Поддержать меня можно подпиской на канал "сбежавшая нейросеть", где я рассказываю про ИИ с творческой стороны.

Читают сейчас

Учёные выдвинули теорию о тёмных измерениях и первичных чёрных дырах

53 минуты назад

Учёные выдвинули теорию о тёмных измерениях и первичных чёрных дырах

Все мы заперты в трёх привычных пространственных и одном временном измерении, однако это не означает, что гравитация не может проникать в другие измерения, если они существуют. И у нас может появиться

DrivingBench проверили GPT-6 Astra, GPT-5.6 Sol, Grok 4.6 и Claude Fable 5.1 на функция управлять авто

57 минут назад

DrivingBench проверили GPT-6 Astra, GPT-5.6 Sol, Grok 4.6 и Claude Fable 5.1 на функция управлять авто

Исследователи из DrivingBench проверили, как современные нейросети умеют водить автомобиль. В контексте этого проекта ИИ-системы OpenAI GPT-6 Astra и GPT-5.6 Sol, SpaceXAI Grok 4.6 и Anthropic Claude

Beyond Good & Evil 2 все еще жива: создание продолжается спустя 18 лет после анонса

3 часа назад

Beyond Good & Evil 2 все еще жива: создание продолжается спустя 18 лет после анонса

Долгострой Beyond Good & Evil 2 продолжает подавать признаки жизни. Ведущий сценарист и помощник нарративного директора Ubisoft Bordeaux Рик Годвин рассказал, что последние некоторое количество месяце

950 Claude-агентов за 21 час нашли новую биологическую систему

3 часа назад

950 Claude-агентов за 21 час нашли новую биологическую систему

Anthropic запустили приблизительно 950 агентов, которые изучили более 200 тысяч обратных транскриптаз, то есть ферментов, способных синтезировать ДНК на основе РНК. За 21 час и 210 млн токенов они ото

Больше никакого фарма чертежей: в ARC Raiders переработают систему разблокировки оружия

4 часа назад

Больше никакого фарма чертежей: в ARC Raiders переработают систему разблокировки оружия

Студия Embark раскрыла подробности крупного обновления Frozen Trail для ARC Raiders, которое выйдет 8 октября. Главными нововведениями станут настраиваемые базы-аванпосты и исследовательский верстак,