22 июня 2026, 23:27
Открытая схема GLM-5.2 заменила забаненную Fable 5 в автоисследователе alphaXiv

В середине июня власти США ограничили доступ иностранных пользователей к топовым моделям Anthropic — Claude Fable 5 и Mythos 5. А спустя несколько дней сервис alphaXiv показал, что его автоисследователь впервые встал на открытую китайскую GLM-5.2, и прямо назвал причиной именно ограничения на Fable 5: мол, раз фронтир закрыли для исследований, открытая альтернатива — большая победа для опенсорса. Важная оговорка сразу: это демонстрация самой alphaXiv, а не независимый проверка.
В показанном прогоне GLM-5.2 сама провела сравнение двух схем обучения с подкреплением (RL) — полностью асинхронной и совмещенной синхронной (colocated) — на двух нодах по восемь ускорителей H100 поверх фреймворка SkyRL, на наборе соревновательных задач по коду Harbor. По описанию команды, агент сам починил проблему окружения (зависимость libnuma), довел прогоны до конца и собрал итоговое сравнение по пропускной способности (throughput) и стабильности вознаграждения (reward).
Поясним, что такое автоисследователь. arXiv — это крупнейший открытый архив научных работ (по физике, математике, ИИ), куда ученые выкладывают статьи-черновики, часто еще до журнальной рецензии. К работам по ИИ (и не только) часто прилагается код, но у других он нередко не запускается: не та версия библиотеки, не хватает зависимостей, неполная инструкция. Автоисследователь alphaXiv берет эту рутину на себя: меняешь в адресе статьи arxiv на autoarxiv — и агент сам разворачивает репозиторий, чинит окружение, прогоняет минимальную проверку воспроизводимости и оценивает, во сколько обойдется повторить итог целиком. Для приватного кода есть отдельная площадка OpenResearch.sh. Речь именно про инженерную часть — поднять и проверить чужой код, а не сделать научное открытие.
Почему выбор пал именно на GLM-5.2, понятно из контекста. Это открытая схема от китайской Z.ai (бывшая Zhipu AI): приблизительно 750 млрд параметров в MoE-архитектуре, приблизительно 40 млрд активных на токен, контекст в 1 млн токенов и лицензия MIT. Выпустили ее почти синхронно с ограничениями на модели Anthropic — и главное ее свойство в этой истории не бенчмарки, а то, что открытые веса нельзя отозвать решением регулятора. Для тулинга, которому нужен предсказуемый доступ, это и есть страховка.
Без оговорок не обошлось, и самые честные дала сама alphaXiv. У GLM-5.2 нет зрения: там, где Opus и Fable читают тренды прямо с графиков в WandB (сервис трекинга экспериментов), GLM пишет numpy-код, чтобы распарсить сырые числа — для простых прогонов хватает, но на сложных задачах, в соответствии с заявлению команды, это будет скорее мешать. И в общем и целом команда признает: на текущем этапе модели еще не ведут исследования как таковые, а сильны в двух вещах — решении проблем реализации и воспроизведении уже существующих работ. То есть автономное исследование здесь — про инженерный цикл эксперимента (поднять, прогнать, сравнить), а не про научные открытия, а формулировку про первую схема, потянувшую реальный ресерч, стоит читать как заявление вендора.
P.S. Поддержать меня можно подпиской на канал сбежавшая нейросеть, где я рассказываю про ИИ с творческой стороны.
Читают сейчас

5 часов назад
Студент из Южной Кореи создал навигатор, прокладывающий пешие маршруты по тени
На фоне сильной жары в Южной Корее появилось местное приложение Shade Walk. Это навигатор для поиска не только самого быстрого маршрута, но и пути, в котором потребитель проведёт как можно больше врем

5 часов назад
Исследователи нашли метод раскрыть фактический IP пользователей функции «Частный узел iCloud»
Исследователи безопасности нашли несколько уязвимостей в WebKit, с помощью которых сайты могут обходить «Частный узел iCloud» и узнавать фактический IP‑адрес пользователей. Проблема затрагивает Safari

5 часов назад
Adobe объединила Photoshop, Premiere, Acrobat и другие сервисы в одном плагине для ChatGPT
Adobe выпустила плагин для ChatGPT, объединяющий возможности для редактирования фотографий и видео, создания макетов, документов и подготовки материалов для публикации и печати. В плагин вошло более 7

6 часов назад
Grokipedia перестала обновляться и принимать правки от сообщества
Онлайн‑энциклопедия Grokipedia, разработанная компанией xAI Илона Маска, уже несколько месяцев не обновляет источник. С апреля 2026 года на платформе не появилось ни одной одобренной или отклонённой п

7 часов назад
DeepSeek предупредили о «значительном» повышении цен на программный оболочку
В личных кабинетах DeepSeek Open Platform появился баннер о предстоящем повышении цен на api. Пользователям сервиса также стартовали приходить письма с тем же предупреждением. DeepSeek пишет, что план