1 июня 2026, 11:10
MiniMax выпустила M3: открытая мультимодальная схема с контекстом 1M токенов

Китайская лаборатория MiniMax представила M3 — открытую мультимодальную схема с контекстным окном до миллиона токенов, ориентированную на программирование и автономные агентные задачи. api и собственная агентная среда MiniMax Code доступны уже сейчас, а веса и технический отчет MiniMax обещает выложить на HuggingFace и GitHub на протяжении примерно десяти дней. Схема обрабатывает текст и изображения как единое целое — мультимодальность, согласно заявлению разработчиков, заложена в нее с самого начала обучения, а не добавлена поверх готовой языковой основы.
На бенчмарках M3 показывает результаты, близкие к топовым закрытым моделям. На SWE-Bench Pro, который проверяет умение решать реальные задачи из GitHub-репозиториев, схема набирает 59,0%, на Terminal Bench 2.1 (выполнение команд в терминале) — 66,0%. Самый заметный результат — на BrowseComp, тесте на автономный веб-поиск и сбор информации: здесь M3 набирает 83,5% и опережает Claude Opus 4.7 с его 79,3%. В наборе агентных и инструментальных бенчмарков вроде MCP Atlas (74,2%) и BankerToolBench (76,1%) M3 идет вровень с лидерами, хотя на части тестов — например, на KernelBench Hard — все еще уступает закрытым конкурентам.
Длинный контекст в M3 обеспечивает собственная архитектура внимания MiniMax Sparse Attention (MSA): api поддерживает окно до 1 миллиона токенов с гарантированным минимумом в 512 тысяч. Такой объем нужен прежде всего для длительных агентных сессий, работы с большими кодовыми базами и анализа длинных видео. Цена одновременно весьма демократичная — 0,60 доллара за миллион входных токенов и 2,40 доллара за миллион выходных в режиме до 512 тысяч; на стандартное использование первые семь дней действует скидка 50%.
В техническом отчете MiniMax приводит некоторое количество примеров работы модели на длинных задачах. В одном из них M3 поручили самостоятельно воспроизвести научную статью с конференции ICLR 2025: модель проработала почти 12 часов без вмешательства человека, сделала 18 коммитов и построила 23 экспериментальных графика, повторив ключевые эксперименты. В другом тесте M3 оптимизировала вычислительное ядро для GPU NVIDIA — за примерно сутки она выполнила 147 итераций и почти две тысячи вызовов инструментов, подняв загрузку оборудования с 7,6% до 71,3%, то есть ускорив работу в 9,4 раза. На бенчмарке PostTrainBench, где схема должна сама обучить другие модели, M3 заняла третье место, уступив только Opus 4.7 и GPT-5.5.
P.S. Поддержать меня можно подпиской на канал "сбежавшая нейросеть", где я рассказываю про ИИ с творческой стороны.
Читают сейчас

5 часов назад
Prusa представила PrusaSlicer 3.0 с новым интерфейсом и поддержкой плагинов
Команда Prusa Research выпустила первую публичную альфа‑версию слайсера PrusaSlicer 3.0. Авторы переписали интерфейс, переработали систему профилей, добавили поддержку полноценной работы с несколькими

6 часов назад
Anthropic обновила Claude – вышли Fable 5.1 и Mythos 5.1
Anthropic выпустила апдейт своих топовых моделей – Claude Fable 5.1 и Claude Mythos 5.1. Это одна и та же модель под капотом, различающаяся уровнем защитных ограничений: Fable 5.1 доступна всем в цело

6 часов назад
Creality представила 3D‑принтер SPARKX i8 с поддержкой многоцветной печати и быстрой сменой филамента
Creality представила 3D‑принтер SPARKX i8 с поддержкой четырёхцветной печати. Его главная особенность заключается в системе QuarTeks, в которой прутки филамента подведены практически к самому соплу, б

6 часов назад
Базовая релиз MacBook Neo аномально быстро расходует источник SSD из‑за всего 8 ГБ оперативной памяти
Автор YouTube‑канала UFD Tech рассказал, что MacBook Neo необычно быстро расходует источник SSD‑накопителя. Всё дело в небольшом объёме оперативной памяти, из‑за которой устройство активно записывает

6 часов назад
Anthropic предупредила пользователей Claude об утечке их данных для входа из‑за вредоносного ПО
Организация Anthropic предупредила, что инфостилеры перехватывают сеансы Claude и открывают злоумышленникам доступ к учётным записям пользователей. Читать далее