
10 сентября 2026, 11:56
DeepSeek V4.1-Flash: новая архитектура, 552 млрд параметров и агентные тесты
DeepSeek вывела V4.1-Flash — младшую модель новой архитектурной линейки компании. Это MoE-модель на 552 млрд параметров с нативной поддержкой изображений, контекстом до 1 млн токенов и отдельными режи
9 сентября 2026, 12:47
Мнение: у нас есть год, чтобы повсеместно решить вопросы безопасности
Автор техноблога создал текст пост, повящённый проблемам кибербезопасности в эпоху ИИ‑агентов. Он считает, что у отрасли есть примерно год, чтобы решить вопрос уязвимостей. Главный причиной для беспок
31 августа 2026, 14:49
Новые ИИ-модели и LLM недели: Qwen3.8-Flash-Next, GLM-5.3, Granite 4.2, Hy4 и новые модели для видео, речи и изображений
С 24 по 31 августа авторы выпустили сразу несколько заметных ИИ-моделей и LLM. В числе главных релизов недели — новая архитектура Qwen3.8-Flash-Next, мультимодальная GLM-5.3-Flash и публикация весов г

26 августа 2026, 17:52
Z.ai выпустили GLM-5.3-Flash: ту самую Ox Alpha, которая за неделю стала топ-1 в OpenCode и OpenRouter
Z.ai выпустили GLM-5.3-Flash, первую нативно мультимодальную модель семейства GLM-5. Она поддерживает контекст до 1 млн токенов и содержит 320 млрд параметров, из которых при генерации активируются 18

26 августа 2026, 11:46
Qwen4: первая схема Alibaba на архитектуре нового поколения — Qwen3.8-Flash-Next
Alibaba анонсировали Qwen3.8-Flash-Next — первую публичную схема на архитектуре следующего поколения Qwen4. Открытые веса должны появиться 26 августа в 15:00 UTC. Несмотря на Qwen3.8 в названии, коман

14 августа 2026, 09:42
Z.ai выпустили GLM-5.3: обошла Opus 4.8 на, но уступила Fable 5 и GPT-5.6 Sol
Z.ai выпустили GLM-5.3, новую модель для программирования и долгих агентных задач. GLM-5.3 использует ту же базовую схема, что и GLM-5.2. Организация не меняла архитектуру и не проводила свежий претре

12 августа 2026, 10:27
NVIDIA представили Nemotron 3.5 Lightning, быструю локальную схема
NVIDIA выпустили Nemotron 3.5 Lightning, новую открытую схема для локальных AI-агентов. Её можно скачать с Hugging Face и файлы модели занимают приблизительно 20 ГБ. Nemotron 3.5 Lightning создавали в

10 августа 2026, 14:23
Meta выпустили Muse Glimmer 30B: локальная схема для кодинга помещается в 24 ГБ памяти
Meta открыли веса Muse Glimmer, мультимодальной модели на 30 млрд параметров для локальных AI-агентов и программирования. Модель опубликована на Hugging Face под лицензией Apache 2.0 и в квантизирован

3 августа 2026, 08:46
Alibaba выпустили Qwen3.8-Max: стоит в четыре раза дешевле Opus 5, но уступает в сложном кодинге
Команда Qwen выпустила Qwen3.8-Max, новую флагманскую MoE-модель на 2,4 трлн параметров. На каждом токене активируются 95 млрд параметров, размер контекста составляет 1 млн токенов. В api схема стоит