
4 августа 2026, 10:00
Галлюцинации недели: открытые веса Kimi K3, Gemini Robotics 2 и внезапное падение цен на GPT 5.6
Дарио написал внятный текст про open weight. Твиттерские, как обычно, прочитали ровно один абзац, и через 7.6 миллиона просмотров в заголовках осталось "Anthropic требует запретить открытые модели". Д
31 июля 2026, 20:15
Thinking Machines Lab выпустила Inkling-Small — компактную open-weights-модель для текста, изображений и аудио
Thinking Machines Lab опубликовала Inkling-Small — компактную версию своей флагманской Inkling. Организация называет релиз efficient open-weights model: Inkling-Small, по ее словам, показывает сопоста
28 июля 2026, 12:18
Moonshot AI опубликовала техотчет Kimi K3: новая архитектура, 1 млн контекста и ставка на агентные сценарии
Moonshot AI выложила технический отчет по Kimi K3 — своей флагманской открытой модели. Вместе с релизом компания подтвердила ключевые архитектурные детали и показала, что K3 действительно заметно отли
30 июня 2026, 10:24
LongCat 2.0: Китайский «дракон», которого вскормили на 50 тысячах своих чипов
Meituan представила LongCat 2.0 — первую в мире схема масштаба триллиона параметров, полностью обученную на китайских процессорах. Читать далее

28 мая 2026, 20:10
Cerebras ускорила 1 трлн схема kimi K2.6 до тысяча т/sec
Недавно компания производитель чипов Cerebras добавила топовую открытую трилионную модель Kimi k2.6, на свою платформу. В сравнении со другими компаниями - это невероятный апгрейд скорости. По существ

24 апреля 2026, 08:49
DeepSeek опубликовал V4 — открытую схема с контекстом в миллион токенов
Сегодня DeepSeek опубликовали две новые модели: V4-Pro и V4-Flash. Обе работают по архитектуре Mixture-of-Experts, веса доступны на Hugging Face под MIT-лицензией. V4-Pro содержит 1,6 триллиона параме

23 марта 2026, 23:21
Qwen 3.5 с 397 млрд параметров запустили на iPhone 17 Pro: для этого понадобился внешний SSD
Разработчик под никнеймом Anemll запустил языковую модель Qwen 3.5 с 397 млрд параметров на iPhone 17 Pro. Веса модели подгружали с внешнего SSD, а скорость генерации ответов составила всего 0,6 токен

20 марта 2026, 12:09
MiniMax M2.7 — самоэволюционирующая схема с упором на coding, Office-задачи и агентные сценарии
MiniMax представила M2.7 - новую MoE-модель на 230B параметров с 10B активных на токен. Компания делает акцент не только на coding-бенчмарках, но и на необычном подходе: во время разработки модель уча

17 марта 2026, 16:10
Mistral AI показала Leanstral: кодинг, который можно не проверять
Французская Mistral AI представила Leanstral – открытого ИИ-агента, который не просто генерирует, а ещё и формально доказывает корректность своих же творений. Это помощник, который работает в связке с