1 час назад
Китай строит свою CUDA. DeepSeek выложила TileLang, DeepGEMM и DeepEP для Huawei Ascend


DeepSeek известна открытыми моделями уровня фронтира при скромных бюджетах. И тут лаборатория выложила в публичный доступ шесть инструментов для программирования ускорителей Huawei Ascend. В набор вошли язык TileLang, библиотеки DeepGEMM, DeepEP, TileKernels, FlashMLA и DeepSelect. Параллельно Huawei рассказала о совместно спроектированной суперноде на 128 чипах Ascend 950.
Что именно выложено
Состав набора повторяет инфраструктуру, на которой DeepSeek обучала свои модели на железе NVIDIA, но теперь перенесенную на Ascend. DeepGEMM отвечает за матричные операции, DeepEP — за межчиповый обмен данными в MoE-моделях, FlashMLA — за внимание на длинном контексте, TileKernels — за стандартные векторные вычисления, DeepSelect — за фильтрацию данных.
Поверх этого, в набор входит TileLang, высокоуровневый язык для ядер ИИ-ускорителей, который DeepSeek позиционирует как более простую альтернативу CUDA. По данным Startup Fortune, набор покрывает большинство операторов, использованных при обучении DeepSeek V4. DeepSeek назвала приоритетом разработка «универсального, простого в программировании» высокоуровневого языка как основы независимой экосистемы GPU-софта.
Предпосылки
Анонс вышел сразу после Huawei Connect 2026, где Huawei показала новое поколение Ascend и суперноды. Железо у Huawei в последние два года появлялось быстрее, чем софт для него. По оценке, которую приводит Startup Fortune, Ascend 910C дает приблизительно 60% инференс-производительности NVIDIA H100. Цифра из одного источника и относится к прошлому поколению, для Ascend 950, независимых замеров пока нет.
Главная проблема Huawei всегда лежала в экосистеме. CUDA удерживает клиентов на NVIDIA, потому что миграция означает месяцы переписывания кода. А теперь стек перенесла лаборатория с реальным опытом обучения фронтирных моделей, и для остальных китайских команд это совсем иной уровень доверия, чем документы вендора. Они зарабатывают проверенные на продакшен-нагрузке ядра и готовый путь миграции.
Вторая половина анонса касается железа. Суперноду на 128 чипах Ascend 950 Huawei проектирует наряду с DeepSeek. И здесь логика та же, что у крупных американских лабораторий с их собственными кластерами. Для MoE-моделей узким местом становится обмен данными между чипами, следовательно DeepEP и топология суперноды оптимизируются под одну и ту же нагрузку. Если исходить из опыта NVIDIA с NVL72, производительность обучения и обслуживания больших MoE-моделей определяет в первую очередь плотная связность внутри стойки, а пиковая производительность одного чипа здесь вторична. Отставание Ascend по отдельному чипу Huawei, судя по всему, собирается компенсировать масштабом и связностью.
Эффект для рынка
Для NVIDIA это медленная, но структурная угроза на китайском рынке, который и так закрыт для ее топовых чипов экспортными ограничениями. Раньше китайские компании мирились с Ascend вынужденно. Открытый стек DeepSeek снижает цену этой вынужденности и может ускорить переход даже там, где серые поставки NVIDIA еще возможны.
TileLang как высокоуровневый язык ядер конкурирует с Triton от OpenAI и Mojo от Modular. Если он действительно окажется переносимым между разными ускорителями, в мире может появиться следующий центр притяжения для кода ядер, в дополнение к CUDA. И вырастет он в Китае.

ИИ‑роутер — доступ к 300+ моделям из одной панели
Подключите OpenAI‑совместимый шлюз по единому api‑ключу. Настраивайте сквозную аналитику, отслеживайте лимиты и квотируйте ресурсы.
Запустить ИИ‑роутер →
Читают сейчас

44 минуты назад
Reasoning-версию GigaChat 3.5 теперь можно подключить в Evolution Foundation Models
Летом коммерческий доступ открыли к GigaChat 3.5 Ultra, теперь же в каталоге сервиса Evolution Foundation Models стала доступна релиз отечественной нейросети с режимом рассуждений GigaChat 3.5 Reasoni

59 минут назад
AMD поглощает World Labs: к команде присоединится «крестная мать ИИ»
AMD покупает стартап-компания World Labs за 8,2 млрд $ акциями. Основательница World Labs Фей-Фей Ли, профессор Стэнфорда и автор датасета ImageNet, с которого в 2012 году началась эпоха глубокого обу

1 час назад
Разработчик сумел запустить на эмуляторе невышедшую ОС Apple Copland
Разработчик Майкл Стейл сумел запустить на эмуляторе ОС Apple Copland, которая разрабатывалась в 90-х. Для запуска Стейл модифицировал эмулятор Power Mac с открытым исходным кодом DingusPPC; по его сл

1 час назад
В OpenIDE обновили поддержку PHP: анализаторы, удалённая отладка и подсказки типов
Вышла версия 0.9.3 плагина PHP for OpenIDE. Переработали настройки внешних анализаторов, добавили отладку через DBGp-прокси и исправили работу с путями к файлам на удалённых серверах и в контейнерах.

1 час назад
В Larian Studios не поняли хейта вокруг ограничений по времени в The Blood of Dawnwalker
Издатель Baldur’s Gate 3 Майкл Даус публично вступился за главную фишку The Blood of Dawnwalker — жесткий лимит по времени. Он заявил, что искренне удивлен шквалом критики в адрес этой механики. Читат