25 апреля 2026, 23:36
Госдеп США против DeepSeek: как дистилляция ИИ стала дипломатическим оружием

Госдеп США разослал американским посольствам и консульствам инструкцию поднимать перед иностранными правительствами тему дистилляции ИИ-моделей китайскими компаниями, включая DeepSeek. По данным Reuters, Вашингтон хочет предупредить партнеров о рисках моделей, которые могли быть "дистиллированы" из закрытых американских систем, и подготовить почву для дальнейших действий. Отдельный демарш, как следует из документа, был предназначен для обсуждения с Пекином.
В тот же день DeepSeek выпустила V4 и в техническом отчете сама сделала дистилляцию одной из ключевых частей обучения модели. Компания пишет, что линейка V4 обучалась на массиве более чем из 32 трлн токенов, а затем прошла двухэтапную донастройку. Сначала специализированные модели-учителя для математики, кода, агентных задач и следования инструкциям обучались через SFT и GRPO, а затем их навыки объединялись в одной модели через on-policy distillation.
В этом и состоит основной парадокс новости. Для инженеров дистилляция — обычный способ обучения: более слабая или новая модель учится у более сильной и перенимает ее поведение. В случае DeepSeek речь идет о схеме "учитель — студент": набор внутренних моделей-учителей помогает единой модели-студенту собрать разные навыки в одной системе. Схожий решение Thinking Machines Lab описывала еще осенью 2025 года как способ дать модели более плотную обратную связь, чем при обычном обучении с подкреплением.
Но в политическом контексте слово "дистилляция" звучит иначе. США говорят не о внутреннем обучении на собственных моделях, а о массовом извлечении поведения закрытых американских систем через программный оболочку, прокси-аккаунты и обход ограничений. Ранее Anthropic обвинила DeepSeek, Moonshot и MiniMax в том, что они сгенерировали более 16 млн обменов с Claude через приблизительно 24 тыс. фейковых аккаунтов. В Госдепе США видят в дистилляции новую форму воровства интеллектуальной собственности — но вряд ли на данном этапе располагают действительно мощными средствами борьбы с ним.
P.S. Поддержать меня можно подпиской на канал "сбежавшая нейросеть", где я рассказываю про ИИ с творческой стороны.
Читают сейчас

1 час назад
Reddit вслед за Old Reddit стартовал показывать всплывающие окна с просьбой авторизоваться
Пользователи, которые пытаются посмотреть контент на Reddit по адресу www.reddit.com без авторизации, сообщают о появлении всплывающих окон с просьбой войти в аккаунт. Окно предлагает «присоединиться
2 часа назад
«Базальт СПО» представила технические образы ОС «Альт Рабочая станция» и «Альт Хост» для архитектуры LoongArch
«Базальт СПО» продолжает развивать поддержку альтернативных аппаратных архитектур. Компания выпустила предварительные технические образы операционных систем «Альт Рабочая станция» и «Альт Хост» для ар

2 часа назад
Организация «Газинформсервис» первой локализовала MITRE ATT&CK v18 для русскоязычной аудитории
Компания «Газинформсервис» перевела и адаптировала матрицу MITRE ATT&CK версии 18 для моделирования угроз и практических сценариев защиты с помощью собственных продуктов и решений. Ознакомиться далее
2 часа назад
Публичный микро для техно‑практиков: приглашаем докладчиков на Импульс Т1 2026 в ноябре
Мы стартовали принимать заявки на участие в деловой программе ежегодной технологической конференции Импульс Т1. В этом году мероприятие пройдёт в пятый раз 19 ноября. Подать заявку на выступление в де

2 часа назад
Исследование: ИИ по‑прежнему не способен справиться со сложными задачами в большинстве профессий
Передовые инструменты ИИ всех типов и моделей по‑прежнему не могут выполнять подавляющее большинство рабочих задач на приемлемом уровне. К такому выводу пришли исследователи Калифорнийского университе