«Агент не может ждать секунды»: NVIDIA представила открытую omni-модель Nemotron 3 Nano

2 мин
«Агент не может ждать секунды»: NVIDIA представила открытую omni-модель Nemotron 3 Nano

NVIDIA выпустила Nemotron 3 Nano Omni — открытую мультимодальную модель, которая объединяет работу с видео, аудио, изображениями и текстом в одной архитектуре. По заявлению компании, ее пропускная способность в 9 раз выше, чем у других открытых omni-моделей при той же интерактивности, а предназначена она прежде всего для агентных систем. Модель доступна на Hugging Face, OpenRouter и build.nvidia.com (в виде NIM-микросервиса), а равным образом на fal.ai.

В основе — гибридная схема Mamba-Transformer с MoE-архитектурой ("смесь экспертов"): из 30 млрд параметров активны только приблизительно 3 млрд, модель подключает нужного эксперта под конкретную задачу и модальность. Контекст — до 256 тысяч токенов, чего хватает для длинных агентных циклов и работы с видео или несколькими документами без дробления на фрагменты. Поддерживаются квантование FP8 и NVFP4, движки vLLM и TensorRT-LLM; есть оптимизация под архитектуры Ampere, Hopper и Blackwell.

Основной аргумент NVIDIA — агентные системы сегодня собирают стек восприятия из отдельных компонентов: одна модель для зрения, другая для звука, третья для текста. Это дает лишние вычислительные шаги, усложняет оркестрацию и повышает стоимость. Omni сводит весь этот конвейер в одну схема. "Чтобы строить полезных агентов, нельзя ждать секунды, пока модель интерпретирует экран", — комментирует глава H Company Готье Клуа, чьи агенты на Omni научились разбирать запись экрана в Full HD в реальном времени. На графиках NVIDIA видно, что относительно предыдущей Nemotron Nano VL V2 у Omni равным образом выросла точность на ряде отраслевых мультимодальных бенчмарков.

Omni позиционируется не как самостоятельная флагманская модель, а как субагент восприятия в составе более крупных агентных архитектур — рядом с Nemotron 3 Super (быстрое исполнение) и Nemotron 3 Ultra (сложное планирование). Это укладывается в общую идею NVIDIA: модульные системы, где специализированные модели делят между собой задачи, а не одна универсальная. Если заявленный 9-кратный выигрыш по пропускной способности подтвердится в реальных нагрузках, у разработчиков открытых агентов появится сильный аргумент против стека из отдельных моделей восприятия.

P.S. Поддержать меня можно подпиской на канал "сбежавшая нейросеть", где я рассказываю про ИИ с творческой стороны.

Читают сейчас

Обновления Windows Server нарушили работу служб удалённых рабочих столов

1 час назад

Обновления Windows Server нарушили работу служб удалённых рабочих столов

Администраторы Windows сообщают, что накопительные обновления за сентябрь 2026 года вызывают сбои в работе служб удалённых рабочих столов (RDS) на системах Windows Server 2019, 2022 и 2025. Из‑за этог

1 час назад

Рекомендации Минпросвещения по работе педагогов с ИИ исключают применение ИИ учениками начальной школы

По информации СМИ, методические рекомендации Минпросвещения России по работе педагогов с искусственным интеллектом исключают применение ИИ учениками начальной школы. В средних классах нейросети могут

Сотрудникам Micron на Тайване выплатят от 35 до 68 окладов по итогам года

1 час назад

Сотрудникам Micron на Тайване выплатят от 35 до 68 окладов по итогам года

Компания Micron объявила, что её сотрудники на Тайване получат бонусы в размере от 35 до 68 месячных окладов за 2026 финансовый год. При этом минимальная денежная выплата составит 1,7 млн ​​тайваньски

Немецкая полиция читает и сохраняет переписку в WhatsApp** и Signal

1 час назад

Немецкая полиция читает и сохраняет переписку в WhatsApp** и Signal

Журналисты netzpolitik.org получили секретный документ Таможенного криминального управления Германии (ZKA), в соответствии с которому полиция ещё в 2023 году тестировала способ «клонирования аккаунтов

Выпуск языка программирования Julia 1.13

4 часа назад

Выпуск языка программирования Julia 1.13

10 сентября 2026 года состоялся выпуск языка программирования Julia 1.13. Проект сочетает в себе такие качества как высокая производительность, поддержка динамической типизации и встроенные средства д