NVIDIA решила сделать ставку не на максимальный интеллект, а на скорость. Компания выпустила Nemotron 3.5 Lightning — открытую модель для локальных ИИ-агентов, которую можно скачать с Hugging Face. Файлы занимают около 20 ГБ.

Модель рассчитана на агентов, которые работают практически без остановки: пишут код, вызывают инструменты, проверяют результаты и обрабатывают тысячи похожих задач подряд.

И здесь у Nemotron есть серьёзный козырь. В тесте NVIDIA на очереди из 10 тысяч агентных заданий модель показала около 86% точности и завершила работу на 30% быстрее Qwen3.6 35B при сопоставимом результате.

Но как только задачи становятся сложнее, преимущество исчезает. В тестах на исправление ошибок в реальных проектах Nemotron решила около 52% заданий против примерно 70% у Qwen3.6 и 57% у Gemma 4.

При этом NVIDIA открыла не только веса Nemotron. Компания опубликовала данные об обучении, рецепты подготовки модели и инструкции по запуску. Её также можно дообучить под собственные данные, инструменты и внутренние правила.

В итоге NVIDIA предлагает не универсального чемпиона, а рабочую лошадку для массовых задач. И если скорость обработки окажется важнее максимального качества, именно такие модели могут стать основой постоянно работающих ИИ-агентов в компаниях.