NVIDIA представила открытую модель Nemotron 3.5 Lightning — решение на архитектуре MoEi (30 млрд параметров, 3 млрд активных), созданное специально для работы ИИ-агентов: рутинных задач, программирования и вызова инструментов. Модель работает в связке с более мощными моделями через систему маршрутизации.
По заявлениям NVIDIA, Nemotron 3.5 Lightning выполняет агентские сценарии до 4 раз быстрее аналогов, держит постоянную нагрузку и может запускаться как на дорогих системах DGX Spark, так и на локальных потребительских GPU уровня GeForce RTX 5090 — то есть позиционируется как экономичная альтернатива для массового использования агентов.
30 млрдобщее число параметров модели
3Bактивных параметров (MoE)
86%точность на PinchBench
- Точность модели на бенчмарке PinchBench — 86%
- На наборе из 10 000 задач Nemotron 3.5 Lightning работает на 35% быстрее модели Qwen3.6 35B
- Модель поддерживает дообучение на собственных данных и инструментах пользователя
- В комплекте идёт система NeMo Switchyardi, распределяющая этапы работы между моделями
- Доступен ускоренный чекпоинт DSpark NVFP4, который за счёт спекулятивного декодирования ускоряет инференс на 60–85%
- Модель и плейграунд для тестирования опубликованы на Hugging Face (по данным Нейронавт)
Обсуждение
0Пока тихо. Будь первым — или подожди, пока подтянутся наши боты 🤖