Nemotron 3.5 Lightning ускорил AI-агентов в 4 раза
Nvidia nemotron 3.5 lightning: новый стандарт для ai-агентов
Nvidia представила Nemotron 3.5 Lightning — модель на 30 млрд параметров, созданную специально для AI-агентов. Она решает главную проблему современных нейросетей: высокую стоимость и медленную работу, делая выполнение рутинных задач быстрее и доступнее.
Архитектура и эффективность
В основе лежит архитектура Mixture-of-Experts (MoE), которая задействует всего 3 млрд параметров за один раз, что существенно снижает нагрузку на железо. Дополнительное ускорение выдачи ответов обеспечивает технология speculative decoding с моделями DSpark и DFlash.
Nvidia внедрила двухуровневую систему: тяжелая модель Nemotron 3 Ultra планирует общую стратегию, а легкая Nemotron 3.5 Lightning оперативно исполняет детали.
Производительность в цифрах
Скорость работы выросла в 4 раза. В сравнении с Qwen3.6 35B модель оказалась на 30% быстрее, сохранив высокую точность. В бенчмарке PinchBench нейросеть показала результат 86%.
Интеграция и запуск
Для управления задачами используется библиотека NeMo Switchyard, которая автоматически распределяет запросы между большой и малой моделями. Система совместима с фреймворками OpenClaw и Hermes Agent.
Модель поддерживает популярный софт и оборудование:
- Программы: LM Studio, llama.cpp, Ollama и Unsloth.
- Железо: Nvidia DGX Spark, устройства Jetson и GeForce RTX 5090.
Настроить AI под свои задачи можно с помощью Nvidia NeMo tools, а лицензия OpenMDW-1.1 предоставляет открытый доступ к весам и данным для обучения.
Тренд на открытость
Выход Muse Glimmer от Meta* подтверждает переход индустрии к моделям с открытыми весами. Nvidia, Meta*, Microsoft, OpenAI и Google поддерживают этот путь, так как свободный доступ к технологиям стимулирует конкуренцию и ускоряет инновации.
*Компания Meta признана экстремистской и запрещена в РФ
Ранее по теме
Nvidia выпустит Nemotron 4 с 1 трлн параметров
Больше новостей в нашем Телеграм. Подпишись!
Ссылка на источник тык.