Nvidia выпустила Nemotron 3.5 Lightning — открытую модель, которая быстрее любого конкурента

Nvidia выпустила Nemotron 3.5 Lightning — открытую модель, которая быстрее любого конкурента

Nvidia выпустила Nemotron 3.5 Lightning — открытую модель, которая быстрее любого конкурента

11 августа 2026 | AI Digest

Суть события

Nvidia представила Nemotron 3.5 Lightning — открытую модель с 3,6 млрд активных параметров. При таком скромном размере она достигает того же уровня интеллекта, что и gpt-oss-120b от OpenAI, который вчетверо больше. При этом скорость генерации Nemotron 3.5 Lightning составляет почти 670 токенов в секунду — быстрее любой модели в аналогичном сравнении.

Технические детали

Nemotron 3.5 Lightning относится к классу открытых моделей: веса модели доступны для скачивания и использования. Это позволяет компаниям запускать её на собственной инфраструктуре без оплаты за каждый запрос к API. При размере в 3,6 млрд параметров модель помещается в память большинства современных видеокарт.

По индексу Intelligence Index от Artificial Analysis модель набирает столько же баллов, сколько gpt-oss-120b, при том что последний содержит 120 млрд параметров. Это означает, что прицел Nvidia — не рекорд абстрактных бенчмарков, а практическая эффективность и скорость работы.

Почему это важно

До сих пор основная гонка в AI была про размер: чем больше модель, тем, как правило, лучше результат. Nvidia демонстрирует, что при правильной архитектуре можно добиться сопоставимого качества при значительно меньшем объёме. Для бизнеса это означает снижение расходов на инфраструктуру и возможность запускать модель локально.

Открытый формат весов также позволяет компаниям дообучать модель под свои задачи без зависимости от внешнего API. Это актуально для отраслей с требованиями к конфиденциальности данных или необходимостью работать в условиях нестабильного интернет-соединения.

Что дальше

Nemotron 3.5 Lightning уже доступна для скачивания. Эксперты рынка ожидают, что она станет популярным выбором для задач, где важна скорость ответа — чат-боты первого уровня, автодополнение кода, обработка документов в реальном времени. Nvidia позиционирует модель как инструмент для локального и корпоративного использования. Компания рассчитывает, что спрос на GPU для локального AI вырастет, что станет дополнительным драйвером для её аппаратного бизнеса.

Открытые модели с каждым годом становятся практичнее — но вопрос монетизации для open-weight стартапов остаётся открытым. Подробнее о том, почему инвесторы задают открытым AI-компаниям неудобный вопрос про деньги. Nvidia также активно инвестирует в AI-стартапы — подробнее о стратегии Nvidia. Подробнее о том, как Nvidia, CrowdStrike и Hugging Face объединились для безопасности AI-систем, — в разборе Open Secure AI Alliance.

Готовые AI-доступы

Подберите сервис под задачу и начните работать сегодня

ChatGPT, Claude, Gemini, MiniMax и другие инструменты для текстов, кода, изображений и автоматизации — без долгого поиска вариантов.

Авто-выдача после оплаты Популярные AI-сервисы Варианты под разные задачи
Все товары

Партнёрская подборка AI Digest. Продажу и оплату проводит продавец через DigiSeller; AI Digest может получить комиссию без изменения цены.

Прокрутить вверх