DeepSeek V4 Flash 0731 догнала GPT-5.6 Luna — при этом стоит на 60% дешевле

DeepSeek V4 Flash 0731 догнала GPT-5.6 Luna — при этом стоит на 60% дешевле

DeepSeek V4 Flash 0731 догнала GPT-5.6 Luna — при этом стоит на 60% дешевле

Китайская DeepSeek выпустила апдейт своей бюджетной модели — V4 Flash 0731. После обновления она набрала 50 баллов в рейтинге Artificial Analysis Intelligence Index, обойдя предыдущую версию на 10 очков. До флагмана OpenAI, GPT-5.6 Luna, не дотянула всего балл — но при этом стоит примерно на 60% дешевле.

Что изменилось в модели

V4 Flash 0731 — не новая архитектура, а оптимизация существующей модели. Архитектура осталась той же: 284 млрд параметров всего, из них 12 млрд активных при каждом запросе. Контекстное окно — 1 млн токенов.

Главные улучшения коснулись агентных задач — сценариев, где модель выполняет цепочку действий. На бенчмарке GDPval, который имитирует реальную офисную работу, результат поднялся с 1 189 до 1 559 пунктов Elo. Также модель стала реже «галлюцинировать» — выдавать уверенные, но неверные ответы.

DeepSeek также сократила расход токенов на 12% по сравнению с предыдущей версией. Это означает, что каждый запрос к модели теперь требует меньше вычислительных ресурсов. API — это программный интерфейс, способ для разработчиков отправлять запросы к модели и получать ответы, не разбираясь в технической кухне.

Почему разница в цене так велика

Даже после того как OpenAI в июле снизила цены на GPT-5.6 Luna на 80%, DeepSeek всё равно остаётся существенно дешевле. Ключевое отличие — в скидке за кэширование (cache discount): DeepSeek даёт 98% скидку на повторяющиеся запросы, тогда как индустриальный стандарт — около 90%.

Для простого понимания: если вы спрашиваете модель о чём-то, что уже спрашивали другие пользователи, DeepSeek берёт за это почти ничего. OpenAI тоже использует кэширование, но менее агрессивно. На больших объёмах это даёт заметную экономию.

DeepSeek V4 Flash 0731 доступна на Hugging Face под лицензией MIT — это означает, что модель можно свободно использовать, модифицировать и встраивать в коммерческие продукты. Ранее мы подробно разбирали первую версию DeepSeek V4 Flash и её позиционирование на рынке бюджетных моделей.

Что это значит для рынка

Бюджетный сегмент AI-моделей становится всё более конкурентным. DeepSeek целенаправленно держит низкую цену, чтобы закрепиться в нише доступных API. Для разработчиков, которым не нужен топовый бенчмарк, это прямое основание перейти на DeepSeek или, по крайней мере, использовать её для части задач.

OpenAI уже снижала цены, но разрыв с DeepSeek сохраняется. Это создаёт давление на маржинальность для всех, кто конкурирует в сегменте быстрых и дешёвых моделей.

Что дальше

DeepSeek не объявляла дат следующих обновлений. Модель уже доступна через API и на Hugging Face. Для тех, кто использует бюджетные модели в высоконагруженных приложениях, апгрейд на 0731 рекомендуется — прирост на реальных задачах ощутимый. Подробнее о сравнении бюджетных моделей мы писали в обзоре бенчмарков 2026 года. О снижении цен на GPT-5.6 Luna и стратегии OpenAI мы подробно рассказывали.

На практике выбор между DeepSeek и OpenAI зависит от профиля нагрузки: если большинство запросов повторяются — DeepSeek выигрывает за счёт кэширования, если нагрузка непредсказуема — разница менее значительна.

Готовые AI-доступы

Подберите сервис под задачу и начните работать сегодня

ChatGPT, Claude, Gemini, MiniMax и другие инструменты для текстов, кода, изображений и автоматизации — без долгого поиска вариантов.

Авто-выдача после оплаты Популярные AI-сервисы Варианты под разные задачи
Прокрутить вверх