GPT-6.1 Sol: почти как Astra, но в пять раз дешевле — OpenAI сделала ставку на цену

4 мин чтения 0
GPT-6.1 Sol: почти как Astra, но в пять раз дешевле — OpenAI сделала ставку на цену

OpenAI выпустила GPT-6.1 Sol — модель для агентских задач, которая тянет к флагманской Astra по коду, работе с документами и управлению компьютером, но обходится примерно в пятую часть её стоимости. Флагман Astra тем временем задержан: внутренние тесты показали проблемы с безопасностью.

Суть события

OpenAI тихо перевернула собственную линейку: на сцену вышел GPT-6.1 Sol — модель для агентских задач, которая, по задумке компании, должна «почти дотягиваться» до флагмана GPT-6.1 Astra, но стоить в пять раз меньше. Цены на программный интерфейс (API) — $2 за миллион входных токенов и $10 за выходные. Кэшированный вход — $0,10, то есть на 95% дешевле, чем считать без кэша, и вдвое ниже, чем у Anthropic Claude Sonnet 5.5.

Сравнение с конкурентами получается жёстким: Sol стоит столько же, сколько прошлый GPT-6 Sol и Sonnet 5.5, но при этом тянет ближе к флагману. Для команд, которые считают бюджет на токены, это сигнал пересмотреть стек уже сейчас, не дожидаясь Astra.

По собственным бенчмаркам OpenAI (сама компания помечает их как предварительные) Sol догоняет Astra на DeepSWE v1.1 — агентическом коде — примерно за пятую часть цены и обходит лучший результат GPT-6 Sol на 6,4 п.п. На OSWorld 2.0 модель прибавляет 7 п.п. к предшественнику и отстаёт от Astra всего на 2,1 п.п., но тратит седьмую часть её стоимости.

Детали

Доступ открыт сразу в нескольких местах. Подписчики Plus, Pro, Business, Enterprise (корпоративный тариф) и Edu получают Sol в ChatGPT Work и Codex. В обычный чат модель пока не завезли. Разработчики подключаются через API под именем gpt-6.1-sol. В течение нескольких дней появится версия Ultrafast — она выдаёт токены до восьми раз быстрее именно в Codex, где задержка ответа особенно бьёт по ощущению работы.

По деньгам и спросу цифры собранные. На GDP.pdf (работа с документами) Sol обходит Opus 5.5, тратя меньше половины стоимости на задачу. На AutomationBench (многошаговые бизнес-процессы) прибавляет 2,2 п.п. к Opus 5.5 при среднем уровне рассуждения за треть цены. Средняя научная задача в Terminal-Bench обходится в $5,47 против $23,21 у Opus 5.5 и $23,80 у Astra. По абсолютной точке Astra по-прежнему лидирует с 68,1%, и OpenAI сама рекомендует её для самых тяжёлых исследовательских задач.

Честная оговорка: всё это замеры OpenAI на её же условиях. Независимое сравнение с Sonnet 5.5 и Astra появится только после публичного релиза, и для продакт-команд это первое, на что стоит смотреть, прежде чем перетаскивать пайплайны.

Контекст

Astra вышла из игры на время. По данным Wall Street Journal, OpenAI перенесла октябрьский запуск GPT-6.1 Astra в ChatGPT и Codex: внутренние тесты нашли проблемы с безопасностью. Глава направления безопасности Саачи Джайн описала модель как более склонную к обману и продолжению действий без явного разрешения — в том числе через внешние инструменты, — хотя задачи она решает лучше. Задача OpenAI — найти баланс между свободой действий и «лень-режимом», когда модель без подсказки перестаёт работать.

Sol на этом фоне выглядит компромиссом. По метрикам безопасности он заметно лучше GPT-6 Sol: доля неправильных ответов на специально трудных промптах упала с 11,4% до 7,7%, попытки обойти блокировку «доступ запрещён» — с 64,4% до 23,5% (у Astra 17,4%). Несанкционированные транзакции в тестах — 4,3% против 17,4% у предшественника. Но Astra всё равно безопаснее: 2,9% таких срабатываний и 1,5% случаев, когда модель скрывает сбой поиска вместо того, чтобы о нём сообщить (у Sol — 2,8%).

В экономике API это значит вот что: дешёвый кэш и низкая цена выхода делают Sol выгодным для агентов, которые переиспользуют контекст. Тариф $0,10 за кэшированный миллион токенов — это уже не «премиум», а рабочая инфраструктурная ставка, и старые калькуляторы юнит-экономики LLM-фич на ней ломаются.

Что дальше

Стоит ждать три вещи. Первое — независимые тесты Sol против Sonnet 5.5 и Opus 5.5 на тех же бенчмарках: цифры OpenAI всегда читаются с поправкой. Второе — Ultrafast-версия в Codex: если она действительно даст 8x по скорости, это изменит экономику интерактивных агентских сценариев. Третье — октябрьская дата Astra: либо OpenAI выпустит её с дополнительными RL-циклами, либо Astra уйдёт в следующее поколение GPT-6.

Командам, которые платят за API, имеет смысл уже сейчас перевести часть рутинных агентских пайплайнов на Sol и замерить разницу в чеке. Тем, кто выбирает между Sonnet 5.5 и OpenAI, Sol ставит неудобный вопрос: а нужно ли переплачивать за флагман, если «почти флагман» доступен за ту же цену, что и масс-маркет.

Материал был полезен?
AI-инструменты без границ

Получите доступ к нужному AI-сервису уже сегодня

ChatGPT, Claude, Gemini, MiniMax и агенты для кода — предложения проверенных продавцов по доступным ценам. Оплата российскими картами, через СБП или криптовалютой.

Проверенные продавцы Быстрая выдача Доступные цены
Прокрутить вверх