OpenAI показала собственный чип: быстрее ответы, но не обещание дешёвого ChatGPT

3 мин чтения 0
OpenAI показала собственный чип: быстрее ответы, но не обещание дешёвого ChatGPT

Первый чип OpenAI Jalapeño хорошо выступил в тестах обработки запросов к нейросетям. Для пользователей здесь интереснее не соревнование с Nvidia само по себе, а возможность получать ответ быстрее. Однако результат лабораторного сравнения ещё не означает снижения цены подписки.

Суть события

OpenAI опубликовала первые замеры Jalapeño — ускорителя для инференса, то есть работы уже обученной модели с запросами. Компания сообщает о приросте производительности на ватт в 1,5–1,9 раза относительно сравниваемых систем. Начать внедрение в свою инфраструктуру она планирует до конца года.

Практический смысл понятен: если сервер за ту же электроэнергию обслуживает больше запросов, себестоимость работы может снизиться. Но из этого не следует, что поставщик немедленно уменьшит тариф. Экономию можно направить и на дополнительную мощность, и на увеличение маржи.

Детали

Результаты касаются нескольких открытых моделей, включая DeepSeek R1 и Kimi K2.5. В <a href=»https://openai.com/index/jalapeno-first-results/»>описании испытаний OpenAI</a> говорится и о снижении задержки. Это особенно полезно для помощника, который выполняет цепочку действий: ожидание на каждом шаге складывается в ощутимую паузу.

Однако у сравнения есть границы. Аналитики <a href=»https://newsletter.semianalysis.com/p/openai-jalapeno-better-than-nvidia»>SemiAnalysis</a> присутствовали при отдельных запусках в лаборатории, но не проверяли весь набор тестов самостоятельно. Они отдельно предупреждают: короткий однопроходный запрос не воспроизводит длинную многошаговую работу агента. Поэтому переносить лабораторное преимущество на любой сценарий пока рано.

Контекст

Собственное оборудование даёт разработчику нейросетей ещё один способ влиять на расходы. Раньше мы разбирали <a href=»https://ai-digest.ru/nvidia-povyshaet-ceny-na-sistemy-vera-rubin-i-grace-blackwell-na-15-chto-izvestn/»>сообщения о подорожании систем Nvidia</a>. На таком фоне выбор между закупкой универсальных ускорителей и разработкой своих решений становится деловым вопросом, а не только инженерным.

При этом стоимость чипа — лишь часть счёта. Для честного сравнения нужно учитывать электричество, охлаждение, программное обеспечение, загрузку серверов и надёжность. Быстрый тест на удачно подобранной задаче не заменяет расчёта расходов за весь срок эксплуатации. Наш вывод: появление альтернативы важно для переговоров о цене, но объявлять победителя всей гонки пока нечестно.

Что дальше

Следить стоит за массовым внедрением и результатами на реальных задачах. OpenAI не заявляет об отказе от ускорителей Nvidia и других партнёров: собственный чип дополняет инфраструктуру. Для обычного пользователя проверка проще лабораторных графиков — стали ли ответы заметно быстрее и изменились ли доступные лимиты.

Разработчикам сервисов тоже полезнее измерять стоимость успешно выполненной задачи, а не любоваться одним показателем скорости. Если агент отвечает быстро, но часто ошибается и требует повторных попыток, экономия на токене не обязательно превращается в экономию для бизнеса.

Материал был полезен?
AI-инструменты без границ

Получите доступ к нужному AI-сервису уже сегодня

ChatGPT, Claude, Gemini, MiniMax и агенты для кода — предложения проверенных продавцов по доступным ценам. Оплата российскими картами, через СБП или криптовалютой.

Проверенные продавцы Быстрая выдача Доступные цены
Прокрутить вверх