Anthropic выпустила Claude Haiku 5.5 — самую дешёвую и быструю модель в линейке. На коротких запросах, которые составляют около 90% трафика, цена за миллион токенов упала до десятой части от прежней. Одновременно компания вдвое срезала стоимость чтения кеша у Sonnet 5.5 и начала выдавать подписчикам API-кредиты. На рынке это читается почти как ответ на свежие ценовые ходы OpenAI: гонка за стоимостью токена только разгоняется. Разбираемся, кому выгодно переходить на Haiku уже сейчас, а где экономия окажется скромнее, чем обещают заголовки, — для выбора полезно сравнение Gemini 3.6 Flash, GPT-4o mini и Claude Sonnet 5 по пяти ключевым отличиям.
Суть события
7 октября 2026 года Anthropic открыла доступ к Claude Haiku 5.5 — младшей модели семейства, рассчитанной на массовые и дешёвые задачи: суммаризацию (краткий пересказ больших текстов), классификацию, поиск по базам данных, работу службы поддержки в реальном времени. На запросах до 100 тысяч токенов Anthropic обещает снижение цены до 90% по сравнению с Haiku 4.5; при более длинных промптах тариф растёт в пять раз. Средний ценник по общему потоку заявлен на уровне «примерно четверть от прежнего».
Одновременно компания вдвое уменьшила стоимость чтения кеша (сохранённого промпта, который модель не считает заново) у Sonnet 5.5 — с $0,20 до $0,10 за миллион токенов. По собственной оценке Anthropic, для большинства агентных задач это должно обойтись в минус примерно 20% к итоговому счёту. Подписчики Max-5x получат $100 API-кредитов в месяц, Max-20x — $200, Team — до $500; тратить их предлагается на эксперименты с инструментами и агентами.
Детали: что показали бенчмарки
Haiku 5.5 выглядит не просто дешевле, но и заметно умнее прежней версии. На тесте знаний GDPval-AA v2.1 он набирает 1 620 против 735 у Haiku 4.5, на Humanity’s Last Exam — 45,9% без инструментов и 57,4% с ними (у предшественника было 10,2% и 18,7%). Самый резкий скачок — в компьютерном использовании (computer use): модель учится самостоятельно управлять интерфейсом, и на OSWorld-2.1 рост с 15,7% до 72,4%.
Этот сценарий — главный повод для оптимизма. Если модель реально работает с интерфейсом, её дешевизна открывает дорогу к самостоятельным агентам, которые будут кликать, заполнять формы и собирать данные без длинных рассуждений. На агентном тесте Terminal-Bench 4.0 Haiku 5.5 показывает 39,2%, у Haiku 4.5 было ноль, то есть в этой области прогресс не эволюционный, а с нуля.
Anthropic прямо сравнивает новинку с бюджетной моделью OpenAI GPT-6 Luna и выигрывает по всем протестированным категориям. При этом до старшего Sonnet 5.5 младшей модели всё ещё далеко: на том же OSWorld-2.1 у Sonnet 5.5 83,9%, а в агентном кодинге — 70,6% против 39,2%. Для сложной работы Sonnet 5.5 и Opus 5.5 остаются более подходящим выбором — Haiku позиционируется как узкоспециализированный помощник.
Отдельно Anthropic предупреждает: в Haiku 5.5 обновили токенизатор (способ разбивки текста на единицы, которые модель «понимает»), и он расходует чуть больше токенов на ту же задачу. С предыдущими Opus 4.x такой переход давал рост потребления примерно на 30%. Так что реальная экономия в проде окажется меньше, чем подсказывают цифры в таблице цен.
Что такое Haiku 5.5 простыми словами?
Это самая быстрая и дешёвая модель Anthropic для больших потоков простых задач: суммаризаций, классификации текстов, общения с клиентами, работы с базами данных и автоматизации интерфейса. Для сложных рассуждений по-прежнему лучше подходят Sonnet 5.5 и Opus 5.5.
Где уже доступна модель?
Haiku 5.5 запущена одновременно на Amazon Web Services, Google Cloud и Microsoft Azure — то есть там же, где живёт остальная линейка Claude.
- Вводные токены Haiku 5.5: $0,10 / $0,50 за миллион (до/после 100k против $1,00 у Haiku 4.5).
- Выводные токены: $0,50 / $2,50 за миллион против $5,00 у предшественника.
- Чтение кеша Sonnet 5.5: $0,10 за миллион вместо $0,20.
- Haiku 5.5 — первая модель линейки с регулируемым уровнем рассуждений, что позволяет торговать стоимостью и качеством.

Контекст: гонка цен и узкие места
Сокращение стоимости кеша у Sonnet 5.5 почти наверняка читается как реакция на свежую серию GPT-6.1 у OpenAI. Anthropic прямо об этом не говорит, но тайминг подозрительно точный: цены режут обе стороны, и период «дешёвого токена» для разработчиков продолжается.
Нам здесь любопытно другое. Haiku 5.5 закрывает очень узкую нишу — массовые дешёвые задачи с низкой ценой ошибки. Но если вы строите сервис на коротких запросах, как раз они и составляют основную долю трафика: Anthropic сама говорит, что около 90% прошлых Haiku-запросов укладывались в 100 тысяч токенов. Получается, ценник пересмотрен именно для той части рынка, где Anthropic уже лидирует. Это не столько завоевание новой аудитории, сколько защита позиций в самой массовой категории.
Есть и риск, о котором компания честно предупреждает: новый токенизатор съедает больше единиц на ту же задачу. Если ваш продукт чувствителен именно к объёму текста, фактический счёт может оказаться ближе к экономии в 70%, а не обещанным 90%. Стоит заложить буфер при переходе с Haiku 4.5.
Для разработчиков, которые выбирают инфраструктуру для нового проекта, разумно держать в голове общую картину по рынку — в подборке лучших AI-инструментов 2026 года мы разбирали, как эти модели соотносятся по цене и сценариям.
Что ограничивает применение Haiku 5.5?
Модель явно лучше работает на узких задачах: пересказ, суммаризация, простая агентная рутина. Для сложного кодинга и многошаговых агентов по-прежнему стоит брать Sonnet 5.5 или Opus 5.5. Проникновение в кибербезопасность у Haiku шире, чем у Sonnet, но пентесты заблокированы — для них нужны специализированные программы верификации Anthropic.
Что дальше
Если вы уже используете Haiku 4.5 на массовых сценариях, имеет смысл в ближайшую пару недель тестово переключить 10–20% нагрузки на 5.5 и сравнить фактические счета и качество. Не стоит сразу переводить всё: новый токенизатор меняет экономику сильнее, чем меняют цены в прайс-листе.
Если вы только выбираете модель под массовый сервис — поддержка клиентов, модерацию контента, обработку тикетов, массовую разметку данных, — Haiku 5.5 теперь выглядит одним из самых прагматичных вариантов по соотношению цены и качества. Для понимания того, как Anthropic удерживает разработчиков в экосистеме, полезно разбор того, как Claude Code учится вести несколько задач параллельно.
Подписчики Max и Team получают ощутимый месячный лимит на эксперименты: $100–$500 — это серьёзный ресурс, чтобы опробовать агентные сценарии, не увеличивая бюджет. Для команд, которые только осваивают API, эти кредиты — повседневная практическая польза, а не маркетинговая подачка. Anthropic заодно обновляет Python и TypeScript SDK, добавляя бета-поддержку computer use и browser use — то есть прямого управления компьютером и браузером из кода.
Стоит ли переходить с Haiku 4.5 сразу?
Не весь трафик сразу. На коротких запросах экономия будет максимальной, на длинных — символической или отрицательной. Начните с коротких сценариев, замерьте качество и фактический счёт за две-три недели и только потом масштабируйте.