7 октября Anthropic выпустила Claude Haiku 5.5 — новую небольшую модель для быстрых и массовых задач. Главная новость для разработчиков — цена: при запросах до 100 000 входных токенов миллион токенов стоит $0,10 на входе и $0,50 на выходе. Это в десять раз ниже тарифов Haiku 4.5. Но для длинных запросов действует другой уровень цен, а переход на новую модель требует проверки старых интеграций.
Релиз интересен тем, кто обрабатывает обращения клиентов, извлекает данные из документов или собирает системы из нескольких ИИ-агентов. На таких задачах стоимость одного вызова невелика, зато вызовов могут быть десятки тысяч. Ниже — что изменилось и где экономия может оказаться меньше, чем обещает сравнение тарифов.
Сколько стоит Haiku 5.5: два уровня цен
По опубликованным тарифам Claude Platform на 9 октября 2026 года цена зависит от длины входного запроса. Все суммы в таблице — за миллион токенов, без кэширования и пакетных скидок.
| Модель и размер запроса | Вход | Выход |
|---|---|---|
| Haiku 5.5: до 100 000 входных токенов включительно | $0,10 | $0,50 |
| Haiku 5.5: свыше 100 000 входных токенов | $0,50 | $2,50 |
| Haiku 4.5 — для сравнения | $1,00 | $5,00 |
В коротком запросе тарифы ниже на 90%, в длинном — на 50%. После порога в 100 000 повышается ставка и для входа, и для выхода. Поэтому заявленная скидка не означает, что любая длинная агентная сессия будет стоить в десять раз меньше.
Собственный расчёт для условного сервиса: один вызов содержит 2 000 входных и 300 оплачиваемых выходных токенов. При одинаковом количестве токенов Haiku 5.5 обойдётся в $0,00035, Haiku 4.5 — в $0,0035. Для 100 000 таких вызовов получается $35 против $350. Это сравнение ставок, без повторных попыток, инструментов, кэша, налогов и различий в фактическом расходе токенов.
Чтобы проверить экономику своего сервиса, полезнее взять реальные счётчики использования, чем оценивать запросы по длине текста. Например, сохранённая история диалога и описания доступных инструментов тоже занимают место во входе. Короткое сообщение пользователя может быть частью большого запроса.
Почему десятикратное снижение тарифа не равно десятикратной экономии
В руководстве по миграции Anthropic предупреждает: новый токенизатор разбивает тот же входной текст примерно на 30% больше токенов, чем Haiku 4.5. Точная разница зависит от содержимого. Старые оценки расходов и ограничения max_tokens нужно пересмотреть.
Есть и второй фактор: сколько работы делает модель. Дополнительные рассуждения, повторные вызовы после неудачного результата и обращения к инструментам меняют итоговый расход. В нашем расчёте выше токены намеренно одинаковые; в реальном сравнении старой и новой модели это условие нужно проверить.
Предлагаемый способ оценки — считать стоимость принятого результата. Если из ста ответов двадцать требуют повторной обработки или ручной правки, это часть цены решения. Для классификации заявок проверяют правильность категории; для извлечения данных — заполненные поля; для помощника программиста — прохождение проверок и полезность изменений.
У Haiku появилась настройка глубины рассуждений
Haiku 5.5 поддерживает адаптивные рассуждения и параметр effort — уровень усилий, который влияет на глубину обработки задачи. В документации модели указан уровень medium по умолчанию. Контекстное окно составляет до миллиона токенов, максимальный выход — до 128 000 токенов. Это технические пределы, а не рекомендация заполнять весь контекст при каждом вызове.
Независимое подтверждение релиза и цен опубликовано в обзоре Handy AI от 7 октября. Есть и данные интегратора: Cursor уже включил Haiku 5.5 в документацию моделей. На собственном CursorBench компания указывает 30,9% при низком effort с включёнными рассуждениями и 48,4% при максимальном effort. Sonnet 5.5 и Opus 5.5 показывают более высокие результаты на сложных задачах этого теста.
Эти числа помогают увидеть компромисс между режимами, но не предсказывают качество на конкретном проекте. Разумный эксперимент — дать разным настройкам один набор ваших задач и сравнить результат, задержку и расход. Для извлечения трёх полей из короткого письма и для анализа ошибки в нескольких файлах подходящий режим может различаться.
Где небольшая модель может быть полезна
Один из практических сценариев — поручать Haiku отдельные ограниченные шаги, а сложную задачу оставлять основной модели. Такой подход можно использовать в системах с субагентами. Например:
- В поддержке: определить тему обращения и передать его нужному обработчику.
- В документообороте: извлечь реквизиты или подготовить короткое описание файла.
- В контентной системе: предложить теги, проверить наличие обязательных разделов или выделить тезисы.
- В работе с кодом: найти связанные файлы и собрать сведения для основного агента.
Это примеры применения, а не результаты наших испытаний Haiku 5.5. У каждого шага должны быть понятные вход, ожидаемый выход и критерий приёмки. Если помощник начинает сам расширять задачу, многократно перечитывать весь проект и вызывать другие инструменты, экономию нужно считать уже по полной цепочке.
Можно начать с одного повторяющегося шага, сохранив остальную систему. Так проще заметить, снизились ли расходы без потери качества. Если одновременно заменить модель, инструкции и формат документов, причину изменений будет сложнее определить.
Переход с Haiku 4.5: замены имени модели мало
Идентификатор для Claude API — claude-haiku-5-5. Руководство по переходу содержит изменения, которые могут затронуть существующий код:
- Пересчитайте токены и проверьте лимит ответа после смены токенизатора.
- Если использовали ручной бюджет рассуждений
budget_tokens, переходите на адаптивный режим по инструкции миграции. - Уберите
temperature,top_pиtop_k: прежние нестандартные настройки могут вернуть ошибку 400. - Если обрабатывали первый блок ответа как обычный текст, выбирайте блоки по их типу.
- Проверьте использование assistant prefill — незаконченного ответа ассистента, который модель должна продолжить: Haiku 5.5 его не принимает.
До массового переключения удобно прогнать сохранённые запросы отдельно и сравнить ответы. Особенно важны места, где приложение ожидает строгую структуру данных или продолжает старую историю разговора. Ответ «модель успешно вызвана» ещё не подтверждает, что ваш обработчик правильно прочитал результат.
Что ещё изменилось в экономике Claude
Вместе с релизом Anthropic вдвое снизила цену чтения кэша Sonnet 5.5: с $0,20 до $0,10 за миллион токенов. Это отдельное изменение — оно важно для сессий с повторяющимся контекстом. Механизм разобран в материале о кэшировании промптов.
Для Haiku 5.5 документация указывает скидку 50% на вход и выход при пакетной обработке. Такой режим подходит задачам, которым не нужен немедленный ответ; подробнее — в статье про Batch API. Эти способы экономии стоит сравнивать с требованиями конкретного процесса: поддержке нужен быстрый ответ, ночной обработке архива важнее общая стоимость.
Что означает релиз для разработчика
Haiku 5.5 делает короткие массовые вызовы заметно доступнее по опубликованным тарифам. Наиболее понятный кандидат для проверки — повторяющийся шаг с ограниченным объёмом данных и измеримым результатом. Длинные агентные сессии требуют отдельного расчёта из-за порога 100 000 токенов.
Начать можно с небольшого набора реальных запросов: сравнить правильность ответов, время выполнения и стоимость принятого результата. Если новая модель проходит ваши критерии, расширять применение постепенно. Так снижение цены превращается в проверенную экономию, а не только в красивое число из анонса.
Частые вопросы
Anthropic представила модель 7 октября 2026 года. Для Claude API используется идентификатор claude-haiku-5-5.
На 9 октября 2026 года в Claude Platform запросы до 100 тысяч входных токенов включительно стоят $0,10 за миллион входных и $0,50 за миллион выходных токенов. Для запросов выше этого порога ставки составляют $0,50 и $2,50 соответственно, без дополнительных скидок.
Нужно проверить интеграцию: пересчитать токены, обновить настройки рассуждений, убрать старые параметры сэмплирования и проверить обработку блоков ответа. Модель не принимает assistant prefill.
Выбор зависит от задачи. В тестах Cursor на сложных задачах Sonnet 5.5 и Opus 5.5 показывают более высокие результаты. Haiku стоит отдельно проверить на ограниченных шагах и массовой обработке.
Источники
- 1.Anthropic — Introducing Claude Haiku 5.5, 7 октября 2026https://www.anthropic.com/claude-haiku-5-5
- 2.Claude Platform — Haiku 5.5: спецификации и ценыhttps://platform.claude.com/docs/en/models/haiku-5-5/overview
- 3.Claude Platform — руководство по миграции на Haiku 5.5https://platform.claude.com/docs/en/models/haiku-5-5/migration-guide
- 4.Cursor — Haiku 5.5: интеграция и результаты CursorBenchhttps://prod.cursor.com/docs/models/claude-haiku-5-5
- 5.Handy AI — Model Drop: Claude Haiku 5.5, независимый обзорhttps://handyai.substack.com/p/model-drop-claude-haiku-55



