Cyber News

Claude Haiku 5.5: Anthropic снизила цены на массовые задачи

M
Markabus
·
Небольшой компьютер обрабатывает карточки задач: слева входящая стопка, справа готовые результаты, рядом три монеты — иллюстрация к новости о Claude Haiku 5.5 и недорогой массовой обработке.

7 октября Anthropic выпустила Claude Haiku 5.5 — новую небольшую модель для быстрых и массовых задач. Главная новость для разработчиков — цена: при запросах до 100 000 входных токенов миллион токенов стоит $0,10 на входе и $0,50 на выходе. Это в десять раз ниже тарифов Haiku 4.5. Но для длинных запросов действует другой уровень цен, а переход на новую модель требует проверки старых интеграций.

Релиз интересен тем, кто обрабатывает обращения клиентов, извлекает данные из документов или собирает системы из нескольких ИИ-агентов. На таких задачах стоимость одного вызова невелика, зато вызовов могут быть десятки тысяч. Ниже — что изменилось и где экономия может оказаться меньше, чем обещает сравнение тарифов.

Сколько стоит Haiku 5.5: два уровня цен

По опубликованным тарифам Claude Platform на 9 октября 2026 года цена зависит от длины входного запроса. Все суммы в таблице — за миллион токенов, без кэширования и пакетных скидок.

Модель и размер запросаВходВыход
Haiku 5.5: до 100 000 входных токенов включительно$0,10$0,50
Haiku 5.5: свыше 100 000 входных токенов$0,50$2,50
Haiku 4.5 — для сравнения$1,00$5,00

В коротком запросе тарифы ниже на 90%, в длинном — на 50%. После порога в 100 000 повышается ставка и для входа, и для выхода. Поэтому заявленная скидка не означает, что любая длинная агентная сессия будет стоить в десять раз меньше.

Собственный расчёт для условного сервиса: один вызов содержит 2 000 входных и 300 оплачиваемых выходных токенов. При одинаковом количестве токенов Haiku 5.5 обойдётся в $0,00035, Haiku 4.5 — в $0,0035. Для 100 000 таких вызовов получается $35 против $350. Это сравнение ставок, без повторных попыток, инструментов, кэша, налогов и различий в фактическом расходе токенов.

Чтобы проверить экономику своего сервиса, полезнее взять реальные счётчики использования, чем оценивать запросы по длине текста. Например, сохранённая история диалога и описания доступных инструментов тоже занимают место во входе. Короткое сообщение пользователя может быть частью большого запроса.

Почему десятикратное снижение тарифа не равно десятикратной экономии

В руководстве по миграции Anthropic предупреждает: новый токенизатор разбивает тот же входной текст примерно на 30% больше токенов, чем Haiku 4.5. Точная разница зависит от содержимого. Старые оценки расходов и ограничения max_tokens нужно пересмотреть.

Есть и второй фактор: сколько работы делает модель. Дополнительные рассуждения, повторные вызовы после неудачного результата и обращения к инструментам меняют итоговый расход. В нашем расчёте выше токены намеренно одинаковые; в реальном сравнении старой и новой модели это условие нужно проверить.

Предлагаемый способ оценки — считать стоимость принятого результата. Если из ста ответов двадцать требуют повторной обработки или ручной правки, это часть цены решения. Для классификации заявок проверяют правильность категории; для извлечения данных — заполненные поля; для помощника программиста — прохождение проверок и полезность изменений.

У Haiku появилась настройка глубины рассуждений

Haiku 5.5 поддерживает адаптивные рассуждения и параметр effort — уровень усилий, который влияет на глубину обработки задачи. В документации модели указан уровень medium по умолчанию. Контекстное окно составляет до миллиона токенов, максимальный выход — до 128 000 токенов. Это технические пределы, а не рекомендация заполнять весь контекст при каждом вызове.

Независимое подтверждение релиза и цен опубликовано в обзоре Handy AI от 7 октября. Есть и данные интегратора: Cursor уже включил Haiku 5.5 в документацию моделей. На собственном CursorBench компания указывает 30,9% при низком effort с включёнными рассуждениями и 48,4% при максимальном effort. Sonnet 5.5 и Opus 5.5 показывают более высокие результаты на сложных задачах этого теста.

Эти числа помогают увидеть компромисс между режимами, но не предсказывают качество на конкретном проекте. Разумный эксперимент — дать разным настройкам один набор ваших задач и сравнить результат, задержку и расход. Для извлечения трёх полей из короткого письма и для анализа ошибки в нескольких файлах подходящий режим может различаться.

Где небольшая модель может быть полезна

Один из практических сценариев — поручать Haiku отдельные ограниченные шаги, а сложную задачу оставлять основной модели. Такой подход можно использовать в системах с субагентами. Например:

  • В поддержке: определить тему обращения и передать его нужному обработчику.
  • В документообороте: извлечь реквизиты или подготовить короткое описание файла.
  • В контентной системе: предложить теги, проверить наличие обязательных разделов или выделить тезисы.
  • В работе с кодом: найти связанные файлы и собрать сведения для основного агента.

Это примеры применения, а не результаты наших испытаний Haiku 5.5. У каждого шага должны быть понятные вход, ожидаемый выход и критерий приёмки. Если помощник начинает сам расширять задачу, многократно перечитывать весь проект и вызывать другие инструменты, экономию нужно считать уже по полной цепочке.

Можно начать с одного повторяющегося шага, сохранив остальную систему. Так проще заметить, снизились ли расходы без потери качества. Если одновременно заменить модель, инструкции и формат документов, причину изменений будет сложнее определить.

Переход с Haiku 4.5: замены имени модели мало

Идентификатор для Claude API — claude-haiku-5-5. Руководство по переходу содержит изменения, которые могут затронуть существующий код:

  • Пересчитайте токены и проверьте лимит ответа после смены токенизатора.
  • Если использовали ручной бюджет рассуждений budget_tokens, переходите на адаптивный режим по инструкции миграции.
  • Уберите temperature, top_p и top_k: прежние нестандартные настройки могут вернуть ошибку 400.
  • Если обрабатывали первый блок ответа как обычный текст, выбирайте блоки по их типу.
  • Проверьте использование assistant prefill — незаконченного ответа ассистента, который модель должна продолжить: Haiku 5.5 его не принимает.

До массового переключения удобно прогнать сохранённые запросы отдельно и сравнить ответы. Особенно важны места, где приложение ожидает строгую структуру данных или продолжает старую историю разговора. Ответ «модель успешно вызвана» ещё не подтверждает, что ваш обработчик правильно прочитал результат.

Что ещё изменилось в экономике Claude

Вместе с релизом Anthropic вдвое снизила цену чтения кэша Sonnet 5.5: с $0,20 до $0,10 за миллион токенов. Это отдельное изменение — оно важно для сессий с повторяющимся контекстом. Механизм разобран в материале о кэшировании промптов.

Для Haiku 5.5 документация указывает скидку 50% на вход и выход при пакетной обработке. Такой режим подходит задачам, которым не нужен немедленный ответ; подробнее — в статье про Batch API. Эти способы экономии стоит сравнивать с требованиями конкретного процесса: поддержке нужен быстрый ответ, ночной обработке архива важнее общая стоимость.

Что означает релиз для разработчика

Haiku 5.5 делает короткие массовые вызовы заметно доступнее по опубликованным тарифам. Наиболее понятный кандидат для проверки — повторяющийся шаг с ограниченным объёмом данных и измеримым результатом. Длинные агентные сессии требуют отдельного расчёта из-за порога 100 000 токенов.

Начать можно с небольшого набора реальных запросов: сравнить правильность ответов, время выполнения и стоимость принятого результата. Если новая модель проходит ваши критерии, расширять применение постепенно. Так снижение цены превращается в проверенную экономию, а не только в красивое число из анонса.

Частые вопросы

Q.Когда вышла Claude Haiku 5.5?

Anthropic представила модель 7 октября 2026 года. Для Claude API используется идентификатор claude-haiku-5-5.

Q.Сколько стоит Haiku 5.5 через API?

На 9 октября 2026 года в Claude Platform запросы до 100 тысяч входных токенов включительно стоят $0,10 за миллион входных и $0,50 за миллион выходных токенов. Для запросов выше этого порога ставки составляют $0,50 и $2,50 соответственно, без дополнительных скидок.

Q.Можно ли просто заменить Haiku 4.5 на Haiku 5.5?

Нужно проверить интеграцию: пересчитать токены, обновить настройки рассуждений, убрать старые параметры сэмплирования и проверить обработку блоков ответа. Модель не принимает assistant prefill.

Q.Заменяет ли Haiku 5.5 Sonnet и Opus для сложного кода?

Выбор зависит от задачи. В тестах Cursor на сложных задачах Sonnet 5.5 и Opus 5.5 показывают более высокие результаты. Haiku стоит отдельно проверить на ограниченных шагах и массовой обработке.

Источники

←
Предыдущая
OpenAI представила Dots: агенты ChatGPT получили собственный компьютер и работу между разговорами

Читайте также

На столе в светлой комнате при дневном свете — ноутбук с закрытой крышкой, а рядом миска с тестом, накрытая полотенцем: тесто поднимается само, пока компьютер выключен — иллюстрация к новости о Dots, агентах ChatGPT, продолжающих работать в облаке между разговорами.Cyber News
29 сентября 2026 г.

OpenAI представила Dots: агенты ChatGPT получили собственный компьютер и работу между разговорами

29 сентября OpenAI представила Dots — агентов ChatGPT с собственным облачным компьютером. Разбираем работу между разговорами, доступность и контроль действий.

Читать →
На светлом столе стоит закрытый прозрачный бокс: катушка внутри, а тонкая красная нить проходит через небольшое отверстие в стенке и тянется наружу — метафора DNS-канала, найденного агентом в изолированной среде. Иллюстрация к новости «Побег из песочницы: агент OpenAI нашёл живой интернет через DNS».Cyber News
27 сентября 2026 г.

Побег из песочницы: агент OpenAI нашёл живой интернет через DNS

Агент OpenAI закодировал вопросы в DNS-имена и получил ответ внешнего чат-бота из изолированной обучающей среды. Разбор отчёта: таймлайн, дыры мониторинга и выводы для песочниц агентов.

Читать →
Макет промышленного кампуса на столе архитектора и медная труба, обрезанная и заглушенная, не доходя до зданий, — иллюстрация к новости о задержках Project Jupiter. Иллюстрация, изображение сгенерировано ИИCyber News
25 сентября 2026 г.

Oracle заявила форс-мажор по дата-центру Stargate в Нью-Мексико: ИИ-кампусу на 2,45 ГВт не хватает газа

Oracle направила застройщику Project Jupiter уведомление о форс-мажоре: кампус Stargate для OpenAI на 2,45 ГВт ждёт газопровод и экологическое разрешение. Разбираем, что случилось и почему энергия стала главным ограничителем ИИ.

Читать →