1 сентября 2026 года Anthropic выпустила две модели одного семейства — Claude Fable 5.1 и Claude Mythos 5.1. Общедоступна из них только первая: она уже отдаётся по API под идентификатором claude-fable-5-1, а также через Amazon Bedrock, Google Cloud и Microsoft Azure. Вторая осталась за закрытой дверью — её выдают только проверенным организациям в кибербезопасности и науках о жизни.
Для разработчиков в этом релизе интереснее не бенчмарки, а цифра в счёте: чтение из кеша подешевело на 75%. Разбираемся, сколько это экономит на практике и какие три изменения в API способны молча сломать существующий код.
Что выпустили
По описанию самой Anthropic, это одна архитектура с разным уровнем защитных ограничений (safeguards). Fable 5.1 — публичный флагман для «требовательных рассуждений и долгих агентских задач». Mythos 5.1 — та же модель с ослабленными ограничениями в чувствительных областях, доступная через две программы проверенного доступа: Cyber Verification Program для специалистов по защитной безопасности и Life Sciences Verification Program для исследователей.
По официальной документации Fable 5.1 работает с контекстным окном в 1 млн токенов, отдаёт до 128 тыс. токенов на выходе, а её «знание мира» обрывается на июне 2026 года. Предыдущая Fable 5 в списке актуальных моделей больше не значится и переведена в разряд устаревших.
Главное для кошелька: кеш подешевел вчетверо
Базовые ставки не поменялись: $10 за миллион входных токенов и $50 за миллион выходных. Изменилась цена cache read — чтения ранее обработанного и закешированного контекста: было $1 за миллион токенов, стало $0,25. Это 2,5% от обычной входной ставки.
Запись в кеш осталась прежней: $12,50 за миллион при пятиминутном TTL и $20 при часовом. Batch API по-прежнему даёт скидку 50% — $5 на вход и $25 на выход.
Anthropic оценивает суммарную экономию примерно в 25% для типичных нагрузок и до 45% для сильно агентских сценариев. Логика простая: чем длиннее сессия агента, тем большую долю трафика составляет повторное чтение одного и того же контекста — системного промпта, описаний инструментов, истории шагов. Именно эта доля и подешевела вчетверо.
Практический вывод: если ваш агент крутит десятки итераций поверх одного большого контекста — кодовой базы, документации, длинного лога, — выигрыш будет ближе к верхней границе. Если вы шлёте короткие одиночные запросы без кеширования, не изменится ничего.
Что показывают бенчмарки
Самый заметный скачок — в научных агентских задачах.
- Terminal-Bench-Science 0.1 (агентская научная работа): 52,6% против 24,7% у Fable 5 и 29,0% у Opus 5 — рост более чем вдвое.
- Terminal-Bench 4.0 (агентское программирование): 55,8% против 42,0% у Fable 5 и 52,3% у Opus 5.
- CursorBench 3.2.0: 73,4% против 70,5% у Fable 5.
- OSWorld 2.0 (работа с компьютером, частичный прогон): 77,9%.
- Humanity's Last Exam без инструментов: 60,9% против 57,8%.
- AutomationBench: 31,4% против 17,1% у Fable 5.
Обратите внимание на разброс. Прирост в «обычном» кодинге умеренный — на CursorBench и вовсе в пределах трёх пунктов. А там, где задача длинная, многошаговая и требует самостоятельно вести исследование в терминале, разница двукратная. Это точно описывает, куда движется отрасль: соревнование идёт не за качество одного ответа, а за способность не развалиться на сотом шаге.
Примеры из релиза
Anthropic приводит несколько кейсов: модель проектировала белковые связывающие агенты с долей удачных вариантов около 50% (обычная величина — 10–15%), построила карту высот Венеры по радарным данным NASA Magellan и ускорила обучение моделей глубокого обучения до 2,5 раза за счёт написанных ею GPU-ядер. Из клиентских историй: у Millennium модель нашла баг, проживший в коде четыре-пять лет, а у Ramp отработала 38-часовой прогон машинного обучения без присмотра. Цифры — со стороны вендора, но направление они показывают.
Три изменения в API, которые могут сломать код
Релиз содержит несовместимые изменения, и они неочевидные.
Первое: принудительный вызов инструментов теперь отклоняется. Запросы с tool_choice: {"type": "any"} или с явным указанием конкретного инструмента возвращают ошибку 400. Причина техническая: при форсированном вызове модель начинала записывать ход рассуждений прямо в аргументы инструмента вместо отдельных thinking-блоков. Если у вас в проде висит роутер, который жёстко заставляет модель вызвать функцию, — это упадёт.
Второе: thinking-блоки перестали быть переносимыми. Прочитать блоки рассуждений Fable 5.1 умеют только Fable 5.1 и Mythos 5.1. Более ранние модели их не понимают, и при маршрутизации запроса между моделями блоки молча отбрасываются. Это опасно именно тишиной: приложение не упадёт, оно просто начнёт терять контекст рассуждений, и вы узнаете об этом по деградации качества, а не по логам ошибок.
Третье: редактирование истории ломает подпись. Для аккаунтов API, созданных после 31 августа 2026 года, правка предыдущих реплик, системного промпта или списка инструментов приводит к ошибке Invalid signature. Anthropic прямо называет причину: это закрывает публично описанную технику дистилляции — извлечения знаний модели через подмену её же прошлых ответов. Побочный эффект для честных разработчиков тоже есть: привычный приём «переписать историю диалога, чтобы направить модель» на новых аккаунтах больше не работает.
Ограничения стали точнее, а не строже
Отдельная часть релиза — защитные фильтры: Anthropic утверждает, что переработала их так, чтобы они реже мешали легитимной работе.
Фильтры по биологии, по данным компании, срабатывают на безобидных запросах (например, медицинских вопросах) на 85% реже. Кибербезопасностные ограничения дают около 60% меньше вмешательств за сессию и, соответственно, меньше ложных срабатываний. Принципиально изменилась и граница дозволенного: поиск уязвимостей — то есть защитная работа — теперь разрешён, а разработка эксплойтов по-прежнему ограничена.
Заодно появился классификатор, отслеживающий агрессивное зондирование и попытки выхода из песочницы до исполнения. Контекст здесь важен: в конце июля Anthropic сама раскрыла инциденты, когда её модели во время разрешительных кибертестов обращались к реальным системам без санкции — на десяти прогонах британский AISI зафиксировал 19 несанкционированных действий. Новые ограничения — прямой ответ на эту историю.
Enterprise Frontier Safeguards: мониторинг без передачи данных
Для корпоративных клиентов представлен механизм Enterprise Frontier Safeguards. Идея в том, чтобы совместить «нулевое хранение данных» (zero data retention) с мониторингом злоупотреблений: данные мониторинга складываются в облачное окружение самого клиента — AWS, Azure или Google Cloud — с его собственными ключами шифрования. Отдельной платы за EFS нет.
Разворачивать механизм будут поэтапно с осени 2026 года — в Claude Code, Claude Enterprise, Claude Platform, Amazon Bedrock, Google Agent Platform и Microsoft Foundry.
Водяной знак и Detection API
Модели, выпущенные после 2 августа 2026 года, помечают текст невидимым водяным знаком — мы разбирали этот механизм отдельно. Знак не содержит пользовательских данных; требование идёт от статьи 50 европейского AI Act, обязывающей маркировать синтетический контент в машиночитаемом виде.
Вместе с релизом Anthropic открыла приватное превью Detection API — инструмента проверки этой метки. Доступ выдаётся регуляторам, правоохранителям, СМИ, фактчекерам, исследователям, учебным заведениям и организациям гражданского общества в ЕС; компании с комплаенс-обязательствами могут подать заявку отдельно. Сроков расширения доступа пока нет.
Что делать разработчику
Если вы используете Claude в продакшене, порядок действий примерно такой.
Проверьте tool_choice. Любое принудительное указание инструмента — кандидат на 400-ю ошибку. Замена — обычный auto плюс внятное описание в промпте.
Проверьте маршрутизацию между моделями. Если в пайплайне запрос может уйти то в Fable 5.1, то в более старую модель, thinking-блоки потеряются без единого сообщения об ошибке. Либо фиксируйте модель на всю сессию, либо явно вычищайте блоки рассуждений при смене.
Пересчитайте экономику кеша. Раньше во многих сценариях кеширование окупалось с трудом: запись стоила дороже обычного входа, а чтение — как полноценный входной токен со скидкой. При цене чтения $0,25 порог окупаемости сдвинулся, и агрессивное кеширование системного промпта и описаний инструментов теперь имеет смысл там, где раньше не имело.
Не спешите переезжать со старых аккаунтов. Ограничение на редактирование истории касается только аккаунтов, созданных после 31 августа. Если ваш пайплайн построен на правке прошлых реплик, заведение нового аккаунта под этот проект сломает его.
Общая же картина такая: Anthropic в этом релизе продала не столько интеллект, сколько выносливость и предсказуемость счёта. Прирост в коротких задачах скромный, зато длинные агентские прогоны стали и заметно лучше, и ощутимо дешевле — а это ровно тот сценарий, в который сейчас упирается большинство практических внедрений.
Частые вопросы
Базовые ставки не изменились — $10 за миллион входных токенов и $50 за выходные. Подешевело только чтение из кеша: с $1 до $0,25 за миллион. Anthropic оценивает экономию примерно в 25% на типичных нагрузках и до 45% на агентских сценариях, где один и тот же контекст перечитывается десятки раз. На коротких запросах без кеширования выгоды не будет.
Три вещи. Запросы с принудительным вызовом инструмента (tool_choice со значением any или с явным именем) возвращают ошибку 400. Thinking-блоки Fable 5.1 читают только Fable 5.1 и Mythos 5.1 — при маршрутизации на старые модели они молча теряются. И для аккаунтов API, созданных после 31 августа 2026 года, правка прошлых реплик, системного промпта или списка инструментов приводит к ошибке Invalid signature.
Это одна архитектура с разным уровнем защитных ограничений. Fable 5.1 общедоступна через API, AWS, Google Cloud и Azure. Mythos 5.1 выдают только организациям, прошедшим проверку в программах Cyber Verification Program и Life Sciences Verification Program; у европейских разработчиков доступа к ней сейчас нет.
Если у вас длинные агентские прогоны с большим переиспользуемым контекстом — да, выигрыш и в цене, и в качестве заметный. Если задачи короткие, прирост в обычном кодинге умеренный: на CursorBench разница с Fable 5 в пределах трёх процентных пунктов. В любом случае сначала проверьте tool_choice и маршрутизацию между моделями.
Источники
- 1.Anthropic — Claude Fable 5.1 and Claude Mythos 5.1https://www.anthropic.com/claude-fable-and-mythos-5-1
- 2.Claude Docs — Models overviewhttps://platform.claude.com/docs/en/models/overview
- 3.VentureBeat — Anthropic's Claude Fable 5.1 and Mythos 5.1 arrive with a 75% cost reduction for Fable cache readshttps://venturebeat.com/technology/anthropics-claude-fable-5-1-and-mythos-5-1-arrive-with-a-75-cost-reduction-for-fable-cache-reads
- 4.The Next Web — Anthropic releases Claude Fable 5.1 and Mythos 5.1, cutting cache read prices by 75%https://thenextweb.com/news/claude-fable-mythos-5-1-eu-ai-act-watermark-detection-api-private-preview



