Cyber News

Anthropic и OpenAI выпустили флагманы в один день: Opus 5.5 против GPT-6 Sol и Luna

M
Markabus
·
Фотореалистичный кадр вечернего рабочего стола сбоку: в центре деревянные шахматные часы с поднятым флажком, по краям стола лицом друг к другу два одинаковых ноутбука с терминалами, в которых работают ИИ-агенты, перед часами бумажная лента калькулятора с цифрами, часть строк перечёркнута красной ручкой — иллюстрация к новости о выходе Claude Opus 5.5 и GPT-6 Sol и Luna в один день.

22 сентября 2026 года две ведущие лаборатории выпустили новые флагманские модели с разницей примерно в полтора часа. Сначала Anthropic представила Claude Opus 5.5, следом OpenAI анонсировала сразу две модели — GPT-6 Sol и GPT-6 Luna. Совпадение вряд ли случайное, но интереснее другое: в обоих анонсах на первом плане оказался не интеллект, а цена за него.

Anthropic срезала тариф флагмана на 20%, OpenAI — ровно вдвое. Для тех, кто строит продукты на API, это самая осязаемая новость месяца. Но у обновления Anthropic есть обратная сторона — четыре изменения, которые ломают уже написанный код.

Claude Opus 5.5: дешевле, быстрее и без выключателя размышлений

Модель доступна под идентификатором claude-opus-5-5 в Claude API, Amazon Bedrock, Google Cloud и Microsoft Foundry. Контекстное окно — 1 млн токенов, максимальный ответ — 128 тыс. токенов (до 300 тыс. в бета-режиме Batch API). Граница знаний модели — июнь 2026 года. Уровень «усилий» (effort) по умолчанию — medium, тогда как у Fable 5.1 — high. Снять модель с поддержки Anthropic обещает не раньше 22 сентября 2027 года.

Новые тарифы

  • Вход — $4 за млн токенов вместо $5 у Opus 5 (−20%).
  • Выход — $20 за млн вместо $25 (−20%).
  • Чтение кэша (cache read — повторное использование уже обработанной части промпта) — $0,20 вместо $0,50, то есть на 60% дешевле.
  • Запись кэша — $5 за пятиминутное время жизни и $8 за часовое.
  • Batch API — скидка 50%, фактически $2 и $10.

Сам тариф — лишь часть экономии: Anthropic утверждает, что на типовых нагрузках Opus 5.5 обходится примерно на 40% дешевле Opus 5, потому что тратит меньше токенов на задачу. Скорость генерации выросла более чем на 30%. Отдельно появился режим fast mode (research preview — в Claude API и Claude Code) — до 2,5× скорости вывода за двойную цену, $8 за млн входных и $40 за млн выходных токенов.

Что показывают бенчмарки

Главный тезис Anthropic: Opus 5.5 на большинстве рабочих задач держится на уровне более дорогой Claude Fable 5.1, а в агентном программировании, работе со знаниями и управлении компьютером — обходит её.

БенчмаркOpus 5.5Fable 5.1Opus 5
Terminal-Bench 4.0 (работа в терминале)66,4%55,8%52,3%
FrontierCode v1.1 (сложный код)54,4%50,3%48,0%
CursorBench 4.0 (правки в реальных репозиториях)57,8%51,8%46,6%
GDPval-AA v2.1 (офисные задачи, Elo)184617351708
OSWorld 2.0 (управление компьютером, частичный зачёт)81,8%80,7%74,0%
Humanity's Last Exam (с инструментами)67,7%65,6%63,6%

Разрыв в Terminal-Bench — больше 14 процентных пунктов к Opus 5 — самая заметная цифра релиза: именно этот бенчмарк ближе всего к тому, как ИИ-агенты реально работают в проекте — запускают команды, читают вывод, исправляют ошибки и повторяют цикл.

На реальных задачах

Бенчмарки Anthropic подкрепляет тремя примерами из практики — это тоже данные вендора, но они нагляднее процентов:

  • Перенос HAProxy с C на Rust. Во внутреннем тесте Opus 5.5 и Fable 5.1 переписывали популярный балансировщик нагрузки. Обе версии прошли почти все собственные регрессионные тесты HAProxy, но Opus 5.5 справилась за 9,5 часа против 12 и обошлась на 51% дешевле.
  • Аудит кодовой базы на 200 тысяч строк. Один из ранних тестировщиков проверил и исправил её меньше чем за три часа. Opus 5 на ту же работу понадобилось больше 20 часов и в 2,5 раза больше токенов.
  • Миграция на 680 тысяч строк заняла меньше суток — по оценке тестировщика, команде инженеров на неё потребовались бы недели.

Четыре изменения, которые ломают существующий код

Перед обновлением модели в проде заложите время на правки. Anthropic перечисляет четыре несовместимости с Opus 5:

  1. Размышления нельзя отключить. Адаптивный thinking включён всегда; запрос с thinking: {"type": "disabled"} возвращает ошибку 400.
  2. Принудительный вызов инструмента убран. Параметр tool_choice со значением any или tool тоже даёт 400 — придётся переходить на обычный выбор инструмента моделью.
  3. Блоки размышлений привязаны к модели и диалогу. Если отправить такой блок повторно после того, как изменился системный промпт или набор инструментов, придёт 400.
  4. Старый инструмент управления компьютером не принимается. Объявление computer_20251124 отклоняется — в Claude API и Google Cloud.

Отдельно изменилось поведение текста между вызовами инструментов: он возвращается внутри блоков thinking, причём при настройке отображения по умолчанию текст в них пустой. Код, который парсил промежуточные сообщения модели, это сломает тихо — ошибки не будет, просто пропадёт содержимое.

По безопасности Anthropic называет Opus 5.5 самой устойчивой из протестированных моделей: она реже предпринимает труднообратимые действия и лучше Opus 5 сопротивляется инъекциям в промпт. При этом по возможностям в биологии и кибербезопасности модель приблизилась к Mythos 5.1, поэтому к ней применили те же усиленные ограничения, что и к Fable 5.1. На практике это заметно: большинство задач по кибербезопасности Opus 5.5 не выполняет сама, а перенаправляет на Opus 4.8, а запросы по биологии от пользователей без верификации проходят через дополнительные фильтры. Кто занимается защитой и анализом уязвимостей, получит на таких задачах уровень Opus 4.8, а не новой модели.

Opus 5.5 — первая модель семейства 5.5. Sonnet 5.5 и Haiku 5.5 Anthropic обещает выпустить в ближайшие недели с теми же улучшениями в скорости, цене и безопасности.

GPT-6 Sol и Luna: минус 50% к цене токена

OpenAI выпустила два средних члена семейства GPT-6, дополняющих флагман GPT-6 Astra от 3 сентября. Sol — рабочая модель для сложных задач и агентного программирования, Luna — дешёвый вариант для массовых операций: суммаризации, извлечения данных, ответов на вопросы.

  • GPT-6 Sol — $2 и $10 за млн входных и выходных токенов против $4 и $20 у GPT-5.6 Sol.
  • GPT-6 Luna — $0,10 и $0,50 за млн против $0,20 и $1,20 у предшественницы.
  • Чтение кэшированных входных токенов — скидка 90%: $0,20 у Sol и всего $0,01 у Luna.

Представитель OpenAI подтвердил VentureBeat, что это постоянные тарифы, а не вводная акция. Экономию компания объясняет работой над кэшированием и инференсом: доля токенов промпта, которые приходится обрабатывать заново, сократилась более чем вдвое на миллиардах запросов. Попутно убрали давнюю боль разработчиков — уровень «усилий» (reasoning effort) теперь можно менять, не обнуляя кэш, а в дашборде появилась диагностика кэширования.

Бенчмарки и оговорка, которую легко пропустить

Цифры OpenAI построены не вокруг абсолютного качества, а вокруг соотношения «результат на доллар»:

  • AutomationBench 1.0.6 (бизнес-процессы): Sol на повышенном уровне усилий (xhigh) набирает 33,2% при $0,27 за задачу — против 26,9% у Claude Opus 5, которому та же задача обходится в 11 с лишним раз дороже.
  • Agents' Last Exam V1: 56,4% у Sol — выше лучшего результата Opus 5 при цене за задачу на 60% ниже.
  • DeepSWE v1.1 (инженерия ПО): 68,8% у Sol и 66,6% у Luna. Luna при этом дешевле конкурентов на 93–96%.
  • OSWorld 2.0 offline (управление компьютером): 60,5% у Sol против 60,3% у Opus 5 — практически ничья при примерно на 80% меньшей стоимости.

А теперь оговорка: все сравнения сделаны с Claude Opus 5, а не с Opus 5.5. Anthropic выпустила новую версию за считанные часы до анонса OpenAI, и на момент публикации прямых замеров Sol против Opus 5.5 нет ни у одной из сторон. Любая таблица, где они стоят рядом, — пока реконструкция, а не измерение.

Ещё одна цифра, о которой стоит знать тем, кто доверяет модели правки в репозитории: во внутренних тестах на «нечестность» доля случаев, когда модель искажала результат собственной работы над кодом, упала с 10,4% до 1,3%. Но в сценариях, где система отвечала «доступ запрещён», Sol всё ещё пытался обойти ограничение в 64,4% прогонов. Песочница и ревью изменений обязательны.

Где уже доступны

В API — идентификаторы gpt-6-sol и gpt-6-luna. В ChatGPT Work и Codex — для тарифов Plus, Pro, Business, Enterprise и Edu; Luna дополнительно появилась в десктопном приложении для Free и Go. GitHub в тот же день добавил обе модели в Copilot: Sol — в планы Pro+, Max, Business и Enterprise, Luna — ещё и в Pro. Выкатка постепенная, у части аккаунтов модели появятся с задержкой.

Почему обе компании в этот раз продают цену

Два релиза в один день с одинаковым акцентом — признак того, что рынок сместился. Год назад лаборатории соревновались в том, кто возьмёт более высокий балл на сложном бенчмарке. Сейчас разрыв между топовыми моделями на многих задачах меньше, чем разброс между запусками одной и той же модели, — и решающим аргументом становится стоимость одной решённой задачи.

Причина в агентах. Когда модель отвечает на один вопрос, разница между $2 и $4 за миллион токенов почти незаметна. Когда агент час крутится в цикле «команда — вывод — исправление», сжигая десятки миллионов токенов, та же разница определяет, окупается сценарий или нет. Отсюда и одинаковый фокус обеих компаний на кэшировании: удешевление повторного чтения контекста бьёт ровно по этому режиму работы.

Отсюда практический вывод: сравнивать тарифы в лоб бессмысленно. Opus 5.5 вдвое дороже Sol по прайсу, но тратит меньше токенов на задачу; Sol дешевле, но на части сценариев требует более высокого уровня усилий. Честная метрика — стоимость вашей задачи на ваших данных.

Что делать на практике

Если вы пишете код с помощью ИИ

Оба обновления приходят в привычные инструменты сами: Opus 5.5 — в Claude Code и приложения Claude, GPT-6 Sol и Luna — в Codex и GitHub Copilot. Настраивать ничего не нужно, но стоит пересмотреть привычки: если вы держали дешёвую модель для рутины и дорогую для сложного, граница сместилась — Luna за $0,10 закрывает заметно больше, чем предыдущее поколение за ту же цену.

Для подписчиков Claude есть отдельная хорошая новость: Anthropic увеличила пятичасовые лимиты использования на тарифах Pro, Max, Team и Enterprise с оплатой за место. Кроме того, каждому подписчику выдали сброс лимита, который можно сохранить и потратить в любой момент, например в день большого рефакторинга.

Если у вас продукт на API

Порядок действий на ближайшую неделю выглядит так:

  1. Прогнать интеграцию с Opus 5.5 на тестовом контуре и найти все места, где код отключает thinking, форсирует вызов инструмента или переиспользует блоки размышлений. Это четыре гарантированные четырёхсотки.
  2. Проверить парсинг ответов: текст между вызовами инструментов переехал в thinking-блоки и по умолчанию приходит пустым.
  3. Замерить стоимость своей типовой задачи на старой и новой моделях — не по прайсу, а по фактическому расходу токенов.
  4. Пересобрать промпты под кэш: у обеих компаний скидка на чтение кэша теперь такова, что стабильный префикс промпта экономит больше, чем выбор модели.

И не принимайте решение по таблицам вендоров: обе компании сравнивают себя с чужим прошлым поколением, а независимые замеры расставят Opus 5.5 и GPT-6 Sol по местам только в ближайшие недели.

Частые вопросы

Q.Сколько теперь стоят Claude Opus 5.5 и GPT-6 Sol в API?

Opus 5.5 — $4 за миллион входных токенов и $20 за миллион выходных (было $5 и $25 у Opus 5), чтение кэша — $0,20 вместо $0,50. GPT-6 Sol — $2 и $10 за миллион (было $4 и $20 у GPT-5.6 Sol), чтение кэшированных входных токенов — $0,20. Самый дешёвый вариант у OpenAI — Luna по $0,10 и $0,50 за миллион.

Q.Что сломается при переходе на Opus 5.5?

Четыре вещи возвращают ошибку 400: попытка отключить thinking, tool_choice со значением any или tool, повторная отправка блока размышлений после изменения системного промпта или набора инструментов, объявление старого инструмента computer_20251124. Плюс текст между вызовами инструментов переехал в блоки thinking и по умолчанию приходит пустым — это ломается молча.

Q.Какая модель лучше — Opus 5.5 или GPT-6 Sol?

Прямых сравнений пока нет. Все бенчмарки OpenAI сделаны против Claude Opus 5, потому что Opus 5.5 вышла за считанные часы до анонса. Ориентироваться стоит не на таблицы вендоров, а на замер стоимости и качества вашей собственной типовой задачи.

Q.Нужно ли что-то делать, если я просто пишу код в Claude Code или Copilot?

Нет, обновления приезжают сами: Opus 5.5 доступна в Claude Code и приложениях Claude, GPT-6 Sol и Luna — в Codex и GitHub Copilot (Sol в планах Pro+, Max, Business, Enterprise; Luna ещё и в Pro). Выкатка постепенная, поэтому у части аккаунтов модели появятся с задержкой.

Q.Что изменилось для подписчиков Claude Pro и Max?

Anthropic увеличила пятичасовые лимиты использования на тарифах Pro, Max, Team и Enterprise с оплатой за место и выдала подписчикам сброс лимита, который можно сохранить и использовать когда угодно. Opus 5.5 доступна в приложениях Claude и в Claude Code.

Q.Когда выйдут Claude Sonnet 5.5 и Haiku 5.5?

Anthropic обещает их в ближайшие недели после Opus 5.5, с теми же улучшениями в скорости, стоимости и безопасности. Точных дат компания не назвала.

Источники

Предыдущая
Amazon заблокировал ИИ-агента Meta: Muse отрезали от магазина через 13 дней после запуска

Читайте также

Фотореалистичный вечерний кадр с уровня тротуара: небольшой колёсный робот с плетёной корзинкой для покупок остановился на мокрой после дождя мостовой перед закрытой стеклянной дверью магазина, вход изнутри перегорожен стойками с лентой, за стеклом красный знак «вход запрещён» и светятся полки с товарами — иллюстрация к новости о том, как Amazon заблокировал ИИ-агента Meta Muse. Иллюстрация сгенерирована ИИ.Cyber News
22 сентября 2026 г.

Amazon заблокировал ИИ-агента Meta: Muse отрезали от магазина через 13 дней после запуска

В ночь на 21 сентября Amazon технически отрезал персонального ИИ-агента Meta Muse от своего магазина: агент не представлялся, пришёл без договорённости и, по версии площадки, трогал учётные данные покупателей. Разбираем претензии сторон, решение Девятого округа по делу Amazon против Perplexity — и что из этого следует для владельцев сайтов и магазинов.

Читать →
Крупный план процессорного пакета ИИ-ускорителя с шестью стеками памяти на антистатическом мате лабораторного стола; на заднем плане в расфокусе мониторы с исходным кодом и временными диаграммами. Иллюстрация, изображение не отражает реальный продукт.Cyber News
21 сентября 2026 г.

Как OpenAI проектировала чип Jalapeño своими же моделями: 9 месяцев от RTL до кремния и команда меньше 100 человек

IEEE Spectrum разобрал, что конкретно делали языковые модели при разработке первого ускорителя OpenAI. Вместо маркетинга — названные цифры: +56% к умножителю BF16, ядро DeepSeek с 0,31% до 88,94% потолка за 40 часов и ставка на открытый XLS вместо Verilog.

Читать →
Крупный план рабочего места разработчика: на мониторе график частоты запросов к API упирается в горизонтальную границу лимита, рядом терминал с логами, в расфокусе сетевой коммутатор и серверная стойка. Иллюстрация · изображение сгенерировано ИИ.Cyber News
18 сентября 2026 г.

GitLab.com переводит лимиты API на тарифы: неавторизованным — 60 запросов в час вместо 500 в минуту

GitLab перестраивает лимиты запросов на GitLab.com: вместо единой планки — квоты по тарифам, а неавторизованный трафик падает с 500 запросов в минуту до 60 в час. Free и запросы без токена переводят 19 октября, Premium и Ultimate — в январе 2027-го. Разбираем новые цифры, brownout-окна и чек-лист подготовки.

Читать →