Cyber News

Agent Harness и Hosted Agents стали общедоступны: Microsoft делает ставку на рантайм для ИИ-агентов

M
Markabus
·8 августа 2026 г.
Фотореалистичный кадр из-за плеча разработчика в затемнённом офисе: на большом мониторе — панель наблюдаемости с каскадом трассировок в бирюзовых, янтарных и фиолетовых полосах, графиком и списком задач, на втором экране справа — код с подсветкой синтаксиса; на столе клавиатура, кружка и витой кабель — к новости о выходе Microsoft Agent Harness и Foundry Hosted Agents в общий доступ

Microsoft перевела в статус общей доступности (general availability, GA — «общедоступный релиз без ограничений») два ключевых компонента своей платформы для ИИ-агентов: Agent Harness и Foundry Hosted Agents. Оба были показаны на конференции Build 2026 в начале июня, несколько месяцев обкатывались в предварительных сборках, а к концу июля — началу августа получили метку «стабильно» и готовность к продакшену. Это не громкий анонс новой модели, но для тех, кто реально строит агентов, событие важнее: Microsoft фактически признала, что самое сложное в агенте — не «мозги», а вся инженерная обвязка вокруг них.

Что такое Microsoft Agent Framework

Чтобы понять новость, нужен контекст. Microsoft Agent Framework (MAF) — это открытый фреймворк для создания и оркестрации ИИ-агентов на .NET и Python. Он появился как слияние двух предыдущих проектов компании: Semantic Kernel (промышленный SDK для внедрения языковых моделей в приложения) и AutoGen (исследовательский фреймворк для мультиагентных сценариев). Долгое время они существовали параллельно и путали разработчиков — какой из двух брать под конкретную задачу. В феврале 2026 объединённый фреймворк дошёл до релиз-кандидата, а 2 апреля вышла версия 1.0.

MAF умеет работать поверх множества провайдеров моделей — Microsoft Foundry, Azure OpenAI, OpenAI, Anthropic Claude, AWS Bedrock, Ollama и других, — и поддерживает открытые стандарты взаимодействия: MCP (Model Context Protocol — протокол подключения моделей к инструментам), Agent-to-Agent (A2A) и AG-UI. Пакеты доступны в NuGet (Microsoft.Agents.AI для .NET) и в PyPI (agent-framework для Python). Всё это уже было в апрельском релизе. Августовская новость — про другое: про среду исполнения, в которой агент живёт в бою.

Agent Harness: 98% агента — это не модель

Главный тезис Microsoft звучит почти провокационно. По оценке, которую компания приводит в анонсе, около 98,4% кода работающего агента — это не логика принятия решений, а «обвязка» (harness): управление контекстом, права доступа, история вызовов, компакция, наблюдаемость. Сама модель — маленькое ядро, а всё остальное приходится писать руками заново в каждом проекте. Именно эту рутину и берёт на себя Agent Harness — поддерживаемый рантайм (runtime — среда исполнения), который превращает «модель с промптом» в управляемый производственный сервис.

В стабильную версию вошли девять возможностей, включённых по умолчанию:

  • Вызов функций с настраиваемым лимитом итераций — агент дёргает ваш код по структурированным параметрам, но не уходит в бесконечный цикл.
  • Персистентность истории — состояние сохраняется после каждого обращения к модели, а не только в конце сессии.
  • Компакция контекста (context compaction — сжатие истории диалога) для длинных циклов, чтобы не упереться в лимит окна.
  • Списки задач с режимами plan/execute — агент сначала строит план, потом выполняет по пунктам.
  • Файловая память — заметки сессии переживают отдельные ходы диалога.
  • Навыки (skills) с постепенным раскрытием — агент подгружает инструкции по мере надобности, а не держит всё в контексте сразу.
  • Встроенный веб-поиск как готовый инструмент.
  • Одобрение инструментов (tool approval) — с постоянными правилами и эвристическим авто-подтверждением безопасных действий.
  • Телеметрия OpenTelemetry — трассировка «из коробки», без ручной инструментовки.

Что пока держат в превью

Четыре функции сознательно оставили за пределами GA и пометили как «скоро»: выполнение shell-команд, доступ к файловой системе, фоновые под-агенты и автоматическое зацикливание. Они остаются в статусе alpha/preview и при включении выдают предупреждение. Логика понятна: именно эти четыре возможности — самые мощные и самые опасные, поэтому Microsoft не спешит объявлять их «продакшен-готовыми», пока не отладит модель безопасности.

Foundry Hosted Agents: оплата по потреблению и «до нуля»

Второй компонент — Foundry Hosted Agents — отвечает за хостинг. Это управляемая среда, где агент запускается без забот о серверах. Ключевая особенность — биллинг по потреблению: платят за vCPU-час и ГиБ-час, ставка зависит от региона. Предлагаются три фиксированных размера песочницы: 0,5 vCPU / 1 ГБ, 1 vCPU / 2 ГБ и 2 vCPU / 4 ГБ.

Самое важное для экономики — масштабирование до нуля (scale to zero): простаивающий агент не стоит ничего, а его файловая система сохраняется и восстанавливается при следующем запуске. Для агентных сценариев, где нагрузка рваная (то шквал запросов, то часы тишины), это принципиально иная модель, чем классический сервер, который тикает по счётчику круглосуточно. Наблюдаемость подключается автоматически: телеметрия уходит в Application Insights без дополнительной настройки.

Мост к чужим агентам: Copilot SDK и Claude Agent SDK

Отдельно Microsoft довела до стабильности коннекторы к внешним агентным SDK. Теперь MAF может делегировать оркестрацию GitHub Copilot SDK или Claude Agent SDK «без кастомных адаптеров». То есть команда, у которой часть агентов написана на инструментарии Anthropic или на кодовом ассистенте GitHub, может собрать их под единой крышей MAF.

Принципиальный момент — управляемость: по формулировке анонса, коннекторы «соблюдают идентичность, контент-безопасность и политики наблюдаемости, уже заданные для всего флота» агентов. Иными словами, чужой агент, подключённый через коннектор, играет по правилам вашей платформы, а не приносит свои. Это укладывается в общий тренд, о котором мы писали раньше: главным вопросом становится не что агенты умеют, а кто их контролирует. Сам протокол MCP, лежащий в основе таких подключений, тоже на глазах взрослеет и упирается в безопасность.

CodeAct и безопасность циклов: цифры

Вместе с релизом Microsoft показала экспериментальный режим CodeAct — вместо серии отдельных вызовов инструментов модель генерирует одну Python-программу, которая делает всё разом. По внутреннему бенчмарку компании это дало на 52,4% быстрее (13,23 против 27,81 секунды) и на 63,9% меньше токенов (2 489 против 6 890) на репрезентативной задаче. Оговорка важна: тест проведён самим вендором, а CodeAct пока в статусе alpha — цифры стоит воспринимать как ориентир, а не гарантию.

Куда показательнее другой замер — про безопасность. На тесте на «убегающие циклы» (runaway safety) сам Agent Framework останавливался после 40 обходов цикла, тогда как GitHub Copilot SDK доходил до 300 без самостоятельной остановки. Это не «плохой Copilot против хорошего MAF», а иллюстрация того, где именно живёт защита: в архитектуре обвязки, а не в модели. Тот, кто пишет harness сам, отвечает и за такие ограничители — и легко про них забывает.

Почему это важно

Ценность новости — в смене философии. MAF эволюционировал «из библиотеки, которой строят агентов, в управляемую платформу, на которой их запускают». Для разработчика это значит меньше велосипедостроения: сохранение состояния, компакцию контекста, одобрение действий и трассировку больше не нужно писать под каждый проект — они есть в рантайме. Для бизнеса — предсказуемость: единые политики безопасности и идентичности поверх агентов от разных поставщиков плюс модель оплаты, при которой простой не съедает бюджет.

Стратегически Microsoft застолбила слой, который часто недооценивают. Пока индустрия спорит о том, чья модель умнее, компания сделала ставку на то, что в реальном продакшене выигрывает не самый умный агент, а самый управляемый. И судя по тому, что «мозги» — это меньше двух процентов кода, ставка выглядит трезвой.

Частые вопросы

Q.Что такое Agent Harness простыми словами?

Это поддерживаемый рантайм — среда исполнения, которая берёт на себя всю инженерную «обвязку» агента: сохранение истории, сжатие контекста, одобрение действий, телеметрию. По оценке Microsoft, на такую обвязку приходится около 98% кода реального агента, тогда как сама модель — небольшое ядро.

Q.Сколько стоят Foundry Hosted Agents?

Оплата по потреблению — за vCPU-час и ГиБ-час, ставка зависит от региона. Доступны три размера песочницы (от 0,5 vCPU / 1 ГБ до 2 vCPU / 4 ГБ). Простаивающий агент масштабируется до нуля и не тарифицируется, а его файловая система сохраняется до следующего запуска.

Q.Можно ли подключить агентов на Claude или GitHub Copilot?

Да. В стабильную версию вошли коннекторы к Claude Agent SDK и GitHub Copilot SDK: MAF делегирует им оркестрацию без кастомных адаптеров, при этом подключённые агенты соблюдают единые политики идентичности, контент-безопасности и наблюдаемости.

Q.На чём писать агентов — .NET или Python?

Поддерживаются оба. Пакеты доступны в NuGet (Microsoft.Agents.AI) и в PyPI (agent-framework). Фреймворк объединил прежние Semantic Kernel и AutoGen; версия 1.0 вышла 2 апреля 2026 года.

Источники

Предыдущая
Terafab: Tesla и SpaceX подтвердили завод чипов за $16,8 млрд — Маск строит собственный кремний

Читайте также

Фотореалистичный кадр чистой комнаты завода по производству полупроводников: техник в белом защитном комбинезоне у литографической установки, ряды технологического оборудования с зелёными и янтарными индикаторами уходят вглубь цеха; в углу пометка «Иллюстрация · изображение сгенерировано ИИ» — к новости о заводе Terafab компаний Tesla и SpaceXCyber News
8 августа 2026 г.

Terafab: Tesla и SpaceX подтвердили завод чипов за $16,8 млрд — Маск строит собственный кремний

Tesla и SpaceX официально выбрали площадку под Terafab — завод полупроводников в Техасе. Первая фаза оценивается в $16,8 млрд, а весь проект — это ставка Илона Маска на собственный кремний вместо зависимости от TSMC и Samsung. Разбираем, что подтвердили, для кого будут эти чипы и почему автопроизводитель вдруг строит фабрику размером с крупнейшее здание в мире.

Читать →
Крупный план реального монитора на столе разработчика: на экране — детальная админка интернет-магазина с сеткой товаров и графиками аналитики, рядом клавиатура и второй экран с кодом в мягком боке. Фотореалистичный редакционный кадр, тёмная графитовая среда с тёплым светом; насыщенный синий — внутри свечения интерфейса.Cyber News
6 августа 2026 г.

WooCommerce 11.0: кеширование товаров ускоряет магазин, а гостевые заказы привязываются к аккаунту

WooCommerce 11.0 вышла 4 августа: 551 pull request, кеширование объектов товаров ускоряет карточки на 9–12%, гостевые заказы теперь привязываются к аккаунту по email, а Action Scheduler обновлён до 4.0. Разбираем, что это даёт владельцам магазинов и на что смотреть разработчикам.

Читать →
Крупный план монитора на рабочем столе разработчика: экран с редактором кода и цветной подсветкой синтаксиса, тёплый свет настольной лампы, механическая клавиатура и кружка кофе в мягком расфокусе.Cyber News
5 августа 2026 г.

Python 3.15 RC1: ленивые импорты, UTF-8 по умолчанию и новый профайлер Tachyon

Вышел первый релиз-кандидат Python 3.15: ленивые импорты (PEP 810), UTF-8 по умолчанию, новые типы frozendict и sentinel, профайлер Tachyon и ускоренный JIT. Что изменилось и как готовиться к обновлению.

Читать →