Cyber News

Agent Harness и Hosted Agents стали общедоступны: Microsoft делает ставку на рантайм для ИИ-агентов

M
Markabus
·
Фотореалистичный кадр из-за плеча разработчика в затемнённом офисе: на большом мониторе — панель наблюдаемости с каскадом трассировок в бирюзовых, янтарных и фиолетовых полосах, графиком и списком задач, на втором экране справа — код с подсветкой синтаксиса; на столе клавиатура, кружка и витой кабель — к новости о выходе Microsoft Agent Harness и Foundry Hosted Agents в общий доступ

Microsoft перевела в статус общей доступности (general availability, GA — «общедоступный релиз без ограничений») два ключевых компонента своей платформы для ИИ-агентов: Agent Harness и Foundry Hosted Agents. Оба были показаны на конференции Build 2026 в начале июня, несколько месяцев обкатывались в предварительных сборках, а к концу июля — началу августа получили метку «стабильно» и готовность к продакшену. Это не громкий анонс новой модели, но для тех, кто реально строит агентов, событие важнее: Microsoft фактически признала, что самое сложное в агенте — не «мозги», а вся инженерная обвязка вокруг них.

Что такое Microsoft Agent Framework

Чтобы понять новость, нужен контекст. Microsoft Agent Framework (MAF) — это открытый фреймворк для создания и оркестрации ИИ-агентов на .NET и Python. Он появился как слияние двух предыдущих проектов компании: Semantic Kernel (промышленный SDK для внедрения языковых моделей в приложения) и AutoGen (исследовательский фреймворк для мультиагентных сценариев). Долгое время они существовали параллельно и путали разработчиков — какой из двух брать под конкретную задачу. В феврале 2026 объединённый фреймворк дошёл до релиз-кандидата, а 2 апреля вышла версия 1.0.

MAF умеет работать поверх множества провайдеров моделей — Microsoft Foundry, Azure OpenAI, OpenAI, Anthropic Claude, AWS Bedrock, Ollama и других, — и поддерживает открытые стандарты взаимодействия: MCP (Model Context Protocol — протокол подключения моделей к инструментам), Agent-to-Agent (A2A) и AG-UI. Пакеты доступны в NuGet (Microsoft.Agents.AI для .NET) и в PyPI (agent-framework для Python). Всё это уже было в апрельском релизе. Августовская новость — про другое: про среду исполнения, в которой агент живёт в бою.

Agent Harness: 98% агента — это не модель

Главный тезис Microsoft звучит почти провокационно. По оценке, которую компания приводит в анонсе, около 98,4% кода работающего агента — это не логика принятия решений, а «обвязка» (harness): управление контекстом, права доступа, история вызовов, компакция, наблюдаемость. Сама модель — маленькое ядро, а всё остальное приходится писать руками заново в каждом проекте. Именно эту рутину и берёт на себя Agent Harness — поддерживаемый рантайм (runtime — среда исполнения), который превращает «модель с промптом» в управляемый производственный сервис.

В стабильную версию вошли девять возможностей, включённых по умолчанию:

  • Вызов функций с настраиваемым лимитом итераций — агент дёргает ваш код по структурированным параметрам, но не уходит в бесконечный цикл.
  • Персистентность истории — состояние сохраняется после каждого обращения к модели, а не только в конце сессии.
  • Компакция контекста (context compaction — сжатие истории диалога) для длинных циклов, чтобы не упереться в лимит окна.
  • Списки задач с режимами plan/execute — агент сначала строит план, потом выполняет по пунктам.
  • Файловая память — заметки сессии переживают отдельные ходы диалога.
  • Навыки (skills) с постепенным раскрытием — агент подгружает инструкции по мере надобности, а не держит всё в контексте сразу.
  • Встроенный веб-поиск как готовый инструмент.
  • Одобрение инструментов (tool approval) — с постоянными правилами и эвристическим авто-подтверждением безопасных действий.
  • Телеметрия OpenTelemetry — трассировка «из коробки», без ручной инструментовки.

Что пока держат в превью

Четыре функции сознательно оставили за пределами GA и пометили как «скоро»: выполнение shell-команд, доступ к файловой системе, фоновые под-агенты и автоматическое зацикливание. Они остаются в статусе alpha/preview и при включении выдают предупреждение. Логика понятна: именно эти четыре возможности — самые мощные и самые опасные, поэтому Microsoft не спешит объявлять их «продакшен-готовыми», пока не отладит модель безопасности.

Foundry Hosted Agents: оплата по потреблению и «до нуля»

Второй компонент — Foundry Hosted Agents — отвечает за хостинг. Это управляемая среда, где агент запускается без забот о серверах. Ключевая особенность — биллинг по потреблению: платят за vCPU-час и ГиБ-час, ставка зависит от региона. Предлагаются три фиксированных размера песочницы: 0,5 vCPU / 1 ГБ, 1 vCPU / 2 ГБ и 2 vCPU / 4 ГБ.

Самое важное для экономики — масштабирование до нуля (scale to zero): простаивающий агент не стоит ничего, а его файловая система сохраняется и восстанавливается при следующем запуске. Для агентных сценариев, где нагрузка рваная (то шквал запросов, то часы тишины), это принципиально иная модель, чем классический сервер, который тикает по счётчику круглосуточно. Наблюдаемость подключается автоматически: телеметрия уходит в Application Insights без дополнительной настройки.

Мост к чужим агентам: Copilot SDK и Claude Agent SDK

Отдельно Microsoft довела до стабильности коннекторы к внешним агентным SDK. Теперь MAF может делегировать оркестрацию GitHub Copilot SDK или Claude Agent SDK «без кастомных адаптеров». То есть команда, у которой часть агентов написана на инструментарии Anthropic или на кодовом ассистенте GitHub, может собрать их под единой крышей MAF.

Принципиальный момент — управляемость: по формулировке анонса, коннекторы «соблюдают идентичность, контент-безопасность и политики наблюдаемости, уже заданные для всего флота» агентов. Иными словами, чужой агент, подключённый через коннектор, играет по правилам вашей платформы, а не приносит свои. Это укладывается в общий тренд, о котором мы писали раньше: главным вопросом становится не что агенты умеют, а кто их контролирует. Сам протокол MCP, лежащий в основе таких подключений, тоже на глазах взрослеет и упирается в безопасность.

CodeAct и безопасность циклов: цифры

Вместе с релизом Microsoft показала экспериментальный режим CodeAct — вместо серии отдельных вызовов инструментов модель генерирует одну Python-программу, которая делает всё разом. По внутреннему бенчмарку компании это дало на 52,4% быстрее (13,23 против 27,81 секунды) и на 63,9% меньше токенов (2 489 против 6 890) на репрезентативной задаче. Оговорка важна: тест проведён самим вендором, а CodeAct пока в статусе alpha — цифры стоит воспринимать как ориентир, а не гарантию.

Куда показательнее другой замер — про безопасность. На тесте на «убегающие циклы» (runaway safety) сам Agent Framework останавливался после 40 обходов цикла, тогда как GitHub Copilot SDK доходил до 300 без самостоятельной остановки. Это не «плохой Copilot против хорошего MAF», а иллюстрация того, где именно живёт защита: в архитектуре обвязки, а не в модели. Тот, кто пишет harness сам, отвечает и за такие ограничители — и легко про них забывает.

Почему это важно

Ценность новости — в смене философии. MAF эволюционировал «из библиотеки, которой строят агентов, в управляемую платформу, на которой их запускают». Для разработчика это значит меньше велосипедостроения: сохранение состояния, компакцию контекста, одобрение действий и трассировку больше не нужно писать под каждый проект — они есть в рантайме. Для бизнеса — предсказуемость: единые политики безопасности и идентичности поверх агентов от разных поставщиков плюс модель оплаты, при которой простой не съедает бюджет.

Стратегически Microsoft застолбила слой, который часто недооценивают. Пока индустрия спорит о том, чья модель умнее, компания сделала ставку на то, что в реальном продакшене выигрывает не самый умный агент, а самый управляемый. И судя по тому, что «мозги» — это меньше двух процентов кода, ставка выглядит трезвой.

Частые вопросы

Q.Что такое Agent Harness простыми словами?

Это поддерживаемый рантайм — среда исполнения, которая берёт на себя всю инженерную «обвязку» агента: сохранение истории, сжатие контекста, одобрение действий, телеметрию. По оценке Microsoft, на такую обвязку приходится около 98% кода реального агента, тогда как сама модель — небольшое ядро.

Q.Сколько стоят Foundry Hosted Agents?

Оплата по потреблению — за vCPU-час и ГиБ-час, ставка зависит от региона. Доступны три размера песочницы (от 0,5 vCPU / 1 ГБ до 2 vCPU / 4 ГБ). Простаивающий агент масштабируется до нуля и не тарифицируется, а его файловая система сохраняется до следующего запуска.

Q.Можно ли подключить агентов на Claude или GitHub Copilot?

Да. В стабильную версию вошли коннекторы к Claude Agent SDK и GitHub Copilot SDK: MAF делегирует им оркестрацию без кастомных адаптеров, при этом подключённые агенты соблюдают единые политики идентичности, контент-безопасности и наблюдаемости.

Q.На чём писать агентов — .NET или Python?

Поддерживаются оба. Пакеты доступны в NuGet (Microsoft.Agents.AI) и в PyPI (agent-framework). Фреймворк объединил прежние Semantic Kernel и AutoGen; версия 1.0 вышла 2 апреля 2026 года.

Источники

Предыдущая
Terafab: Tesla и SpaceX подтвердили завод чипов за $16,8 млрд — Маск строит собственный кремний
Следующая
Cloudflare открыла исходники Cloudflare OS: рабочее место для ИИ-агентов, которое компания использует сама

Читайте также

Ноутбук на тёмном рабочем столе разработчика: на экране терминал с выводом менеджера пакетов, рядом клавиатура с подсветкой и внешний SSD. Иллюстрация · изображение сгенерировано ИИCyber News
14 сентября 2026 г.

Homebrew 7.0.0: встроенный сканер уязвимостей, графическое приложение и понижение Intel-маков до Tier 3

13 сентября вышел первый за полтора года мажорный релиз Homebrew: команда brew vulns проверяет пакеты по базе OSV, появилось приложение BrewUI, установка стала параллельной. Intel-маки переведены в третий уровень поддержки — запуск на них отключат в сентябре 2027-го.

Читать →
Крупный план рабочего места разработчика в тёмной графитовой комнате: на большом мониторе запущенная терминальная сессия с логами и редактор кода с подсветкой синтаксиса, позади — второй экран с панелями мониторингаCyber News
11 сентября 2026 г.

OpenAI открыла Agents API: обвязка Codex доступна через один вызов, песочницы — в комплекте

10 сентября OpenAI выпустила Agents API в публичной бете: управляющий слой Codex, долгоживущие сессии, автоматическая компактация контекста, субагенты, MCP и хостируемые песочницы. Разбираем, что это меняет для разработчиков, сколько стоят контейнеры и почему бета пока не подойдёт части команд.

Читать →
Двое инженеров у большого настенного экрана с панелями код-ревью и статусами сборок в тёмной переговорной; на переднем плане коллега с ноутбуком. Иллюстрация · изображение сгенерировано ИИ.Cyber News
10 сентября 2026 г.

Cognition привлекла более $2 млрд при оценке $48 млрд: выручка создателя Devin почти удвоилась за четыре месяца

Разработчик ИИ-агента Devin и владелец Windsurf закрыл раунд Series E на сумму свыше $2 млрд при оценке $48 млрд — почти вдвое больше майской. Ещё показательнее выручка: run-rate вырос с $492 млн до почти $900 млн за четыре месяца. Разбираем, что нового в самом Devin и что это значит для команд.

Читать →