Claude Managed Agents — это набор API для создания и развёртывания агентов в масштабе. Вы определяете агентов с конкретными инструментами, персоналиями и возможностями. Настраиваете песочницы с нужными пакетами и сетевыми ограничениями. Затем запускаете сеансы из собственного приложения, а Claude выполняет работу внутри изолированного контейнера с полным доступом к файловой системе, возможностью выполнения bash и веб-поиском.
Цикл агента, который обслуживается за вас
В основе лежит цикл агента: Claude рассуждает, вызывает инструмент, считывает результат и повторяет, пока задача не будет выполнена. Если вы уже создавали агентов, то, вероятно, писали такой цикл самостоятельно. Managed Agents берёт этот цикл и размещает его на инфраструктуре Anthropic, чтобы вам не пришлось запускать его самому.
Найти Managed Agents можно в отдельном разделе в Claude Console.
Лучший способ понять, что это открывает, — разобрать несколько примеров.
Пример 1: Канбан-доска, которая выполняет работу
Представьте Канбан-доску, подключённую к управляемым агентам. Вы перетаскиваете задачу в колонку «В работе», и это автоматически запускает сеанс. Допустим, задача звучит так: «оптимизировать производительность сайта». Вот что происходит:
- Ваша бэкенд-система создаёт сеанс.
- Сеанс ссылается на среду, которую вы настроили с заранее установленными Lighthouse и Puppeteer.
- Репозиторий GitHub монтируется в контейнер.
Теперь у Claude есть кодовая база, инструменты и критерии, определяющие, что такое «готово»:
- Оценка Lighthouse выше 90
- Нет блокирующих ресурсов
- Все изображения загружаются по требованию
Claude запускает аудит, затем начинает сжимать изображения, встраивать CSS и откладывать скрипты. Каждый вызов инструмента транслируется на доску в реальном времени через поток событий, так что вы можете наблюдать за процессом.
Затем подключается критерий. Отдельный проверяющий, работающий в собственном контекстном окне, оценивает результат по вашим требованиям. Claude считывает эту обратную связь, возвращается и исправляет упущения, затем отправляет результат повторно. На демо эта петля поднимает оценку Lighthouse до 96.
Ещё один момент: вы можете перетащить вторую задачу, пока первая ещё выполняется. Два сеанса, два контейнера, две отдельные задачи работают параллельно.
Пример 2: Регулярный исследовательский агент с памятью
Вот другой тип агента: его задача — отслеживать цены и изменения планов для всех SaaS-инструментов, за которые платит ваша компания, и готовить отчёт к утреннему стендапу.
На каждом запуске агент:
- Ищет в интернете текущие страницы с ценами, проверяет изменения тарифных планов и отмечает новые функции, которые могут повлиять на ваши контракты
- Выполняет анализ затрат на Python внутри песочницы
- Использует навык работы с Excel и составляет краткое резюме для руководства
- Публикует ссылку в Slack и создаёт задачу на проверку в Asana, используя MCP-серверы
Агент также считывает данные и записывает их в хранилище памяти. Перед началом он проверяет, что нашёл на прошлой неделе. После завершения сохраняет изменения. Так отчёт в следующий понедельник может звучать так: «стоимость вычислений на 15% ниже, чем на прошлой неделе», вместо того чтобы перечислять одни и те же статические данные о ценах каждый раз.
Пример 3: Реагирование на инциденты с несколькими агентами
Теперь представьте, что срабатывает оповещение из вашей системы мониторинга. Кастомный инструмент в вашем бэкенде получает полезную нагрузку оповещения и отправляет её в новый сеанс в качестве результата инструмента. Этот сеанс использует координацию между несколькими агентами:
- Координирующий агент получает оповещение и делегирует задачу трём специалистам.
- Каждый специалист работает в собственном контекстном окне на общей файловой системе.
- Специалисты отчитываются, а координатор синтезирует их выводы в единое резюме инцидента.
Перед тем как резюме отправится в Slack, срабатывает политика разрешений. Вы видите черновик на экране, одобряете его, и сообщение уходит. Конфиденциальные действия ждут подтверждения от человека.
Память связывает всё это воедино. Координатор проверяет прошлые инциденты в хранилище памяти и отмечает закономерность: «это похоже на проблему с разрешением DNS двухнедельной давности, вызванную неправильно настроенным TTL». В следующий раз, когда сработает похожее оповещение, агент начнёт с этого контекста, а не станет диагностировать с нуля.
Строительные блоки
Во всех этих примерах Managed Agents предоставляет разработчикам инструменты для создания полностью управляемого, сохраняющего состояние опыта работы с агентами на основе:
- Агентов — определений с конкретными инструментами, персоналиями и возможностями
- Сеансов — отдельных запусков, которые вы инициируете из собственного приложения
- Среды — песочниц с нужными пакетами и сетевыми ограничениями
- Инструментов — включая кастомные инструменты в вашем бэкенде
- MCP — подключения к сервисам вроде Slack и Asana
- Памяти — хранилища, из которого агент считывает данные перед началом и записывает по завершении
- Результатов — критериев и проверяющих, которые определяют и контролируют, что такое «готово»
- Координации между несколькими агентами — координаторы делегируют задачу специалистам
Итоги
- Claude Managed Agents — это набор API для создания и развёртывания агентов в масштабе, размещённый на инфраструктуре Anthropic.
- Он выполняет знакомый цикл агента — рассуждение, вызов инструмента, считывание результата, повторение — внутри изолированного контейнера с доступом к файловой системе, возможностью выполнения bash и веб-поиском.
- Сеансы работают в средах, которые вы настраиваете, выполняются параллельно и транслируют вызовы инструментов в ваше приложение в реальном времени.
- Критерии и отдельные проверяющие позволяют задать критерии успеха; Claude итеративно работает, пока не достигнет их.
- Память, MCP-серверы, кастомные инструменты, политики разрешений и координация между несколькими агентами дополняют возможности сохраняющего состояние опыта работы с агентами.
- Вы определяете, что такое «готово». Claude работает, пока не достигнет этого.
Claude Managed Agents is a suite of APIs for building and deploying agents at scale. You define agents with specific tools, personas, and capabilities. You configure sandbox environments with the right packages and network controls. Then you fire off sessions from your own application, and Claude does the work inside an isolated container with full file system access, bash execution, and web search.
The agent loop, hosted for you
Under the hood, this is an agent loop: Claude reasons, calls a tool, reads the result, and repeats until the job is done. If you've built agents before, you've probably written this kind of loop yourself. Managed agents takes that same loop and hosts it on Anthropic's infrastructure, so you don't have to run it.
You'll find Managed Agents in its own section of the Claude Console.
The best way to understand what this unlocks is to walk through a few examples.
Example 1: A Kanban board that does the work
Picture a Kanban board sitting on top of managed agents. You drag a ticket into the "in progress" column, and that fires off a session automatically. Say the ticket reads "optimize website performance." Here's what happens:
- Your back end creates a session.
- The session points to an environment you configured with Lighthouse and Puppeteer pre-installed.
- Your GitHub repo gets mounted into the container.
Now Claude has the codebase, the tools, and a rubric that defines what done looks like:
- Lighthouse score above 90
- No render-blocking resources
- All images lazy loaded
Claude runs the audit, then starts compressing images, inlining CSS, and deferring scripts. Every tool call streams back to the board in real time through the event stream, so you can watch the work as it happens.
Then the rubric kicks in. A separate grader, running in its own context window, evaluates the output against your criteria. Claude reads that feedback, goes back in, fixes what it missed, and resubmits. In the demo, that loop takes the Lighthouse score up to 96.
One more thing: you can drag a second ticket over while the first is still running. Two sessions, two containers, two separate tasks running in parallel.
Example 2: A recurring research agent with memory
Here's a different shape of agent: one whose job is to track prices and plan changes across every SaaS tool your company pays for, with a report ready before stand-up.
On each run, the agent:
- Searches the web for current pricing pages, checks for plan tier changes, and flags new features that might affect your contracts
- Runs a cost analysis in Python inside the sandbox
- Uses an Excel spreadsheet skill and writes an executive summary
- Posts a link to Slack and creates a review task in Asana, both through MCP servers
The agent also reads from and writes to a memory store. Before it starts, it checks what it found last week. After it finishes, it stores what changed. So next Monday's report can say "compute costs are 15% lower since last week" instead of listing the same static pricing data every time.
Example 3: Incident response with multiple agents
Now imagine an alert fires from your monitoring stack. A custom tool on your back end receives the alert payload and sends it into a new session as a tool result. This session uses multi-agent coordination:
- A coordinator agent receives the alert and delegates to three specialists.
- Each specialist runs in its own context window on the same shared file system.
- The specialists report back, and the coordinator synthesizes their findings into a single incident summary.
Before the summary goes to Slack, the permissions policy fires. You see the draft on screen, approve it, and the message goes out. Sensitive actions wait for a human.
Memory ties all of this together. The coordinator checks past incidents in the memory store and flags a pattern: "this looks like the DNS resolution issue from two weeks ago that was caused by a misconfigured TTL." The next time a similar alert fires, the agent starts with that context instead of diagnosing from scratch.
The building blocks
Across these examples, managed agents gives developers the tools to deliver a fully managed, stateful agent experience built on:
- Agents — definitions with specific tools, personas, and capabilities
- Sessions — individual runs you fire off from your own application
- Environments — sandboxes with the right packages and network controls
- Tools — including custom tools on your back end
- MCP — connections to services like Slack and Asana
- Memory — a store the agent reads before starting and writes to when done
- Outcomes — rubrics and graders that define and check what done looks like
- Multi-agent coordination — coordinators delegating to specialists
Recap
- Claude Managed Agents is a suite of APIs for building and deploying agents at scale, hosted on Anthropic's infrastructure.
- It runs the familiar agent loop — reason, call a tool, read the result, repeat — inside an isolated container with file system access, bash execution, and web search.
- Sessions run in environments you configure, work in parallel, and stream tool calls back to your app in real time.
- Rubrics and separate graders let you define success criteria; Claude iterates until it meets them.
- Memory, MCP servers, custom tools, permissions policies, and multi-agent coordination round out the stateful agent experience.
- You define what done looks like. Claude works until it gets there.