Cloudflare объявила о начале предоставления WriteGuard в рамках частной бета-версии для своих шлюзов серверов MCP, чтобы обеспечить централизованный уровень контроля действий, выполняемых агентами на базе искусственного интеллекта. Инструмент объединяет политики инструментов, идентичность пользователя и агента, привязку операций к их источнику и централизованный аудит, что позволяет пропустить запрос, дополнить его метаданными или заблокировать до запуска обработчика, отвечающего за его выполнение.
Проблема, на решение которой нацелен WriteGuard
Cloudflare приводит сценарий, в котором тикеты об ошибках начинают закрываться с ускоренными темпами, тогда как в журналах выглядит так, будто все операции выполняет один и тот же инженер. В этом примере у инженера было несколько агентов, работавших в параллельных сеансах, и один из них запустил задачу очистки со слишком широкой областью действия. На определение ответственного агента ушло полчаса. Кроме того, исправление состояния системы тикетов стало сложнее, поскольку ручные изменения и изменения, внесённые агентами, записывались на имя одного и того же инженера, а сетевые журналы не различали разные сеансы агентов.
Cloudflare считает, что в других системах риски могут быть ещё выше: агент с доступом к программам для работы с договорами может изменить соглашение, отправить сотни ответов клиентам через систему поддержки или удалить целые таблицы из базы данных. Поэтому компания не хотела полагаться на способность каждого сотрудника правильно настроить каждого агента или отслеживать каждый вызов инструмента.
Роль MCP во внутренней архитектуре
Аббревиатура MCP расшифровывается как Model Context Protocol — стандарт, используемый для подключения приложений искусственного интеллекта к внешним инструментам и источникам данных. Сервер MCP предоставляет инструменты, которыми могут пользоваться подключённые клиенты; у каждого инструмента есть имя, описание, схема входных данных и обработчик, выполняющий задачу. Когда агент выбирает инструмент, клиент MCP отправляет его вызов на сервер, который, в свою очередь, взаимодействует с последующим приложением или системой.
Cloudflare использует серверы MCP во внутренней инфраструктуре, поддерживающей её внутренних агентов, через локальные клиенты, такие как OpenCode и Cloudflare OS, а также через долгоживущие сервисы агентов. Эти серверы работают за Cloudflare Access, а доступ к ним осуществляется через единый внутренний шлюз серверов MCP. В апреле, когда компания описывала свою внутреннюю архитектуру для разработки искусственного интеллекта, шлюз объединял 13 серверов. К моменту публикации материала их число выросло до 27, при этом команды продолжают запускать новые серверы каждый месяц.
От режима только для чтения к выполнению действий
Изначально серверы работали в режиме только для чтения, что позволяло командам искать информацию в Jira, GitLab, вики, операционных системах и других системах и просматривать её без внесения изменений. По мере совершенствования моделей и накопления командами опыта использования искусственного интеллекта сотрудники инженерных, продуктовых, дизайнерских команд, отделов продаж и клиентского успеха начали запрашивать инструменты, способные выполнять действия.
Перед расширением прав на запись Cloudflare хотела централизованно контролировать действия записи, которые могут выполнять агенты, отображать метки агентов в последующих приложениях и создавать аудиторский маршрут, упрощающий расследование их активности. Компания утверждает, что клиентские средства контроля, такие как навыки или уточняющие запросы, не обеспечивают достаточной основы, поскольку их поведение различается в зависимости от среды выполнения, а пользователи могут их отключить.
Централизованные политики, привязка и аудит
WriteGuard использует настройки каждого инструмента и контекст запроса для определения подходящего действия. Он может пропустить вызов без изменений, добавить данные о привязке агента к поддерживаемым операциям записи и создать событие аудита, очищенное от ненужных данных, либо заблокировать действие до запуска его обработчика.
Инструмент позволяет определять политику рядом с каждым инструментом без изменения базового сервера MCP. Каждому инструменту назначаются уровень риска, статус включения или отключения и настройки маркировки. Уровни риска определяют, будет ли действие записано и разрешён ли вызов инструмента, а также позволяют выполнять запросы к журналу аудита по уровню риска. Настройки маркировки позволяют добавлять данные о привязке агента и выбирать текстовый формат, наиболее подходящий для последующего приложения, без необходимости вносить программные изменения в сам сервер MCP.
Cloudflare уточняет, что текущая версия доступна в формате частной бета-версии для шлюзов серверов MCP, а источник не сообщил сроков общего доступа или дополнительных подробностей о пределах доступности.