All Articles
6 minUpdated

Можно ли собрать свой Meta Muse на Claude Sonnet 5.5 и MCP?

ИИ-агентыClaudeMCPАрхитектура

Короткий ответ: Claude Sonnet 5.5 вместе с MCP-серверами уже закрывает модель и слой инструментов Meta Muse. Рантайм вокруг них (шлюз политик, хранилище токенов, память, очередь задач, журнал аудита, защита от инъекций и изолированный браузер) по-прежнему пишете вы. В статье разобрана каждая часть и показан цикл, который их связывает.

Почему разработчикам стоит обратить внимание на эти запуски?

Два запуска разделяют три недели. 8 сентября 2026 года Meta анонсировала Muse, персонального агента, который ходит по сайтам, отправляет письма, делает покупки и работает после закрытия приложения. 28 сентября Anthropic выпустила Claude Sonnet 5.5 по цене 2 доллара за миллион входных токенов и 10 долларов за миллион выходных, с результатом 80,1% в тесте OSWorld 2.1 на работу с компьютером.

Если вы делаете продукты, полезный вопрос звучит так: какую часть Muse вы могли бы встроить в своё приложение в следующем месяце? Я разбил Muse на части, которые Meta действительно выпустила, отметил те, что Claude и MCP закрывают уже сегодня, а остальное набросал в виде кода.

Что именно выпустила Meta?

  • Muse Spark, саму модель.
  • Muse Secure VM: изолированную виртуальную машину на каждого пользователя со своим браузером и хранилищем.
  • Sentinel: отдельного агента политик, который разрешает, запрещает или передаёт пользователю каждый запрос к коннектору и каждый исходящий вызов.
  • Подтверждения перед отправкой писем и покупками и полный журнал аудита.
  • Память о привычках и разовых деталях для проактивных подсказок.
  • Фоновое выполнение, которое продолжается после закрытия приложения.
  • Оплату через Link от Stripe с одноразовыми номерами карт; Shop Pay и 1Password анонсированы.
  • Платформы: iOS, Android, веб и WhatsApp, запуск в США.

Моделью здесь является только первый пункт. Остальные семь это инфраструктура.

Анимированная схема браузерной задачи Meta Muse: Secure VM, Sentinel и подтверждение пользователя
Как Muse выполняет задачу в браузере: план, чтение дерева доступности, заполнение формы, проверка Sentinel, подтверждение, журнал.

Что Claude Sonnet 5.5 даёт агенту?

В этой схеме Sonnet 5.5 выполняет роль планировщика. Для агента важны такие цифры: вывод примерно на 30% быстрее Sonnet 5, стоимость задачи ниже до 30% за счёт меньшего числа токенов и вызовов инструментов, 80,1% в OSWorld 2.1 против 81,8% у Opus 5.5, настраиваемые уровни усилия и доступность через Claude API, AWS, Google Cloud и Microsoft Azure. Lovable после перехода увидела примерно на треть меньше вызовов инструментов.

Для агента, который делает десятки вызовов за задачу, сокращение вызовов важнее лишнего пункта в бенчмарке. Каждый несделанный вызов означает на один сетевой запрос к MCP-серверу меньше и на одну точку отказа меньше.

Что MCP даёт из коробки?

Model Context Protocol это открытый стандарт, который Anthropic создала в 2024 году и в декабре 2025 года передала в Agentic AI Foundation при Linux Foundation. Он даёт агенту единый способ добраться до любого инструмента. Стартовый набор для ассистента в духе Muse выглядит так:

ЗадачаMCP-серверСтатус
ПочтаКоннектор Gmail или удалённый серверГотово
КалендарьGoogle CalendarГотово
ДокументыGoogle DriveГотово
Браузер@playwright/mcpГотово, хостите вы
Кодgithub-mcp-serverГотово
Данные и записи памятиСервер PostgresГотово
Внутренние APIНебольшой свой сервер на SDK для TypeScript или PythonПишете вы
Анимированная схема: Claude Sonnet 5.5 направляет вызовы инструментов через MCP-клиент к шести MCP-серверам
По одному вызову за раз: Claude выбирает инструмент, MCP-клиент направляет вызов, сервер обращается к настоящему API, результат возвращается в контекст.

Какие семь частей всё равно пишете вы?

  1. Шлюз политик. Пометьте каждый инструмент как чтение, запись или деньги. Чтение разрешайте, запись отправляйте в очередь на подтверждение, всё, чего нет в списке, блокируйте. Для начала хватит таблицы tool_policies(tool, risk, requires_approval).
  2. Хранилище токенов. Шифруйте refresh-токены каждого пользователя через KMS или libsodium, обновляйте их в воркере и никогда не кладите в промпт.
  3. Память. Postgres с pgvector, таблица memories с источником и временем каждого факта и страница настроек, где пользователь может читать и удалять записи.
  4. Задачи. Очередь вроде BullMQ на Redis или управляемая вроде SQS, плюс планировщик для просьб вида «через пять дней».
  5. Журнал аудита. Таблица agent_events только на добавление: задача, инструмент, хеш входа, краткий результат, кто одобрил, время.
  6. Защита от инъекций. Помечайте результаты из веба как недоверенные. После чтения недоверенного контента разрешайте только инструменты чтения, пока пользователь не одобрит следующую запись.
  7. Изолированный браузер. Один контейнер на пользовательскую сессию с Playwright, живым просмотром и кнопкой экстренной остановки.
Архитектура агента в стиле Muse: Claude Sonnet 5.5 в центре, MCP-серверы, API, изолированный браузер, память, воркеры, шлюз политик и журнал
Полный стек: модель в центре, а всё вокруг неё это инфраструктура, которую держите вы.

Как выглядит минимальный цикл агента?

Это ядро рантайма на TypeScript. Основную работу делают модель и MCP-серверы. Цикл добавляет проверку политики, журнал и паузу.

import Anthropic from "@anthropic-ai/sdk";
const claude = new Anthropic();

export async function runTask(task: Task) {
  const messages = await memory.load(task.userId, task.goal);
  const tools = await mcp.listTools(task.userId); // tools from every connected MCP server

  for (let step = 0; step < 40; step++) {
    const res = await claude.messages.create({
      model: "claude-sonnet-5-5",
      max_tokens: 4096,
      tools,
      messages,
    });
    messages.push({ role: "assistant", content: res.content });
    if (res.stop_reason !== "tool_use") return finish(task, res);

    const results = [];
    for (const call of res.content.filter((b) => b.type === "tool_use")) {
      const verdict = policy.check(task.userId, call); // "allow" | "ask" | "deny"
      if (verdict === "ask") return queue.pauseForApproval(task, messages, call);
      const output = verdict === "allow"
        ? await mcp.callTool(task.userId, call.name, call.input)
        : "Blocked by policy.";
      await audit.log({ task: task.id, tool: call.name, verdict, output });
      results.push({ type: "tool_result", tool_use_id: call.id, content: output });
    }
    messages.push({ role: "user", content: results });
    await memory.checkpoint(task.id, messages);
  }
}

pauseForApproval сохраняет диалог и ожидающий вызов. Когда пользователь нажимает «одобрить», воркер выполняет вызов, добавляет результат и снова запускает runTask с контрольной точки. Именно эта небольшая функция позволяет агенту «работать после закрытия приложения».

Как поиск работы выглядит в журнале аудита?

Вот пример запроса «найди удалённые вакансии React, проверь календарь, подготовь отклики, напомни через пять дней» в том виде, в каком его запишет журнал:

09:02  plan        search remote React roles, posted in last 7 days
09:02  browser     navigate jobs board        allow   42 listings (untrusted)
09:03  postgres    read prefs                 allow   remote, React, salary floor
09:03  calendar    find_free_slots(14d)       allow   6 slots
09:05  drive       create_doc x5              allow   5 cover letters
09:05  gmail       create_draft x5            ask     waiting for user
09:41  approval    user approved 4, rejected 1
09:42  browser     submit application x4      allow   4 submitted
09:42  scheduler   follow_up in 5 days        allow   job #8812
day 5  gmail       search replies             allow   1 reply, 3 silent
day 5  gmail       create_draft x3            ask     waiting for user

Каждая строка с пометкой ask это место, где Sentinel в Muse тоже остановился бы. Каждая строка с номером задачи это то, чего одно окно чата сделать не может.

Muse или свой стек?

Берите Muse, если вы один человек, которому нужен результат, и вас устраивают условия Meta по данным, доступность только в США и текущий список интеграций.

Стройте на Claude и MCP, если агент должен жить внутри вашего продукта, работать с внутренними системами, соблюдать ваши правила хранения данных или позже сменить модель без переписывания всех интеграций.

Вывод

Sonnet 5.5 даёт планировщика, который почти догоняет старшую модель по цене средней. MCP превращает слой инструментов в конфигурацию. Настоящее преимущество Muse в его рантайме: VM, агент политик, хранилище, планировщик и журнал. Именно на этом слое дальше будут конкурировать агентные продукты, и именно этот слой вы можете построить сами.

Источники