Как я строил мультиагентную систему: Hermes, Claude Code, Codex и Gemini под одной крышей

Как я строил мультиагентную систему: Hermes, Claude Code, Codex и Gemini под одной крышей

Зачем всё это

Я занимаюсь контентом, SEO и монетизацией. В 2026 году AI-агенты — уже не игрушка, а рабочий инструмент. Но большинство решений на рынке — либо коробочные (закрытые, дорогие), либо требуют ручной сборки.

Я решил построить свою Agent OS — систему, где несколько AI-агентов работают вместе, дополняют друг друга и контролируют друг друга. Без единой точки отказа, без vendor lock-in, с максимальным контролем.

Эта статья — честный рассказ о том, что получилось, какие грабли я собрал по пути и что планирую дальше.

Железо и инфраструктура

Серверная часть крутится на Minisforum MS02:

  • Intel Core Ultra 9 285HX
  • 64GB RAM
  • 1TB SSD
  • Домашний ПК: Ryzen 9950X3D + RTX 5080 + 64GB

Основной сервер работает под Proxmox. Hermes Agent живёт в Docker-контейнере на VM с 77GB диска и 55GB свободно. Доступ наружу — через Cloudflare Tunnel и Access.

Я не случайно выбрал Docker, а не нативную установку. Ниже расскажу почему.

Четыре агента

Система состоит из четырёх AI-агентов, каждый в своей среде со своей ролью:

1. Hermes Agent — центр и интерфейс

Hermes (эту статью пишет он) живёт в Docker-контейнере на сервере. Это мой основной интерфейс: я общаюсь с ним через Telegram. Он занимается контентом, исследованиями, SEO-стратегией, управляет блогом на Astro + Cloudflare Pages.

Из плюсов: 71 встроенный скилл, прямые MCP-инструменты, Obsidian vault как база знаний, cron-задачи для ежедневной генерации контента.

Из минусов: живёт в песочнице с ограниченным диском (23GB внутри overlay, 55GB на точке монтирования — долгая история про путаницу с дисками, к которой мы ещё вернёмся).

2. Claude Code — хозяин сервера

Claude Code работает на моём домашнем ПК и имеет прямой SSH-доступ к серверу. Он делает всю host-администрацию: расширение дисков VM, настройку Proxmox, управление Docker-образами, бэкапами и systemd-сервисами.

Фактически это админ с правами root. Именно через него проходят все инфраструктурные изменения.

3. Codex — DevOps-аналитик

Codex от OpenAI работает в read-only песочнице на хосте сервера. У него доступ к /workspace, но права только на чтение и анализ.

Он не может ничего изменить — только проверить, спланировать, найти проблему. И это осознанное решение: Codex — контролёр, а не исполнитель.

4. Gemini — облачный верификатор

Gemini через OpenRouter добавляет третий взгляд на архитектурные решения. Он не привязан ни к серверу, ни к ПК — чисто облачный участник. Когда Claude и Codex расходятся во мнениях, Gemini помогает найти баланс.

Как они связаны

Самое интересное — как четыре агента коммуницируют:

Telegram ← Ты → Hermes (Docker) ← MCP Bridge → Codex (host)

                    Claude Code (ПК) ← SSH → Сервер (Proxmox)

                     Gemini (OpenRouter)

Цепочка принятия решений:

  1. Я даю задачу в Telegram
  2. Hermes анализирует, привлекает Codex (через MCP bridge) и Gemini (через OpenRouter)
  3. Собирает единый план
  4. Claude Code получает инструкцию и исполняет через SSH на сервере
  5. Результат возвращается через Telegram

Obsidian как общая память

Отдельного упоминания заслуживает Obsidian vault. Все четыре агента имеют к нему доступ (каждый через свой канал), и это создаёт единое информационное пространство.

Hermes читает и пишет через MCP filesystem. Codex через workspace. Claude через SSH. Gemini через OpenRouter с контекстом из Obsidian.

Мы не настраивали это специально — получилось само собой, как естественная эволюция.

Реальный кейс: спор агентов

Самый показательный случай произошёл, когда я решил перенести Hermes из Docker на нативную установку. Вот как это было.

Hermes (через Telegram) аргументировал:

  • «Docker-оверлей даёт всего 23GB — это 5% от 1TB SSD»
  • «Security scanner режет токены — костыль»
  • «Нет прямого доступа к host-процессам — всё через bridge с Клодом»

Звучало логично. Я почти согласился.

Claude Code сказал: «Стоп. Проверяем факты».

И проверил. Оказалось:

  • Диск не 23GB, а 77GB (Hermes перепутал физический диск MS02 с диском VM — распространённая ошибка)
  • Security scanner — не Docker, а конфиг redact_secrets в самом Hermes
  • Docker — официальный рекомендованный способ установки от Nous Research

Codex добавил: «Host bridge — это главный security boundary. Изоляция не баг, а фича».

Gemini подтвердил: «Каждый пункт Hermes уменьшает безопасность, не увеличивает».

В итоге я оставил всё как есть. Hermes получил важный урок: агент может быть уверен в своей правоте и ошибаться. Именно поэтому мультиагентная система с перекрёстной верификацией — не роскошь, а необходимость.

Что я вынес

  1. Не доверяй одному агенту. Даже самому убедительному. Каждый может ошибаться — и чем увереннее он говорит, тем выше шанс, что он не проверял факты, а «дорисовывал» картину.

  2. Изоляция — это защита. Docker не для того, чтобы всё усложнить. Он для того, чтобы агент с доступом в интернет (Telegram, веб) не имел доступа к корням сервера. Это не костыль, это предохранитель.

  3. Строй итеративно. Не пытайтесь сделать идеально с первого раза. Система собиралась постепенно: сначала Hermes, потом Obsidian, потом мост к Codex, потом Claude с ПК. Каждый слой добавлялся, когда становилось ясно, что без него не обойтись.

  4. Shared memory — ключ к синхронизации. Единый Obsidian vault для всех агентов решил проблему контекста. Каждый знает, что делают другие, не нужно передавать историю диалогов.

Планы на будущее

Система работает, но это не финальная версия. Вот что я планирую:

🔜 Ближайшее (недели)

  • Расширение диска VM — дать Hermes больше пространства для кэшей, логов, артефактов
  • Чистка bridge — формализовать host maintenance сокет, убрать legacy-инструменты
  • Автоматический restore drill — чтобы восстановление из бэкапа проверялось не руками раз в месяц, а cron-задачей раз в неделю

📅 Среднесрочное (месяцы)

  • YouTube-контент с AI — агенты будут писать сценарии, искать темы, генерировать субтитры
  • SEO-пайплайн — от идеи до проиндексированной статьи в Google без моего участия
  • Мониторинг и алерты — Uptime Kuma + Telegram, с автоматическим реагированием агентов на падения

🚀 Дальняя перспектива (год)

  • Голосовое управление — отдавать команды голосом, агенты распределяют и исполняют
  • Локальная LLM — запустить свою модель на сервере (когда расширим диск), чтобы меньше зависеть от облачных API
  • Публичный кейс — open-source инструменты и практики, собранные в этой системе

Итог

Четыре AI-агента, один сервер, один Obsidian vault и я в роли дирижёра. Система ещё сырая, но уже работает и приносит пользу: контент пишется, блог индексируется, инфраструктура бэкапится.

И главное — я вижу, как агенты развиваются. Они не просто выполняют команды. Они спорят, проверяют друг друга, находят ошибки. Иногда — мои, иногда — свои собственные.

А это значит, что я на правильном пути.