From ef00a64f93a75b55af5d27185659aac3a63cc21f Mon Sep 17 00:00:00 2001 From: Hermes Team Date: Wed, 2 Sep 2026 19:17:44 +0700 Subject: [PATCH] =?UTF-8?q?docs(research):=20=D0=BA=D0=B0=D1=82=D0=B0?= =?UTF-8?q?=D0=BB=D0=BE=D0=B3=20=D1=80=D0=B0=D0=B7=D0=B2=D0=B5=D0=B4=D0=BA?= =?UTF-8?q?=D0=B8=20=E2=80=94=20=D1=80=D0=B0=D0=B7=D0=B1=D0=BE=D1=80=20Age?= =?UTF-8?q?nt=20Orchestrator=20=D0=B8=20=D0=B6=D1=83=D1=80=D0=BD=D0=B0?= =?UTF-8?q?=D0=BB=20=D0=BD=D0=B0=D0=B1=D0=BB=D1=8E=D0=B4=D0=B5=D0=BD=D0=B8?= =?UTF-8?q?=D0=B9?= MIME-Version: 1.0 Content-Type: text/plain; charset=UTF-8 Content-Transfer-Encoding: 8bit Наработки из новостных сводок оседали в переписке и терялись. Заведён docs/research/: что рассмотрено для Hub, с вердиктом и причиной по каждому пункту — отдельно от ARCHITECTURE (что построено). Разбор Agent Orchestrator: ближайший архитектурный родственник Hub. Перенять автоматический возврат замечаний исполнителю (у нас его нет — ревьюер правит руками), ветку и worktree на работника, доску состояния флота; целиком не брать. Журнал разведки за 31.08–02.09: Fable 5.1 и AgentsView — брать; Hermes v0.21.0 — сервер обновлять последним (два бага, но 65536 у нас своё, не путать); Qwen MTP и свежий llama.cpp — на V100 выигрыша нет, проверено в A52. Co-Authored-By: Claude Opus 5 --- docs/research/README.md | 18 ++++++ docs/research/agent-orchestrator.md | 71 ++++++++++++++++++++++ docs/research/scouting-log.md | 94 +++++++++++++++++++++++++++++ 3 files changed, 183 insertions(+) create mode 100644 docs/research/README.md create mode 100644 docs/research/agent-orchestrator.md create mode 100644 docs/research/scouting-log.md diff --git a/docs/research/README.md b/docs/research/README.md new file mode 100644 index 0000000..45b98a9 --- /dev/null +++ b/docs/research/README.md @@ -0,0 +1,18 @@ +# Разведка и идеи + +Здесь — то, что рассмотрено для Hermes Hub, но ещё не решено делать: чужие +проекты, откуда стоит перенять устройство, наблюдения из новостей, отложенные +замыслы. Отдельно от `ARCHITECTURE.md`: тот описывает **что построено**, а этот +каталог — **что взвешено и почему**. + +Правило одно: сюда попадает только то, что проверено рассуждением и привязано к +нашей машине и нашим ограничениям, а не пересказ рекламных обещаний. У каждой +записи — дата, вердикт и причина вердикта. Устаревшее не удалять молча: +помечать, что и когда изменилось. + +## Записи + +- [agent-orchestrator.md](agent-orchestrator.md) — разбор Agent Orchestrator, + ближайшего архитектурного родственника Hub; что перенять, чего не брать. +- [scouting-log.md](scouting-log.md) — журнал разведки: что рассмотрено по датам, + с вердиктом по каждому пункту и причиной. diff --git a/docs/research/agent-orchestrator.md b/docs/research/agent-orchestrator.md new file mode 100644 index 0000000..289f1f4 --- /dev/null +++ b/docs/research/agent-orchestrator.md @@ -0,0 +1,71 @@ +# Разбор: Agent Orchestrator + +**Источник:** сводка AI Daily News за 2026-08-31. +**Лицензия по сводке:** Apache 2.0, локальный запуск. +**Вердикт:** разобрать устройство и перенять две идеи; целиком не брать. +**Дата разбора:** 2026-09-02. + +> Первоисточник перед внедрением перепроверить: сводка — это пересказ, а не сам +> проект. Ссылку и точное имя репозитория подтвердить. + +## Почему он для нас важен + +Это ближайший архитектурный родственник того, что строит Hermes Hub. Он тоже +раздаёт работу флоту coding-агентов (Claude Code, Codex, Aider, OpenCode, Cline, +Continue, Goose и другие) и держит постоянную роль оркестратора — планирование, +делегирование, координация, — а работники заняты реализацией, тестами, PR и +исправлениями. Ровно наша схема ролей из `ROUTER.md`. + +Ценность не в том, чтобы взять его вместо Hub, а в том, что он уже прошёл путь, +на котором мы сейчас: у нас роли есть, но замечания исполнителю пока возвращает +живой ревьюер вручную. + +## Что перенять + +### 1. Возврат замечаний исполнителю — то, чего у нас нет + +У них отказы CI и замечания ревью **маршрутизируются обратно нужному агенту**, и +петля замыкается автоматически. У нас этого звена нет: агент присылает отчёт, +ревьюер проверяет исполнением, находит расхождение — и передаёт правку заново +руками. За 1–2 сентября так было трижды (A56, A57, ложный «16/16»). + +Стоит спроектировать: результат проверки (прошло / не прошло + причина + номер +задания) возвращается тому исполнителю и в ту ветку, откуда пришла работа. Это +естественное продолжение линии заданий, которую ведёт `agents/inbox`. + +### 2. Ветка и worktree на каждого работника + +Каждый работник получает отдельный git worktree, отдельную ветку и отдельное +состояние сессии. Мы это уже делаем вручную — каждое задание Antigravity живёт в +своей ветке `antigravity/aNN-*`, ревьюер сливает в `main`. У них это часть +системы, а не ручной обычай. Формализовать наш обычай стоит. + +### 3. Отслеживание PR / CI / merge conflicts / состояния работника + +Единая доска состояния флота. У нас это разбросано: `agents/inbox`, +`agents/done`, `agents/reports` и git-ветки. Свести в один обзор — понятная +польза, когда исполнителей несколько и они на разных машинах. + +## Чего НЕ брать + +- **Целиком как замену Hub.** Hub — маршрутизатор провайдеров внутри Hermes + Agent, а не автономная IDE для флота. Задачи пересекаются, но не совпадают. +- **Прямой доступ агентов к рабочему окружению без ограничений.** Здесь держать + в уме вывод из отчёта OpenAI Astra (сводка за 2026-09-02): автономным агентам + ограничения должны обеспечиваться инфраструктурой, а не системным запросом. У + нас противовес уже есть — изоляция из A37 и правило про `agy_profiles`; + ослаблять его ради удобства оркестрации нельзя. + +## Что проверить у первоисточника перед любым внедрением + +- точное имя и адрес репозитория, реальную лицензию (в коде, не в сводке); +- как именно возвращаются замечания — формат, транспорт, привязка к ветке; +- требования к окружению и зрелость проекта (возраст, тесты, сообщество); +- модель прав: что работник может делать с репозиторием и системой. + +## Связанное + +- Роли и цепочки: [../ROUTER.md](../ROUTER.md). +- Изоляция агентов и запрет на чужие ключи: A37, `agents/inbox/2026-08-30-A37-*`. +- Наблюдаемость сессий агентов — см. AgentsView в + [scouting-log.md](scouting-log.md). diff --git a/docs/research/scouting-log.md b/docs/research/scouting-log.md new file mode 100644 index 0000000..a0132a5 --- /dev/null +++ b/docs/research/scouting-log.md @@ -0,0 +1,94 @@ +# Журнал разведки + +Что рассмотрено для Hermes Hub, с вердиктом и причиной. Причина важнее вердикта: +она объясняет, почему решение такое, и не даёт вернуться к отвергнутому через +месяц, забыв доводы. + +Наша машина, чтобы вердикты были понятны: сервер — одна **Tesla V100 32 ГиБ** +(Volta, sm_70), кодер Qwen3-Coder-30B-A3B занимает ~30 ГиБ из 32, свободно ~2. +Провайдеры подключаются аккаунтами через хаб. + +--- + +## 2026-09-02 + +### Взять + +**Claude Fable 5.1** — новая frontier-модель Anthropic под длительные +coding/agent-задачи. Цена $10 / $50 за миллион (вход/выход). Ложится на нашу +маршрутизацию по ролям как ревьюер и второй кодер; на повседневное не ставить +из-за цены. Проверяется через уже подключённый аккаунт Claude, отдельного +провайдера не требует. **Вердикт: протестировать на одной сложной задаче, +сравнить с текущими кодером и ревьюером по времени, стоимости и качеству.** + +### Внимание, не улучшение + +**Hermes Agent v0.21.0** — не обновлять сервер первым. В сводке два бага: +`ollama_num_ctx` может ограничить контекст облачного провайдера локальным +лимитом Ollama (в отчёте 65 536 при заявленном 1M); shutdown-watchdog зовёт +`asyncio.start_unix_server`, которого нет в родном Python под Windows. Проверено: +ни `AF_UNIX`, ни `ollama_num_ctx` в коде хаба нет — оба дефекта в самом Hermes +Agent, но хаб работает его плагином. **Отдельно:** 65 536 — это ещё и наше +запасное значение `n_ctx` в `local_supervisor.query_server_props`, когда `/props` +недоступен. Числа совпадают, дефекты разные — не перепутать при разборе. +**Вердикт: сервер обновлять последним, после Windows-машины (canary first).** + +### Перенять устройство + +**Agent Orchestrator** (Apache 2.0, локальный) — ближайший родственник Hub. +Подробный разбор: [agent-orchestrator.md](agent-orchestrator.md). Коротко: +перенять автоматический возврат замечаний исполнителю (у нас его нет), ветку и +worktree на работника, единую доску состояния флота; целиком не брать. + +**Наблюдаемость — паттерн NVIDIA BioNeMo / Claude Science:** оркестратор + узкие +инструменты вместо «одна модель делает всё». Архитектурно полезно для Кроны, не +для Hub напрямую. **Вердикт: держать в уме для Кроны.** + +### Отложить + +**AgentsView** (MIT, локальный, без аккаунта) — местная аналитика сессий +coding-агентов: единый индекс, SQLite, токены и стоимость по агентам и датам, +сбор с нескольких машин. Полезно: у нас теперь сессии на двух машинах и +несколько исполнителей (Claude, Antigravity, Codex), и вопрос «куда ушли токены» +встанет скоро. Риск низкий. **Вердикт: протестировать локально, когда дойдут +руки; не срочно, пока хаб не стабилизирован.** + +### Не для нас сейчас + +**ARD (Agentic Resource Discovery)** — слой обнаружения инструментов, чтобы не +грузить весь каталог в prompt. Идея верная, но преждевременная: сначала хаб +должен надёжно видеть подключённые аккаунты. **Вердикт: следить за стандартом, +не внедрять.** + +**ComfyUI MCP, VoiceStudio, Gemini Agentic Video, DreamX-Creator** — медиа и +видео. Не про Hermes Hub; относится к SMM/медийным проектам среди прочих +каталогов `/srv/projects`. **Вердикт: не в Hub.** + +**Rapid-MLX, MLX Workbench, CAVI MLX Agent** — только Apple Silicon. Mac-узла +нет. **Вердикт: наблюдать до появления Mac.** + +--- + +## 2026-09-01 + +### Проверять, а не брать на веру + +**llama.cpp свежие сборки** (flash-attention под CUDA, shared-memory K/V, +MoE-fusion). Новые пути CUDA обычно рассчитаны на Ampere и новее; V100 — Volta +(sm_70), выигрыш не гарантирован. **Вердикт: если пробовать — только с повторным +замером тех же 107,4 ток/с на нашей сборке; по умолчанию не выигрыш.** + +**Qwen3.8-27B MTP / спекулятивное декодирование** — приведённые замеры на RTX +3090 и 5090. У нас черновой модели некуда встать: кодер занимает 30 ГиБ из 32. И +в A52 уже измерено — две модели на одной V100 делят пропускную способность +памяти 0,78–0,99×, ускорения нет. **Вердикт: не тратить время на нашей машине.** + +### Паттерн, не продукт + +**AWS Agent Toolkit** — паттерн `Skills + restricted MCP + policy + audit`. +Совпадает с линией изоляции A37 и моделью безопасности (`SECURITY_MODEL.md`). +**Вердикт: держать как ориентир для Tool/Skill-подсистемы, продукт не тащить.** + +**TradingAgents v0.4.0** — не для Hub; идеи point-in-time (защита от заглядывания +в будущее, historical snapshot, отметки времени в памяти решений) — для +финансовых проектов. **Вердикт: не в Hub, передать в торговые проекты.**