merge origin/main

This commit is contained in:
ochenstarik-ui 2026-09-02 19:26:59 +07:00
commit c0485a3721
3 changed files with 183 additions and 0 deletions

18
docs/research/README.md Normal file
View file

@ -0,0 +1,18 @@
# Разведка и идеи
Здесь — то, что рассмотрено для Hermes Hub, но ещё не решено делать: чужие
проекты, откуда стоит перенять устройство, наблюдения из новостей, отложенные
замыслы. Отдельно от `ARCHITECTURE.md`: тот описывает **что построено**, а этот
каталог — **что взвешено и почему**.
Правило одно: сюда попадает только то, что проверено рассуждением и привязано к
нашей машине и нашим ограничениям, а не пересказ рекламных обещаний. У каждой
записи — дата, вердикт и причина вердикта. Устаревшее не удалять молча:
помечать, что и когда изменилось.
## Записи
- [agent-orchestrator.md](agent-orchestrator.md) — разбор Agent Orchestrator,
ближайшего архитектурного родственника Hub; что перенять, чего не брать.
- [scouting-log.md](scouting-log.md) — журнал разведки: что рассмотрено по датам,
с вердиктом по каждому пункту и причиной.

View file

@ -0,0 +1,71 @@
# Разбор: Agent Orchestrator
**Источник:** сводка AI Daily News за 2026-08-31.
**Лицензия по сводке:** Apache 2.0, локальный запуск.
**Вердикт:** разобрать устройство и перенять две идеи; целиком не брать.
**Дата разбора:** 2026-09-02.
> Первоисточник перед внедрением перепроверить: сводка — это пересказ, а не сам
> проект. Ссылку и точное имя репозитория подтвердить.
## Почему он для нас важен
Это ближайший архитектурный родственник того, что строит Hermes Hub. Он тоже
раздаёт работу флоту coding-агентов (Claude Code, Codex, Aider, OpenCode, Cline,
Continue, Goose и другие) и держит постоянную роль оркестратора — планирование,
делегирование, координация, — а работники заняты реализацией, тестами, PR и
исправлениями. Ровно наша схема ролей из `ROUTER.md`.
Ценность не в том, чтобы взять его вместо Hub, а в том, что он уже прошёл путь,
на котором мы сейчас: у нас роли есть, но замечания исполнителю пока возвращает
живой ревьюер вручную.
## Что перенять
### 1. Возврат замечаний исполнителю — то, чего у нас нет
У них отказы CI и замечания ревью **маршрутизируются обратно нужному агенту**, и
петля замыкается автоматически. У нас этого звена нет: агент присылает отчёт,
ревьюер проверяет исполнением, находит расхождение — и передаёт правку заново
руками. За 12 сентября так было трижды (A56, A57, ложный «16/16»).
Стоит спроектировать: результат проверки (прошло / не прошло + причина + номер
задания) возвращается тому исполнителю и в ту ветку, откуда пришла работа. Это
естественное продолжение линии заданий, которую ведёт `agents/inbox`.
### 2. Ветка и worktree на каждого работника
Каждый работник получает отдельный git worktree, отдельную ветку и отдельное
состояние сессии. Мы это уже делаем вручную — каждое задание Antigravity живёт в
своей ветке `antigravity/aNN-*`, ревьюер сливает в `main`. У них это часть
системы, а не ручной обычай. Формализовать наш обычай стоит.
### 3. Отслеживание PR / CI / merge conflicts / состояния работника
Единая доска состояния флота. У нас это разбросано: `agents/inbox`,
`agents/done`, `agents/reports` и git-ветки. Свести в один обзор — понятная
польза, когда исполнителей несколько и они на разных машинах.
## Чего НЕ брать
- **Целиком как замену Hub.** Hub — маршрутизатор провайдеров внутри Hermes
Agent, а не автономная IDE для флота. Задачи пересекаются, но не совпадают.
- **Прямой доступ агентов к рабочему окружению без ограничений.** Здесь держать
в уме вывод из отчёта OpenAI Astra (сводка за 2026-09-02): автономным агентам
ограничения должны обеспечиваться инфраструктурой, а не системным запросом. У
нас противовес уже есть — изоляция из A37 и правило про `agy_profiles`;
ослаблять его ради удобства оркестрации нельзя.
## Что проверить у первоисточника перед любым внедрением
- точное имя и адрес репозитория, реальную лицензию (в коде, не в сводке);
- как именно возвращаются замечания — формат, транспорт, привязка к ветке;
- требования к окружению и зрелость проекта (возраст, тесты, сообщество);
- модель прав: что работник может делать с репозиторием и системой.
## Связанное
- Роли и цепочки: [../ROUTER.md](../ROUTER.md).
- Изоляция агентов и запрет на чужие ключи: A37, `agents/inbox/2026-08-30-A37-*`.
- Наблюдаемость сессий агентов — см. AgentsView в
[scouting-log.md](scouting-log.md).

View file

@ -0,0 +1,94 @@
# Журнал разведки
Что рассмотрено для Hermes Hub, с вердиктом и причиной. Причина важнее вердикта:
она объясняет, почему решение такое, и не даёт вернуться к отвергнутому через
месяц, забыв доводы.
Наша машина, чтобы вердикты были понятны: сервер — одна **Tesla V100 32 ГиБ**
(Volta, sm_70), кодер Qwen3-Coder-30B-A3B занимает ~30 ГиБ из 32, свободно ~2.
Провайдеры подключаются аккаунтами через хаб.
---
## 2026-09-02
### Взять
**Claude Fable 5.1** — новая frontier-модель Anthropic под длительные
coding/agent-задачи. Цена $10 / $50 за миллион (вход/выход). Ложится на нашу
маршрутизацию по ролям как ревьюер и второй кодер; на повседневное не ставить
из-за цены. Проверяется через уже подключённый аккаунт Claude, отдельного
провайдера не требует. **Вердикт: протестировать на одной сложной задаче,
сравнить с текущими кодером и ревьюером по времени, стоимости и качеству.**
### Внимание, не улучшение
**Hermes Agent v0.21.0** — не обновлять сервер первым. В сводке два бага:
`ollama_num_ctx` может ограничить контекст облачного провайдера локальным
лимитом Ollama (в отчёте 65 536 при заявленном 1M); shutdown-watchdog зовёт
`asyncio.start_unix_server`, которого нет в родном Python под Windows. Проверено:
ни `AF_UNIX`, ни `ollama_num_ctx` в коде хаба нет — оба дефекта в самом Hermes
Agent, но хаб работает его плагином. **Отдельно:** 65 536 — это ещё и наше
запасное значение `n_ctx` в `local_supervisor.query_server_props`, когда `/props`
недоступен. Числа совпадают, дефекты разные — не перепутать при разборе.
**Вердикт: сервер обновлять последним, после Windows-машины (canary first).**
### Перенять устройство
**Agent Orchestrator** (Apache 2.0, локальный) — ближайший родственник Hub.
Подробный разбор: [agent-orchestrator.md](agent-orchestrator.md). Коротко:
перенять автоматический возврат замечаний исполнителю (у нас его нет), ветку и
worktree на работника, единую доску состояния флота; целиком не брать.
**Наблюдаемость — паттерн NVIDIA BioNeMo / Claude Science:** оркестратор + узкие
инструменты вместо «одна модель делает всё». Архитектурно полезно для Кроны, не
для Hub напрямую. **Вердикт: держать в уме для Кроны.**
### Отложить
**AgentsView** (MIT, локальный, без аккаунта) — местная аналитика сессий
coding-агентов: единый индекс, SQLite, токены и стоимость по агентам и датам,
сбор с нескольких машин. Полезно: у нас теперь сессии на двух машинах и
несколько исполнителей (Claude, Antigravity, Codex), и вопрос «куда ушли токены»
встанет скоро. Риск низкий. **Вердикт: протестировать локально, когда дойдут
руки; не срочно, пока хаб не стабилизирован.**
### Не для нас сейчас
**ARD (Agentic Resource Discovery)** — слой обнаружения инструментов, чтобы не
грузить весь каталог в prompt. Идея верная, но преждевременная: сначала хаб
должен надёжно видеть подключённые аккаунты. **Вердикт: следить за стандартом,
не внедрять.**
**ComfyUI MCP, VoiceStudio, Gemini Agentic Video, DreamX-Creator** — медиа и
видео. Не про Hermes Hub; относится к SMM/медийным проектам среди прочих
каталогов `/srv/projects`. **Вердикт: не в Hub.**
**Rapid-MLX, MLX Workbench, CAVI MLX Agent** — только Apple Silicon. Mac-узла
нет. **Вердикт: наблюдать до появления Mac.**
---
## 2026-09-01
### Проверять, а не брать на веру
**llama.cpp свежие сборки** (flash-attention под CUDA, shared-memory K/V,
MoE-fusion). Новые пути CUDA обычно рассчитаны на Ampere и новее; V100 — Volta
(sm_70), выигрыш не гарантирован. **Вердикт: если пробовать — только с повторным
замером тех же 107,4 ток/с на нашей сборке; по умолчанию не выигрыш.**
**Qwen3.8-27B MTP / спекулятивное декодирование** — приведённые замеры на RTX
3090 и 5090. У нас черновой модели некуда встать: кодер занимает 30 ГиБ из 32. И
в A52 уже измерено — две модели на одной V100 делят пропускную способность
памяти 0,780,99×, ускорения нет. **Вердикт: не тратить время на нашей машине.**
### Паттерн, не продукт
**AWS Agent Toolkit** — паттерн `Skills + restricted MCP + policy + audit`.
Совпадает с линией изоляции A37 и моделью безопасности (`SECURITY_MODEL.md`).
**Вердикт: держать как ориентир для Tool/Skill-подсистемы, продукт не тащить.**
**TradingAgents v0.4.0** — не для Hub; идеи point-in-time (защита от заглядывания
в будущее, historical snapshot, отметки времени в памяти решений) — для
финансовых проектов. **Вердикт: не в Hub, передать в торговые проекты.**