Hermes Agent v0.19.0 (v2026.7.20)

Hermes Agent v0.19.0 (v2026.7.20) — The Quicksilver Release

Дата выхода: 20 июля 2026

С v0.18.0: ~2 245 коммитов · ~1 065 смерженных PR · ~2 465 изменённых файлов · ~300 000 строк добавлено · ~36 000 удалено · ~3 300 закрытых issues · 450+ участников сообщества

> The Quicksilver Release. Гермес — бог-вестник, и в этом окне мы заставили его двигаться соответственно. Время до первого токена сократилось на ~80% на всех платформах, рассуждения стримятся по умолчанию, десктоп-приложение получило волну из ~20 PR по оптимизации (14× быстрее рендеринг markdown, виртуализированные диффы, шустрая смена сессий), а TUI рендерит markdown инкрементально. Кроме скорости: теперь можно управлять подпиской Nous прямо из терминала, подключать Bitwarden и 1Password напрямую, доверять умным одобрениям оценку команд по умолчанию, наблюдать за работой субагентов в реальном времени, и быть уверенным, что готовый ответ переживёт крах шлюза благодаря журналу доставки.


✨ Главные новинки

Кардинальное ускорение — первый токен за доли секунды

Холодный старт «Initializing agent…» раньше занимал ~4.3 секунды прежде чем ваш первый запрос достучался до модели — теперь ~0.9с, сокращение на ~80% для CLI, gateway, TUI, дескстопа и крона. Модели с рассуждениями теперь стримят ход мыслей по умолчанию (больше никакого спиннера 30 секунд), а блок ответа рисуется по токенам, а не по строкам. Если раньше Hermes делал глубокий вдох перед ответом — теперь этого вдоха нет.

Волна ускорения десктопа — 20+ целевых PR

Длинные ответы раньше стоили 14× больше CPU в разделителе markdown; гигантские диффы замораживали панель ревью до виртуализации; переключение сессий больше не ломает раскладку. Стриминг больше не перерендеривает сайдбар и каждую строку инструмента на каждый токен, бэкенды профилей предзагружаются при наведении, а скрытые панели монтируются в простое. Итог: десктоп ощущается как нативное приложение даже под нагрузкой.

Управление подпиской Nous из терминала — `/subscription` и `/topup`

Смена подписки раньше требовала похода на сайт биллинга. Теперь /subscription открывает полный процесс прямо в TUI или CLI: текущий план и остаток, точная стоимость апгрейда или дата вступления даунгрейда — с баннерами отложенных изменений и отменой.

Умные одобрения по умолчанию

Когда Hermes хочет выполнить помеченную команду, LLM-ревьюер оценивает её независимо вместо одобрения каждой вручную. Каждое заключение касается только конкретной команды. Плюс пользовательские правила запрета (блокируют команды даже в yolo-режиме) и /deny (объясняет агенту, почему вы отказали).

Менеджеры паролей — Bitwarden и 1Password

API-ключи больше не обязаны лежать в открытом .env. Новый интерфейс SecretSource позволяет Hermes получать секреты из Bitwarden и 1Password (op:// ссылки) при загрузке, с несколькими хранилищами одновременно, детерминированным приоритетом и предупреждениями о конфликтах.

Наблюдайте за субагентами — живые транскрипты + устойчивая фоновая делегация

delegate_task теперь возвращает файлы живых транскриптов, которые можно tail -f сразу после запуска: каждый вызов инструмента, результат и стриминговый ответ — по одному читаемому логу на каждого воркера. Фоновые результаты теперь устойчивы — при перезапуске процесса результаты восстанавливаются через журнал с проверкой владения.

Ответ больше не потеряется — журнал обязательств доставки

Если gateway умирал между генерацией ответа и подтверждением доставки платформой, ответ тихо исчезал. Теперь финальные ответы записываются в устойчивый журнал в state.db и переотправляются при следующей загрузке — закрывая P1-окно потери для Telegram, Discord, Slack и всех остальных каналов.

Один шлюз, множество профилей — маршрутизация по профилям

Единственный мультиплексированный gateway с одним токеном бота теперь может направлять конкретные серверы, каналы или треды в разные профили — каждый с полностью изолированной конфигурацией, навыками, памятью и секретами. Один неправильно настроенный профиль больше не может уронить весь gateway.

Новые провайдеры и новейшие модели

  • Fireworks AI — полноценный провайдер с оценкой стоимости, на 2-м месте в пикере
  • DeepInfra — усиленная интеграция; Upstage Solar — через salvage
  • GPT-5.6 (Sol/Terra/Luna + Pro варианты) — настроены от и до
  • grok-4.5 (GA), kimi-k3, claude-fable-5 / claude-sonnet-5, GA tencent/hy3
  • LM Studio JIT-загрузка моделей для локальных конфигураций
  • Claude Sonnet 5 полностью настроен — курируемые списки, вводная цена, метаданные
  • Скрытие ненужных провайдеров — флаг enabled: false + excluded_providers
  • Новые уровни рассуждений — max и ultra

    Уровни max и ultra для рассуждений (топовые уровни GPT-5.6 и Codex), выбираемые от CLI до дескстопа. Можно задавать переопределения на модель, на слот в пресетах MoA и на задачу для вспомогательных моделей. Глубина мышления теперь — регулятор, а не глобальный переключатель.

    Экспорт сессий — ваши данные

    hermes sessions export теперь пишет Markdown, Quarto, HTML, prompt-only и даже Hugging Face-ready trace форматы, с полной фильтрацией (возраст, workspace, платформа), опциональной очисткой секретов --redact и сшитой линией сессий.

    Волна безопасности

    Закрыт длинный список уязвимостей: Vertex-креды через профильные скоупы, единый guard для чтения локальных файлов, ограничение размера тела webhook, редактирование токенов Fireworks в логах, шесть P1-hardenings, CI-защита от интерполяции ненадёжных ref’ов.


    ⚡ Производительность

    Первый токен (все платформы)

  • ~80% сокращение TTFT — определение возможностей Discord вынесено с критического пути (кеш на 24ч по токену + фоновое обновление), Ollama-зонд пропускается для известных не-Ollama провайдеров, блокирующая работа при инициализации агента убрана; холодный submit→dispatch ~4.3с → ~0.9с
  • Воспринимаемая задержка, раунд 2display.show_reasoning включён по умолчанию, рендеринг ответа по токенам с принудительным сбросом, кеширование prompt-build, mtime-кешированное разрешение часового пояса
  • Сегментация смешанных пакетов инструментов для восстановления потерянной конкурентности
  • Десктоп-волна

  • 14× меньше CPU сплиттера за счёт инкрементального блочного лексинга; виртуализированные диффы в панели ревью; шустрая смена сессий; убран layout-thrash cascade
  • Сокращена сериализация запуска + REST-усиление за ход; предзагрузка бэкендов профилей по hover intent; монтирование скрытых панелей в простое
  • Остановлены перерендеры сайдбара и строк инструментов на каждый токен; остановлен eager JSON.stringify; целевая ревалидация файлового дерева
  • Повсюду

  • TUI рендерит стриминговый markdown инкрементально по блокам
  • Обнаружение навыков кешировано по подписи сканирования; сборка манифеста снимков ~5× быстрее; текстовый префильтр перед AST-парсингом
  • Copy-on-write подготовка сообщений вместо deepcopy; byte-stable системные промпты gateway

  • 🏗️ Ядро и архитектура

    Провайдеры и модели

  • Fireworks AI, DeepInfra, Upstage Solar, GPT-5.6, grok-4.5, kimi-k3, claude-fable-5, claude-sonnet-5, tencent/hy3
  • Скрытие провайдеров (enabled: false + excluded_providers)
  • Каталог Bedrock: реальное зондирование контекстного окна, 1M-контекст для текущего поколения Claude + Fable
  • Рассуждения и MoA

  • Уровни max + ultra на всех поверхностях
  • Переопределения reasoning_effort на модель; на задачу для вспомогательных моделей; на слот в пресетах MoA
  • MoA: reference_max_tokens для ограничения вывода советников, per-preset fanout cadence

  • 🌐 Gateway, Fleet и Relay

  • Устойчивый журнал обязательств доставки для финальных ответов
  • Маршрутизация по профилям для входящих сообщений + вторая волна укрепления мультиплекса
  • Per-session turn lease + conversation-scope funnel; единые границы сброса сессий; честные проверки готовности runtime
  • Переопределения модели и системного промпта на канал; per-session /model сохраняется после перезагрузок
  • Relay: generic OIDC client-credentials provisioning; Nous auth forensics + nous_session_valid на /api/status

  • 📱 Мессенджеры

  • Inline choice pickers для /reasoning и /fast на Telegram, Discord и Matrix — нативные кнопки вместо ввода
  • WhatsApp: нативные опросы Baileys, локации, метаданные; панель сопряжения
  • Discord: восстановление пропущенных при реконнекте сообщений; автопеременование тредов; таймаут интерактивных view
  • Slack: строка статуса по инструменту в реальном времени
  • Telegram: allowlist свободных ответов по топику

  • 🖥️ Десктоп-приложение

  • Оболочка на модели layout-tree — панели, зоны и раскладки как данные
  • Страница возможностей — Skills/Tools/MCP + Hub в одном месте
  • Режим Hermes Cloud (salvage); мягкий переключение gateway + полировка настроек
  • Подсказки клавиш + вкладка настроек клавиш; пикер базовой ветки для новых worktrees; зелёная точка непрочитанного
  • Система цветов сессий и проектов; объединённая идентификация активного проекта
  • Декларативная панель провайдера памяти; TTS/STT провайдеры из конфига; UI scale; Ctrl/Cmd+колёсико зум
  • Полная конвертация TypeScript

  • 📊 Веб-дашборд

  • Переключение провайдера памяти; безопасный импорт сессий; WhatsApp pairing; Discord инструменты из веб-UI
  • Terminal keep-alive + reattach; тяжёлые ходы в изолированном compute host; вставка/перетаскивание изображений

  • 🧰 CLI и TUI

  • /subscription + /topup — терминальный биллинг
  • /model --once — одноразовое переопределение модели с автоматическим откатом
  • Стэкаемые slash-skill вызовы/skill-a /skill-b do XYZ загружает оба навыка по порядку
  • --safe-mode для отладки; сухой запуск деинсталляции; быстрый TLS fail-fast
  • TUI: обновление пикера моделей; пользовательские skill-бандлы как ходы агента

  • 🔧 Система инструментов, навыки и MCP

  • MCP: конвенция именования mcp__server__tool; логи сервера в agent.log; OAuth для hosted; Blender в каталоге MCP
  • Навыки: security/unbroker (автономное удаление из брокеров данных) + усиление слепого opt-out; humanizer
  • Browser: полные снимки при усечении, eval denylist opt-in
  • Kanban: модальный диалог создания задачи + редактируемая директория проекта; grab-to-pan прокрутка; инструментарий вложений с SSRF-guard
  • Cron: устойчивая история аудита выполнения; one-shot fix race condition
  • mem0: self-hosted дашборд + настройка recall + режим мастера установки
  • Генерация изображений: Codex image inputs; нормализация аргументов по схеме

  • 🔒 Безопасность и надёжность

  • Vertex: разрешение credentials/project/region через profile secret scope; переменные вычищены из env подпроцессов
  • Шесть P1 hardening PR — браузерные guards, MEDIA anchoring, .env lockdown
  • Единый guard для чтения локальных файлов media/vision/image-gen
  • Webhook body-cap sweep: явный client_max_size на 3 нелимитированных aiohttp серверах
  • Редактирование: Fireworks token prefixes + Telegram transport errors; bot tokens scrubbed
  • computer-use: env подпроцессов санирован во всех пяти точках spawn
  • Dashboard: guard для managed-files расширен; OAuth token TOCTOU закрыт
  • CI: ненадёжные ref’ы через env, не run: интерполяция; JS/TS тесты в CI

  • 👥 Участники

    450+ человек внесли вклад в этот релиз — крупнейшее окно участников. Спасибо всем!

    Основная команда

  • @teknium1 — лид релиза; TTFT, delivery durability, smart approvals, SecretSource, gateway multiplex, sessions export, security, ~290 PR salvage
  • @OutThisLife — десктоп (speed wave, layout-tree shell, Capabilities page, session colors, TUI incremental markdown, perf harness)
  • @kshitijk4poor — GPT-5.6 end-to-end, DeepInfra + Upstage Solar, perf cluster, compression, mem0, dashboard guards
  • @ethernet8023 — CI overhaul, desktop keybinds/worktrees/status, полная TypeScript конвертация
  • @benbarclay — relay OIDC, gateway multiplex override, Nous auth self-heal, hosted MCP OAuth
  • @alt-glitch — терминальный биллинг, desktop billing tab
  • @helix4u — desktop provider/model UX, TUI model picker, Windows hardening

  • Полный changelog: v2026.7.1…v2026.7.20