От Manus к Гермесу
Первая волна: расширения и Manus
Первый массовый опыт с автономными агентами начался с браузерного расширения Monica AI — оно встраивалось в браузер и умело выполнять несложные автоматизации. Затем та же команда выпустила агента Manus, который за 10 месяцев набрал такую аудиторию, что Meta намеревалась выкупить компанию за $2 млрд. Сделку заблокировало китайское правительство.
Manus хорош для research-задач и рутинной автоматизации, но он закрытый и облачный — данные уходят на чужие серверы.
OpenClow: попытка №2
С выходом Claude 4.7 и 4.8 возможности Manus начал перекрывать сам Claude Code. В это время появился OpenClow — первый open-source автономный агент, который взорвал GitHub. Однако оказался супернестабильным: требовал ручного кодинга через командную строку, отдельного сервера, долгой настройки — и всё равно регулярно падал. OpenClow позже выкупила OpenAI.
Гермес: стабильная альтернатива
Hermes Agent — open-source система от Nous Research. Настраивается значительно проще, имеет понятную архитектуру, активно развивается на GitHub и поддерживает все основные ИИ-модели через единый API.
Позвоночник, Профили, Скиллы
Концепция «Позвоночника»
Гермес — это позвоночник: единое ядро, которое разворачивается на вашем сервере и соединяет всё вокруг. К нему «навешивается мясо»: глаза (vision-модели), голос (Whisper + ElevenLabs), генераторы изображений, базы знаний, внешние сервисы. Всё через одну точку управления.
Профили (субличности)
Под каждый класс задач создаётся отдельный профиль с собственным системным промптом и моделью:
- Профиль для AR-очков: системный промпт «Отвечай максимально кратко, без форматирования, 2–3 строки» + сверхбыстрая модель DeepSeek-V4 PSI. На крошечный дисплей очков помещается 3–4 строчки — подходит идеально.
- Профиль для финансового анализа: «думающая» тяжёлая модель (Claude / Grok) + детальный формат вывода с таблицами.
- Профиль для китайского контекста: автоматическая маршрутизация локальных запросов на Kimi или Qwen — они понимают азиатский контент и не срабатывают на bot-защиту.
Единая память и Скиллы
Все профили разделяют одну базу памяти — каждая подключённая модель знает о вас всё. Ключевая суперсила — скиллы: если вы полчаса промптами настраивали идеальный формат презентации в корпоративном стиле, говорите агенту: «Мне нравится результат, зафиксируй его». Гермес кодирует алгоритм в скилл. В следующий раз та же задача займёт 3 минуты вместо 30.
Гермес в Telegram: практика
Telegram как «тело» агента
Основной интерфейс управления Гермесом — бот в Telegram. Он поддерживает текст, голос (через Whisper), изображения и файлы. Помимо Telegram, Гермес работает через веб-интерфейс, iMessage, WhatsApp и электронную почту.
Пример: подкаст из новостей
Голосовой запрос:
Гермес выполняет цепочку автономно: парсит TechCrunch и X (Twitter), компилирует сценарий (~4000 символов), отправляет его в ElevenLabs на озвучку и присылает готовый аудиофайл.
Переключение моделей на лету
Команда через косую черту (/) прямо во время диалога переключает активную модель: с DeepSeek на Claude или Grok — без потери контекста разговора.
ElevenLabs Phone Extension
Актуальное расширение от ElevenLabs позволяет созваниваться с Гермесом по телефону — диктовать задачи голосом в реальном времени, как живому ассистенту.
Grok + OpenRouter: экономия токенов
Зачем отдельный сервер?
Гермес должен работать 24/7 — ноутбук закрывается, уходит в рюкзак, агент засыпает. Отдельная машина (мини-ПК, VPS или Nvidia Jetson) решает две задачи:
- Безопасность — агент изолирован от основного рабочего компьютера с конфиденциальными данными.
- Бесперебойность — сервер работает всегда, принимает задачи по расписанию ночью.
SuperGrok как CLI-администратор сервера
Подписка SuperGrok за $30/мес позволяет подключить Grok как CLI-агента прямо в терминал. Вместо поиска нужных Linux-команд, копирования ошибок в ChatGPT и возврата обратно — достаточно написать обычным языком:
Проверь обновления на моего Гермеса
Grok сам понимает контекст, лезет в систему, проверяет файлы, выводит состояние. Через ту же подписку можно гнать основной трафик запросов Гермеса без переплат за токены американских сетей по API.
DeepSeek как резервный Fallback
Если Grok перегружен или слетела авторизация — Гермес автоматически переключает вычисления на DeepSeek, API которого в 10 раз дешевле американских моделей.
Маршрутизация по задачам
Почему не Now Portal
Официальный платный шлюз разработчиков Гермеса — Now Portal ($20). По умолчанию система считает его приоритетным и отправляет все запросы через него — включая самую дорогую модель Claude 3 Opus. Результат: $20 сгорают за 3 дня. Не пополнять — Now Portal блокируется, приложение начинает выдавать баги.
OpenRouter: один ключ на все модели
OpenRouter — агрегатор, дающий один API-ключ на все ИИ рынка: DeepSeek, Claude, GPT, Qwen, Mistral. Пополняете один баланс на $10–30 и выбираете дешёвую модель под каждый тип задачи.
OPENROUTER_API_KEY=sk-or-v1-xxxxxxxxx...
Умная маршрутизация по контексту
Внутри Гермеса настраивается правило: если запрос касается местного контента (адреса, расписание, язык запроса) — автоматически направлять его на специализированные региональные модели. Китайские Kimi и Qwen через OpenRouter берутся поштучно за копейки — не нужно оплачивать отдельные подписки.
MCP-интеграции: Календарь и созвоны
Что такое MCP
Model Context Protocol — открытый стандарт от Anthropic для подключения ИИ к внешним приложениям через API. Гермес использует MCP-серверы как «руки»: через них он пишет в календарь, читает данные созвонов, отправляет почту.
Google Календарь голосом
Запрос в Telegram:
Гермес подключается к Google Workspace по API, создаёт событие в нужное время, добавляет описание и автоматически прикрепляет эмодзи ☕️ — потому что смог вывести смысл из контекста.
Fireflies.ai: анализ созвонов
Fireflies.ai автоматически подключается к Zoom/Meet/Teams и записывает все рабочие созвоны. Запрос к Гермесу:
Через MCP-сервер Гермес запрашивает транскрипты из Fireflies и выдаёт чёткую структуру: список звонков с именами, тезисы по каждому, выделенные дедлайны.
Полностью локальный контур
Для задач под NDA (юристы, медики, финансисты) — Гермес разворачивается на мощном ПК от 200–250 тыс. руб. полностью без выхода в облако. Данные не покидают вашу инфраструктуру. Используются локальные модели: Gemma 4 (12B) через Ollama.
Кейсы из практики
Михаил — контент-завод для детского бизнеса
Михаил возит по школам и детским садам голографические вентиляторы с 3D-мультфильмами. Развернул 3 сервера Гермеса и превратил агента в «Контент-Завод»: подключил базу данных Notion и ElevenLabs. Помощницы создают мультики в полуавтоматическом режиме.
Кейс с PDF: прислали 8–10 страниц отсканированных документов в JPG со сложными таблицами. Нужно было разрезать их пополам, найти строки со схожими датами и собрать в новые PDF-файлы. Михаил скинул 10 картинок Гермесу. Агент за 15–18 минут самостоятельно написал скрипт на Python, скачал нужные библиотеки, обработал изображения и выдал готовые файлы.
Геймификация для детей: старая плата Raspberry Pi 3 + Гермес по VPN = интерактивный дашборд домашних задач со звёздочками. Дети надиктовывают задачи голосом, ИИ обновляет экран.
Дмитрий — бытовая автоматизация и удалённая разработка
Настроил утренний автопромпт: каждый день в 08:00 Гермес присылает точный прогноз погоды, дёргая данные напрямую по API.
«Что посмотреть в пятницу»: ИИ в пятницу вечером сам присылает подборку киноновинок под вкусы Дмитрия. Учится на просмотренном, ищет фильмы на торрентах, собирает культурную афишу города.
Для разработки: идея приходит на обеде — пишет Гермесу в Telegram. Агент удалённо лезет в репозиторий на сервере, скачивает код, проверяет логику и выдаёт отчёт прямо в чат смартфона.
Илья — изучение языков + Codex
Скрестил Гермеса со средой Codex. За 2–3 промпта собрал собственное работающее приложение — аналог карточек Anki для изучения китайского и английского языков.
Антон — локальный запуск на видеокарте
Вместо облачных моделей — китайская Qwen, развёрнутая полностью локально на видеокарте с 12 ГБ видеопамяти. Расходы на токены: $0. «Впритык, но хватает» для сложных задач по кодингу.
Агентская эпоха
Реальные расходы участников в месяц
Предупреждение: Claude API и блокировки
Anthropic массово блокирует API-аккаунты из СНГ. При подозрении на использование API через прокси система может запросить верификацию по паспорту. Отправка российского паспорта — гарантированная вечная блокировка аккаунта.
Третья эпоха ИИ
Мы переходим от «ИИ как поисковик» к эпохе автономных агентов. Три стадии:
- 1-я эпоха — чат-боты: спросил, получил ответ.
- 2-я эпоха — ассистенты: помогают в диалоге.
- 3-я эпоха — агенты: работают автономно, принимают решения, взаимодействуют с системами.
Visa и Mastercard уже разработали протоколы для ИИ-агентов с собственными цифровыми картами и балансом. Сценарий ближайших лет: говорите агенту «купи карбоновый чехол на мой телефон» — ИИ сам проверяет модель по базе памяти, идёт на маркетплейс, выбирает товар, присылает фото для подтверждения, списывает деньги и оформляет доставку.
В Китае на технологических выставках логотип OpenClow стал главным маскотом автоматизации. Hermes Agent — 42 000+ форков. Это не тренд, это смена парадигмы.
Каталог сервисов
Языковые модели и платформы
Архитектура агентов и память
Голос, видео и автоматизация
Железо и менеджмент
Технические инструкции
1. Развёртывание ядра Гермеса на сервере
Для бесперебойной работы 24/7 устанавливайте на VPS (Ubuntu/Linux) или локальный мини-ПК (Nvidia Jetson).
Подключение к серверу:
ssh username@your_server_ip
Автоматическая установка:
curl -fsSL https://get.hermesagent.com | sh
Первичная конфигурация:
hermes --configure
Конфигуратор создаст мастер-аккаунт администратора и сгенерирует файл .env.
2. Интеграция OpenRouter
Зарегистрируйтесь на openrouter.ai, создайте API Key (начинается на sk-or-...), пополните баланс на $10–15.
OPENROUTER_API_KEY=sk-or-v1-xxxxxxxxx...
Резервная модель в конфиге:
FALLBACK_MODEL=deepseek/deepseek-chat
При ошибке 504 основной модели Гермес автоматически переключится на DeepSeek.
3. Долгосрочная память через Honcho
Зарегистрируйтесь на honcho.dev. Для старта выберите Cloud API (не Self-hosted). Получите токен и endpoint.
hermes memory --provider honcho --token ВАШ_ТОКЕН_HONCHO
Прогрев памяти: в первые 4–7 дней скидывайте агенту текстовые файлы регламентов, описания структуры бизнеса, роли команды. Honcho кластеризует их автоматически.
4. Telegram-бот как интерфейс
В Telegram найдите @BotFather, отправьте /newbot, задайте имя и юзернейм (оканчивается на _bot). Скопируйте HTTP API Token.
hermes telegram --enable --token ВАШ_ТОКЕН_ИЗ_BOTFATHER
hermes start
Напишите боту /start — агент готов к работе.
Telegram Business (для Premium): настройки профиля → Telegram Бизнес → Чат-боты → вставьте юзернейм бота. Гермес будет анализировать входящие сообщения от клиентов фоновым процессом.
5. MCP-сервер для Google Календаря
Создайте проект в Google Cloud Console. Включите Google Calendar API. Создайте OAuth client ID (тип «Desktop App»), скачайте credentials.json.
Перенесите файл на сервер и установите коннектор:
hermes mcp --install google-calendar --credentials ./credentials.json
При первом запросе к календарю Гермес пришлёт OAuth-ссылку в Telegram. Авторизуйтесь один раз — дальше всё автоматически.
Ресурсы и ссылки
Ключевые open-source проекты и сервисы из гайда — официальные ссылки и репозитории: