Как подключить Hermes к Tokenator API
Hermes работает с любым OpenAI-совместимым эндпоинтом. Адрес и ключ вводятся в мастере hermes model либо прописываются в config.yaml — оба пути пишут в один и тот же файл.
Что получится в итоге
После настройки Hermes перестаёт обращаться к своему стандартному провайдеру и отправляет все запросы в Tokenator. Оплата идёт токенами вашего ключа, а список доступных моделей задаётся ключом, а не инструментом.
| Инструмент | Hermes |
| Протокол | OpenAI-совместимый |
| Base URL | https://api.tokenator.top/v1 |
| Ключ | sk-your-tokenator-key |
Требования и поддерживаемые ОС
- Windows 10/11, macOS 12+ или современный Linux с 64-битной архитектурой.
- Доступ в интернет к домену Tokenator по HTTPS.
- API-ключ Tokenator вида
sk-your-tokenator-key.
Нужен терминал: на macOS, Linux, WSL2 и Termux установка идёт скриптом через curl, на Windows — через PowerShell. Настройки лежат в ~/.hermes/, на Windows — в %LOCALAPPDATA%\hermes.
Установка Hermes
curl -fsSL https://hermes-agent.nousresearch.com/install.sh | bash
iex (irm https://hermes-agent.nousresearch.com/install.ps1)
После установки перезапустите оболочку и проверьте команду: hermes запускает агента, hermes model — мастер настройки провайдеров.
Настройка Tokenator
- Зарегистрируйтесь в личном кабинете и купите пакет токенов.
- Ключ появится в кабинете сразу после подтверждения оплаты — копировать его нужно целиком, вместе с префиксом.
- В примерах ниже вместо настоящего ключа стоит плейсхолдер
sk-your-tokenator-key. Не публикуйте настоящий ключ в репозиториях и скриншотах.
Конфигурация
- Выйдите из активной сессии: внутри чата команда
/modelтолько переключает уже настроенное и не умеет добавлять провайдеров. - Запустите мастер:
hermes model. - Выберите пункт Custom endpoint (self-hosted / VLLM / etc.).
- API base URL:
https://api.tokenator.top/v1 - API key:
sk-your-tokenator-key - Model name:
gpt-5.5 - Поле длины контекста можно оставить пустым — тогда она определяется автоматически.
model: default: gpt-5.5 provider: custom base_url: https://api.tokenator.top/v1 api_key: sk-your-tokenator-key
providers:
tokenator:
api: https://api.tokenator.top/v1
key_env: TOKENATOR_API_KEY
transport: chat_completions
discover_models: false
models:
- gpt-5.5Второй блок — именованный провайдер. Он нужен, когда эндпоинтов несколько: тогда модель выбирается тройным синтаксисом /model custom:tokenator:gpt-5.5. Ключ в этом варианте берётся из переменной окружения, названной в key_env.
TOKENATOR_API_KEY=sk-your-tokenator-key
Файлы лежат в ~/.hermes/, а на Windows — в %LOCALAPPDATA%\hermes: там те же %LOCALAPPDATA%\hermes\config.yaml и %LOCALAPPDATA%\hermes\.env.
config.yaml: мастер просто заполняет его за вас. Команда hermes config set раскладывает значения сама — точечные пути вроде model.base_url уходят в config.yaml, а имена в ВЕРХНЕМ_РЕГИСТРЕ в файл .env рядом с ним.Первый запрос
Перед запуском инструмента полезно убедиться, что ключ и модель рабочие. Один запрос curl отвечает на оба вопроса сразу.
curl https://api.tokenator.top/v1/chat/completions \ -H "Authorization: Bearer sk-your-tokenator-key" \ -H "Content-Type: application/json" \ -d '{ "model": "gpt-5.5", "messages": [{"role": "user", "content": "ping"}] }'
cd /path/to/project
hermesВнутри сессии модель переключается командой /model custom:gpt-5.5, а для именованного провайдера — /model custom:tokenator:gpt-5.5.
Успешный ответ означает, что ключ действителен, модель разрешена для этого ключа и апстрим доступен. Расход виден в кабинете сразу после запроса.
Переключение моделей
Список моделей показывает мастер hermes model, а внутри сессии — команда /model. При discover_models: false показывается ровно то, что перечислено в models; со значением по умолчанию Hermes опрашивает /models самого эндпоинта.
Примеры ID моделей, доступных сейчас:
claude-haiku-4-5claude-opus-4-6claude-opus-4-7claude-sonnet-4-6gpt-5.5deepseek-v4-pro
Актуальные ID и характеристики — в каталоге AI-моделей; там же видно, какие модели сейчас доступны. Выбрать между близкими вариантами помогает сравнение моделей.
Настройка reasoning
Если инструмент умеет передавать поле reasoning_effort в запросе, Tokenator пробрасывает его в апстрим без изменений. Дополнительно у самого ключа есть переключатель reasoning в личном кабинете — он действует независимо от инструмента.
Частые ошибки и способы исправления
| Симптом | Причина | Что сделать |
|---|---|---|
| В пикере «No authenticated providers» | Hermes показывает провайдера только с рабочим ключом. | Откройте раздел Keys или заново пройдите hermes model и введите ключ. |
Нового провайдера не видно в /model | Команда /model внутри сессии только переключает уже настроенное и не добавляет провайдеров. | Выйдите из сессии, запустите hermes model, затем начните новую сессию. |
| Список моделей долгий или в нём лишнее | По умолчанию Hermes опрашивает /models эндпоинта. | Поставьте discover_models: false и перечислите нужные модели в models. |
401 или сообщение о недействительном ключе | Ключ скопирован с лишними пробелами, отозван, истёк или подставлен не в ту переменную окружения. | Проверьте ключ в личном кабинете и убедитесь, что переменная окружения действительно попала в тот процесс, где запускается инструмент. |
403 | Модель не входит в список разрешённых для этого ключа. | Посмотрите список моделей ключа в кабинете и выберите ID из каталога моделей. |
429 | Превышен лимит запросов в минуту или час либо лимит одновременных стримов для ключа. | Уменьшите параллелизм агента и повторите запрос с экспоненциальной задержкой. Лимиты ключа видны в кабинете. |
| Модель не найдена / не поддерживается | В запросе указан ID, которого нет в каталоге, либо алиас, недоступный этому ключу. | Скопируйте точный API ID со страницы модели — регистр и точки значимы. |
| Запрос завис или обрывается на длинном ответе | Клиент закрыл соединение по своему таймауту раньше, чем модель закончила генерацию. | Включите потоковый режим (stream: true) и увеличьте таймаут клиента: у длинных reasoning-ответов первый токен может прийти не сразу. |
| Ошибка вида «Request error» без деталей | Апстрим-провайдер вернул ошибку. Её текст не передаётся клиенту. | Повторите запрос: Tokenator сам переключается на следующего провайдера модели. Если ошибка стабильна — напишите в поддержку. |
Частые вопросы
Нужна ли подписка Hermes или отдельный аккаунт провайдера?
Нет. Инструмент обращается к Tokenator, а оплата идёт токенами вашего ключа Tokenator.
Где посмотреть расход после подключения?
В личном кабинете: там видны запросы, израсходованные токены и остаток лимита ключа.
Можно ли использовать один ключ в нескольких инструментах?
Да. Ограничение — лимиты самого ключа: запросы в минуту и час, а также количество одновременных стримов.
Что будет, если токены закончатся посреди сессии?
Запросы начнут возвращать ошибку. Лимит восстанавливается пополнением того же ключа — переустанавливать инструмент не нужно.
Как вернуться к прежнему провайдеру?
Уберите добавленные настройки — переменные окружения или блок провайдера в конфиге. Инструмент вернётся к своему поведению по умолчанию.
Где почитать про сам формат API?
В документации Tokenator API и на странице про OpenAI-compatible API.