Как подключить Hermes к Tokenator API

Hermes работает с любым OpenAI-совместимым эндпоинтом. Адрес и ключ вводятся в мастере hermes model либо прописываются в config.yaml — оба пути пишут в один и тот же файл.

Что получится в итоге

После настройки Hermes перестаёт обращаться к своему стандартному провайдеру и отправляет все запросы в Tokenator. Оплата идёт токенами вашего ключа, а список доступных моделей задаётся ключом, а не инструментом.

ИнструментHermes
ПротоколOpenAI-совместимый
Base URLhttps://api.tokenator.top/v1
Ключsk-your-tokenator-key

Требования и поддерживаемые ОС

  • Windows 10/11, macOS 12+ или современный Linux с 64-битной архитектурой.
  • Доступ в интернет к домену Tokenator по HTTPS.
  • API-ключ Tokenator вида sk-your-tokenator-key.

Нужен терминал: на macOS, Linux, WSL2 и Termux установка идёт скриптом через curl, на Windows — через PowerShell. Настройки лежат в ~/.hermes/, на Windows — в %LOCALAPPDATA%\hermes.

Установка Hermes

macOS, Linux, WSL2, Termux
curl -fsSL https://hermes-agent.nousresearch.com/install.sh | bash
Windows PowerShell
iex (irm https://hermes-agent.nousresearch.com/install.ps1)

После установки перезапустите оболочку и проверьте команду: hermes запускает агента, hermes model — мастер настройки провайдеров.

Настройка Tokenator

  1. Зарегистрируйтесь в личном кабинете и купите пакет токенов.
  2. Ключ появится в кабинете сразу после подтверждения оплаты — копировать его нужно целиком, вместе с префиксом.
  3. В примерах ниже вместо настоящего ключа стоит плейсхолдер sk-your-tokenator-key. Не публикуйте настоящий ключ в репозиториях и скриншотах.

Конфигурация

  1. Выйдите из активной сессии: внутри чата команда /model только переключает уже настроенное и не умеет добавлять провайдеров.
  2. Запустите мастер: hermes model.
  3. Выберите пункт Custom endpoint (self-hosted / VLLM / etc.).
  4. API base URL: https://api.tokenator.top/v1
  5. API key: sk-your-tokenator-key
  6. Model name: gpt-5.5
  7. Поле длины контекста можно оставить пустым — тогда она определяется автоматически.
~/.hermes/config.yaml
model:
  default: gpt-5.5
  provider: custom
  base_url: https://api.tokenator.top/v1
  api_key: sk-your-tokenator-key
~/.hermes/config.yaml — вариант с именованным провайдером
providers:
  tokenator:
    api: https://api.tokenator.top/v1
    key_env: TOKENATOR_API_KEY
    transport: chat_completions
    discover_models: false
    models:
      - gpt-5.5

Второй блок — именованный провайдер. Он нужен, когда эндпоинтов несколько: тогда модель выбирается тройным синтаксисом /model custom:tokenator:gpt-5.5. Ключ в этом варианте берётся из переменной окружения, названной в key_env.

~/.hermes/.env
TOKENATOR_API_KEY=sk-your-tokenator-key

Файлы лежат в ~/.hermes/, а на Windows — в %LOCALAPPDATA%\hermes: там те же %LOCALAPPDATA%\hermes\config.yaml и %LOCALAPPDATA%\hermes\.env.

Оба пути пишут в один и тот же config.yaml: мастер просто заполняет его за вас. Команда hermes config set раскладывает значения сама — точечные пути вроде model.base_url уходят в config.yaml, а имена в ВЕРХНЕМ_РЕГИСТРЕ в файл .env рядом с ним.

Первый запрос

Перед запуском инструмента полезно убедиться, что ключ и модель рабочие. Один запрос curl отвечает на оба вопроса сразу.

Проверка OpenAI-эндпоинта
curl https://api.tokenator.top/v1/chat/completions \
  -H "Authorization: Bearer sk-your-tokenator-key" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "gpt-5.5",
    "messages": [{"role": "user", "content": "ping"}]
  }'
Запуск агента
cd /path/to/project
hermes

Внутри сессии модель переключается командой /model custom:gpt-5.5, а для именованного провайдера — /model custom:tokenator:gpt-5.5.

Успешный ответ означает, что ключ действителен, модель разрешена для этого ключа и апстрим доступен. Расход виден в кабинете сразу после запроса.

Переключение моделей

Список моделей показывает мастер hermes model, а внутри сессии — команда /model. При discover_models: false показывается ровно то, что перечислено в models; со значением по умолчанию Hermes опрашивает /models самого эндпоинта.

Примеры ID моделей, доступных сейчас:

  • claude-haiku-4-5
  • claude-opus-4-6
  • claude-opus-4-7
  • claude-sonnet-4-6
  • gpt-5.5
  • deepseek-v4-pro

Актуальные ID и характеристики — в каталоге AI-моделей; там же видно, какие модели сейчас доступны. Выбрать между близкими вариантами помогает сравнение моделей.

Настройка reasoning

Если инструмент умеет передавать поле reasoning_effort в запросе, Tokenator пробрасывает его в апстрим без изменений. Дополнительно у самого ключа есть переключатель reasoning в личном кабинете — он действует независимо от инструмента.

Частые ошибки и способы исправления

СимптомПричинаЧто сделать
В пикере «No authenticated providers»Hermes показывает провайдера только с рабочим ключом.Откройте раздел Keys или заново пройдите hermes model и введите ключ.
Нового провайдера не видно в /modelКоманда /model внутри сессии только переключает уже настроенное и не добавляет провайдеров.Выйдите из сессии, запустите hermes model, затем начните новую сессию.
Список моделей долгий или в нём лишнееПо умолчанию Hermes опрашивает /models эндпоинта.Поставьте discover_models: false и перечислите нужные модели в models.
401 или сообщение о недействительном ключеКлюч скопирован с лишними пробелами, отозван, истёк или подставлен не в ту переменную окружения.Проверьте ключ в личном кабинете и убедитесь, что переменная окружения действительно попала в тот процесс, где запускается инструмент.
403Модель не входит в список разрешённых для этого ключа.Посмотрите список моделей ключа в кабинете и выберите ID из каталога моделей.
429Превышен лимит запросов в минуту или час либо лимит одновременных стримов для ключа.Уменьшите параллелизм агента и повторите запрос с экспоненциальной задержкой. Лимиты ключа видны в кабинете.
Модель не найдена / не поддерживаетсяВ запросе указан ID, которого нет в каталоге, либо алиас, недоступный этому ключу.Скопируйте точный API ID со страницы модели — регистр и точки значимы.
Запрос завис или обрывается на длинном ответеКлиент закрыл соединение по своему таймауту раньше, чем модель закончила генерацию.Включите потоковый режим (stream: true) и увеличьте таймаут клиента: у длинных reasoning-ответов первый токен может прийти не сразу.
Ошибка вида «Request error» без деталейАпстрим-провайдер вернул ошибку. Её текст не передаётся клиенту.Повторите запрос: Tokenator сам переключается на следующего провайдера модели. Если ошибка стабильна — напишите в поддержку.

Частые вопросы

Нужна ли подписка Hermes или отдельный аккаунт провайдера?

Нет. Инструмент обращается к Tokenator, а оплата идёт токенами вашего ключа Tokenator.

Где посмотреть расход после подключения?

В личном кабинете: там видны запросы, израсходованные токены и остаток лимита ключа.

Можно ли использовать один ключ в нескольких инструментах?

Да. Ограничение — лимиты самого ключа: запросы в минуту и час, а также количество одновременных стримов.

Что будет, если токены закончатся посреди сессии?

Запросы начнут возвращать ошибку. Лимит восстанавливается пополнением того же ключа — переустанавливать инструмент не нужно.

Как вернуться к прежнему провайдеру?

Уберите добавленные настройки — переменные окружения или блок провайдера в конфиге. Инструмент вернётся к своему поведению по умолчанию.

Где почитать про сам формат API?

В документации Tokenator API и на странице про OpenAI-compatible API.