Как подключить Kilo Code к Tokenator API

Kilo Code настраивается как обычный OpenAI-совместимый провайдер: base URL Tokenator, ключ и ID модели из каталога.

Что получится в итоге

После настройки Kilo Code перестаёт обращаться к своему стандартному провайдеру и отправляет все запросы в Tokenator. Оплата идёт токенами вашего ключа, а список доступных моделей задаётся ключом, а не инструментом.

ИнструментKilo Code
ПротоколOpenAI-совместимый
Base URLhttps://api.tokenator.top/v1
Ключsk-your-tokenator-key

Требования и поддерживаемые ОС

  • Windows 10/11, macOS 12+ или современный Linux с 64-битной архитектурой.
  • Доступ в интернет к домену Tokenator по HTTPS.
  • API-ключ Tokenator вида sk-your-tokenator-key.

Нужен VS Code (или совместимый редактор) и установленное расширение из Marketplace.

Установка Kilo Code

Откройте панель расширений VS Code, найдите Kilo Code и нажмите Install.

Настройка Tokenator

  1. Зарегистрируйтесь в личном кабинете и купите пакет токенов.
  2. Ключ появится в кабинете сразу после подтверждения оплаты — копировать его нужно целиком, вместе с префиксом.
  3. В примерах ниже вместо настоящего ключа стоит плейсхолдер sk-your-tokenator-key. Не публикуйте настоящий ключ в репозиториях и скриншотах.

Конфигурация для Windows

  1. Откройте панель расширения и перейдите в настройки провайдера.
  2. В списке провайдеров выберите OpenAI Compatible.
  3. Base URL: https://api.tokenator.top/v1
  4. API Key: sk-your-tokenator-key
  5. Model ID: gpt-5.5 (или любой другой ID из каталога)
  6. Сохраните настройки и отправьте первое сообщение.
Настройки расширения хранятся в профиле VS Code, поэтому последовательность шагов на Windows, macOS и Linux не отличается. Если вы используете несколько профилей VS Code, ключ нужно указать в каждом.

Конфигурация для macOS и Linux

  1. Откройте панель расширения и перейдите в настройки провайдера.
  2. В списке провайдеров выберите OpenAI Compatible.
  3. Base URL: https://api.tokenator.top/v1
  4. API Key: sk-your-tokenator-key
  5. Model ID: gpt-5.5 (или любой другой ID из каталога)
  6. Сохраните настройки и отправьте первое сообщение.
Настройки расширения хранятся в профиле VS Code, поэтому последовательность шагов на Windows, macOS и Linux не отличается. Если вы используете несколько профилей VS Code, ключ нужно указать в каждом.

Первый запрос

Перед запуском инструмента полезно убедиться, что ключ и модель рабочие. Один запрос curl отвечает на оба вопроса сразу.

Проверка OpenAI-эндпоинта
curl https://api.tokenator.top/v1/chat/completions \
  -H "Authorization: Bearer sk-your-tokenator-key" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "gpt-5.5",
    "messages": [{"role": "user", "content": "ping"}]
  }'

Откройте проект в редакторе и отправьте любое сообщение в чат расширения. Если запрос дошёл, он появится в статистике ключа в личном кабинете.

Успешный ответ означает, что ключ действителен, модель разрешена для этого ключа и апстрим доступен. Расход виден в кабинете сразу после запроса.

Переключение моделей

Модель указывается полем Model ID в настройках провайдера. Base URL и ключ при смене модели менять не нужно.

Примеры ID моделей, доступных сейчас:

  • claude-haiku-4-5
  • claude-opus-4-6
  • claude-opus-4-7
  • claude-sonnet-4-6
  • gpt-5.5
  • deepseek-v4-flash

Актуальные ID и характеристики — в каталоге AI-моделей; там же видно, какие модели сейчас доступны. Выбрать между близкими вариантами помогает сравнение моделей.

Настройка reasoning

Если инструмент умеет передавать поле reasoning_effort в запросе, Tokenator пробрасывает его в апстрим без изменений. Дополнительно у самого ключа есть переключатель reasoning в личном кабинете — он действует независимо от инструмента.

Частые ошибки и способы исправления

СимптомПричинаЧто сделать
401 или сообщение о недействительном ключеКлюч скопирован с лишними пробелами, отозван, истёк или подставлен не в ту переменную окружения.Проверьте ключ в личном кабинете и убедитесь, что переменная окружения действительно попала в тот процесс, где запускается инструмент.
403Модель не входит в список разрешённых для этого ключа.Посмотрите список моделей ключа в кабинете и выберите ID из каталога моделей.
429Превышен лимит запросов в минуту или час либо лимит одновременных стримов для ключа.Уменьшите параллелизм агента и повторите запрос с экспоненциальной задержкой. Лимиты ключа видны в кабинете.
Модель не найдена / не поддерживаетсяВ запросе указан ID, которого нет в каталоге, либо алиас, недоступный этому ключу.Скопируйте точный API ID со страницы модели — регистр и точки значимы.
Запрос завис или обрывается на длинном ответеКлиент закрыл соединение по своему таймауту раньше, чем модель закончила генерацию.Включите потоковый режим (stream: true) и увеличьте таймаут клиента: у длинных reasoning-ответов первый токен может прийти не сразу.
Ошибка вида «Request error» без деталейАпстрим-провайдер вернул ошибку. Её текст не передаётся клиенту.Повторите запрос: Tokenator сам переключается на следующего провайдера модели. Если ошибка стабильна — напишите в поддержку.

Частые вопросы

Нужна ли подписка Kilo Code или отдельный аккаунт провайдера?

Нет. Инструмент обращается к Tokenator, а оплата идёт токенами вашего ключа Tokenator.

Где посмотреть расход после подключения?

В личном кабинете: там видны запросы, израсходованные токены и остаток лимита ключа.

Можно ли использовать один ключ в нескольких инструментах?

Да. Ограничение — лимиты самого ключа: запросы в минуту и час, а также количество одновременных стримов.

Что будет, если токены закончатся посреди сессии?

Запросы начнут возвращать ошибку. Лимит восстанавливается пополнением того же ключа — переустанавливать инструмент не нужно.

Как вернуться к прежнему провайдеру?

Уберите добавленные настройки — переменные окружения или блок провайдера в конфиге. Инструмент вернётся к своему поведению по умолчанию.

Где почитать про сам формат API?

В документации Tokenator API и на странице про OpenAI-compatible API.