Gemini 3.1 Flash Lite via the Tokenator API

What the model is for

Gemini 3.1 Flash Lite is Google’s GA high-efficiency multimodal model optimized for low-latency, high-volume workloads.

Specification

Full nameGemini 3.1 Flash Lite
API IDgemini-3.1-flash-lite
Model vendorGemini
TypeText model (chat / completions)
Context window1M tokens
Max output65.5K tokens
Image inputyes
Tokenator usage multiplier1.5×
Input modalitiestext, image, audio, video, file
Aliasescursor-gemini-3.1-flash-lite
Supported API formats/v1/chat/completions /v1/responses /v1/messages
Upstream providers2
Current statusavailable
Data updated2026-08-04

Upstream providers

ProviderMultiplier
Gemini Partner #11.5×
Gemini Partner #31.5×

A request goes to the first available provider by priority; if it fails, Tokenator switches to the next one.

Example request

curl
curl https://api.tokenator.top/v1/chat/completions \
  -H "Authorization: Bearer sk-your-tokenator-key" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "gemini-3.1-flash-lite",
    "messages": [{"role": "user", "content": "Hello"}]
  }'

Compatible tools

The model can be used in any tool that accepts a custom base URL: Claude Code, Codex CLI, OpenCode, Cursor, Cline, Kilo Code, OpenClaw.

FAQ about Gemini 3.1 Flash Lite

What is the API ID of Gemini 3.1 Flash Lite?

gemini-3.1-flash-lite — put this into the model field of your request.

What context window does Gemini 3.1 Flash Lite have?

1M tokens; max output is 65.5K tokens.

How many tokens will a request cost?

(input + output) × 1.5×. See the documentation for details.

Which tools support this model?

Any tool that accepts a custom base URL: Claude Code, Codex CLI, OpenCode, Cursor, Cline, Kilo Code. Setup guides are in the integrations section.