Gemini 3.8 Flash via the Tokenator API

What the model is for

Gemini 3.8 Flash is Google's most intelligent Flash model with significant gains from 3.7 Flash across software engineering, agentic tasks, and multi-step reasoning.

Specification

Full nameGemini 3.8 Flash
API IDgemini-3.8-flash
Model vendorGemini
TypeText model (chat / completions)
Context window1M tokens
Max output65.5K tokens
Image inputyes
Tokenator usage multiplier
Input modalitiestext, image, audio, video, file
Aliasescursor-gemini-3.8-flash
Supported API formats/v1/chat/completions /v1/responses /v1/messages
Current statuscurrently unavailable
Data updated2026-09-02

Example request

curl
curl https://api.tokenator.top/v1/chat/completions \
  -H "Authorization: Bearer sk-your-tokenator-key" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "gemini-3.8-flash",
    "messages": [{"role": "user", "content": "Hello"}]
  }'

Compatible tools

The model can be used in any tool that accepts a custom base URL: Claude Code, Codex CLI, OpenCode, Cursor, Cline, Kilo Code, Cherry Studio, OpenClaw.

FAQ about Gemini 3.8 Flash

What is the API ID of Gemini 3.8 Flash?

gemini-3.8-flash — put this into the model field of your request.

What context window does Gemini 3.8 Flash have?

1M tokens; max output is 65.5K tokens.

How many tokens will a request cost?

(input + output) × 1×. See the documentation for details.

Which tools support this model?

Any tool that accepts a custom base URL: Claude Code, Codex CLI, OpenCode, Cursor, Cline, Kilo Code. Setup guides are in the integrations section.