Length
integer
175 models
Max tokens
max_tokens
Maximum number of output tokens the model may generate.
- Type
- integer
- Default
- varies by model
- Range
- 1 – 131072
max_tokens by model
The exact type, default, range, and conditions for max_tokens on each model that documents it.
Models without max_tokens documented yet
max_tokens documented yet
These models don't list max_tokens in the catalog. That may mean the provider doesn't accept it, or it simply hasn't been added yet — the data is community-maintained.
Alibaba
Bedrock
Claude Haiku 4.5
Claude Opus 4.5 20251101
Claude Opus 4.6
Claude Sonnet 4.5
Claude Sonnet 4.6
DeepSeek R1
DeepSeek v3.2
Devstral 2 123B
Gemma 3 12B IT
Gemma 3 27B IT
Gemma 3 4B IT
GLM-4.7
GLM-4.7 Flash
GLM-5
GPT-OSS 120B
GPT-OSS 20B
GPT-OSS Safeguard 120B
GPT-OSS Safeguard 20B
Kimi K2 Thinking
Kimi K2.5
Llama3 1 70B Instruct
Llama3 1 8B Instruct
Llama3 3 70B Instruct
Llama3 70B Instruct
Llama3 8B Instruct
Magistral Small 2509
MiniMax M2
MiniMax M2.1
MiniMax M2.5
Ministral 3 14B Instruct
Ministral 3 3B Instruct
Ministral 3 8B Instruct
Mistral 7B Instruct
Mistral Large 2402
Mistral Large 3 675B Instruct
Mistral Small 2402
Mixtral 8x7b Instruct
Nemotron Nano 12B
Nemotron Nano 3 30B
Nemotron Nano 9B
Nemotron Super 3 120B
Nova 2 Lite
Nova Lite
Nova Micro
Nova Pro
Palmyra Vision 7B
Palmyra X4
Palmyra X5
Pixtral Large 2502
Qwen3 32B
Qwen3 Coder 30B A3B
Qwen3 Coder Next
Qwen3 Next 80B A3B
Qwen3 Vl 235B A22B
Voxtral Mini 3B 2507
Voxtral Small 24B 2507
Cerebras
Gemini 2.5 Flash
Gemini 2.5 Flash
Gemini 2.5 Flash Lite
Gemini 2.5 Flash Lite
Gemini 2.5 Pro
Gemini 2.5 Pro
Gemini 3 Flash Preview
Gemini 3 Flash Preview
Gemini 3.1 Flash Lite
Gemini 3.1 Flash Lite
Gemini 3.1 Flash Lite Preview
Gemini 3.1 Flash Lite Preview
Gemini 3.1 Pro Preview
Gemini 3.1 Pro Preview
Gemini 3.1 Pro Preview Customtools
Gemini 3.5 Flash
Gemini 3.5 Flash Lite
Gemini 3.6 Flash
Gemini 3.7 Flash
Gemini Flash Latest
Gemma 3 12B IT
Gemma 3 1B IT
Gemma 3 27B IT
Gemma 3 4B IT
Gemma 3n E2B IT
Gemma 3n E4B IT
Gemma 4 12B IT
Gemma 4 26B A4B IT
Gemma 4 31B IT
Gemma 4 E2B IT
Gemma 4 E4B IT
Meta
MiniMax
Moonshot AI
OpenAI
GPT-4
GPT-5
GPT-5 Chat Latest
GPT-5 Mini
GPT-5 Nano
GPT-5.1
GPT-5.1 Codex
GPT-5.1 Codex Max
GPT-5.2
GPT-5.2
GPT-5.2 Codex
GPT-5.3 Codex
GPT-5.3 Codex
GPT-5.3 Codex Spark
GPT-5.4
GPT-5.4
GPT-5.4 Mini
GPT-5.4 Mini
GPT-5.4 Nano
GPT-5.4 Pro
GPT-5.4 Pro
GPT-5.5
GPT-5.5
GPT-5.5 Pro
GPT-5.5 Pro
GPT-5.6
GPT-5.6 Luna
GPT-5.6 Luna
GPT-5.6 Sol
GPT-5.6 Sol
GPT-5.6 Terra
GPT-5.6 Terra
GPT-OSS 120B
GPT-OSS 20B
GPT-OSS Safeguard 120B
GPT-OSS Safeguard 20B
o1
o3
o3-mini
o3-pro
o4-mini
Vertex
xAI
Xiaomi
Related length parameters
Max completion tokens
max_completion_tokens
Max tokens
inferenceConfig.maxTokens
Stop sequences
inferenceConfig.stopSequences
Stop sequence
stop
Max output tokens
generationConfig.maxOutputTokens
Candidate count
generationConfig.candidateCount
Stop sequences
generationConfig.stopSequences
Stop sequences
stop_sequences
Number of completions
n
Max output tokens
max_output_tokens