Merge Gateway serves 145 of the models we track. We do not support bring-your-own-key for this provider yet.
| Model | Made by | Input / 1M | Output / 1M | Context |
|---|---|---|---|---|
| Nemotron 3.5 Lightning 30B A3B | NVIDIA | $0 | $0 | 1.0M |
| GLM-5.3-Flash | Zhipu AI | $0.015 | $0.05 | 1.0M |
| Qwen Flash | Alibaba | $0.022 | $0.216 | 1.0M |
| DeepSeek V4 Flash 0731 | Alibaba | $0.035 | $0.07 | 1.0M |
| DeepSeek V4 Flash | DeepSeek | $0.035 | $0.07 | 1.0M |
| GPT-OSS 20B | OpenAI | $0.04 | $0.2 | 131K |
| Gemma 3 4B | $0.04 | $0.08 | 128K | |
| GPT-5 Nano | OpenAI | $0.05 | $0.4 | 400K |
| Qwen3.5 35B-A3B | Alibaba | $0.057 | $0.459 | 131K |
| GLM-4.7-FlashX | Zhipu AI | $0.07 | $0.4 | 200K |
| GLM-4.7-Flash | Zhipu AI | $0.07 | $0.4 | 200K |
| GPT OSS Safeguard 20B | Amazon Bedrock | $0.07 | $0.2 | 4K |
| Gemma 3 27B IT | Amazon Bedrock | $0.08 | $0.45 | 131K |
| Qwen3.5 27B | Alibaba | $0.086 | $0.688 | 256K |
| Gemma 3 12B | $0.09 | $0.29 | 128K | |
| GPT-OSS 120B | OpenAI | $0.09 | $0.36 | 131K |
| Gemini 2.5 Flash Lite | $0.1 | $0.4 | 1.0M | |
| Devstral Small | Mistral | $0.1 | $0.3 | 128K |
| Qwen3 235B-A22B Instruct 2507 | Amazon Bedrock | $0.1 | $0.6 | 131K |
| GPT-4.1 Nano | OpenAI | $0.1 | $0.4 | 1.0M |
| Qwen3.5 Plus | Alibaba | $0.115 | $0.688 | 1.0M |
| Qwen3.5 122B-A10B | Alibaba | $0.115 | $0.917 | 256K |
| Qwen Plus | Alibaba | $0.115 | $0.287 | 1.0M |
| Gemma 4 31B IT | $0.14 | $0.4 | 262K | |
| Qwen3-VL Plus | Alibaba | $0.143 | $1.434 | 262K |
| Qwen3 Coder Flash | Alibaba | $0.144 | $0.574 | 1.0M |
| Qwen3-Next 80B-A3B Instruct | Alibaba | $0.144 | $0.574 | 131K |
| DeepSeek V4.1 Flash | DeepSeek | $0.15 | $0.6 | 1.0M |
| GPT OSS Safeguard 120B | Amazon Bedrock | $0.15 | $0.6 | 4K |
| Qwen3 Coder Next | Amazon Bedrock | $0.15 | $0.8 | 262K |
| GPT-4o Mini | OpenAI | $0.15 | $0.6 | 128K |
| Gemini Embedding 001 | $0.15 | $0 | 2K | |
| Qwen3-Next 80B-A3B (Thinking) | Alibaba | $0.15 | $1.2 | 131K |
| Mistral Small (latest) | Mistral | $0.15 | $0.6 | 256K |
| Qwen3.6 Flash | Alibaba | $0.165 | $0.99 | 1.0M |
| Qwen3.5 397B-A17B | Alibaba | $0.172 | $1.032 | 256K |
| GPT-5.4 nano | OpenAI | $0.2 | $1.25 | 400K |
| GPT-5.6 Luna | OpenAI | $0.2 | $1.2 | 1.1M |
| GLM-4.5-Air | Zhipu AI | $0.2 | $1.1 | 128K |
| Llama 3.3 70b Instruct | NVIDIA | $0.22 | $0.5 | 131K |
| Qwen3-Coder 480B-A35B Instruct | Alibaba | $0.22 | $1.8 | 131K |
| Qwen3.6 35B-A3B | Alibaba | $0.248 | $1.485 | 262K |
| Gemini Flash-Lite Latest | $0.25 | $1.5 | 1.0M | |
| GPT-5 Mini | OpenAI | $0.25 | $2 | 400K |
| Gemini 3.1 Flash Lite | $0.25 | $1.5 | 1.0M | |
| Qwen3.6 Plus | Alibaba | $0.276 | $1.651 | 1.0M |
| DeepSeek V3.2 | DeepSeek | $0.28 | $0.45 | 164K |
| Qwen3 VL 235B A22B Instruct | Amazon Bedrock | $0.287 | $1.147 | 131K |
| Qwen3 235B-A22B | Alibaba | $0.287 | $1.147 | 131K |
| Qwen3.6 27B | Alibaba | $0.289 | $2.4 | 131K |
| Gemini 2.5 Flash | $0.3 | $2.5 | 1.0M | |
| MiniMax-M2.7 | MiniMax | $0.3 | $1.2 | 205K |
| Codestral | Mistral | $0.3 | $0.9 | 256K |
| MiniMax M2.5 | MiniMax | $0.3 | $1.2 | 205K |
| Gemini 3.5 Flash Lite | $0.3 | $2.5 | 1.0M | |
| MiniMax-M2.1 | MiniMax | $0.3 | $1.2 | 205K |
| MiniMax-M2 | MiniMax | $0.3 | $1.2 | 205K |
| MiniMax-M3 | MiniMax | $0.3 | $1.2 | 1.0M |
| Devstral Medium | Mistral | $0.4 | $2 | 128K |
| GPT-4.1 Mini | OpenAI | $0.4 | $1.6 | 1.0M |
| Mistral Medium (latest) | Mistral | $0.4 | $2 | 262K |
| Mistral Medium 3 | Mistral | $0.4 | $2 | 128K |
| Qwen3.7 Plus | Alibaba | $0.4 | $1.6 | 1.0M |
| Devstral 2 | Mistral | $0.4 | $2 | 262K |
| GPT-3.5-turbo | OpenAI | $0.5 | $1.5 | 16K |
| Mistral Large (latest) | Mistral | $0.5 | $1.5 | 262K |
| Mistral Large 3 | Mistral | $0.5 | $1.5 | 256K |
| DeepSeek V3.1 | DeepSeek | $0.5 | $1.5 | 164K |
| Qwen3 Coder Plus | Alibaba | $0.574 | $2.294 | 1.0M |
| Kimi K2.5 | Moonshot AI | $0.6 | $3 | 262K |
| GLM-4.5V | Zhipu AI | $0.6 | $1.8 | 128K |
| GLM-4.5 | Zhipu AI | $0.6 | $2.2 | 128K |
| GLM-4.6 | Zhipu AI | $0.6 | $2.2 | 200K |
| GLM-4.7 | Zhipu AI | $0.6 | $2.2 | 200K |
| MiniMax-M2.7-highspeed | MiniMax | $0.6 | $2.4 | 205K |
| MiniMax-M2.5-highspeed | MiniMax | $0.6 | $2.4 | 205K |
| Kimi K2 Thinking | Vertex | $0.6 | $2.5 | 262K |
| Palmyra X5 (US) | Amazon Bedrock | $0.6 | $6 | 1.0M |
| DeepSeek V4 Pro | DeepSeek | $0.66 | $1.98 | 1.0M |
| DeepSeek V4 Pro 0813 | NVIDIA | $0.66 | $1.98 | 1.0M |
| GLM-5.3 | Zhipu AI | $0.7 | $2.2 | 1.0M |
| GPT-5.4 mini | OpenAI | $0.75 | $4.5 | 400K |
| Gemini 3.8 Flash | $0.75 | $3.75 | 1.0M | |
| Gemini 3.7 Flash | $0.75 | $3.75 | 1.0M | |
| Qwen3.7 Max | Alibaba | $0.825 | $2.4755 | 1.0M |
| Kimi K2.6 | Moonshot AI | $0.95 | $4 | 262K |
| Kimi K2.7 Code | Moonshot AI | $0.95 | $4 | 262K |
| Grok Build 0.1 | xAI | $1 | $2 | 256K |
| Claude Haiku 4.5 | Anthropic | $1 | $5 | 200K |
| Inkling | NVIDIA | $1 | $4.05 | 1.0M |
| GLM-5 | Zhipu AI | $1 | $3.2 | 200K |
| GLM-5.2 | Mistral | $1.05 | $3.3 | 1.0M |
| o4 Mini | OpenAI | $1.1 | $4.4 | 200K |
| o3 Mini | OpenAI | $1.1 | $4.4 | 200K |
| GPT-5 | OpenAI | $1.25 | $10 | 400K |
| Gemini 2.5 Pro | $1.25 | $10 | 1.0M | |
| Grok 4.20 (Reasoning) | xAI | $1.25 | $2.5 | 1.0M |
| Grok 4.3 | xAI | $1.25 | $2.5 | 1.0M |
| Muse Spark 1.2 | Meta | $1.25 | $4.25 | 1.0M |
| Muse Spark 1.1 | Meta | $1.25 | $4.25 | 1.0M |
| GPT-5.1 | OpenAI | $1.25 | $10 | 400K |
| Qwen3.6 Max Preview | Alibaba | $1.31 | $7.88 | 256K |
| DeepSeek R1 | DeepSeek | $1.35 | $5.4 | 164K |
| GLM-5.1 | Zhipu AI | $1.4 | $4.4 | 200K |
| Gemini 3.6 Flash | $1.5 | $7.5 | 1.0M | |
| Gemini Flash Latest | $1.5 | $9 | 1.0M | |
| Gemini 3.5 Flash | $1.5 | $9 | 1.0M | |
| GPT-5.3 Chat (latest) | OpenAI | $1.75 | $14 | 128K |
| GPT-5.2 | OpenAI | $1.75 | $14 | 400K |
| GPT-5.2 Chat | OpenAI | $1.75 | $14 | 128K |
| Kimi K2.7 Code HighSpeed | Moonshot AI | $1.9 | $8 | 262K |
| GPT-5.6 Terra | OpenAI | $2 | $12 | 1.1M |
| Magistral Medium (latest) | Mistral | $2 | $5 | 128K |
| o3 | OpenAI | $2 | $8 | 200K |
| Grok 4.6 | xAI | $2 | $6 | 500K |
| Pixtral Large | Mistral | $2 | $6 | 128K |
| GPT-4.1 | OpenAI | $2 | $8 | 1.0M |
| Grok 4.5 | xAI | $2 | $6 | 500K |
| Mistral Large 2.1 | Mistral | $2 | $6 | 131K |
| Qwen3.8 Max | Alibaba | $2 | $6 | 1.0M |
| Gemini 3 Pro | $2 | $12 | 1.0M | |
| GPT-4o | OpenAI | $2.5 | $10 | 128K |
| Palmyra X4 (US) | Amazon Bedrock | $2.5 | $10 | 128K |
| GPT-5.4 | OpenAI | $2.5 | $15 | 1.1M |
| Kimi K3 | Moonshot AI | $2.9 | $14 | 1.0M |
| Claude Sonnet 5 | Anthropic | $3 | $15 | 1.0M |
| Claude Sonnet 4.6 | Anthropic | $3 | $15 | 1.0M |
| Claude Sonnet 4 | Anthropic | $3 | $15 | 200K |
| Claude Sonnet 4.5 | Anthropic | $3 | $15 | 200K |
| Claude 3.7 Sonnet | Anthropic | $3 | $15 | 200K |
| Claude Opus 5 | Anthropic | $5 | $25 | 1.0M |
| GPT-5.6 Sol | OpenAI | $5 | $30 | 1.1M |
| Claude Opus 4.8 | Anthropic | $5 | $25 | 1.0M |
| Claude Opus 4.5 | Anthropic | $5 | $25 | 200K |
| Claude Opus 4.7 | Anthropic | $5 | $25 | 1.0M |
| Claude Opus 4.6 | Anthropic | $5 | $25 | 1.0M |
| GPT-5.5 | OpenAI | $5 | $30 | 1.1M |
| GPT-4 Turbo | OpenAI | $10 | $30 | 128K |
| Claude Fable 5.1 | Anthropic | $10 | $50 | 1.0M |
| Claude Fable 5 | Anthropic | $10 | $50 | 1.0M |
| GPT-6 Astra | OpenAI | $10 | $50 | 1.1M |
| Claude Opus 4.1 | Vertex | $15 | $75 | 200K |
| Claude Opus 4 | Anthropic | $15 | $75 | 200K |
| o1 | OpenAI | $15 | $60 | 200K |
| GPT-4 | OpenAI | $30 | $60 | 8K |
Merge Gateway serves 145 of the models we track, across 1 model type.
Nemotron 3.5 Lightning 30B A3B at $0 per million input tokens.
Not yet — Merge Gateway is not currently one of the providers Serenities supports for bring-your-own-key.