No provider description is available for this model yet.
Models
Every model in the catalog with source-linked pricing, context limits, provider availability, and published benchmark results.
No provider description is available for this model yet.
No provider description is available for this model yet.
No provider description is available for this model yet.
No provider description is available for this model yet.
No provider description is available for this model yet.
Compared with GLM-4.5, this generation brings several key improvements: Longer context window: The context window has been expanded from 128K to 200K tokens, enabling the model to handle more complex...
No provider description is available for this model yet.
No provider description is available for this model yet.
No provider description is available for this model yet.
Mercury 2.5 is the fastest reasoning LLM, and the latest diffusion LLM (dLLM) from Inception. Instead of generating tokens sequentially, Mercury 2.5 produces and refines multiple tokens in parallel, achieving...
No provider description is available for this model yet.
No provider description is available for this model yet.
No provider description is available for this model yet.
No provider description is available for this model yet.
No provider description is available for this model yet.
No provider description is available for this model yet.
No provider description is available for this model yet.
No provider description is available for this model yet.
DeepSeek V4 Pro 0813 is a large-scale mixture-of-experts model from DeepSeek. This is the GA release of DeepSeek V4 Pro.
No provider description is available for this model yet.
No provider description is available for this model yet.
No provider description is available for this model yet.
No provider description is available for this model yet.
Qwen3.8 Max 0902 is an updated snapshot of Qwen3.8 Max from Alibaba's Qwen team. It is a 2.4-trillion-parameter mixture-of-experts model that accepts text, image, and video input and returns text,...
No provider description is available for this model yet.
No provider description is available for this model yet.
No provider description is available for this model yet.
GPT-6 Astra Pro is the same underlying model as [GPT-6 Astra](https://openrouter.ai/openai/gpt-6-astra), served with `reasoning.mode` set to `pro` for higher-quality responses on complex tasks. Learn more in OpenAI's docs: https://developers.openai.com/api/docs/guides/reasoning#reasoning-mode
No provider description is available for this model yet.
No provider description is available for this model yet.
Qwen3.8 27B is an open-weight dense vision-language model from Qwen. It is suited for coding, professional workflows, research, multimodal interaction, and long-running agent tasks, with flexible thinking that can be...
No provider description is available for this model yet.
No provider description is available for this model yet.
No provider description is available for this model yet.
No provider description is available for this model yet.
No provider description is available for this model yet.
No provider description is available for this model yet.
GPT-4.1 Mini is a mid-sized model delivering performance competitive with GPT-4o at substantially lower latency and cost. It retains a 1 million token context window and scores 45.1% on hard...
No provider description is available for this model yet.
No provider description is available for this model yet.
No provider description is available for this model yet.
No provider description is available for this model yet.
No provider description is available for this model yet.
No provider description is available for this model yet.
No provider description is available for this model yet.
No provider description is available for this model yet.
No provider description is available for this model yet.
No provider description is available for this model yet.
No provider description is available for this model yet.
| Model | Creator | Inputs | Context | Input | Output | Released | Compare |
|---|---|---|---|---|---|---|---|
| us/gpt-5.5azure/us/gpt-5.5 | 1.05M | $5.5 | $33 | — | |||
| eu/gpt-5.5azure/eu/gpt-5.5 | 1.05M | $5.5 | $33 | — | |||
| open-mistral-nemo-2407mistral/open-mistral-nemo-2407 | 128K | $0.3 | $0.3 | — | |||
| gpt-5.5-2026-04-23azure/gpt-5.5-2026-04-23 | 1.05M | $5 | $30 | — | |||
| llama-3.3-70bcerebras/llama-3.3-70b | 128K | $0.85 | $1.2 | — | |||
| gemini-2.5-flash-litevertex_ai-language-models/gemini-2.5-flash-lite | 1.04858M | $0.1 | $0.4 | — | |||
| Z.ai: GLM 4.6z-ai/glm-4.6 | 198K | $0.43 | $1.75 | — | |||
| minimax/minimax-m2.7:freeopenrouter/minimax/minimax-m2.7:free | 196.608K | Free | Free | — | |||
| us/gpt-5.5-2026-04-23azure/us/gpt-5.5-2026-04-23 | 1.05M | $5.5 | $33 | — | |||
| eu/gpt-5.5-2026-04-23azure/eu/gpt-5.5-2026-04-23 | 1.05M | $5.5 | $33 | — | |||
| Inception: Mercury 2.5 Previewinception/mercury-2.5-preview | 260K | $0.2 | $0.75 | — | |||
| gpt-5.4-miniazure/gpt-5.4-mini | 272K | $0.75 | $4.5 | — | |||
| llama3.1-70bcerebras/llama3.1-70b | 128K | $0.6 | $0.6 | — | |||
| minimax/minimax-m2.7openrouter/minimax/minimax-m2.7 | 204.8K | $0.3 | $1.2 | — | |||
| grok-2-latestxai/grok-2-latest | 131.072K | $2 | $10 | — | |||
| z-ai/glm-5v-turboopenrouter/z-ai/glm-5v-turbo | 202.752K | $1.2 | $4 | — | |||
| google/gemma-4-31b-it:freeopenrouter/google/gemma-4-31b-it:free | 262.144K | Free | Free | — | |||
| grok-2-1212xai/grok-2-1212 | 131.072K | $2 | $10 | — | |||
| gpt-5.4-nanoazure/gpt-5.4-nano | 272K | $0.2 | $1.25 | — | |||
| DeepSeek: DeepSeek V4 Pro 0813 (batch)deepseek/deepseek-v4-pro-0813:batch | 1.04858M | $0.66 | $1.98 | — | |||
| open-mistral-nemomistral/open-mistral-nemo | 128K | $0.3 | $0.3 | — | |||
| google/gemma-4-31b-itopenrouter/google/gemma-4-31b-it | 262.144K | $0.09 | $0.34 | — | |||
| gpt-5.4-nano-2026-03-17azure/gpt-5.4-nano-2026-03-17 | 272K | $0.2 | $1.25 | — | |||
| mistral-large-2402azure/mistral-large-2402 | 32K | $8 | $24 | — | |||
| Qwen: Qwen3.8 Max (0902)qwen/qwen3.8-max-0902 | 1M | $2 | $6 | — | |||
| mistral-large-latestazure/mistral-large-latest | 32K | $8 | $24 | — | |||
| o1azure/o1 | 200K | $15 | $60 | — | |||
| o1-2024-12-17azure/o1-2024-12-17 | 200K | $15 | $60 | — | |||
| OpenAI: GPT-6 Astra Proopenai/gpt-6-astra-pro | 1.05M | $10 | $50 | — | |||
| o1-miniazure/o1-mini | 128K | $1.21 | $4.84 | — | |||
| o1-mini-2024-09-12azure/o1-mini-2024-09-12 | 128K | $1.1 | $4.4 | — | |||
| Qwen: Qwen3.8 27Bqwen/qwen3.8-27b | 262.144K | $0.214 | $2.55 | — | |||
| o1-previewazure/o1-preview | 128K | $15 | $60 | — | |||
| o1-preview-2024-09-12azure/o1-preview-2024-09-12 | 128K | $15 | $60 | — | |||
| llama3.1-8bcerebras/llama3.1-8b | 128K | $0.1 | $0.1 | — | |||
| o3azure/o3 | 200K | $2 | $8 | — | |||
| google/gemma-4-26b-a4b-it:freeopenrouter/google/gemma-4-26b-a4b-it:free | 262.144K | Free | Free | — | |||
| o3-2025-04-16azure/o3-2025-04-16 | 200K | $2 | $8 | — | |||
| OpenAI: GPT-4.1 Mini (batch)openai/gpt-4.1-mini:batch | 1.04758M | $0.2 | $0.8 | — | |||
| o3-miniazure/o3-mini | 200K | $1.1 | $4.4 | — | |||
| o3-mini-2025-01-31azure/o3-mini-2025-01-31 | 200K | $1.1 | $4.4 | — | |||
| gpt-oss-120bcerebras/gpt-oss-120b | 131.072K | $0.35 | $0.75 | — | |||
| o4-miniazure/o4-mini | 200K | $1.1 | $4.4 | — | |||
| o4-mini-2025-04-16azure/o4-mini-2025-04-16 | 200K | $1.1 | $4.4 | — | |||
| grok-2xai/grok-2 | 131.072K | $2 | $10 | — | |||
| us/gpt-4.1-mini-2025-04-14azure/us/gpt-4.1-mini-2025-04-14 | 1.04758M | $0.44 | $1.76 | — | |||
| us/gpt-4.1-nano-2025-04-14azure/us/gpt-4.1-nano-2025-04-14 | 1.04758M | $0.11 | $0.44 | — | |||
| us/gpt-4o-2024-08-06azure/us/gpt-4o-2024-08-06 | 128K | $2.75 | $11 | — | |||
| us/gpt-4o-2024-11-20azure/us/gpt-4o-2024-11-20 | 128K | $2.75 | $11 | — | |||
| google/gemma-4-26b-a4b-itopenrouter/google/gemma-4-26b-a4b-it | 262.144K | $0.07 | $0.34 | — |