No provider description is available for this model yet.
Models
Every model in the catalog with source-linked pricing, context limits, provider availability, and published benchmark results.
No provider description is available for this model yet.
No provider description is available for this model yet.
No provider description is available for this model yet.
Qwen3-14B is a dense 14.8B parameter causal language model from the Qwen3 series, designed for both complex reasoning and efficient dialogue. It supports seamless switching between a "thinking" mode for...
No provider description is available for this model yet.
No provider description is available for this model yet.
No provider description is available for this model yet.
No provider description is available for this model yet.
No provider description is available for this model yet.
No provider description is available for this model yet.
Claude Opus 4 is benchmarked as the world’s best coding model, at time of release, bringing sustained performance on complex, long-running tasks and agent workflows. It sets new benchmarks in...
No provider description is available for this model yet.
No provider description is available for this model yet.
A cost-efficient version of GPT Audio. The new snapshot features an upgraded decoder for more natural sounding voices and maintains better voice consistency. Input is priced at $0.60 per million...
No provider description is available for this model yet.
No provider description is available for this model yet.
No provider description is available for this model yet.
No provider description is available for this model yet.
No provider description is available for this model yet.
No provider description is available for this model yet.
No provider description is available for this model yet.
No provider description is available for this model yet.
No provider description is available for this model yet.
No provider description is available for this model yet.
No provider description is available for this model yet.
No provider description is available for this model yet.
No provider description is available for this model yet.
No provider description is available for this model yet.
No provider description is available for this model yet.
No provider description is available for this model yet.
No provider description is available for this model yet.
No provider description is available for this model yet.
No provider description is available for this model yet.
No provider description is available for this model yet.
No provider description is available for this model yet.
No provider description is available for this model yet.
No provider description is available for this model yet.
No provider description is available for this model yet.
No provider description is available for this model yet.
No provider description is available for this model yet.
No provider description is available for this model yet.
No provider description is available for this model yet.
No provider description is available for this model yet.
No provider description is available for this model yet.
No provider description is available for this model yet.
Mercury 2.5 is the fastest reasoning LLM, and the latest diffusion LLM (dLLM) from Inception. Instead of generating tokens sequentially, Mercury 2.5 produces and refines multiple tokens in parallel, achieving...
No provider description is available for this model yet.
No provider description is available for this model yet.
No provider description is available for this model yet.
| Model | Creator | Inputs | Context | Input | Output | Released | Compare |
|---|---|---|---|---|---|---|---|
| us-west-2/qwen.qwen3-coder-nextbedrock/us-west-2/qwen.qwen3-coder-next | 262.144K | $0.5 | $1.2 | — | |||
| davinci-002text-completion-openai/davinci-002 | 16.384K | $2 | $2 | — | |||
| mistral-7B-Instruct-v0.1ollama/mistral-7b-instruct-v0.1 | 8.192K | — | — | — | |||
| mistral-7B-Instruct-v0.2ollama/mistral-7b-instruct-v0.2 | 32.768K | — | — | — | |||
| Qwen: Qwen3 14Bqwen/qwen3-14b | 40.96K | $0.12 | $0.24 | — | |||
| us/gpt-5.6-solazure/us/gpt-5.6-sol | 1.05M | $5.5 | $33 | — | |||
| us/gpt-5.6-terraazure/us/gpt-5.6-terra | 1.05M | $2.75 | $16.5 | — | |||
| mistral-large-instruct-2407ollama/mistral-large-instruct-2407 | 65.536K | — | — | — | |||
| mixtral-8x22B-Instruct-v0.1ollama/mixtral-8x22b-instruct-v0.1 | 65.536K | — | — | — | |||
| us/gpt-5.6-lunaazure/us/gpt-5.6-luna | 1.05M | $1.1 | $6.6 | — | |||
| eu/gpt-5.6azure/eu/gpt-5.6 | 1.05M | $5.5 | $33 | — | |||
| Anthropic: Claude Opus 4anthropic/claude-opus-4 | 200K | $15 | $75 | — | |||
| microsoft/Dayhoff-170M-UR90-HL-28000microsoft/Dayhoff-170M-UR90-HL-28000 | Not documented | — | — | — | |||
| microsoft/Dayhoff-170M-UR90-HL-26000microsoft/Dayhoff-170M-UR90-HL-26000 | Not documented | — | — | — | |||
| OpenAI: GPT Audio Miniopenai/gpt-audio-mini | 128K | $0.6 | $2.4 | — | |||
| microsoft/Dayhoff-170M-UR90-HL-24000microsoft/Dayhoff-170M-UR90-HL-24000 | Not documented | — | — | — | |||
| microsoft/Dayhoff-170M-UR90-HL-22000microsoft/Dayhoff-170M-UR90-HL-22000 | Not documented | — | — | — | |||
| microsoft/Dayhoff-170M-UR90-HL-20000microsoft/Dayhoff-170M-UR90-HL-20000 | Not documented | — | — | — | |||
| eu/gpt-5.6-solazure/eu/gpt-5.6-sol | 1.05M | $5.5 | $33 | — | |||
| pplx-70b-onlineperplexity/pplx-70b-online | 4.096K | — | $2.8 | — | |||
| pplx-7b-chatperplexity/pplx-7b-chat | 8.192K | $0.07 | $0.28 | — | |||
| microsoft/Dayhoff-170M-UR90-HL-18000microsoft/Dayhoff-170M-UR90-HL-18000 | Not documented | — | — | — | |||
| eu/gpt-5.6-terraazure/eu/gpt-5.6-terra | 1.05M | $2.75 | $16.5 | — | |||
| eu/gpt-5.6-lunaazure/eu/gpt-5.6-luna | 1.05M | $1.1 | $6.6 | — | |||
| microsoft/Dayhoff-170M-UR90-HL-14000microsoft/Dayhoff-170M-UR90-HL-14000 | Not documented | — | — | — | |||
| us.anthropic.claude-3-5-haiku-20241022-v1:0bedrock/us.anthropic.claude-3-5-haiku-20241022-v1:0 | 200K | $0.8 | $4 | — | |||
| pplx-7b-onlineperplexity/pplx-7b-online | 4.096K | — | $0.28 | — | |||
| sonar-medium-chatperplexity/sonar-medium-chat | 16.384K | $0.6 | $1.8 | — | |||
| sonar-medium-onlineperplexity/sonar-medium-online | 12K | — | $1.8 | — | |||
| microsoft/Dayhoff-170M-UR90-HL-12000microsoft/Dayhoff-170M-UR90-HL-12000 | Not documented | — | — | — | |||
| microsoft/Dayhoff-170M-UR90-HL-10000microsoft/Dayhoff-170M-UR90-HL-10000 | Not documented | — | — | — | |||
| microsoft/Dayhoff-170M-UR90-HL-6000microsoft/Dayhoff-170M-UR90-HL-6000 | Not documented | — | — | — | |||
| gpt-5.5azure/gpt-5.5 | 1.05M | $5 | $30 | — | |||
| microsoft/Dayhoff-170M-UR90-HL-2000microsoft/Dayhoff-170M-UR90-HL-2000 | Not documented | — | — | — | |||
| deepseek-ai/ESFT-gate-summary-litedeepseek-ai/ESFT-gate-summary-lite | Not documented | — | — | — | |||
| microsoft/Dayhoff-170M-GRS-76000microsoft/Dayhoff-170M-GRS-76000 | Not documented | — | — | — | |||
| us/gpt-5.5azure/us/gpt-5.5 | 1.05M | $5.5 | $33 | — | |||
| eu/gpt-5.5azure/eu/gpt-5.5 | 1.05M | $5.5 | $33 | — | |||
| microsoft/Dayhoff-170M-GRS-50000microsoft/Dayhoff-170M-GRS-50000 | Not documented | — | — | — | |||
| microsoft/Dayhoff-170M-GRS-26000microsoft/Dayhoff-170M-GRS-26000 | Not documented | — | — | — | |||
| microsoft/Dayhoff-170M-GRS-112000microsoft/Dayhoff-170M-GRS-112000 | Not documented | — | — | — | |||
| microsoft/Dayhoff-170M-GRS-2000microsoft/Dayhoff-170M-GRS-2000 | Not documented | — | — | — | |||
| gpt-5.5-2026-04-23azure/gpt-5.5-2026-04-23 | 1.05M | $5 | $30 | — | |||
| llama-3.3-70bcerebras/llama-3.3-70b | 128K | $0.85 | $1.2 | — | |||
| us/gpt-5.5-2026-04-23azure/us/gpt-5.5-2026-04-23 | 1.05M | $5.5 | $33 | — | |||
| eu/gpt-5.5-2026-04-23azure/eu/gpt-5.5-2026-04-23 | 1.05M | $5.5 | $33 | — | |||
| Inception: Mercury 2.5 Previewinception/mercury-2.5-preview | 260K | $0.2 | $0.75 | — | |||
| gpt-5.4-miniazure/gpt-5.4-mini | 272K | $0.75 | $4.5 | — | |||
| llama3.1-70bcerebras/llama3.1-70b | 128K | $0.6 | $0.6 | — | |||
| ibm-granite/granite-4.2-30bibm-granite/granite-4.2-30b | Not documented | — | — | — |