No provider description is available for this model yet.
Models
Every model in the catalog with source-linked pricing, context limits, provider availability, and published benchmark results.
No provider description is available for this model yet.
No provider description is available for this model yet.
No provider description is available for this model yet.
No provider description is available for this model yet.
No provider description is available for this model yet.
Llama 3.2 11B Vision is a multimodal model with 11 billion parameters, designed to handle tasks combining visual and textual data. It excels in tasks such as image captioning and...
No provider description is available for this model yet.
No provider description is available for this model yet.
GPT-5.4 nano is the most lightweight and cost-efficient variant of the GPT-5.4 family, optimized for speed-critical and high-volume tasks. It supports text and image inputs and is designed for low-latency...
No provider description is available for this model yet.
No provider description is available for this model yet.
No provider description is available for this model yet.
No provider description is available for this model yet.
No provider description is available for this model yet.
No provider description is available for this model yet.
No provider description is available for this model yet.
No provider description is available for this model yet.
No provider description is available for this model yet.
No provider description is available for this model yet.
No provider description is available for this model yet.
No provider description is available for this model yet.
No provider description is available for this model yet.
No provider description is available for this model yet.
No provider description is available for this model yet.
No provider description is available for this model yet.
No provider description is available for this model yet.
No provider description is available for this model yet.
No provider description is available for this model yet.
No provider description is available for this model yet.
No provider description is available for this model yet.
No provider description is available for this model yet.
No provider description is available for this model yet.
No provider description is available for this model yet.
No provider description is available for this model yet.
No provider description is available for this model yet.
No provider description is available for this model yet.
No provider description is available for this model yet.
No provider description is available for this model yet.
No provider description is available for this model yet.
No provider description is available for this model yet.
No provider description is available for this model yet.
No provider description is available for this model yet.
No provider description is available for this model yet.
No provider description is available for this model yet.
No provider description is available for this model yet.
No provider description is available for this model yet.
No provider description is available for this model yet.
No provider description is available for this model yet.
No provider description is available for this model yet.
| Model | Creator | Inputs | Context | Input | Output | Released | Compare |
|---|---|---|---|---|---|---|---|
| gpt-4.1-nanoazure/gpt-4.1-nano | 1.04758M | $0.1 | $0.4 | — | |||
| gpt-4.1-mini-2025-04-14azure/gpt-4.1-mini-2025-04-14 | 1.04758M | $0.4 | $1.6 | — | |||
| anthropic.claude-opus-4-6-v1bedrock_converse/anthropic.claude-opus-4-6-v1 | 1M | $5 | $25 | — | |||
| databricks-claude-sonnet-5databricks/databricks-claude-sonnet-5 | 1M | $3 | $15 | — | |||
| mistral-nemo-instruct-2407gradient_ai/mistral-nemo-instruct-2407 | 128K | $0.3 | $0.3 | — | |||
| @cf/moonshotai/kimi-k2.6cloudflare/@cf/moonshotai/kimi-k2.6 | 262.144K | $0.95 | $4 | — | |||
| Meta: Llama 3.2 11B Vision Instructmeta-llama/llama-3.2-11b-vision-instruct | 131.072K | $0.345 | $0.345 | — | |||
| glm-5p2-fastfireworks_ai/glm-5p2-fast | 1.04858M | $2.1 | $6.6 | — | |||
| zai-glm-4.6cerebras/zai-glm-4.6 | 128K | $2.25 | $2.75 | — | |||
| OpenAI: GPT-5.4 Nano (batch)openai/gpt-5.4-nano:batch | 400K | $0.1 | $0.625 | — | |||
| gpt-4.1-miniazure/gpt-4.1-mini | 1.04758M | $0.4 | $1.6 | — | |||
| gpt-4.1-2025-04-14azure/gpt-4.1-2025-04-14 | 1.04758M | $2 | $8 | — | |||
| anthropic.claude-opus-4-5-20251101-v1:0bedrock_converse/anthropic.claude-opus-4-5-20251101-v1:0 | 200K | $5 | $25 | — | |||
| alibaba-qwen3-32bgradient_ai/alibaba-qwen3-32b | 131.072K | — | — | — | |||
| gpt-5-mini-2025-08-07openai/gpt-5-mini-2025-08-07 | 272K | $0.25 | $2 | — | |||
| zai-glm-4.7cerebras/zai-glm-4.7 | 128K | $2.25 | $2.75 | — | |||
| deepseek-v4-flash-0731fireworks_ai/deepseek-v4-flash-0731 | 1.04858M | $0.14 | $0.28 | — | |||
| gpt-4.1azure/gpt-4.1 | 1.04758M | $2 | $8 | — | |||
| gpt-5.4-mini-2026-03-17openai/gpt-5.4-mini-2026-03-17 | 272K | $0.75 | $4.5 | — | |||
| gpt-5.4-2026-03-05openai/gpt-5.4-2026-03-05 | 1.05M | $2.5 | $15 | — | |||
| gpt-4-turbo-vision-previewazure/gpt-4-turbo-vision-preview | 128K | $10 | $30 | — | |||
| anthropic.claude-opus-4-20250514-v1:0bedrock_converse/anthropic.claude-opus-4-20250514-v1:0 | 200K | $15 | $75 | — | |||
| gpt-5.5-2026-04-23openai/gpt-5.5-2026-04-23 | 1.05M | $5 | $30 | — | |||
| gpt-5.6openai/gpt-5.6 | 1.05M | $5 | $30 | — | |||
| databricks-claude-opus-5databricks/databricks-claude-opus-5 | 1M | $5 | $25 | — | |||
| gpt-5.2-2025-12-11openai/gpt-5.2-2025-12-11 | 272K | $1.75 | $14 | — | |||
| gpt-5.4-nano-2026-03-17openai/gpt-5.4-nano-2026-03-17 | 272K | $0.2 | $1.25 | — | |||
| gpt-5-2025-08-07openai/gpt-5-2025-08-07 | 272K | $1.25 | $10 | — | |||
| gpt-5.1-2025-11-13openai/gpt-5.1-2025-11-13 | 272K | $1.25 | $10 | — | |||
| gpt-5-nano-2025-08-07openai/gpt-5-nano-2025-08-07 | 272K | $0.05 | $0.4 | — | |||
| gpt-4-turbo-2024-04-09azure/gpt-4-turbo-2024-04-09 | 128K | $10 | $30 | — | |||
| anthropic-claude-3-opusgradient_ai/anthropic-claude-3-opus | 200K | $15 | $75 | — | |||
| anthropic-claude-3.5-haikugradient_ai/anthropic-claude-3.5-haiku | 200K | $0.8 | $4 | — | |||
| anthropic-claude-3.5-sonnetgradient_ai/anthropic-claude-3.5-sonnet | 200K | $3 | $15 | — | |||
| anthropic-claude-3.7-sonnetgradient_ai/anthropic-claude-3.7-sonnet | 200K | $3 | $15 | — | |||
| llama3.3-70b-instructgradient_ai/llama3.3-70b-instruct | 128K | $0.65 | $0.65 | — | |||
| anthropic.claude-opus-4-1-20250805-v1:0bedrock_converse/anthropic.claude-opus-4-1-20250805-v1:0 | 200K | $15 | $75 | — | |||
| openai-gpt-4ogradient_ai/openai-gpt-4o | 128K | — | — | — | |||
| openai-gpt-4o-minigradient_ai/openai-gpt-4o-mini | 128K | — | — | — | |||
| openai-o3gradient_ai/openai-o3 | 200K | $2 | $8 | — | |||
| openai-o3-minigradient_ai/openai-o3-mini | 200K | $1.1 | $4.4 | — | |||
| Qwen3-Coder-30B-A3B-Instruct-GGUFlemonade/qwen3-coder-30b-a3b-instruct-gguf | 262.144K | — | — | — | |||
| gpt-oss-20b-mxfp4-GGUFlemonade/gpt-oss-20b-mxfp4-gguf | 131.072K | — | — | — | |||
| gpt-oss-120b-mxfp-GGUFlemonade/gpt-oss-120b-mxfp-gguf | 131.072K | — | — | — | |||
| Gemma-3-4b-it-GGUFlemonade/gemma-3-4b-it-gguf | 128K | — | — | — | |||
| Qwen3-4B-Instruct-2507-GGUFlemonade/qwen3-4b-instruct-2507-gguf | 262.144K | — | — | — | |||
| nova-micro-v1amazon_nova/nova-micro-v1 | 128K | $0.035 | $0.14 | — | |||
| nova-lite-v1amazon_nova/nova-lite-v1 | 300K | $0.06 | $0.24 | — | |||
| nova-premier-v1amazon_nova/nova-premier-v1 | 1M | $2.5 | $12.5 | — | |||
| FW-Inklingazure_ai/fw-inkling | 1.04858M | $1 | $4.05 | — |