No provider description is available for this model yet.
Models
Every model in the catalog with source-linked pricing, context limits, provider availability, and published benchmark results.
No provider description is available for this model yet.
Venice Uncensored Dolphin Mistral 24B Venice Edition is a fine-tuned variant of Mistral-Small-24B-Instruct-2501, developed by dphn.ai in collaboration with Venice.ai. This model is designed as an “uncensored” instruct-tuned LLM, preserving...
No provider description is available for this model yet.
No provider description is available for this model yet.
No provider description is available for this model yet.
No provider description is available for this model yet.
No provider description is available for this model yet.
No provider description is available for this model yet.
No provider description is available for this model yet.
No provider description is available for this model yet.
No provider description is available for this model yet.
No provider description is available for this model yet.
No provider description is available for this model yet.
No provider description is available for this model yet.
No provider description is available for this model yet.
This is Mistral AI's flagship model, Mistral Large 2 (version mistral-large-2407). It's a proprietary weights-available model and excels at reasoning, code, JSON, chat, and more. Read the launch announcement [here](https://mistral.ai/news/mistral-large-2407/)....
No provider description is available for this model yet.
Gemini 2.5 Pro is Google’s state-of-the-art AI model designed for advanced reasoning, coding, mathematics, and scientific tasks. It employs “thinking” capabilities, enabling it to reason through responses with enhanced accuracy...
No provider description is available for this model yet.
No provider description is available for this model yet.
No provider description is available for this model yet.
No provider description is available for this model yet.
No provider description is available for this model yet.
This model offers four times the context length of gpt-3.5-turbo, allowing it to support approximately 20 pages of text in a single request at a higher cost. Training data: up...
Gemini 3.5 Flash is Google's high-efficiency multimodal model, bringing near-Pro level coding and reasoning at Flash-tier cost and speed. It is highly optimized for coding proficiency and parallel agentic execution...
No provider description is available for this model yet.
No provider description is available for this model yet.
No provider description is available for this model yet.
No provider description is available for this model yet.
No provider description is available for this model yet.
No provider description is available for this model yet.
No provider description is available for this model yet.
No provider description is available for this model yet.
No provider description is available for this model yet.
No provider description is available for this model yet.
No provider description is available for this model yet.
No provider description is available for this model yet.
No provider description is available for this model yet.
No provider description is available for this model yet.
No provider description is available for this model yet.
No provider description is available for this model yet.
No provider description is available for this model yet.
No provider description is available for this model yet.
No provider description is available for this model yet.
No provider description is available for this model yet.
No provider description is available for this model yet.
No provider description is available for this model yet.
No provider description is available for this model yet.
This model is a variant of GPT-3.5 Turbo tuned for instructional prompts and omitting chat-related optimizations. Training data: up to Sep 2021.
| Model | Creator | Inputs | Context | Input | Output | Released | Compare |
|---|---|---|---|---|---|---|---|
| us-gov.openai.gpt-oss-20b-1:0bedrock_converse/us-gov.openai.gpt-oss-20b-1:0 | 128K | $0.084 | $0.36 | — | |||
| nvidia/Riva-Translate-4B-Instruct-v2nvidia/Riva-Translate-4B-Instruct-v2 | Not documented | — | — | — | |||
| Venice: Uncensored (free)cognitivecomputations/dolphin-mistral-24b-venice-edition:free | 32.768K | Free | Free | — | |||
| us-gov.openai.gpt-oss-120b-1:0bedrock_converse/us-gov.openai.gpt-oss-120b-1:0 | 128K | $0.18 | $0.72 | — | |||
| us-gov.xai.grok-4.6bedrock_converse/us-gov.xai.grok-4.6 | 500K | $2.64 | $7.92 | — | |||
| kimi-k3-fastfireworks_ai/kimi-k3-fast | 1.04858M | $4.5 | $22.5 | — | |||
| FW-Kimi-K2.6azure_ai/fw-kimi-k2.6 | 262.144K | $1.045 | $4.4 | — | |||
| FW-Kimi-K2.7-Codeazure_ai/fw-kimi-k2.7-code | 262.144K | $1.05 | $4.4 | — | |||
| kimi-k3-usfireworks_ai/kimi-k3-us | 1.04858M | $3.3 | $16.5 | — | |||
| qwen3p8-maxfireworks_ai/qwen3p8-max | 262.144K | $2 | $6 | — | |||
| muse-glimmer-30bfireworks_ai/muse-glimmer-30b | 131.072K | $0.35 | $1.5 | — | |||
| us-gov-west-1/nvidia.nemotron-nano-9b-v2bedrock/us-gov-west-1/nvidia.nemotron-nano-9b-v2 | 128K | $0.072 | $0.276 | — | |||
| us-gov-west-1/anthropic.claude-opus-5bedrock/us-gov-west-1/anthropic.claude-opus-5 | 1M | $6 | $30 | — | |||
| nemotron-lightning-3p5-30b-a3bfireworks_ai/nemotron-lightning-3p5-30b-a3b | 262.144K | $0.05 | $0.2 | — | |||
| FW-Kimi-K2.5azure_ai/fw-kimi-k2.5 | 262.144K | $0.66 | $3.3 | — | |||
| FW-Kimi-K3azure_ai/fw-kimi-k3 | 1.04858M | $3.3 | $16.5 | — | |||
| Mistral Large 2407mistralai/mistral-large-2407 | 131.072K | $2 | $6 | — | |||
| FW-MiniMax-M3azure_ai/fw-minimax-m3 | 512K | $0.33 | $1.32 | — | |||
| Google: Gemini 2.5 Pro Preview 06-05google/gemini-2.5-pro-preview | 1.04858M | $1.25 | $10 | — | |||
| us-gov-east-1/nvidia.nemotron-nano-9b-v2bedrock/us-gov-east-1/nvidia.nemotron-nano-9b-v2 | 128K | $0.072 | $0.276 | — | |||
| us-gov.nvidia.nemotron-nano-9b-v2bedrock_converse/us-gov.nvidia.nemotron-nano-9b-v2 | 128K | $0.072 | $0.276 | — | |||
| accounts/fireworks/models/muse-glimmer-30bfireworks_ai/accounts/fireworks/models/muse-glimmer-30b | 131.072K | $0.35 | $1.5 | — | |||
| glm-5p2-fastfireworks_ai/glm-5p2-fast | 1.04858M | $2.1 | $6.6 | — | |||
| grok-4.3azure_ai/grok-4.3 | 200K | $1.25 | $2.5 | — | |||
| OpenAI: GPT-3.5 Turbo 16kopenai/gpt-3.5-turbo-16k | 16.385K | $3 | $4 | — | |||
| Google: Gemini 3.5 Flash (batch)google/gemini-3.5-flash:batch | 1.04858M | $0.75 | $4.5 | — | |||
| deepseek-v4-flash-0731fireworks_ai/deepseek-v4-flash-0731 | 1.04858M | $0.14 | $0.28 | — | |||
| accounts/fireworks/models/nemotron-3-ultra-nvfp4fireworks_ai/accounts/fireworks/models/nemotron-3-ultra-nvfp4 | 262.144K | $0.6 | $2.4 | — | |||
| us-gov-east-1/anthropic.claude-opus-5bedrock/us-gov-east-1/anthropic.claude-opus-5 | 1M | $6 | $30 | — | |||
| us-east-1/minimax.minimax-m2.1bedrock/us-east-1/minimax.minimax-m2.1 | 196K | $0.3 | $1.2 | — | |||
| gpt-4.1github_copilot/gpt-4.1 | 128K | — | — | — | |||
| gpt-4.1-2025-04-14github_copilot/gpt-4.1-2025-04-14 | 128K | — | — | — | |||
| accounts/fireworks/models/qwen3p8-maxfireworks_ai/accounts/fireworks/models/qwen3p8-max | 262.144K | $2 | $6 | — | |||
| FW-Inklingazure_ai/fw-inkling | 1.04858M | $1 | $4.05 | — | |||
| accounts/fireworks/routers/glm-5p2-fastfireworks_ai/accounts/fireworks/routers/glm-5p2-fast | 1.04858M | $2.1 | $6.6 | — | |||
| accounts/fireworks/routers/glm-5p2-fast-usfireworks_ai/accounts/fireworks/routers/glm-5p2-fast-us | 1.04858M | $2.1 | $6.6 | — | |||
| us-gov-east-1/anthropic.claude-fable-5-1bedrock/us-gov-east-1/anthropic.claude-fable-5-1 | 1M | $12 | $60 | — | |||
| us-east-1/minimax.minimax-m2.5bedrock/us-east-1/minimax.minimax-m2.5 | 1M | $0.3 | $1.2 | — | |||
| accounts/fireworks/routers/kimi-k3-fastfireworks_ai/accounts/fireworks/routers/kimi-k3-fast | 1.04858M | $4.5 | $22.5 | — | |||
| us-gov-west-1/xai.grok-4.6bedrock_mantle/us-gov-west-1/xai.grok-4.6 | 500K | $2.64 | $7.92 | — | |||
| accounts/fireworks/routers/kimi-k3-usfireworks_ai/accounts/fireworks/routers/kimi-k3-us | 1.04858M | $3.3 | $16.5 | — | |||
| us-gov-west-1/google.gemma-4-e2bbedrock_mantle/us-gov-west-1/google.gemma-4-e2b | 128K | $0.048 | $0.096 | — | |||
| us-gov-west-1/google.gemma-4-26b-a4bbedrock_mantle/us-gov-west-1/google.gemma-4-26b-a4b | 256K | $0.156 | $0.48 | — | |||
| us-gov-west-1/google.gemma-4-31bbedrock_mantle/us-gov-west-1/google.gemma-4-31b | 256K | $0.168 | $0.48 | — | |||
| us-gov-west-1/openai.gpt-oss-20bbedrock_mantle/us-gov-west-1/openai.gpt-oss-20b | 131.072K | $0.084 | $0.36 | — | |||
| us-gov-west-1/openai.gpt-oss-120bbedrock_mantle/us-gov-west-1/openai.gpt-oss-120b | 131.072K | $0.18 | $0.72 | — | |||
| us-gov-east-1/xai.grok-4.6bedrock_mantle/us-gov-east-1/xai.grok-4.6 | 500K | $2.64 | $7.92 | — | |||
| us-gov-east-1/openai.gpt-oss-20bbedrock_mantle/us-gov-east-1/openai.gpt-oss-20b | 131.072K | $0.084 | $0.36 | — | |||
| us-gov-east-1/openai.gpt-oss-120bbedrock_mantle/us-gov-east-1/openai.gpt-oss-120b | 131.072K | $0.18 | $0.72 | — | |||
| OpenAI: GPT-3.5 Turbo Instructopenai/gpt-3.5-turbo-instruct | 4.095K | $1.5 | $2 | — |