Reasoning Tools Open weights

Open Nemotron omni model combining reasoning with text, vision, and audio

nvidia/nemotron-3-nano-omni-30b-a3b-reasoning 2026-04-28 256K context $0.2/M input $0.8/M output
5 providers

Qwen vision-language model for visual reasoning, documents, and agent tasks

alibaba/qwen3.6-flash 2026-04-27 1M context $0.188/M input $1.125/M output
22 providers
Reasoning Tools JSON Open weights

Open MoE flagship with million-token context for coding and long agent runs

deepseek/deepseek-v4-pro 2026-04-24 1M context $0.435/M input $0.87/M output
62 providers
Reasoning Tools JSON Open weights

Fast DeepSeek V4 lane for economical reasoning, coding, and long-context work

deepseek/deepseek-v4-flash 2026-04-24 1M context $0.15/M input $0.6/M output
62 providers
Reasoning Tools JSON

Default frontier GPT for coding, computer use, research, and knowledge work

openai/gpt-5.5 2026-04-23 1.05M context $5/M input $30/M output
46 providers
Reasoning Tools JSON Open weights

Open MiMo model for multimodal coding agents and long-context automation

xiaomi/mimo-v2.5 2026-04-22 1.04858M context $0.14/M input $0.28/M output
23 providers
Tools Open weights

Qwen vision-language model for visual reasoning, documents, and agent tasks

alibaba/qwen3.6-27b 2026-04-22 262.144K context $0.6/M input $3.6/M output
24 providers
Reasoning Tools Open weights

Stronger MiMo Pro tier for multimodal reasoning and coding-agent execution

xiaomi/mimo-v2.5-pro 2026-04-22 1.04858M context $0.435/M input $0.87/M output
24 providers
Reasoning Tools JSON Open weights

Multimodal Kimi workhorse for agent loops, coding tasks, and visual context

moonshotai/kimi-k2.6 2026-04-21 262.144K context $0.95/M input $4/M output
64 providers

Flagship Qwen model for complex reasoning, coding, and agentic workflows

alibaba/qwen3.6-max-preview 2026-04-20 262.144K context $1.3/M input $7.8/M output
12 providers
Reasoning Tools Open weights

Tencent Hy reasoning model for coding, instruction following, and agent tasks

tencent/hy3-preview 2026-04-20 256K context $0.066/M input $0.26/M output
7 providers
Reasoning Tools JSON

xAI's default Grok for chat, coding, agentic tools, and lower hallucination risk

xai/grok-4.3 2026-04-17 1M context $1.25/M input $2.5/M output
28 providers
Reasoning Tools JSON

Fast Grok coding model tuned for agentic engineering and iterative edits

xai/grok-build-0.1 2026-04-16 256K context $1/M input $2/M output
19 providers
Reasoning

Muse Spark is a natively multimodal reasoning model with support for tool-use, visual chain of thought, and multi-agent orchestration.

meta/muse-spark-1.1 2026-04-08 1.04858M context $1.25/M input $4.25/M output
12 providers
Reasoning Open weights

StepFun flash model for efficient multimodal reasoning, coding, and tool use

stepfun/step-3.5-flash-2603 2026-04-02 256K context $0.1/M input $0.3/M output
6 providers
Reasoning Tools JSON Open weights

Open Gemma instruction model for efficient chat and self-hosted deployments

google/gemma-4-26b-a4b-it 2026-04-02 262.144K context $0.042/M input $0.22/M output
22 providers
Reasoning Tools JSON Open weights

Largest Gemma 4 instruction model for open, self-hosted chat and reasoning

google/gemma-4-31b-it 2026-04-02 262.144K context $0.09/M input $0.34/M output
33 providers
Reasoning Tools Open weights

Reasoning-optimized 398B MoE agent model with extended thinking for long-horizon and multi-turn tool use

arcee-ai/trinity-large-thinking 2026-04-01 524.288K context $0.25/M input $0.9/M output
5 providers
Reasoning Tools

MiMo omni model for text, image, video, audio, and agents

xiaomi/mimo-v2-omni 2026-03-18 262.144K context $0.14/M input $0.28/M output
4 providers
Reasoning Tools

Earlier MiMo Pro model for multimodal agents, reasoning, and code tasks

xiaomi/mimo-v2-pro 2026-03-18 1.04858M context $0.435/M input $0.87/M output
10 providers
Reasoning Tools JSON

Strong small GPT for coding subagents, quick tool use, and high-volume work

openai/gpt-5.4-mini 2026-03-17 400K context $0.75/M input $4.5/M output
31 providers
Reasoning Tools JSON

Cheapest GPT-5.4 lane for simple routing, extraction, and bulk automation

openai/gpt-5.4-nano 2026-03-17 400K context $0.2/M input $1.25/M output
27 providers
Reasoning Open weights

Nemotron middle tier for collaborative agents and high-volume reasoning workloads

nvidia/nemotron-3-super-120b-a12b 2026-03-11 262.144K context $0.2/M input $0.8/M output
15 providers
Reasoning Tools JSON

Agent-ready GPT for coding and computer-use workflows at a lower cost

openai/gpt-5.4 2026-03-05 1.05M context $2.5/M input $15/M output
42 providers
Reasoning Tools

More exact GPT-5.4 tier for demanding professional reasoning and agent tasks

openai/gpt-5.4-pro 2026-03-05 1.05M context $30/M input $180/M output
19 providers
Reasoning Tools Open weights

Qwen instruction model for multilingual chat, reasoning, and tool use

alibaba/qwen3.5-9b 2026-02-23 262.144K context $0.04/M input $0.15/M output
16 providers
Tools Open weights

Qwen vision-language model for visual reasoning, documents, and agent tasks

alibaba/qwen3.5-27b 2026-02-23 262.144K context $0.3/M input $2.4/M output
14 providers

Qwen vision-language model for visual reasoning, documents, and agent tasks

alibaba/qwen3.5-flash 2026-02-23 1M context $0.029/M input $0.287/M output
7 providers
Reasoning Tools JSON

Advanced Gemini model for complex reasoning, coding, and multimodal analysis

google/gemini-3.1-pro-preview-customtools 2026-02-19 1.04858M context $2/M input $12/M output
11 providers
Reasoning Tools JSON

Reasoning-first Gemini preview for agentic coding and complex problem solving

google/gemini-3.1-pro-preview 2026-02-19 1.04858M context $2/M input $12/M output
31 providers
Reasoning Tools Open weights

Efficient Indian-language reasoning model for chat, coding, and multilingual work

sarvam/sarvam-30b 2026-02-18 128K context $0.02/M input $0.1/M output
2 providers
Reasoning Tools

Claude workhorse for coding agents, careful analysis, and production cost control

anthropic/claude-sonnet-4-6 2026-02-17 1M context $3/M input $15/M output
45 providers

Qwen vision-language model for visual reasoning, documents, and agent tasks

alibaba/qwen3.5-plus 2026-02-16 1M context $0.4/M input $2.4/M output
13 providers
Reasoning Tools JSON

ByteDance Seed coding model for multimodal software engineering and long-running agents

bytedance-seed/seed-2.0-code 2026-02-14 262.144K context $0.4/M input $2.4/M output
10 providers
JSON

Cost-efficient ByteDance Seed 2.0 model for production chat, analysis, and structured generation

bytedance-seed/seed-2.0-lite 2026-02-14 256K context $0.089/M input $0.534/M output
8 providers
Reasoning Tools JSON

Coding-optimized GPT model for repository edits, reviews, and agentic software work

openai/gpt-5.3-codex 2026-02-05 400K context $1.75/M input $14/M output
28 providers
Tools JSON Open weights

Open-weight Qwen coding model for agents, repository edits, and multi-turn tool use

alibaba/qwen3-coder-next 2026-02-03 262.144K context $0.108/M input $0.675/M output
13 providers
Open weights

StepFun flash lane for quick multimodal reasoning and coding assistance

stepfun/step-3.5-flash 2026-01-29 256K context $0.1/M input $0.3/M output
14 providers
Tools Open weights

Earlier Kimi frontier model for long-context agents, coding, and multimodal work

moonshotai/kimi-k2.5 2026-01 262.144K context $0.3/M input $1.9/M output
45 providers

Flagship model for demanding analysis, coding, and production agent workflows

upstage/solar-pro3 2026-01 131.072K context $0.15/M input $0.6/M output
3 providers
Reasoning Tools JSON

New Gemini flash lane bringing frontier-style multimodal reasoning to cheaper runs

google/gemini-3-flash-preview 2025-12-17 1.04858M context $0.5/M input $3/M output
25 providers
Reasoning Tools Open weights

MiMo flash model for fast multimodal assistance and agent workflows

xiaomi/mimo-v2-flash 2025-12-16 262.144K context $0.14/M input $0.28/M output
7 providers
Open weights

Small Nemotron 3 MoE for efficient coding, math, and long-context agents

nvidia/nemotron-3-nano-30b-a3b 2025-12-15 262.144K context $0.05/M input $0.2/M output
11 providers
Reasoning Tools

Higher-accuracy GPT-5.2 variant for tougher reasoning and review workflows

openai/gpt-5.2-pro 2025-12-11 400K context $21/M input $168/M output
13 providers
Reasoning Tools JSON

Code-specialist GPT for repository edits, reviews, and long-running software agents

openai/gpt-5.2-codex 2025-12-11 400K context $0.14/M input $1.14/M output
23 providers
Reasoning Tools

Reliable GPT generation for broad coding, writing, and tool-assisted product work

openai/gpt-5.2 2025-12-11 400K context $1.75/M input $14/M output
33 providers
Open weights

DeepSeek reasoning model for multi-step analysis, math, coding, and tools

deepseek/deepseek-reasoner 2025-12-01 1M context $0.147/M input $0.295/M output
6 providers
Reasoning Tools JSON Open weights

Hybrid-reasoning DeepSeek model with thinking and non-thinking modes, sparse attention, and tool-use

deepseek/deepseek-v3.2 2025-12-01 128K context $0.18/M input $0.35/M output
23 providers
Reasoning

Coding-optimized GPT model for repository edits, reviews, and agentic software work

openai/gpt-5.1-codex-mini 2025-11-13 400K context $0.22/M input $1.8/M output
15 providers
Reasoning Tools JSON

Sharper GPT-5 generation for coding, product work, and tool-assisted tasks

openai/gpt-5.1 2025-11-13 400K context $1.25/M input $10/M output
28 providers