Open weights

Nemotron model for efficient reasoning, coding, and specialized AI agents

nvidia/nemotron-cascade-2-30b-a3b 2026-03-24 256K context Input not listed Output not listed
1 provider
Reasoning Tools Open weights

Low-latency M2.7 variant for interactive coding plans and agent loops

minimax/MiniMax-M2.7-highspeed 2026-03-18 204.8K context $0.6/M input $2.4/M output
13 providers
Reasoning Tools Open weights

Open MiniMax flagship for coding agents, office automation, and complex environments

minimax/MiniMax-M2.7 2026-03-18 204.8K context $0.3/M input $1.2/M output
35 providers
Tools Open weights

Efficient Mistral model for fast chat, extraction, and production assistants

mistral/mistral-small-latest 2026-03-16 256K context $0.15/M input $0.6/M output
5 providers
Reasoning Tools Open weights

Fast Mistral production model for chat, extraction, and cost-sensitive agents

mistral/mistral-small-2603 2026-03-16 256K context $0.15/M input $0.6/M output
12 providers
Reasoning Open weights

Nemotron middle tier for collaborative agents and high-volume reasoning workloads

nvidia/nemotron-3-super-120b-a12b 2026-03-11 262.144K context $0.2/M input $0.8/M output
15 providers
Reasoning Tools JSON Open weights

Qwen vision-language model for visual reasoning, documents, and agent tasks

alibaba/qwen3.5-35b-a3b 2026-02-23 262.144K context $0.25/M input $2/M output
11 providers
Reasoning Tools JSON Open weights

Qwen vision-language model for visual reasoning, documents, and agent tasks

alibaba/qwen3.5-122b-a10b 2026-02-23 262.144K context $0.4/M input $3.2/M output
16 providers
Tools Open weights

Qwen vision-language model for visual reasoning, documents, and agent tasks

alibaba/qwen3.5-27b 2026-02-23 262.144K context $0.3/M input $2.4/M output
14 providers
Reasoning Tools Open weights

Qwen instruction model for multilingual chat, reasoning, and tool use

alibaba/qwen3.5-9b 2026-02-23 262.144K context $0.04/M input $0.15/M output
16 providers
Reasoning Tools JSON Open weights

Large open Qwen multimodal MoE for visual agents and long technical tasks

alibaba/qwen3.5-397b-a17b 2026-02-15 262.144K context $0.6/M input $3.6/M output
18 providers
Reasoning Tools Open weights

High-speed MiniMax model for low-latency coding and agent workflows

minimax/MiniMax-M2.5-highspeed 2026-02-13 204.8K context $0.6/M input $2.4/M output
7 providers
Reasoning Tools Open weights

General GLM flagship for coding, analysis, and tool-heavy engineering workflows

zhipuai/glm-5 2026-02-12 204.8K context $1/M input $3.2/M output
37 providers
Reasoning Tools Open weights

Prior MiniMax coding model for agent workflows, office edits, and automation

minimax/MiniMax-M2.5 2026-02-12 204.8K context $0.3/M input $1.2/M output
35 providers
Tools JSON Open weights

Open-weight Qwen coding model for agents, repository edits, and multi-turn tool use

alibaba/qwen3-coder-next 2026-02-03 262.144K context $0.108/M input $0.675/M output
13 providers
Open weights

StepFun flash lane for quick multimodal reasoning and coding assistance

stepfun/step-3.5-flash 2026-01-29 256K context $0.1/M input $0.3/M output
14 providers
Tools Open weights

Lightly post-trained 398B MoE chat model for creative work, long-context prompts, and tool-using agents

arcee-ai/trinity-large-preview 2026-01-27 524.288K context Input not listed Output not listed
1 provider
Reasoning Tools Open weights

Efficient GLM model for fast reasoning, coding, and agent workflows

zhipuai/glm-4.7-flashx 2026-01-19 200K context $0.07/M input $0.4/M output
5 providers
Reasoning Tools Open weights

Budget GLM lane for fast coding help, routing, and everyday automation

zhipuai/glm-4.7-flash 2026-01-19 200K context $0.06/M input $0.4/M output
14 providers
Tools Open weights

Earlier Kimi frontier model for long-context agents, coding, and multimodal work

moonshotai/kimi-k2.5 2026-01 262.144K context $0.3/M input $1.9/M output
46 providers
Reasoning Tools Open weights

Earlier MiniMax agent model for practical coding and productivity tasks

minimax/MiniMax-M2.1 2025-12-23 204.8K context $0.3/M input $1.2/M output
16 providers
Reasoning Tools Open weights

Mature GLM model for dependable coding, reasoning, and structured agent tasks

zhipuai/glm-4.7 2025-12-22 204.8K context $0.6/M input $2.2/M output
30 providers
Reasoning Tools Open weights

MiMo flash model for fast multimodal assistance and agent workflows

xiaomi/mimo-v2-flash 2025-12-16 262.144K context $0.14/M input $0.28/M output
7 providers
Open weights

Small Nemotron 3 MoE for efficient coding, math, and long-context agents

nvidia/nemotron-3-nano-30b-a3b 2025-12-15 262.144K context $0.05/M input $0.2/M output
11 providers
Tools Open weights

Compact multimodal coding model for repository exploration, file editing, and software agents

mistral/devstral-small-2 2025-12-09 262.144K context $0.1/M input $0.3/M output
3 providers
Tools Open weights

Mistral's coding-agent model for repository work, terminal tasks, and software fixes

mistral/devstral-2512 2025-12-09 262.144K context $0.4/M input $2/M output
13 providers
Open weights

Open vision-language model for efficient local deployment, instruction following, and tool use

mistral/ministral-3-14b-instruct-2512 2025-12-02 262.144K context $0.1/M input $0.4/M output
2 providers
Open weights

Mistral's largest general model for enterprise agents, coding, and multilingual reasoning

mistral/mistral-large-2512 2025-12-02 262.144K context $0.5/M input $1.5/M output
13 providers
Open weights

Compact multimodal Mistral model for local assistants, edge agents, and efficient tool use

mistral/ministral-14b 2025-12-02 262.144K context $0.2/M input $0.2/M output
3 providers
Tools JSON Open weights

Compact open vision-language model for edge deployment, instruction following, and tool use

mistral/ministral-3-3b-instruct-2512 2025-12-02 262.144K context $0.1/M input $0.1/M output
1 provider
Tools Open weights

Compact open vision-language model for edge deployment, instruction following, and tool use

mistral/ministral-3-8b-instruct-2512 2025-12-02 262.144K context $0.15/M input $0.15/M output
2 providers
Tools Open weights

Mistral coding agent model for repository tasks and software engineering workflows

mistral/devstral-medium-latest 2025-12-02 262.144K context $0.4/M input $2/M output
3 providers
Open weights

DeepSeek reasoning model for multi-step analysis, math, coding, and tools

deepseek/deepseek-reasoner 2025-12-01 1M context $0.147/M input $0.295/M output
6 providers
Tools Open weights

DeepSeek chat model for instruction following, coding, and analysis

deepseek/deepseek-chat 2025-12-01 1M context $0.147/M input $0.295/M output
8 providers
Reasoning Tools Open weights

Kimi reasoning model for long-horizon research, planning, and tool use

moonshotai/kimi-k2-thinking-turbo 2025-11-06 262.144K context $1.15/M input $8/M output
3 providers
Tools Open weights

Thinking Kimi model for slower research passes, planning, and hard technical questions

moonshotai/kimi-k2-thinking 2025-11-06 262.144K context $0.4/M input $2.5/M output
22 providers
Reasoning Tools Open weights

Efficient open MiniMax model built for coding agents and tool-heavy workflows

minimax/MiniMax-M2 2025-10-27 204.8K context $0.3/M input $1.2/M output
14 providers
Reasoning Tools Open weights

Late GLM-4 workhorse for coding agents, reasoning, and structured tasks

zhipuai/glm-4.6 2025-09-30 204.8K context $0.6/M input $2.2/M output
18 providers
Reasoning Tools Open weights

Cohere reasoning model for multilingual enterprise agents, tools, and complex workflows

cohere/command-a-reasoning-08-2025 2025-08-21 256K context $2.5/M input $10/M output
1 provider
Tools Open weights

Updated large open Qwen3 MoE instruct model for multilingual chat, coding, and tool use

alibaba/qwen3-235b-a22b-instruct-2507 2025-07-21 262.144K context $0.069/M input $0.455/M output
7 providers
Tools Open weights

Open multimodal Llama for strong reasoning with efficient everyday serving

meta/llama-4-maverick-17b-instruct 2025-04-05 1M context $0.14/M input $0.59/M output
6 providers
Open weights

Open Llama with long-context vision for efficient multimodal agents

meta/llama-4-scout-17b-instruct 2025-04-05 10M context $0.17/M input $0.66/M output
2 providers
Tools Open weights

Smaller Qwen coder for efficient local agents and repo-level fixes

alibaba/qwen3-coder-30b-a3b-instruct 2025-04 262.144K context $0.45/M input $2.25/M output
13 providers
Tools Open weights

Open Qwen coding heavyweight for repository reasoning and agentic engineering

alibaba/qwen3-coder-480b-a35b-instruct 2025-04 262.144K context $1.5/M input $7.5/M output
8 providers
Reasoning Tools Open weights

Cohere command model for multilingual enterprise agents, tools, and chat

cohere/command-a-03-2025 2025-03-13 256K context $2.5/M input $10/M output
6 providers
Open weights

Flagship Mistral model for advanced reasoning, coding, and multilingual work

mistral/mistral-large-latest 2024-11-01 262.144K context $0.5/M input $1.5/M output
7 providers
Tools Open weights

Mistral code model for completions, refactors, and developer IDE workflows

mistral/codestral-latest 2024-05-29 256K context $0.3/M input $0.9/M output
5 providers