20 models
Ranked by Agentic Index
Reasoning Tools JSON Open weights 50.6

Multimodal Kimi model with 1M context and toggleable max-effort thinking for long-horizon agent work

moonshotai/kimi-k3 2026-07-16 1.04858M context $3/M input $15/M output
63 providers
Reasoning Tools JSON Open weights 42.3

DeepSeek V4 Pro snapshot with million-token context and support for thinking and non-thinking modes

deepseek/deepseek-v4-pro-0813 2026-08-12 1M context $0.442/M input $0.884/M output
30 providers
Reasoning Tools JSON Open weights 41.7

Official DeepSeek V4 Flash release with enhanced agentic capabilities and integrated DSpark speculative decoding

deepseek/deepseek-v4-flash-0731 2026-07-31 1M context $0.035/M input $0.07/M output
43 providers
Reasoning Tools JSON Open weights 27.9

Fast DeepSeek V4 lane for economical reasoning, coding, and long-context work

deepseek/deepseek-v4-flash 2026-04-24 1M context $0.15/M input $0.6/M output
62 providers
Reasoning Tools JSON Open weights 27.7

Open MoE flagship with million-token context for coding and long agent runs

deepseek/deepseek-v4-pro 2026-04-24 1M context $0.435/M input $0.87/M output
62 providers
Tools Open weights 25.0

Multimodal MoE reasoning model (276B total, 12B active) for text, image, and audio

thinkingmachines/inkling-small 2026-07-30 1.04858M context $0.45/M input $1.2/M output
11 providers
Tools JSON Open weights 24.3

Multimodal MoE reasoning model (975B total, 41B active) for text, image, and audio

thinkingmachines/inkling 2026-07-15 1.04858M context $1.87/M input $4.68/M output
21 providers
Reasoning Tools Open weights 22.7

Stronger MiMo Pro tier for multimodal reasoning and coding-agent execution

xiaomi/mimo-v2.5-pro 2026-04-22 1.04858M context $0.435/M input $0.87/M output
24 providers
Reasoning Tools JSON Open weights 22.5

Coding-focused Kimi model, stronger on long-horizon repo work with less overthinking

moonshotai/kimi-k2.7-code 2026-06-12 262.144K context $0.95/M input $4/M output
61 providers
Reasoning Tools JSON Open weights 22.1

Multimodal Kimi workhorse for agent loops, coding tasks, and visual context

moonshotai/kimi-k2.6 2026-04-21 262.144K context $0.95/M input $4/M output
64 providers
Tools Open weights 21.7

Earlier Kimi frontier model for long-context agents, coding, and multimodal work

moonshotai/kimi-k2.5 2026-01 262.144K context $0.3/M input $1.9/M output
46 providers
Reasoning Tools JSON Open weights 21.7

Newer StepFun flash model for faster agents, coding, and multimodal prompts

stepfun/step-3.7-flash 2026-05-29 256K context $0.185/M input $1.11/M output
17 providers
Reasoning Tools JSON Open weights 17.4

Open MiMo model for multimodal coding agents and long-context automation

xiaomi/mimo-v2.5 2026-04-22 1.04858M context $0.14/M input $0.28/M output
23 providers
Reasoning Tools JSON Open weights 11.0

Open Gemma instruction model for efficient chat and self-hosted deployments

google/gemma-4-26b-a4b-it 2026-04-02 262.144K context $0.042/M input $0.22/M output
22 providers
Reasoning Tools JSON Open weights 6.7

Largest Gemma 4 instruction model for open, self-hosted chat and reasoning

google/gemma-4-31b-it 2026-04-02 262.144K context $0.09/M input $0.34/M output
33 providers
Reasoning Tools JSON Open weights 6.2

Open GPT reasoning model for self-hosted agents and controllable deployments

openai/gpt-oss-120b 2025-08-05 131.072K context $0.03/M input $0.17/M output
53 providers
Reasoning Tools Open weights 1.4

Open GPT reasoning model for self-hosted agents and controllable deployments

openai/gpt-oss-20b 2025-08-05 131.072K context $0.02/M input $0.1/M output
32 providers
Open weights 1.0

Small Nemotron 3 MoE for efficient coding, math, and long-context agents

nvidia/nemotron-3-nano-30b-a3b 2025-12-15 262.144K context $0.05/M input $0.2/M output
11 providers
Open weights 0.1

Largest open Gemma 3 instruction model for multilingual text generation and visual understanding

google/gemma-3-27b-it 2025-03-12 131.072K context $0.08/M input $0.16/M output
10 providers
Open weights 0.1

Open multimodal Gemma instruction model for multilingual text generation and image understanding

google/gemma-3-12b-it 2025-03-12 131.072K context $0.05/M input $0.1/M output
8 providers