Reasoning Tools JSON Open weights

Native multimodal GLM model for efficient coding and long-horizon agent tasks

zhipuai/glm-5.3-flash 2026-08-26 1M context $0.075/M input $0.25/M output
35 providers
Reasoning Tools JSON Open weights

Dense 27B vision-language model for coding, agent tasks, and image and video understanding

alibaba/qwen3.8-27b 2026-08-14 262.144K context $0.1/M input $0.4/M output
27 providers
Reasoning Tools JSON Open weights

Muse Glimmer is a 30-billion-parameter open-weight multimodal model from Meta Superintelligence Labs, distilled from Muse Spark for always-on local agents, tool use, coding, and image understanding.

meta/muse-glimmer-30b 2026-08-10 131.072K context $0.2/M input $0.8/M output
9 providers
Tools Open weights

Multimodal MoE reasoning model (276B total, 12B active) for text, image, and audio

thinkingmachines/inkling-small 2026-07-30 1.04858M context $0.45/M input $1.2/M output
10 providers
Reasoning Tools JSON Open weights

Multimodal Kimi model with 1M context and toggleable max-effort thinking for long-horizon agent work

moonshotai/kimi-k3 2026-07-16 1.04858M context $3/M input $15/M output
62 providers
Tools JSON Open weights

Multimodal MoE reasoning model (975B total, 41B active) for text, image, and audio

thinkingmachines/inkling 2026-07-15 1.04858M context $1.87/M input $4.68/M output
21 providers
Reasoning Tools Open weights

Lower-latency Kimi Code variant for interactive edits and coding-agent loops

moonshotai/kimi-k2.7-code-highspeed 2026-06-12 262.144K context $1.9/M input $8/M output
9 providers
Reasoning Tools JSON Open weights

Coding-focused Kimi model, stronger on long-horizon repo work with less overthinking

moonshotai/kimi-k2.7-code 2026-06-12 262.144K context $0.95/M input $4/M output
61 providers
Reasoning Tools Open weights

MiniMax multimodal model for long-context coding, perception, and agent planning

minimax/MiniMax-M3 2026-06-01 1.04858M context $0.3/M input $1.2/M output
37 providers
Reasoning Tools JSON Open weights

Newer StepFun flash model for faster agents, coding, and multimodal prompts

stepfun/step-3.7-flash 2026-05-29 256K context $0.185/M input $1.11/M output
17 providers
Reasoning Tools JSON Open weights

Balanced Mistral model for enterprise assistants, multilingual work, and tools

mistral/mistral-medium-2604 2026-04-29 262.144K context $1.5/M input $7.5/M output
9 providers
Tools JSON Open weights

Balanced Mistral model for enterprise assistants, multilingual work, and tools

mistral/mistral-medium-latest 2026-04-29 262.144K context $1.5/M input $7.5/M output
5 providers
Reasoning Tools JSON Open weights

Multimodal Kimi workhorse for agent loops, coding tasks, and visual context

moonshotai/kimi-k2.6 2026-04-21 262.144K context $0.95/M input $4/M output
64 providers
Tools Open weights

Efficient Mistral model for fast chat, extraction, and production assistants

mistral/mistral-small-latest 2026-03-16 256K context $0.15/M input $0.6/M output
5 providers
Reasoning Tools Open weights

Fast Mistral production model for chat, extraction, and cost-sensitive agents

mistral/mistral-small-2603 2026-03-16 256K context $0.15/M input $0.6/M output
12 providers
Tools Open weights

Earlier Kimi frontier model for long-context agents, coding, and multimodal work

moonshotai/kimi-k2.5 2026-01 262.144K context $0.3/M input $1.9/M output
45 providers
Reasoning Tools Open weights

GLM vision model for visual reasoning, documents, and multimodal agents

zhipuai/glm-4.6v 2025-12-08 128K context $0.3/M input $0.9/M output
9 providers
Open weights

Qwen vision-language instruct model for visual reasoning, documents, and agent tasks

alibaba/qwen3-vl-235b-a22b-instruct 2025-09-23 131.072K context $0.2/M input $0.88/M output
11 providers
Reasoning Open weights

Qwen vision-language thinking model for visual reasoning, documents, and agent tasks

alibaba/qwen3-vl-235b-a22b-thinking 2025-09-23 131.072K context $0.4/M input $4/M output
8 providers
Open weights

Flagship Mistral model for advanced reasoning, coding, and multilingual work

mistral/mistral-large-latest 2024-11-01 262.144K context $0.5/M input $1.5/M output
7 providers
Open weights

Mistral's largest general model for enterprise agents, coding, and multilingual reasoning

mistral/mistral-large-2512 2024-11-01 262.144K context $0.5/M input $1.5/M output
12 providers
Tools JSON Open weights

Open multimodal Llama model for image understanding, captioning, and visual QA

meta/llama-3.2-11b-vision-instruct 2024-09-25 128K context $0.055/M input $0.055/M output
3 providers