Reasoning Tools JSON

ByteDance Seed multimodal model for image understanding, visual reasoning, and tool-assisted tasks

bytedance-seed/seed-1-6-vision 2025-08-15 256K context $0.119/M input $1.187/M output
2 providers
Reasoning Tools Open weights

GLM vision model for visual reasoning, documents, and multimodal agents

zhipuai/glm-4.5v 2025-08-11 64K context $0.6/M input $1.8/M output
7 providers
Tools

Original GPT-5 workhorse for reasoning, coding, writing, and tool workflows

openai/gpt-5 2025-08-07 400K context $1.25/M input $10/M output
30 providers
Reasoning

Tiny GPT-5 lane for routing, extraction, classification, and bulk jobs

openai/gpt-5-nano 2025-08-07 400K context $0.05/M input $0.4/M output
26 providers
Reasoning

Small GPT-5 for responsive agents, coding help, and everyday automation

openai/gpt-5-mini 2025-08-07 400K context $0.25/M input $2/M output
29 providers
Reasoning Tools

Flagship Claude model for deep reasoning, coding, and long-horizon agents

anthropic/claude-opus-4-1 2025-08-05 200K context $15/M input $75/M output
9 providers
Reasoning Tools JSON

Flagship Claude model for deep reasoning, coding, and long-horizon agents

anthropic/claude-opus-4-1-20250805 2025-08-05 200K context $15/M input $75/M output
13 providers
Tools Open weights

Efficient Mistral model for fast chat, extraction, and production assistants

mistral/mistral-small-2506 2025-06-20 128K context $0.1/M input $0.3/M output
6 providers
Reasoning Tools JSON

Lean Gemini 2.5 lane for cheap multimodal traffic and quick agents

google/gemini-2.5-flash-lite 2025-06-17 1.04858M context $0.1/M input $0.4/M output
18 providers
Reasoning Tools JSON

Google's proven reasoning model for coding, math, and multimodal analysis

google/gemini-2.5-pro 2025-06-17 1.04858M context $1.25/M input $10/M output
29 providers
Reasoning Tools JSON

Fast Gemini workhorse for multimodal apps where latency and price matter

google/gemini-2.5-flash 2025-06-17 1.04858M context $0.3/M input $2.5/M output
30 providers
Reasoning Tools

High-effort o3 tier for difficult technical reasoning and careful answers

openai/o3-pro 2025-06-10 200K context $20/M input $80/M output
8 providers
Reasoning Tools JSON

Balanced Claude model for coding, analysis, agent workflows, and cost control

anthropic/claude-sonnet-4-0 2025-05-22 200K context $2.898/M input $14.493/M output
4 providers

Flagship Claude model for deep reasoning, coding, and long-horizon agents

anthropic/claude-opus-4-0 2025-05-22 200K context Input not listed Output not listed
2 providers
Reasoning Tools

Flagship Claude model for deep reasoning, coding, and long-horizon agents

anthropic/claude-opus-4-20250514 2025-05-22 200K context $15/M input $75/M output
8 providers
Reasoning Tools

Balanced Claude model for coding, analysis, agent workflows, and cost control

anthropic/claude-sonnet-4-20250514 2025-05-22 200K context $3/M input $15/M output
11 providers

Mistral model for multilingual chat, reasoning, and tool-assisted workflows

mistral/mistral-medium-2505 2025-05-07 131.072K context $0.4/M input $2/M output
10 providers

Reasoning model for deliberate analysis, multi-step problem solving, and tool use

writer/palmyra-x5 2025-04-28 1M context $0.6/M input $6/M output
4 providers
Tools

OpenAI image model for production generation, edits, and brand-safe visual workflows

openai/gpt-image-1 2025-04-24 Not documented context $5/M input $40/M output
3 providers
Reasoning

Deliberate o-series reasoner for hard math, coding, and multi-step analysis

openai/o3 2025-04-16 200K context $2/M input $8/M output
20 providers
Reasoning Tools JSON

Fast o-series model for compact reasoning, coding, and tool use

openai/o4-mini 2025-04-16 200K context $1.1/M input $4.4/M output
20 providers

Tiny GPT-4.1 option for classification, routing, and very high-volume tasks

openai/gpt-4.1-nano 2025-04-14 1.04758M context $0.1/M input $0.4/M output
20 providers

Affordable GPT-4.1 lane for fast coding help and structured extraction

openai/gpt-4.1-mini 2025-04-14 1.04758M context $0.4/M input $1.6/M output
25 providers
Tools JSON

Long-lived GPT workhorse for coding, instruction following, and production apps

openai/gpt-4.1 2025-04-14 1.04758M context $2/M input $8/M output
28 providers
Tools

Mistral vision-language model for image understanding and multimodal chat

mistral/pixtral-large-2502 2025-04-08 128K context $1.993/M input $5.978/M output
2 providers
Tools Open weights

Open multimodal Llama for strong reasoning with efficient everyday serving

meta/llama-4-maverick-17b-instruct 2025-04-05 1M context $0.14/M input $0.59/M output
6 providers
Open weights

Open Llama with long-context vision for efficient multimodal agents

meta/llama-4-scout-17b-instruct 2025-04-05 10M context $0.17/M input $0.66/M output
2 providers

O-series reasoning model for hard analysis, math, coding, and planning

openai/o1-pro 2025-03-19 200K context $150/M input $600/M output
7 providers
Tools JSON Open weights

Efficient multimodal model for instruction following, coding, reasoning, and function calling

mistral/mistral-small-3-1-24b-instruct-2503 2025-03-17 128K context $0.106/M input $0.318/M output
2 providers
Open weights

Largest open Gemma 3 instruction model for multilingual text generation and visual understanding

google/gemma-3-27b-it 2025-03-12 131.072K context $0.08/M input $0.16/M output
10 providers
Open weights

Open multimodal Gemma instruction model for multilingual text generation and image understanding

google/gemma-3-12b-it 2025-03-12 131.072K context $0.05/M input $0.1/M output
8 providers
Tools JSON Open weights

Open multimodal Gemma instruction model for efficient text generation and image understanding

google/gemma-3-4b-it 2025-03-12 131.072K context $0.04/M input $0.08/M output
7 providers
Reasoning Tools

Balanced Claude model for coding, analysis, agent workflows, and cost control

anthropic/claude-3-7-sonnet-20250219 2025-02-19 200K context $3/M input $15/M output
4 providers

Qwen omni model for text, vision, audio, and multimodal agent tasks

alibaba/qwen-omni-turbo 2025-01-19 32.768K context $0.07/M input $0.27/M output
4 providers
Tools

Earlier Gemini Flash workhorse for responsive multimodal apps and tool use

google/gemini-2.0-flash 2024-12-11 1.04858M context $0.1/M input $0.42/M output
2 providers
Tools

Low-latency Gemini model for high-volume multimodal and agent workloads

google/gemini-2.0-flash-lite 2024-12-11 1.04858M context $0.052/M input $0.21/M output
2 providers
Reasoning

O-series reasoning model for hard analysis, math, coding, and planning

openai/o1 2024-12-05 200K context $15/M input $60/M output
16 providers
Tools

Flagship model for demanding analysis, coding, and production agent workflows

amazon/nova-pro 2024-12-03 300K context $0.8/M input $3.2/M output
3 providers
Tools

Efficient model for low-latency assistance, extraction, and routine automation

amazon/nova-lite 2024-12-03 300K context $0.06/M input $0.24/M output
3 providers
Tools

GPT model for general reasoning, writing, coding, and tool-assisted tasks

openai/gpt-4o-2024-11-20 2024-11-20 128K context $2.5/M input $10/M output
8 providers
Open weights

Flagship Mistral model for advanced reasoning, coding, and multilingual work

mistral/mistral-large-latest 2024-11-01 262.144K context $0.5/M input $1.5/M output
7 providers
Tools Open weights

Mistral's larger vision model for document-heavy image understanding and chat

mistral/pixtral-large-latest 2024-11-01 128K context $2/M input $6/M output
5 providers
Tools

Fast Claude model for responsive assistance, classification, and lightweight agents

anthropic/claude-3-5-haiku-20241022 2024-10-22 200K context $0.8/M input $4/M output
3 providers

Balanced Claude model for coding, analysis, agent workflows, and cost control

anthropic/claude-3-5-sonnet-20241022 2024-10-22 200K context Input not listed Output not listed
1 provider
Tools JSON Open weights

Open multimodal Llama model for image understanding, captioning, and visual QA

meta/llama-3.2-11b-vision-instruct 2024-09-25 128K context $0.055/M input $0.055/M output
3 providers
Tools Open weights

Mistral vision-language model for image understanding and multimodal chat

mistral/pixtral-12b 2024-09-01 128K context $0.15/M input $0.15/M output
4 providers
Tools Open weights

Qwen vision-language model for visual reasoning, documents, and agent tasks

alibaba/qwen2-5-vl-72b-instruct 2024-09 131.072K context $2.8/M input $8.4/M output
3 providers
Tools

GPT model for general reasoning, writing, coding, and tool-assisted tasks

openai/gpt-4o-2024-08-06 2024-08-06 128K context $2.5/M input $10/M output
7 providers

Small omni GPT for cheap multimodal assistance and production-scale traffic

openai/gpt-4o-mini 2024-07-18 128K context $0.15/M input $0.6/M output
23 providers
Reasoning Tools

Research model for long-horizon investigation, synthesis, and analytical reports

openai/o3-deep-research 2024-06-26 200K context $9/M input $36/M output
6 providers