1,547 models
Tools JSON

Grok model for agentic tool use, reasoning, coding, and live assistance

xai/grok-4.20-0309-non-reasoning 2026-03-09 1M context $1.25/M input $2.5/M output
8 providers
Reasoning Tools JSON

Reasoning Grok for document-heavy analysis and long-horizon tool use

xai/grok-4.20-0309-reasoning 2026-03-09 1M context $1.25/M input $2.5/M output
9 providers
Reasoning Tools JSON

GPT-5.4 is OpenAI’s latest frontier model, unifying the Codex and GPT lines into a single system. It features a 1M+ token context window (922K input, 128K output) with support for...

openai/gpt-5.4 2026-03-05 1.05M context $2.5/M input $15/M output
42 providers
Reasoning Tools

GPT-5.4 Pro is OpenAI's most advanced model, building on GPT-5.4's unified architecture with enhanced reasoning capabilities for complex, high-stakes tasks. It features a 1M+ token context window (922K input, 128K...

openai/gpt-5.4-pro 2026-03-05 1.05M context $30/M input $180/M output
19 providers
Tools JSON

Chat-tuned GPT model for conversational assistance, writing, and tool workflows

openai/gpt-5.3-chat-latest 2026-03-03 128K context $1.75/M input $14/M output
7 providers
Reasoning Tools JSON

Gemini 3.1 Flash Lite Preview is Google's high-efficiency model optimized for high-volume use cases. It outperforms Gemini 2.5 Flash Lite on overall quality and approaches Gemini 2.5 Flash performance across...

google/gemini-3.1-flash-lite-preview 2026-03-03 1.04858M context $0.25/M input $1.5/M output
13 providers
Reasoning

Gemini 3.1 Flash Image Preview, a.k.a. "Nano Banana 2," is Google’s latest state of the art image generation and editing model, delivering Pro-level visual quality at Flash speed. It combines...

google/gemini-3.1-flash-image-preview 2026-02-26 65.536K context $0.5/M input $3/M output
9 providers
Reasoning Tools JSON Open weights

Qwen vision-language model for visual reasoning, documents, and agent tasks

alibaba/qwen3.5-122b-a10b 2026-02-23 262.144K context $0.4/M input $3.2/M output
16 providers
Reasoning Tools Open weights

Qwen instruction model for multilingual chat, reasoning, and tool use

alibaba/qwen3.5-9b 2026-02-23 262.144K context $0.04/M input $0.15/M output
16 providers

Qwen vision-language model for visual reasoning, documents, and agent tasks

alibaba/qwen3.5-flash 2026-02-23 1M context $0.029/M input $0.287/M output
7 providers
Tools Open weights

Qwen vision-language model for visual reasoning, documents, and agent tasks

alibaba/qwen3.5-27b 2026-02-23 262.144K context $0.3/M input $2.4/M output
14 providers
Reasoning Tools JSON Open weights

Qwen vision-language model for visual reasoning, documents, and agent tasks

alibaba/qwen3.5-35b-a3b 2026-02-23 262.144K context $0.25/M input $2/M output
11 providers
Reasoning Tools JSON

Gemini 3.1 Pro Preview is Google’s frontier reasoning model, delivering enhanced software engineering performance, improved agentic reliability, and more efficient token usage across complex workflows. Building on the multimodal foundation...

google/gemini-3.1-pro-preview 2026-02-19 1.04858M context $2/M input $12/M output
31 providers
Reasoning Tools JSON

Gemini 3.1 Pro Preview Custom Tools is a variant of Gemini 3.1 Pro that improves tool selection behavior by preventing overuse of a general bash tool when more efficient third-party...

google/gemini-3.1-pro-preview-customtools 2026-02-19 1.04858M context $2/M input $12/M output
11 providers
Open weights

Turkish-language multimodal instruct model built on Gemma 3 12B for e-commerce text, chat, and image-text tasks

trendyol/asure-12b 2026-02-19 131.072K context $0.1/M input $0.5/M output
1 provider
Reasoning Tools

Claude workhorse for coding agents, careful analysis, and production cost control

anthropic/claude-sonnet-4-6 2026-02-17 1M context $3/M input $15/M output
45 providers

Qwen vision-language model for visual reasoning, documents, and agent tasks

alibaba/qwen3.5-plus 2026-02-16 1M context $0.4/M input $2.4/M output
13 providers
Reasoning Tools JSON Open weights

Large open Qwen multimodal MoE for visual agents and long technical tasks

alibaba/qwen3.5-397b-a17b 2026-02-15 262.144K context $0.6/M input $3.6/M output
18 providers
Reasoning Tools JSON

Flagship ByteDance Seed 2.0 model for complex multimodal reasoning and long-horizon agent workflows

bytedance-seed/seed-2.0-pro 2026-02-14 256K context $0.475/M input $2.375/M output
6 providers
Reasoning Tools JSON

Seed-2.0-mini targets latency-sensitive, high-concurrency, and cost-sensitive scenarios, emphasizing fast response and flexible inference deployment. It delivers performance comparable to ByteDance-Seed-1.6, supports 256k context, four reasoning effort modes (minimal/low/medium/high), multimodal understanding,...

bytedance-seed/seed-2.0-mini 2026-02-14 262.144K context $0.1/M input $0.4/M output
9 providers
JSON

Seed-2.0-Lite is a versatile, cost‑efficient enterprise workhorse that delivers strong multimodal and agent capabilities while offering noticeably lower latency, making it a practical default choice for most production workloads across...

bytedance-seed/seed-2.0-lite 2026-02-14 262.144K context $0.25/M input $2/M output
8 providers
Reasoning Tools JSON

Seed 2.0 Code is a model from ByteDance Seed optimized for agentic coding. It is suited for frontend development, multilingual programming tasks, and coding-agent workflows in tools such as Claude...

bytedance-seed/seed-2.0-code 2026-02-14 262.144K context $0.5/M input $3/M output
10 providers
Open weights

Embedding model for semantic search, retrieval, clustering, and ranking pipelines

nvidia/llama-nemotron-embed-vl-1b-v2 2026-02-10 32.768K context Input not listed Output not listed
1 provider
Reasoning Tools

High-end Claude for difficult coding, planning, and slower expert reasoning

anthropic/claude-opus-4-6 2026-02-05 1M context $5/M input $25/M output
37 providers
Reasoning Tools

Coding-optimized GPT model for repository edits, reviews, and agentic software work

openai/gpt-5.3-codex-spark 2026-02-05 128K context $1.75/M input $14/M output
4 providers
Reasoning Tools JSON

GPT-5.3-Codex is OpenAI’s most advanced agentic coding model, combining the frontier software engineering performance of GPT-5.2-Codex with the broader reasoning and professional knowledge capabilities of GPT-5.2. It achieves state-of-the-art results...

openai/gpt-5.3-codex 2026-02-05 400K context $1.75/M input $14/M output
28 providers
Open weights

High-accuracy OCR model for extracting text from documents, screenshots, receipts, and natural scenes

deepseek/deepseek-ocr-2 2026-01-27 8.192K context $0.03/M input $0.03/M output
3 providers
Tools Open weights

Kimi K2.5 is Moonshot AI's native multimodal model, delivering state-of-the-art visual coding capability and a self-directed agent swarm paradigm. Built on Kimi K2 with continued pretraining over approximately 15T mixed...

moonshotai/kimi-k2.5 2026-01 262.144K context $0.45/M input $2.25/M output
46 providers
Reasoning Tools JSON

ByteDance Seed model for multimodal reasoning, long-context analysis, and agent workflows

bytedance-seed/seed-1-8 2025-12-28 256K context $0.119/M input $1.187/M output
3 providers
Reasoning Tools JSON

Gemini 3 Flash Preview is a high speed, high value thinking model designed for agentic workflows, multi turn chat, and coding assistance. It delivers near Pro level reasoning and tool...

google/gemini-3-flash-preview 2025-12-17 1.04858M context $0.5/M input $3/M output
25 providers
Reasoning Tools

GPT-5.2 Pro is OpenAI’s most advanced model, offering major improvements in agentic coding and long context performance over GPT-5 Pro. It is optimized for complex tasks that require step-by-step reasoning,...

openai/gpt-5.2-pro 2025-12-11 400K context $21/M input $168/M output
13 providers
Reasoning Tools

GPT-5.2 is the latest frontier-grade model in the GPT-5 series, offering stronger agentic and long context perfomance compared to GPT-5.1. It uses adaptive reasoning to allocate computation dynamically, responding quickly...

openai/gpt-5.2 2025-12-11 400K context $1.75/M input $14/M output
33 providers
Reasoning Tools JSON

Chat-tuned GPT model for conversational assistance, writing, and tool workflows

openai/gpt-5.2-chat-latest 2025-12-11 128K context $1.75/M input $14/M output
9 providers
Reasoning Tools JSON

GPT-5.2-Codex is an upgraded version of GPT-5.1-Codex optimized for software engineering and coding workflows. It is designed for both interactive development sessions and long, independent execution of complex engineering tasks....

openai/gpt-5.2-codex 2025-12-11 400K context $1.75/M input $14/M output
23 providers
Tools Open weights

Compact multimodal coding model for repository exploration, file editing, and software agents

mistral/devstral-small-2 2025-12-09 262.144K context $0.1/M input $0.3/M output
3 providers
Reasoning Tools Open weights

GLM vision model for visual reasoning, documents, and multimodal agents

zhipuai/glm-4.6v 2025-12-08 128K context $0.3/M input $0.9/M output
9 providers
Reasoning Tools Open weights

Lightweight GLM vision model for visual reasoning, documents, and multimodal agents

zhipuai/glm-4.6v-flash 2025-12-08 128K context $0.3/M input $0.9/M output
2 providers
Reasoning

Multimodal reasoning model for visual analysis, planning, and tool use

amazon/nova-2-lite 2025-12-02 1M context $0.3/M input $2.5/M output
4 providers
Open weights

Compact multimodal Mistral model for local assistants, edge agents, and efficient tool use

mistral/ministral-14b 2025-12-02 262.144K context $0.2/M input $0.2/M output
3 providers

Image model for prompt-driven generation, editing, and visual design workflows

openai/gpt-image-1.5 2025-11-25 Not documented context $5/M input $32/M output
3 providers
Reasoning Tools

Flagship Claude model for deep reasoning, coding, and long-horizon agents

anthropic/claude-opus-4-5 2025-11-24 200K context $5/M input $25/M output
17 providers
Reasoning

Nano Banana Pro is Google’s most advanced image-generation and editing model, built on Gemini 3 Pro. It extends the original Nano Banana with significantly improved multimodal reasoning, real-world grounding, and...

google/gemini-3-pro-image-preview 2025-11-20 65.536K context $2/M input $12/M output
8 providers
Tools JSON

xAI's fast agentic tool-calling model with a 2M context window; non-reasoning variant for low-latency responses

xai/grok-4.1-fast 2025-11-19 2M context $0.2/M input $0.5/M output
2 providers
Reasoning Tools JSON

xAI's fast agentic tool-calling model with a 2M context window and built-in reasoning

xai/grok-4.1-fast-reasoning 2025-11-19 2M context $0.2/M input $0.5/M output
4 providers
Reasoning Tools JSON

Preview Gemini flagship for complex reasoning, coding, and rich multimodal prompts

google/gemini-3-pro-preview 2025-11-18 1.04858M context $0.57/M input $3.43/M output
10 providers
Reasoning Tools JSON

GPT-5.1-Codex-Max is OpenAI’s latest agentic coding model, designed for long-running, high-context software development tasks. It is based on an updated version of the 5.1 reasoning stack and trained on agentic...

openai/gpt-5.1-codex-max 2025-11-13 400K context $1.25/M input $10/M output
15 providers
Reasoning Tools JSON

GPT-5.1 is the latest frontier-grade model in the GPT-5 series, offering stronger general-purpose reasoning, improved instruction adherence, and a more natural conversational style compared to GPT-5. It uses adaptive reasoning...

openai/gpt-5.1 2025-11-13 400K context $1.25/M input $10/M output
28 providers
Reasoning Tools JSON

Chat-tuned GPT-5.1 for polished assistants, writing, and product conversations

openai/gpt-5.1-chat-latest 2025-11-13 128K context $1.25/M input $10/M output
7 providers
Reasoning

GPT-5.1-Codex is a specialized version of GPT-5.1 optimized for software engineering and coding workflows. It is designed for both interactive development sessions and long, independent execution of complex engineering tasks....

openai/gpt-5.1-codex 2025-11-13 400K context $1.25/M input $10/M output
19 providers
Reasoning

GPT-5.1-Codex-Mini is a smaller and faster version of GPT-5.1-Codex

openai/gpt-5.1-codex-mini 2025-11-13 400K context $0.25/M input $2/M output
15 providers