GPT-4o Mini
standardFast, cost-effective
- Provider
- OpenAI
- Context
- 128K
- Speed
- fast
- Quality
- great
- Input
- $0.15/1M
- Output
- $0.6/1M
High-volume chatClassification
GPT-4o
premiumMultimodal flagship
- Provider
- OpenAI
- Context
- 128K
- Speed
- balanced
- Quality
- frontier
- Input
- $5/1M
- Output
- $15/1M
ChatVisionTools
GPT-5.6 Luna
standardEfficient high-volume GPT-5.6
- Provider
- OpenAI
- Context
- 256K
- Speed
- fast
- Quality
- great
- Input
- $1/1M
- Output
- $4/1M
High volumeClassification
GPT-5.6 Terra
premiumBalanced intelligence and cost
- Provider
- OpenAI
- Context
- 256K
- Speed
- balanced
- Quality
- frontier
- Input
- $5/1M
- Output
- $20/1M
AgentsCoding
GPT-5.6 Sol
frontierFrontier GPT-5.6 for complex work
- Provider
- OpenAI
- Context
- 256K
- Speed
- quality
- Quality
- frontier
- Input
- $15/1M
- Output
- $60/1M
Complex reasoningAgent workflows
GPT-5.6
frontierAlias for GPT-5.6 Sol
- Provider
- OpenAI
- Context
- 256K
- Speed
- balanced
- Quality
- frontier
- Input
- $15/1M
- Output
- $60/1M
Complex reasoningCode generation
o3-mini
premiumReasoning optimized
- Provider
- OpenAI
- Context
- 200K
- Speed
- balanced
- Quality
- frontier
- Input
- $3/1M
- Output
- $12/1M
MathLogicPlanning
Claude Haiku 4.5
standardFast Claude responses
- Provider
- Claude
- Context
- 200K
- Speed
- fast
- Quality
- great
- Input
- $0.8/1M
- Output
- $4/1M
SupportTriageSummaries
Claude Sonnet 4
premiumBalanced Claude 4
- Provider
- Claude
- Context
- 200K
- Speed
- balanced
- Quality
- frontier
- Input
- $3/1M
- Output
- $15/1M
CodingAnalysisWriting
Claude Sonnet 5
premiumLatest Sonnet mid-tier
- Provider
- Claude
- Context
- 200K
- Speed
- balanced
- Quality
- frontier
- Input
- $3/1M
- Output
- $15/1M
CodingAgents
Claude Opus 4
frontierClaude 4 maximum capability
- Provider
- Claude
- Context
- 200K
- Speed
- quality
- Quality
- frontier
- Input
- $15/1M
- Output
- $75/1M
ResearchComplex agents
Claude Opus 5
frontierLatest Opus frontier
- Provider
- Claude
- Context
- 200K
- Speed
- quality
- Quality
- frontier
- Input
- $15/1M
- Output
- $75/1M
ResearchDeep agents
Gemini 2.5 Flash
standardUltra-fast Gemini
- Provider
- Gemini
- Context
- 1000K
- Speed
- fast
- Quality
- great
- Input
- $0.15/1M
- Output
- $0.6/1M
Real-timeHigh volume
Gemini 3.6 Flash
standardLatest Gemini Flash workhorse
- Provider
- Gemini
- Context
- 1000K
- Speed
- fast
- Quality
- frontier
- Input
- $0.2/1M
- Output
- $0.8/1M
Real-timeMultimodal
Gemini 2.5 Pro
premiumGoogle multimodal Pro
- Provider
- Gemini
- Context
- 1000K
- Speed
- balanced
- Quality
- frontier
- Input
- $2.5/1M
- Output
- $10/1M
Long contextMultimodal
Gemini 3.1 Pro
frontierLatest Gemini Pro preview
- Provider
- Gemini
- Context
- 1000K
- Speed
- balanced
- Quality
- frontier
- Input
- $3/1M
- Output
- $12/1M
Long contextResearch
Kimi K2.6
standardGeneral-purpose Kimi with vision and tools
- Provider
- Kimi
- Context
- 256K
- Speed
- balanced
- Quality
- great
- Input
- $0.95/1M
- Output
- $4/1M
ChatToolsVision
Kimi K2.7 Code
premiumKimi coding agent model
- Provider
- Kimi
- Context
- 256K
- Speed
- balanced
- Quality
- frontier
- Input
- $0.95/1M
- Output
- $4/1M
Coding agentsRepos
Kimi K3
frontierMoonshot flagship — 1M context, deep reasoning
- Provider
- Kimi
- Context
- 1000K
- Speed
- quality
- Quality
- frontier
- Input
- $3/1M
- Output
- $15/1M
Long-horizon codingAgentsReasoning
DeepSeek V3
premiumStrong coding and math
- Provider
- OpenRouter
- Context
- 64K
- Speed
- balanced
- Quality
- great
- Input
- $0.27/1M
- Output
- $1.1/1M
CodeMathCost-efficient
DeepSeek R1
premiumChain-of-thought reasoning
- Provider
- OpenRouter
- Context
- 64K
- Speed
- quality
- Quality
- frontier
- Input
- $0.55/1M
- Output
- $2.19/1M
ReasoningProofs
DeepSeek Free
freeLow-cost DeepSeek via OpenRouter
- Provider
- OpenRouter
- Context
- 64K
- Speed
- fast
- Quality
- good
- Input
- $0/1M
- Output
- $0/1M
Free chatExperiments
Claude Sonnet (OpenRouter)
premiumClaude Sonnet via OpenRouter
- Provider
- OpenRouter
- Context
- 200K
- Speed
- balanced
- Quality
- frontier
- Input
- $3/1M
- Output
- $15/1M
CodingAnalysis
Qwen 2.5 72B (OpenRouter)
standardAlibaba Qwen via OpenRouter
- Provider
- OpenRouter
- Context
- 131K
- Speed
- balanced
- Quality
- great
- Input
- $0.35/1M
- Output
- $0.4/1M
Chinese/EnglishCoding
Mistral Large
premiumEuropean flagship
- Provider
- Mistral
- Context
- 128K
- Speed
- balanced
- Quality
- great
- Input
- $2/1M
- Output
- $6/1M
EU complianceMultilingual
Mistral Small
standardEfficient general purpose
- Provider
- Mistral
- Context
- 128K
- Speed
- fast
- Quality
- good
- Input
- $0.2/1M
- Output
- $0.6/1M
ChatClassification
Codestral
premiumCode-specialized
- Provider
- Mistral
- Context
- 256K
- Speed
- fast
- Quality
- great
- Input
- $0.3/1M
- Output
- $0.9/1M
IDE completionRefactoring
Llama 4 70B
standardOpen frontier model
- Provider
- Llama
- Context
- 128K
- Speed
- balanced
- Quality
- great
- Input
- $0.4/1M
- Output
- $0.4/1M
Self-hostFine-tuning
Llama 3.3 70B
freeProven open model
- Provider
- Llama
- Context
- 128K
- Speed
- balanced
- Quality
- good
- Input
- $0.2/1M
- Output
- $0.2/1M
General chatRAG
Qwen Max
premiumAlibaba flagship
- Provider
- Qwen
- Context
- 131K
- Speed
- balanced
- Quality
- great
- Input
- $1.6/1M
- Output
- $6.4/1M
Chinese/EnglishEnterprise
Qwen 2.5 72B
standardStrong open model
- Provider
- Qwen
- Context
- 131K
- Speed
- balanced
- Quality
- great
- Input
- $0.35/1M
- Output
- $0.4/1M
CodingMath
Groq Llama 70B
standardUltra-low latency
- Provider
- Groq
- Context
- 128K
- Speed
- fast
- Quality
- good
- Input
- $0.59/1M
- Output
- $0.79/1M
Real-time chatVoice
Groq Mixtral
standardFast mixture-of-experts
- Provider
- Groq
- Context
- 33K
- Speed
- fast
- Quality
- good
- Input
- $0.24/1M
- Output
- $0.24/1M
Fast inference
Grok 2
premiumxAI conversational model
- Provider
- Grok
- Context
- 131K
- Speed
- balanced
- Quality
- great
- Input
- $2/1M
- Output
- $10/1M
Real-time infoChat
Grok 4.3
premiumLong-context Grok workhorse
- Provider
- Grok
- Context
- 1000K
- Speed
- balanced
- Quality
- frontier
- Input
- $3/1M
- Output
- $12/1M
Long contextTools
Grok 4.5
frontierLatest Grok coding and agents flagship
- Provider
- Grok
- Context
- 500K
- Speed
- balanced
- Quality
- frontier
- Input
- $5/1M
- Output
- $20/1M
CodingAgents
OpenRouter Auto
standardRoutes to best available
- Provider
- OpenRouter
- Context
- 128K
- Speed
- balanced
- Quality
- great
- Input
- $1/1M
- Output
- $3/1M
Fallback routing
Cerebras Gemma 4 31B
standardUltra-fast Cerebras inference
- Provider
- Cerebras
- Context
- 8K
- Speed
- fast
- Quality
- good
- Input
- $0.1/1M
- Output
- $0.1/1M
Low latencyHigh volume
Cerebras GPT-OSS 120B
premiumFast 120B on Cerebras
- Provider
- Cerebras
- Context
- 128K
- Speed
- fast
- Quality
- great
- Input
- $0.6/1M
- Output
- $0.6/1M
Production chat
SambaNova Llama 3.3 70B
frontierLarge model on SambaNova Cloud
- Provider
- SambaNova
- Context
- 128K
- Speed
- balanced
- Quality
- frontier
- Input
- $5/1M
- Output
- $15/1M
EnterpriseResearch
SambaNova DeepSeek V3.2
premiumDeepSeek on SambaNova
- Provider
- SambaNova
- Context
- 64K
- Speed
- balanced
- Quality
- great
- Input
- $1/1M
- Output
- $3/1M
CodeReasoning
Ollama Llama 3.2
freeLocal offline model
- Provider
- Ollama
- Context
- 128K
- Speed
- fast
- Quality
- good
- Input
- $0/1M
- Output
- $0/1M
PrivacyOffline
HF Mistral 7B
freeHosted open model
- Provider
- HuggingFace
- Context
- 33K
- Speed
- fast
- Quality
- good
- Input
- $0.1/1M
- Output
- $0.1/1M
Experiments
Together Llama 70B
standardFast open inference
- Provider
- Together
- Context
- 128K
- Speed
- fast
- Quality
- good
- Input
- $0.88/1M
- Output
- $0.88/1M
ScaleFine-tunes
Fireworks Llama 70B
standardOptimized inference
- Provider
- Fireworks
- Context
- 128K
- Speed
- fast
- Quality
- good
- Input
- $0.9/1M
- Output
- $0.9/1M
ProductionLow latency