LIVETracking 1,072 AI models from 273 providers.
BenchGeckoBeta
AI
Providers
Economy
Mindshare
Infra
Learn
Labs
Developers
Charts·Build live AI market viewsOpen chartsBuild your own chart
Home·Models
BenchGecko

BenchGecko is the data layer of the AI economy. Thousands of models with cross-provider pricing and daily price history. Hundreds of companies with valuations, funding timelines, and revenue estimates. Benchmark scores, developer adoption signals, agent leaderboards, and a changelog that captures every price drop, every launch, every deprecation as it happens. If it moved in AI today, it's already on BenchGecko.

@BenchGecko

Rankings

  • Leaderboard
  • All Models
  • AI Agents
  • Benchmarks
  • Compare Models
  • MCP Servers
  • Skills
  • Pricing

Top Models

  • DeepSeek V3.1 Terminus
  • Qwen3 VL 235B A22B Instruct
  • Qwen3 VL 235B A22B Thinking
  • Trinity Large Preview (free)
  • GLM 4.5 Air
  • GLM 4.7 Flash
  • MiniMax M1
  • GLM 4.5V
  • Gemma 3 12B
  • Nova 2 Lite

Providers

  • ~anthropic
  • ~google
  • ~moonshotai
  • ~openai
  • AI Research
  • AI21 Labs
  • AI4Bharat
  • aion-labs
  • All Providers →

Benchmarks

  • Aider · Code Editing
  • Aider polyglot
  • ANLI
  • APEX-Agents
  • ARC AI2
  • ARC-AGI
  • ARC-AGI-2
  • Artificial Analysis · Agentic Index
  • All Benchmarks →

Resources

  • API Documentation
  • Methodology
  • Research
  • Gecko Mindshare
  • News
  • Changelog
  • Countries
  • Model Status
  • Brand Assets
  • Developers
  • Charts
  • Learn
  • Economy
  • Labs
  • Gecko Tests
© 2026 BenchGecko·The AI Economy, Tracked
Privacy·Terms·Press
Models · LeaderboardUpdated 27d ago · 1,200 models · 273 providers · 130 benchmarks

Every AI Model · Tracked

The most complete list of AI models you can actually use · 1,200 models, 273 providers, 130 benchmarks · all scored, priced, and ranked in one place.

Benchmark scoredCross-provider pricingContext · parameters · licensingRefreshed daily
Compare side by sideShowing 910 of 1,200
Total Models
1,200
Providers
273
Top Model
GPT-5.5 Pro
87.8%
Cheapest Capable
gpt-oss-20b
$0.03/M
PodiumMoversLeaderboardFAQ

Top 10 Overall

Ranked by average benchmark score · min 3 benchmarks

#1 GOLD3 benchmarks
OpenAI logo
GPT-5.5 Pro
OpenAI
87.8%
#2 SILVER6 benchmarks
OpenAI logo
GPT-5.5
OpenAI
85.0%
#3 BRONZE7 benchmarks
OpenAI logo
GPT-5 Chat
OpenAI
81.9%
#4Anthropic logo
Claude Mythos Preview
Anthropic
81.8%14 benchmarks
#5Alibaba Qwen logo
Qwen3.5 397B A17B
Alibaba Qwen
78.4%11 benchmarks
#6DeepSeek logo
DeepSeek V3.2 Speciale
DeepSeek
78.2%9 benchmarks
#7Anthropic logo
Claude Instant
Anthropic
78.0%4 benchmarks
#8stepfun logo
Step 3.5 Flash
stepfun
76.9%10 benchmarks
#9DeepSeek logo
DeepSeek-V2 (MoE-236B, May 2024)
DeepSeek
76.5%7 benchmarks
#10z-ai logo
GLM 5.2
z-ai
76.2%13 benchmarks

What's moving

New releases, coverage, price leaders, and ELO champions

#ModelProviderCategoryReleased
1inception logoMercury 2.5inceptionLLMSep 8, 2026
2nex-agi logoNex-N2.5-Mini (free)nex-agiLLMSep 8, 2026
3nex-agi logoNex-N2.5-Pro (free)nex-agiMultimodalSep 8, 2026
4OpenAI logoGPT-6 AstraOpenAIMultimodalSep 4, 2026
5OpenAI logoGPT-6 Astra (batch)OpenAIMultimodalSep 4, 2026
6OpenAI logoGPT-6 Astra ProOpenAIMultimodalSep 4, 2026
7OpenAI logoGPT-6 Astra Pro (batch)OpenAIMultimodalSep 4, 2026
8Alibaba Qwen logoQwen3.8 Max (0902)Alibaba QwenMultimodalSep 3, 2026
9Google DeepMind logoGemini 3.8 Flash (batch)Google DeepMindMultimodalSep 2, 2026
10Google DeepMind logoGemini 3.8 FlashGoogle DeepMindMultimodalSep 2, 2026
Provider
Filter

All Models

#ModelProviderCategoryContextIn $/MOut $/MAvgBenchmarksELO
1OpenAI logoGPT-5.5 ProOpenAILLM400K$30.00$180.0087.8%3—
2OpenAI logoGPT-5.5OpenAILLM400K$5.00$30.0085.0%6—
3Anthropic logoClaude Mythos PreviewAnthropicLLM1.0MTBDTBD81.8%14—
4DeepSeek logoDeepSeek V3.2 SpecialeOSSDeepSeekLLM164K$0.40$1.2078.2%9—
5Anthropic logoClaude InstantAnthropicLLM—TBDTBD78.0%4—
6stepfun logoStep 3.5 FlashOSSstepfunLLM262K$0.10$0.3076.9%10—
7DeepSeek logoDeepSeek-V2 (MoE-236B, May 2024)OSSDeepSeekLLM—TBDTBD76.5%7—
8z-ai logoGLM 5.2OSSz-aiLLM1.0M$1.00$4.0076.2%13—
9DeepSeek logoDeepSeek V4 ProOSSDeepSeekLLM1.0M$0.96$1.9173.6%12—
10
U
PaLM 2-L
UnknownLLM—TBDTBD73.4%4—
11xiaomi logoMiMo-V2-FlashOSSxiaomiLLM262K$0.09$0.2973.3%11—
12writer logoPalmyra X5writerLLM1.0M$0.60$6.0069.7%5—
13minimax logoMiniMax M2OSSminimaxLLM205K$0.26$1.0269.5%8—
14xAI logoGrok 3 BetaxAILLM131K$3.00$15.0069.5%6—
15z-ai logoGLM 4.5OSSz-aiLLM131K$0.60$2.2069.2%7—
16OpenAI logoGPT-4OpenAILLM8K$30.00$60.0068.7%1—
17OpenAI logogpt-oss-120b (free)OSSOpenAILLM131KFreeFree68.7%10—
18Alibaba Qwen logoQwen3.7 MaxOSSAlibaba QwenLLM1.0M$1.25$3.7568.1%18—
19Microsoft logophi-3-small 7.4BOSSMicrosoftLLM—TBDTBD67.4%8—
20OpenAI logogpt-oss-20bOSSOpenAILLM131K$0.03$0.1367.4%6—
21DeepSeek logoDeepSeek V4 FlashOSSDeepSeekLLM1.0M$0.09$0.1867.2%12—
22OpenAI logogpt-oss-20b (free)OSSOpenAILLM131KFreeFree66.4%9—
23Alibaba Qwen logoQwen3 30B A3B Thinking 2507OSSAlibaba QwenLLM82K$0.20$2.4066.2%6—
24OpenAI logoGPT-4 Turbo (older v1106)OpenAILLM128K$10.00$30.0065.4%2—
25xAI logoGrok 3 Mini BetaxAILLM131K$0.30$0.5064.8%7—
26minimax logoMiniMax M2.7OSSminimaxLLM205K$0.30$1.2063.5%13—
27
U
PaLM 2-M
UnknownLLM—TBDTBD63.0%5—
28Alibaba Qwen logoQwen3 Next 80B A3B ThinkingOSSAlibaba QwenLLM262K$0.15$1.2061.6%20—
29Microsoft logophi-3-mini 3.8BOSSMicrosoftLLM—TBDTBD61.0%8—
30Alibaba Qwen logoQwen-14BOSSAlibaba QwenLLM—TBDTBD60.7%7—
31Alibaba logoQwen3 4B Thinking 2507OSSAlibabaLLM—TBDTBD60.6%6—
32Google DeepMind logoGemini 3 ProGoogle DeepMindLLM—TBDTBD60.4%29—
33OpenAI logoo3 Mini HighOpenAILLM200K$1.10$4.4060.4%2—
34meituan logoLongCat Flash ChatOSSmeituanLLM131K$0.20$0.8059.8%7—
35z-ai logoGLM 5.1OSSz-aiLLM205K$0.97$3.0459.8%22—
36
U
internlm-20b
UnknownLLM—TBDTBD59.0%7—
37DeepSeek logoDeepSeek V3OSSDeepSeekLLM164K$0.26$1.0359.0%22—
38
U
PaLM 2-S
UnknownLLM—TBDTBD58.9%5—
39Microsoft logophi-3-medium 14BOSSMicrosoftLLM—TBDTBD58.6%10—
40Alibaba Qwen logoQwen3 MaxOSSAlibaba QwenLLM262K$0.78$3.9058.3%8—
41Alibaba Qwen logoQwen3 32BOSSAlibaba QwenLLM131K$0.08$0.2858.2%8—
42xiaomi logoMiMo-V2-ProxiaomiLLM1.0M$1.00$3.0058.1%13—
43TII logoFalcon 2 11BOSSTIILLM—TBDTBD58.0%4—
44DeepSeek logoR1 0528OSSDeepSeekLLM164K$0.50$2.1557.9%25—
45Mistral AI logoMixtral 8x7BOSSMistral AILLM—TBDTBD57.8%11—
46Mistral AI logoMixtral 8x7B InstructOSSMistral AILLM33K$0.54$0.5457.8%11—
47baidu logoERNIE 4.5 21B A3B ThinkingOSSbaiduLLM131K$0.07$0.2857.0%6—
48Alibaba Qwen logoQwen3 8BOSSAlibaba QwenLLM131K$0.12$0.4656.5%6—
49Alibaba Qwen logoQwen3 235B A22BOSSAlibaba QwenLLM131K$0.46$1.8256.4%8—
50moonshotai logoKimi K2 0711OSSmoonshotaiLLM131K$0.57$2.3056.2%12—
51z-ai logoGLM 5OSSz-aiLLM205K$0.60$1.9256.1%29—
52DeepSeek logoDeepSeek R1 Distill Qwen 14BOSSDeepSeekLLM—TBDTBD56.0%11—
53Alibaba Qwen logoQwen3 235B A22B Thinking 2507OSSAlibaba QwenLLM131K$0.23$2.3055.9%24—
54
U
Muse Spark
UnknownLLM—TBDTBD55.5%10—
55Alibaba Qwen logoQwen3 30B A3B Instruct 2507OSSAlibaba QwenLLM262K$0.05$0.1955.3%7—
56minimax logoMiniMax M2.5OSSminimaxLLM205K$0.27$1.0855.1%21—
57DeepSeek logoDeepSeek V3 0324OSSDeepSeekLLM164K$0.25$1.0055.1%2—
58OpenAI logoGPT-4 (older v0314)OpenAILLM8K$30.00$60.0055.0%7—
59xAI logoGrok 4xAILLM—TBDTBD54.8%24—
60Alibaba Qwen logoQwen3 Next 80B A3B InstructOSSAlibaba QwenLLM262K$0.09$1.1054.4%18—
61Google DeepMind logoGemini 2.0 ProGoogle DeepMindLLM—TBDTBD53.7%4—
62
U
Nemotron-4 15B
UnknownLLM—TBDTBD53.4%7—
63moonshotai logoKimi K2 ThinkingOSSmoonshotaiLLM262K$0.60$2.5053.3%25—
64xAI logoGrok-3 minixAILLM—TBDTBD53.3%16—
65DeepSeek logoDeepSeek V3.2 ExpOSSDeepSeekLLM164K$0.27$0.4153.2%14—
66Alibaba Qwen logoQwen2.5 Coder 32B InstructOSSAlibaba QwenLLM33K$0.66$1.0053.1%14—
67tencent logoHunyuan A13B InstructOSStencentLLM131K$0.14$0.5752.3%6—
68Alibaba Qwen logoQwen2.5-Coder-3BOSSAlibaba QwenLLM—TBDTBD52.2%4—
69NVIDIA logoNemotron 3 UltraOSSNVIDIALLM1.0M$0.50$2.2051.8%11—
70Alibaba Qwen logoQwen2.5 72B InstructOSSAlibaba QwenLLM33K$0.36$0.4051.6%25—
71DeepSeek logoDeepSeek V3.2OSSDeepSeekLLM164K$0.27$0.4051.2%30—
72Alibaba Qwen logoQwen3.6 Max PreviewOSSAlibaba QwenLLM262K$1.03$6.1651.2%10—
73DeepSeek logoDeepSeek V3.1OSSDeepSeekLLM164K$0.25$0.9551.1%5—
74z-ai logoGLM 4.6OSSz-aiLLM205K$0.43$1.7550.8%20—
75DeepSeek logoDeepSeek-Coder-V2-Lite-BaseOSSDeepSeekLLM—TBDTBD50.8%4—
76Alibaba logoQwen2 7B InstructOSSAlibabaLLM—TBDTBD50.5%25—
77z-ai logoGLM 4.7OSSz-aiLLM205K$0.40$1.7550.5%26—
78xAI logoGrok 4 FastxAILLM—TBDTBD50.4%6—
79Alibaba logoQwen2.5 Coder 14B InstructOSSAlibabaLLM—TBDTBD50.0%12—
80DeepSeek logoDeepSeek R1 Distill Qwen 32BOSSDeepSeekLLM—TBDTBD49.0%11—
81Alibaba Qwen logoQwen3 235B A22B Instruct 2507OSSAlibaba QwenLLM262K$0.09$0.5548.5%20—
82
HA
Qwen2.5 72B Instruct Abliterated
HuiHui AILLM—TBDTBD48.1%6—
83Google DeepMind logoGemini 2.0 Flash (Dec 2024)Google DeepMindLLM—TBDTBD48.0%19—
84
U
Stable Beluga 2
UnknownLLM—TBDTBD47.8%13—
85Anthropic logoClaude 3.7 SonnetAnthropicLLM—TBDTBD47.7%26—
86Google DeepMind logoGemini 1.5 Flash (May 2024)Google DeepMindLLM—TBDTBD47.3%17—
87Alibaba logoQwen2 VL 7B InstructOSSAlibabaLLM—TBDTBD47.3%11—
88Alibaba logoQwen3 4B Instruct 2507OSSAlibabaLLM—TBDTBD47.2%6—
89Meta logoLlama 3.3 70B InstructOSSMetaLLM131K$0.10$0.3246.9%8—
90OpenAI logogpt-oss-120bOSSOpenAILLM131K$0.04$0.1746.9%27—
91OpenAI logoGPT-3.5 Turbo (older v0613)OpenAILLM4K$1.00$2.0045.8%13—
92Mistral AI logoMistral Large 2411OSSMistral AILLM131K$2.00$6.0045.8%11—
93xAI logoGrok 3xAILLM—TBDTBD45.5%19—
94Meta logoMeta Llama 3 8B InstructOSSMetaLLM—TBDTBD45.2%25—
95DeepSeek logoR1OSSDeepSeekLLM64K$0.70$2.5045.1%14—
96Alibaba Qwen logoQwen2.5 Coder 7B InstructOSSAlibaba QwenLLM33K$0.03$0.0944.4%12—
97TII logoFalcon-180BOSSTIILLM—TBDTBD44.4%17—
98Alibaba logoQwen2.5 Coder 7B InstructOSSAlibabaLLM—TBDTBD44.4%12—
99Meta logoMeta Llama 3 8BOSSMetaLLM—TBDTBD44.2%11—
100Microsoft logoPhi 4OSSMicrosoftLLM16K$0.07$0.1443.2%16—

Showing 1-100 of 910 · page 1/10

…

Top 5 by category

Specialist leaders across every modality we track

LLMs

See all →
#1OpenAI logoGPT-5.5 Pro87.8%#2OpenAI logoGPT-5.585.0%#3Anthropic logoClaude Mythos Preview81.8%#4DeepSeek logoDeepSeek V3.2 Speciale78.2%#5Anthropic logoClaude Instant78.0%

Multimodal

See all →
#1OpenAI logoGPT-5 Chat81.9%#2Alibaba Qwen logoQwen3.5 397B A17B78.4%#3Google DeepMind logoGemini 2.5 Pro Preview 05-0676.9%#4Anthropic logoClaude Fable 574.4%#5OpenAI logoo4 Mini High72.0%

Decision shortcuts

Jump from the leaderboard into comparison, provider, pricing, and benchmark paths

GPT-5.5 Pro vs Qwen3.5
Frontier comparison
Qwen3.5 vs DeepSeek V3.2
Open model comparison
OpenAI model lineup
Provider profile
Anthropic Claude lineup
Provider profile
Coding model pricing
Cost by use case
Reasoning model pricing
Cost by use case
SWE-bench Verified results
Coding benchmark
GPQA Diamond results
Reasoning benchmark

Frequently asked

Quick answers, sourced from our data

How many AI models does BenchGecko track?

BenchGecko currently tracks 1,200 AI models across 273 providers, each scored against up to 130 benchmarks. New models are added continuously and the full dataset refreshes daily.

What is the best AI model right now?

"Best" depends on the task. For general reasoning we rank by average score across 3+ benchmarks; for coding we surface ELO and SWE-bench specifically; for cost/performance we expose a "cheapest capable" metric. Use the filter bar and column sort to define your own winner, or pick a category from the mini tables below.

How is the average score calculated?

Average score is the arithmetic mean of a model's normalized benchmark scores, computed only when the model has at least one public benchmark result. Models with fewer than 3 benchmarks are excluded from the podium to avoid single-score outliers.

Where does BenchGecko get this data?

Model metadata and pricing come from OpenRouter's public API. Benchmarks are pulled from Epoch AI (CC-BY) and SWE-bench's public leaderboards. ELO ratings come from LMArena. Everything is re-normalized and cross-linked daily. See the methodology page for full provenance.

Can I use this data in my article or product?

Yes. All BenchGecko data is licensed CC BY 4.0 — attribution required. Use the "Cite this page" button above for ready-made APA, MLA, AP Style, BibTeX, and HTML embed snippets. The free API tier requires a backlink to benchgecko.ai.

How often does the data refresh?

Core model, pricing and benchmark data refreshes every 24 hours. Live status and pricing alerts can fire more frequently when upstream sources change. The "Live" pill on this page lights up when the last refresh was less than an hour ago.

Which models are open source?

Toggle the "Open Source" filter to see only models with OSS weights available. We currently count permissively — weights-available licenses like Llama, Qwen, DeepSeek, and Mistral Open count as OSS for this filter even when the weights come with usage restrictions.

How do I compare two models side by side?

Check the boxes next to any 2-4 models in the leaderboard above, then click "Compare →" in the pink action bar. You can also navigate directly to /compare/[modelA]-vs-[modelB] for shareable comparisons.

See also

Related model, benchmark, provider, and pricing indexes

Compare models
Side-by-side with charts
Benchmarks
Every eval we track
Providers
Where to run models
Pricing
Every model, every provider
AI agents
SWE-bench leaderboard
MCP servers
Tools for LLMs
AI economy
Valuations & funding
Methodology
How we score