Benchmark · KnowledgeSettled

Artificial Analysis · Long Context Reasoning

Updated 2026-09-29
Models tested
61
Top score
88.7
Kimi K3
Median
71.7
min 5.7
Top-5 spread
σ 1.6
Settled

Best score over time · one chart, every benchmark

ARTIFICIAL ANALYSIS · LONG CONTEXT REASONING61 MODELS · FRONTIER RUNNING MAX0255075100SCORE ↑Feb 25Jul 25Dec 25May 26Sep 26RELEASE DATE →benchgecko.ai/benchmark/aa-long-context-reasoning · frontier
Frontier on Artificial Analysis · Long Context Reasoning rose from 15.3 to 88.7 in 17 months · +73.4 points · latest leader Kimi K3 from moonshotai.
Pink dots = frontier records · 7 totalClick to open model page

61 models tested · sorted by score

#ModelScore
1moonshotai logoKimi K388.7
2xiaomi logoMiMo-V2.6-Pro86.3
3Anthropic logoClaude Fable 5.185.3
4Anthropic logoClaude Opus 5.584.7
5DeepSeek logoDeepSeek V4.1 Flash84.0
6OpenAI logoGPT-5.3-Codex83.3
7OpenAI logoGPT-6 Luna83.3
8upstage logoSolar Mini 483.3
9OpenAI logoGPT-5.6 Terra83.0
10OpenAI logoGPT-6.1 Sol83.0
11minimax logoMiniMax M383.0
12Anthropic logoClaude Sonnet 5.582.7
13Google DeepMind logoGemini 3.1 Pro Preview82.0
14Alibaba Qwen logoQwen3.8 27B82.0
15Google DeepMind logoGemini 3.8 Flash81.3
16OpenAI logoGPT-6 Astra80.7
17DeepSeek logoDeepSeek V4 Pro80.3
18Alibaba Qwen logoQwen3.8 2.4T A95B80.3
19Alibaba Qwen logoQwen3.8 Max (0902)80.3
20z-ai logoGLM 5.3 Flash80.0
21z-ai logoGLM 5.379.7
22moonshotai logoKimi K2.7 Code79.3
23NVIDIA logoNemotron 3 Ultra79.3
24tencent logoHy379.0
25xAI logoGrok 4.776.7
26Google DeepMind logoGemini 3.5 Flash Lite76.0
27OpenAI logoo374.7
28xiaomi logoMiMo-V2.6-Flash74.3
29upstage logoSolar Pro 474.0
30Alibaba Qwen logoQwen3.7 Plus73.0
31inception logoMercury 2.571.7
32Alibaba Qwen logoQwen3.6 35B A3B71.7
33Google DeepMind logoGemma 4 31B69.7
34Mistral AI logoMistral Medium 3.569.3
35Google DeepMind logoGemma 4 26B A4B 65.7
36NVIDIA logoNemotron 3 Super65.7
37meituan logoLongCat 2.065.0
38Alibaba Qwen logoQwen3.5 397B A17B64.3
39Alibaba Qwen logoQwen3 Next 80B A3B Instruct63.7
40Alibaba logoQwen3.5 4B63.0
41Alibaba Qwen logoQwen3.5-122B-A10B61.3
42NVIDIA logoNemotron 3.5 Lightning60.3
43Cohere logoCommand A+52.7
44OpenAI logogpt-oss-120b52.0
45DeepSeek logoDeepSeek V4 Pro 081350.7
46Meta logoLlama 4 Maverick50.0
47Mistral AI logoMistral Small 449.7
48ibm-granite logoGranite 4.2 8B49.0
49Alibaba Qwen logoQwen3 Coder Next47.0
50Alibaba Qwen logoQwen3.5-9B46.0
51arcee-ai logoTrinity Large Thinking38.0
52Cohere logoNorth Mini Code (free)37.3
53OpenAI logogpt-oss-20b34.7
54Meta logoLlama 4 Scout27.7
55NVIDIA logoNVIDIA Nemotron Nano 9B V222.7
56Cohere logoCommand A21.3
57Alibaba logoQwen3.5 2B21.0
58Microsoft logoPhi 4 Mini Instruct15.3
59Alibaba logoQwen3.5 0.8B9.0
60ibm-granite logoGranite 4.0 Micro7.0
61liquid logoLFM2.5-2.6B (free)5.7

Same category · related evaluations