LIVE
Apr 7Claude Mythos Preview · Anthropic's most capable model arrives·Mar 31GPT-5.4 Nano launched on OpenAI·Mar 31GPT-5.4 Mini joins the OpenAI lineup·Mar 30Claude Opus 4.5 input price dropped · $5.00 per 1M tokens·Mar 30Mistral Small 4 available via Mistral AI·Mar 29Gemini 2.5 Pro scores 94.1% on MMLU·Mar 29Grok 4.20 Multi-Agent Beta enters agent rankings·Mar 28DeepSeek V3.2 output price dropped · $0.38 per 1M tokens·Mar 287 new MCP servers added in dev-tools category·Mar 27Claude Sonnet 4.6 released by Anthropic·Mar 27Claude Opus 4.6 released by Anthropic·Mar 26OTIS Mock AIME 2024-2025 benchmark added·Mar 26Claude Opus 4.1 pricing increased · $15/$75 per 1M tokens·Mar 25Grok 4.20 Beta launched by xAI·Mar 25Inception added as a tracked provider·Mar 24DeepSeek R1 0528 posted 87.2% on GPQA Diamond·Mar 243 new MCP servers in AI/ML category·Mar 23GPT-4o Audio Preview marked as deprecated·Mar 23Mistral Medium 3.1 input price cut to $0.40 per 1M tokens·Mar 22DeepSeek V3.2 Speciale released·Mar 22WeirdML benchmark now tracked on BenchGecko·Mar 20Nemotron 3 Super (120B) launched by NVIDIA·Mar 20Gemini 2.5 Flash Lite priced at $0.10/$0.40 per 1M tokens·Mar 18Mistral Large 3 2512 released by Mistral AI·Mar 18Grok Code Fast 1 added to agent rankings·Mar 16Claude Sonnet 4.5 scores 91.7% on MMLU·Mar 1612 new MCP servers added across 5 categories·Mar 14GPT-5.4 Pro launched · OpenAI's new flagship·Mar 14GPT-5.4 standard tier released by OpenAI·Mar 12Grok 3 Mini marked as deprecated by xAI·Mar 12Llama 3.3 Nemotron Super 49B pricing dropped·Mar 10Liquid added as a tracked provider·Mar 10MiniMax M2.7 released by MiniMax·Mar 8Grok 4 posted 89.4% on GPQA Diamond·Mar 8LAMBADA benchmark scores now tracked·Mar 5Gemini 2.5 Flash output price reduced to $2.50 per 1M tokens·Mar 5Mercury 2 launched by Inception·Mar 3Qwen3.5-Flash released by Alibaba Qwen·Mar 35 new MCP servers added · finance and auth categories·Apr 7Claude Mythos Preview · Anthropic's most capable model arrives·Mar 31GPT-5.4 Nano launched on OpenAI·Mar 31GPT-5.4 Mini joins the OpenAI lineup·Mar 30Claude Opus 4.5 input price dropped · $5.00 per 1M tokens·Mar 30Mistral Small 4 available via Mistral AI·Mar 29Gemini 2.5 Pro scores 94.1% on MMLU·Mar 29Grok 4.20 Multi-Agent Beta enters agent rankings·Mar 28DeepSeek V3.2 output price dropped · $0.38 per 1M tokens·Mar 287 new MCP servers added in dev-tools category·Mar 27Claude Sonnet 4.6 released by Anthropic·Mar 27Claude Opus 4.6 released by Anthropic·Mar 26OTIS Mock AIME 2024-2025 benchmark added·Mar 26Claude Opus 4.1 pricing increased · $15/$75 per 1M tokens·Mar 25Grok 4.20 Beta launched by xAI·Mar 25Inception added as a tracked provider·Mar 24DeepSeek R1 0528 posted 87.2% on GPQA Diamond·Mar 243 new MCP servers in AI/ML category·Mar 23GPT-4o Audio Preview marked as deprecated·Mar 23Mistral Medium 3.1 input price cut to $0.40 per 1M tokens·Mar 22DeepSeek V3.2 Speciale released·Mar 22WeirdML benchmark now tracked on BenchGecko·Mar 20Nemotron 3 Super (120B) launched by NVIDIA·Mar 20Gemini 2.5 Flash Lite priced at $0.10/$0.40 per 1M tokens·Mar 18Mistral Large 3 2512 released by Mistral AI·Mar 18Grok Code Fast 1 added to agent rankings·Mar 16Claude Sonnet 4.5 scores 91.7% on MMLU·Mar 1612 new MCP servers added across 5 categories·Mar 14GPT-5.4 Pro launched · OpenAI's new flagship·Mar 14GPT-5.4 standard tier released by OpenAI·Mar 12Grok 3 Mini marked as deprecated by xAI·Mar 12Llama 3.3 Nemotron Super 49B pricing dropped·Mar 10Liquid added as a tracked provider·Mar 10MiniMax M2.7 released by MiniMax·Mar 8Grok 4 posted 89.4% on GPQA Diamond·Mar 8LAMBADA benchmark scores now tracked·Mar 5Gemini 2.5 Flash output price reduced to $2.50 per 1M tokens·Mar 5Mercury 2 launched by Inception·Mar 3Qwen3.5-Flash released by Alibaba Qwen·Mar 35 new MCP servers added · finance and auth categories·

AI 경제를, 추적합니다.

펄스34·불안정
버블278%·불안정
GPT-5.5 Pro+4.0
Open Source16.2%

The Pulse

펄스
frothy
7d · +3 pts
버블 지수 · 구성 요소
Valuation Premiumhealthy+2.1
Funding Accelerationhealthy+1.5
Concentration Riskhealthy0
Revenue Qualityhealthy+1.4
Capex Gaphealthy+0.3
최대 변동 · Valuation Premium 상승 2.1 pts
AI 버블 지수
건전과열 조짐과열버블
업데이트 Sep 8·방법론·리서치·무료 API·개발자

크로스 레이어 인사이트

전체 매트릭스
#벤치마크
1OpenAI logoGPT-5.5 Pro99.9$30.00400K3
2Anthropic logoClaude Mythos Preview97.81000K14
3Alibaba Qwen logoQwen3.5 397B A17B96.3$0.39256K11
4DeepSeek logoDeepSeek V3.2 Speciale95.2$0.40164K9
5Anthropic logoClaude Fable 593.2$10.001000K13
6z-ai logoGLM 5.292.7$1.001049K13
7stepfun logoStep 3.5 Flash89.5$0.10262K10
8OpenAI logoGPT-5 Chat89.0$1.25128K7
9OpenAI logoGPT-5.4 Pro87.9$30.001050K10
10
HA
Qwen2.5 72B Instruct Abliterated
87.56
11DeepSeek logoDeepSeek V4 Pro86.5$0.431049K12
12DeepSeek logoDeepSeek-V2 (MoE-236B, May 2024)86.17
13OpenAI logoGPT-5.1-Codex-Max85.6$1.25400K8
14DeepSeek logoDeepSeek R1 Distill Qwen 14B85.411
15Anthropic logoClaude Instant84.64
16Anthropic logoClaude Opus 4.6 (Fast)83.3$30.001000K12
17Anthropic logoClaude Opus 4.882.8$5.001000K16
18
U
PaLM 2-L
81.84
19xiaomi logoMiMo-V2-Flash81.7$0.09262K11
20Alibaba logoQwen2.5 32B Instruct81.37
검색 297 AI 용어 · 트랜스포머에서 어텐션 프리미엄까지열기
전체 방법론
BenchGecko 데이터는 얼마나 자주 업데이트됩니까?

모델 및 벤치마크 데이터는 1차 출처에서 매일 갱신합니다. 가격은 모든 프로바이더 API에서 순환 방식으로 수집합니다. 화제 시그널은 주간 단위로 집계합니다. 펄스는 매일 00:00 UTC에 재산출합니다.

펄스란 무엇입니까?

AI 경제 건전성의 0-100 복합 점수입니다. 역 버블 지수, 벤치마크 속도, 가격 압축, 화제 다양성, 공급망 긴장을 하나의 숫자로 결합합니다. 낮을수록 건전합니다.

벤치마크 점수는 어떻게 정규화됩니까?

모든 벤치마크는 점수가 매겨진 전체 모델 세트에 대해 min-max 정규화합니다. 순위는 모델당 3개 이상 벤치마크에 걸쳐 정규화된 점수를 평균하여 단일 테스트의 과대 반영을 방지합니다.

가격 데이터의 출처는 어디입니까?

프로바이더 API 직접 응답 · OpenRouter, OpenAI, Anthropic, Google, xAI, DeepSeek, Mistral 등. 모든 스냅샷은 모델 상세 페이지에 출처 표기와 함께 캐시됩니다.

BenchGecko 데이터를 인용할 수 있습니까?

가능합니다. 모든 페이지에 APA, MLA, BibTeX, Chicago, 일반 텍스트 형식의 공유 및 인용 바를 제공합니다. 무료 API 등급에서는 출처 표기가 필수이며, 모든 곳에서 권장합니다.

출처 ·OpenRouterEpoch AISWE-benchMCP RegistryChatbot ArenaHuggingFaceLiveBenchArtificial AnalysisSEALAider
2시간 전 업데이트 · 10개 이상의 권위 있는 출처 · 편집 콘텐츠 없음·Learn · Glossary·리서치·Developers