Cada chip de IA · en seguimiento
Chips de IA de todos los fabricantes y fundiciones. Especificaciones, potencia, precios en la nube, compradores conocidos y tensión de suministro en vivo · enlazado con fundiciones, proveedores de memoria, racks, centros de datos y los modelos entrenados en ellos.
- Escasez ponderada68
- Multiplicador de plazo de entrega2.09×
- Acelerador de capex1.85×
- Prima por reserva de chips frontier+60
New since Apr 14, 2026
verified on the source page · specs added after review- Zhenwu M890Alibaba T-Headannounced2026-05-20source
T-Head formally debuted the Zhenwu M890 as its latest AI training and inference processor for datacenter use.
- TPU 8tGoogleannounced2026-04-22source
Google announced TPU 8t as its training-focused eighth-generation TPU for AI workloads.
- TPU 8iGoogleannounced2026-04-22source
Google announced TPU 8i as its inference-focused eighth-generation TPU for AI workloads.
Escalera de tiers
Frontier · Mainstream · Especializado · Legacy · evaluado trimestralmente
Silicio insignia de la generación actual que se envía a escala a los hiperescaladores. Los chips que entrenan los modelos más grandes ahora mismo.
Chips de la generación actual que no son insignia, o insignia de la generación anterior aún muy desplegados. Los caballos de batalla de la economía de la IA.
Escala de oblea, silicio personalizado de hiperescaladores o arquitecturas experimentales para cargas de trabajo de nicho.
Chips antiguos en retirada o que ya superaron el fin de vida. Aún se usan en clústeres de investigación y cargas sensibles al precio.
Rendimiento por vatio
TFLOPs FP16 vs TDP · escala logarítmica · tamaño de burbuja = capacidad HBM
Arriba a la izquierda gana. Los chips por encima de la 4 T/W línea son la frontera de eficiencia · ahí se gana la batalla del presupuesto energético a gran escala. Los superchips a escala de oblea y multidado están arriba a la derecha porque sacrifican vatios por rendimiento bruto.
Escalera de demanda de chips
Qué tan ajustado está el suministro ahora · curado a mano a partir de libros de pedidos y llamadas de resultados
Notas de suministro
- GB200Sold out through 2027 · Oracle, Microsoft, Meta competing
- GB300xAI Memphis + Stargate phase 2
- B200CoWoS-L packaging capacity is the bottleneck
- Ascend 910CChina export-ban alternative · SMIC N7 constrained
- WSE-3G42 Condor Galaxy absorbing most wafers
- B300Ultra variant ramping Q4 2025
Esta es la vista previa por chip de la Índice de Demanda de Cómputo de IA disponible en /compute · sin límite superior sobre 100, llega a 250+ cuando el mercado está en llamas. Se actualiza cada semana con libros de pedidos de hiperescaladores y datos de resultados.
Mejor para
Seis listas curadas computadas a partir de los datos de especificaciones en vivo
Mayor rendimiento bruto en FP16
Los 5 mejores en TFLOPs FP16/BF16 · sin considerar precio ni consumo · cómputo puro
Más eficientes (TFLOPs/W)
Mejores TFLOPs FP16 por Watt · los chips que hacen viables los presupuestos de energía de los centros de datos
Mayor capacidad HBM
La mayor memoria para alojar modelos de más de 400B parámetros en un solo nodo
Alquiler en la nube más barato
Menor $/h en nubes públicas · ideal para experimentos rápidos
Chips insignia actuales
Los chips que entrenan los mayores modelos de vanguardia ahora mismo
Tabla completa
Ordenado por puntuación Gecko · compuesto de tier, antigüedad, adopción, densidad de rendimiento
| # | Chip | Fabricante | Puntuación |
|---|---|---|---|
| 1 | NVIDIA | 94 | |
| 2 | NVIDIA | 86 | |
| 3 | 83 | ||
| 4 | AWS | 78 | |
| 5 | NVIDIA | 75 | |
| 6 | AMD | 75 | |
| 7 | Huawei | 75 | |
| 8 | 71 | ||
| 9 | NVIDIA | 70 | |
| 10 | AMD | 68 | |
| 11 | AMD | 65 | |
| 12 | Cerebras | 60 | |
| 13 | Intel | 57 | |
| 14 | NVIDIA | 55 | |
| 15 | NVIDIA | 55 | |
| 16 | Meta | 52 | |
| 17 | 49 | ||
| 18 | Microsoft | 42 | |
| 19 | Groq | 34 | |
| 20 | NVIDIA | 31 |
Por fabricante
10 empresas · 3 fundiciones · 2 países
Preguntas frecuentes
Extraídas del dataset en vivo · actualizadas a diario
¿Qué chip de IA tiene más TFLOPs FP16 ahora mismo?
El NVIDIA GB300 (Grace Blackwell Ultra) lidera el rendimiento FP16 denso con unos 5000 TFLOPs por superchip, seguido del GB200 con 4500 TFLOPs. El Cerebras WSE-3 alcanza 125000 TFLOPs por oblea, pero es una arquitectura fundamentalmente distinta · una sola oblea contiene lo que de otro modo serían unas 50 GPU.
¿Qué chip de IA es más eficiente por Watt?
Google TPU v7 (Ironwood) y NVIDIA B200 lideran los TFLOPs FP16 por Watt entre los chips en circulación. Trillium (TPU v6e) les sigue de cerca. Los diseños centrados en inferencia (Ironwood, Groq LPU) tienden a dominar el rendimiento por Watt porque prescinden de circuitería específica para entrenamiento.
¿Quién fabrica chips de IA además de NVIDIA?
10 empresas comercializan aceleradores de IA en producción registrados en BenchGecko · NVIDIA, AMD, Google, AWS, Intel, Microsoft, Meta, Huawei, Cerebras, Groq y más. NVIDIA domina las ventas a terceros, pero los hiperescaladores lanzan cada vez más silicio personalizado (Trainium2, TPU v7, Maia 100, MTIA) para reducir su dependencia.
¿Qué fábricas producen los chips de IA?
El 90% de los chips registrados se fabrica en TSMC. GlobalFoundries se encarga de la LPU de 14 nm de Groq. SMIC fabrica el Ascend 910C de Huawei en su nodo N7 como respuesta principal a la prohibición de exportaciones de EE. UU. Los nodos avanzados de TSMC (N5/N4/N3) son el cuello de botella del silicio actual de NVIDIA, AMD, AWS, Google y Microsoft.
¿Cómo se decide qué chip pertenece al nivel "frontier"?
Frontier significa buque insignia de la generación actual, con lanzamiento en 2025-2026 y pedidos masivos de hiperescaladores. Mainstream significa generación actual no insignia o insignia de la generación anterior aún desplegado (H100, H200, MI300X). Specialized significa diseños a escala de oblea, LPU, MTIA y otros diseños personalizados. Legacy significa fin de vida o en retirada (A100, V100). Los niveles se revisan cada trimestre.
¿De dónde obtiene BenchGecko los datos de los chips?
Hojas de datos de los fabricantes para las especificaciones, informes 10-K de la SEC y transcripciones de resultados para las declaraciones de compradores, precios de API de proveedores cloud para el $/hora y comunicados de prensa públicos para las fechas de lanzamiento. Cada página de detalle de chip incluye enlaces a las fuentes. Sin datos de pago · sin rankings patrocinados por fabricantes · todo es reproducible.
Ver también
Sigue explorando el grafo de compute