Chaque puce IA · suivis
Chaque puce IA de chaque fabricant et chaque fonderie. Spécifications, puissance, tarification cloud, acheteurs connus et tension d'approvisionnement en direct · croisées avec fonderies, fournisseurs de mémoire, racks, datacenters et modèles entraînés dessus.
- Tension pondérée68
- Multiplicateur de délai de livraison2.09×
- Accélérateur de capex1.85×
- Prime de rétention frontier+60
New since Apr 14, 2026
verified on the source page · specs added after review- Zhenwu M890Alibaba T-Headannounced2026-05-20source
T-Head formally debuted the Zhenwu M890 as its latest AI training and inference processor for datacenter use.
- TPU 8tGoogleannounced2026-04-22source
Google announced TPU 8t as its training-focused eighth-generation TPU for AI workloads.
- TPU 8iGoogleannounced2026-04-22source
Google announced TPU 8i as its inference-focused eighth-generation TPU for AI workloads.
Échelle des niveaux
Frontier · Mainstream · Spécialisé · Legacy · évalué trimestriellement
Silicium phare de dernière génération livré à grande échelle aux hyperscalers. Les puces qui entraînent les plus grands modèles actuellement.
Puces de génération actuelle non phares ou phares de la génération précédente encore largement déployés. Les bêtes de somme de l'économie de l'IA.
Échelle de wafer, silicium sur mesure d'hyperscaler ou architectures expérimentales pour des charges de niche.
Puces plus anciennes en cours de retrait ou déjà en fin de vie. Encore utilisées dans les clusters de recherche et les charges sensibles au prix.
Performance par watt
TFLOPs FP16 vs TDP · échelle logarithmique · taille de la bulle = capacité HBM
Haut et à gauche, c'est gagnant. Les puces au-dessus de la 4 T/W ligne forment la frontière d'efficacité · c'est là que se gagne la bataille du budget énergétique à l'échelle hyperscale. Les puces wafer-scale et les superpuces multi-die se placent en haut à droite, car elles sacrifient des watts pour un débit brut maximal.
Échelle de la demande de puces
Niveau de tension de l'offre actuel · compilé à la main à partir des carnets de commandes et des conférences de résultats
Notes sur l'offre
- GB200Sold out through 2027 · Oracle, Microsoft, Meta competing
- GB300xAI Memphis + Stargate phase 2
- B200CoWoS-L packaging capacity is the bottleneck
- Ascend 910CChina export-ban alternative · SMIC N7 constrained
- WSE-3G42 Condor Galaxy absorbing most wafers
- B300Ultra variant ramping Q4 2025
Ceci est l'aperçu par puce de la page Indice de demande de calcul IA disponible sur /compute · sans plafond au-dessus de 100, monte à 250+ quand le marché s'emballe. Mis à jour chaque semaine à partir des carnets de commandes des hyperscalers et de leurs publications de résultats.
Idéal pour
Six sélections calculées à partir des données live
Plus haut débit FP16 brut
Top 5 en TFLOPs FP16/BF16 · sans tenir compte du prix ni de la consommation · calcul pur
Plus efficace (TFLOPs/W)
Meilleurs TFLOPs FP16 par Watt · les puces qui rendent viables les budgets énergétiques des datacenters
Plus grande capacité HBM
La plus grande mémoire pour loger des modèles de plus de 400 Mds de paramètres sur un seul nœud
Location cloud la moins chère
Plus bas $/h dans les clouds publics · idéal pour des expériences rapides
Puces phares actuelles
Les puces qui entraînent les plus grands modèles de pointe actuellement
Podium complet
Trié par score Gecko · composite de tier, récence, adoption, densité de performance
| # | Puce | Fabricant | Score |
|---|---|---|---|
| 1 | NVIDIA | 94 | |
| 2 | NVIDIA | 86 | |
| 3 | 83 | ||
| 4 | AWS | 78 | |
| 5 | NVIDIA | 75 | |
| 6 | AMD | 75 | |
| 7 | Huawei | 75 | |
| 8 | 71 | ||
| 9 | NVIDIA | 70 | |
| 10 | AMD | 68 | |
| 11 | AMD | 65 | |
| 12 | Cerebras | 60 | |
| 13 | Intel | 57 | |
| 14 | NVIDIA | 55 | |
| 15 | NVIDIA | 55 | |
| 16 | Meta | 52 | |
| 17 | 49 | ||
| 18 | Microsoft | 42 | |
| 19 | Groq | 34 | |
| 20 | NVIDIA | 31 |
Par fabricant
10 entreprises · 3 fonderies · 2 pays
Questions fréquentes
Extrait du dataset live · mis à jour chaque jour
Quelle puce IA offre le plus de TFLOPs FP16 actuellement ?
Le NVIDIA GB300 (Grace Blackwell Ultra) domine le débit FP16 dense avec environ 5000 TFLOPs par superpuce, suivi du GB200 à 4500 TFLOPs. Le Cerebras WSE-3 atteint 125000 TFLOPs par wafer mais repose sur une architecture fondamentalement différente · un seul wafer contient l'équivalent d'environ 50 GPU.
Quelle puce IA est la plus efficace par Watt ?
Le Google TPU v7 (Ironwood) et le NVIDIA B200 sont en tête en TFLOPs FP16 par Watt parmi les puces commercialisées. Le Trillium (TPU v6e) suit de près. Les conceptions axées sur l'inférence (Ironwood, Groq LPU) dominent généralement en perf/Watt car elles se passent des circuits spécifiques à l'entraînement.
Qui fabrique des puces d'IA en dehors de NVIDIA ?
10 entreprises commercialisent des accélérateurs d'IA de production suivis sur BenchGecko · NVIDIA, AMD, Google, AWS, Intel, Microsoft, Meta, Huawei, Cerebras, Groq, et d'autres. NVIDIA domine les ventes à des tiers, mais les hyperscalers livrent de plus en plus de silicium sur mesure (Trainium2, TPU v7, Maia 100, MTIA) pour réduire leur dépendance.
Quelles fonderies fabriquent les puces d'IA ?
90% des puces suivies sont gravées chez TSMC. GlobalFoundries produit le LPU 14 nm de Groq. SMIC fabrique l'Ascend 910C de Huawei sur son nœud N7, principale réponse à l'interdiction d'exportation américaine. Les nœuds avancés de TSMC (N5/N4/N3) sont le goulot d'étranglement pour le silicium actuel de NVIDIA, AMD, AWS, Google et Microsoft.
Comment décidez-vous qu'une puce est de niveau « frontier » ?
Frontier désigne le produit phare de la génération actuelle, livré en 2025-2026 et largement commandé par les hyperscalers. Mainstream désigne un produit non phare de la génération actuelle ou un ancien produit phare encore déployé (H100, H200, MI300X). Specialized désigne les conceptions sur mesure comme le wafer-scale, les LPU et MTIA. Legacy désigne les puces en fin de vie ou en cours de retrait (A100, V100). Les niveaux sont revus chaque trimestre.
D'où BenchGecko tire-t-il ses données sur les puces ?
Fiches techniques des fabricants pour les spécifications, rapports 10-K de la SEC et transcriptions de résultats pour les informations sur les acheteurs, tarifs d'API des fournisseurs cloud pour le $/heure, communiqués de presse publics pour les dates de sortie. Chaque page de détail d'une puce inclut des liens vers les sources. Aucune donnée payante · aucun classement sponsorisé par un fournisseur · tout est reproductible.
Voir aussi
Continuez à explorer le graphe de compute