Compare · GPUs & AI chips
H100 SXM vs Trainium2
RANKED BY DENSE FP16/BF16 TENSOR TFLOPS PER CHIP
#9 VS #12
CHECKED 06 SEPT 2026
Side by side
Verdict
H100 SXM ranks #9 of 20 on Dense FP16/BF16 tensor TFLOPS per chip (0.990 PFLOPS); Trainium2 ranks #12 (667 TFLOPS).
Rank 09 of 20 · leads
Dense FP16/BF16 tensor TFLOPS per chip
0.990 PFLOPS
MakerNVIDIA
Date2022
Verified04 Sept 2026
Evidence
NVIDIA H100 product page, H100 SXM column: FP16/BF16 Tensor Core 1,979 teraFLOPS. H100 datasheet footnote 2: "With sparsity." Dense is 1,979 / 2 = 989.5 TFLOPS (0.990 PFLOPS). 80 GB HBM3. Tied with H200 SXM on this compute metric.Rank 12 of 20
Dense FP16/BF16 tensor TFLOPS per chip
667 TFLOPS
MakerAWS
Date2024
Verified04 Sept 2026
Evidence
AWS Neuron Trainium2 Architecture page, compute table: each Trainium2 chip delivers "667 BF16/FP16/TF32 TFLOPS" dense; sparse counterpart is 2,563 TFLOPS and was not used. 96 GiB device memory. Trn2 instances are generally available (AWS announcement 3 Dec 2024).Try another pair
More H100 SXM matchups
- H100 SXM vs Instinct MI355X
- H100 SXM vs Instinct MI350X
- H100 SXM vs Blackwell B200 SXM
- H100 SXM vs Blackwell Ultra B300 SXM
- H100 SXM vs Gaudi 3
- H100 SXM vs Instinct MI325X
- H100 SXM vs Instinct MI300X
- H100 SXM vs H200 SXM
- H100 SXM vs Instinct MI300A
- H100 SXM vs TPU v6e (Trillium)
- H100 SXM vs TPU v5p
- H100 SXM vs Gaudi 2
Source Vendor product pages and official spec documents (AMD Instinct MI355X / MI350X / MI325X / MI300X / MI300A / MI250X / MI250 / MI210; NVIDIA…
Last checked 06 Sept 2026
