Compare · GPUs & AI chips
Gaudi 3 vs Instinct MI300X
RANKED BY DENSE FP16/BF16 TENSOR TFLOPS PER CHIP
#5 VS #7
CHECKED 06 SEPT 2026
Side by side
Verdict
Gaudi 3 ranks #5 of 20 on Dense FP16/BF16 tensor TFLOPS per chip (1.678 PFLOPS); Instinct MI300X ranks #7 (1.3 PFLOPS).
Rank 05 of 20 · leads
Dense FP16/BF16 tensor TFLOPS per chip
1.678 PFLOPS
MakerIntel
Date2024
Verified04 Sept 2026
Evidence
Intel Gaudi 3 AI Accelerator white paper (Intel document 817486), product-comparison table: "BF16 MME TFLOPS 1678" for Gaudi 3. The same paper's MME-precision table lists BF16 and FP8 at 1678 TFLOPS and "FP16 (signed)" at 459 TFLOPS — so this row is the BF16 matrix figure. 128 GB HBM2e. Not an FP16=BF16 part in the NVIDIA/AMD sense; the difference is disclosed here rather than hidden.Rank 07 of 20
Dense FP16/BF16 tensor TFLOPS per chip
1.3 PFLOPS
MakerAMD
Date2023
Verified04 Sept 2026
Evidence
AMD Instinct MI300X product page, per-GPU spec: "Peak Half Precision (FP16) Performance 1.3 PFLOPs" / Peak bfloat16 1.3 PFLOPs; structured-sparsity counterparts 2.61 PFLOPs. Launch date on the page: 6 December 2023. 192 GB HBM3. Same dense FP16 figure as MI325X.Try another pair
More Gaudi 3 matchups
Source Vendor product pages and official spec documents (AMD Instinct MI355X / MI350X / MI325X / MI300X / MI300A / MI250X / MI250 / MI210; NVIDIA…
Last checked 06 Sept 2026
