GPU / MI300X
AMD Instinct MI300X 192GB
High-capacity inference and training on ROCm
Spec sheet
AMD
- Vendor
- AMD
- Architecture
- CDNA 3
- Memory
- 192 GB HBM3
- Bandwidth
- 5.3 TB/s
- Power
- 750 W
- Class
- Datacenter
- Form factor
- OAM
- Interconnect
- Infinity Fabric
- Released
- 2023
- Workloads
- Inference · Fine-tuning · Training
Model fit / Inference
8K ctx · batch 1 · ≥10% headroom
| Model | FP16 | INT8 | INT4 |
|---|---|---|---|
| Llama 3.2 1B | 1×3.0 GB | 1×1.6 GB | 1×0.95 GB |
| Llama 3.2 3B | 1×8.0 GB | 1×4.5 GB | 1×2.7 GB |
| Llama 3.1 8B | 1×18.7 GB | 1×9.9 GB | 1×5.5 GB |
| Llama 3.1 70B | 1×158.0 GB | 1×80.3 GB | 1×41.5 GB |
| Llama 3.3 70B | 1×158.0 GB | 1×80.3 GB | 1×41.5 GB |
| Llama 3.1 405B | 8×897.2 GB | 4×450.7 GB | 2×227.5 GB |
| Qwen2.5 1.5B | 1×3.6 GB | 1×1.9 GB | 1×1.1 GB |
| Qwen2.5 3B | 1×7.1 GB | 1×3.7 GB | 1×2.0 GB |
| Qwen2.5 7B | 1×17.2 GB | 1×8.9 GB | 1×4.7 GB |
| Qwen2.5 14B | 1×34.0 GB | 1×17.8 GB | 1×9.7 GB |
| Qwen2.5 32B | 1×73.6 GB | 1×37.9 GB | 1×20.0 GB |
| Qwen2.5 72B | 1×162.6 GB | 1×82.7 GB | 1×42.7 GB |
| Mistral 7B | 1×17.0 GB | 1×9.0 GB | 1×5.1 GB |
| Mistral NeMo 12B | 1×28.2 GB | 1×14.8 GB | 1×8.1 GB |
| Mistral Small 24B | 1×53.3 GB | 1×27.3 GB | 1×14.3 GB |
| Mixtral 8x7B | 1×103.8 GB | 1×52.4 GB | 1×26.8 GB |
| Mixtral 8x22B | 2×312.1 GB | 1×157.0 GB | 1×79.4 GB |
| Gemma 2 9B | 1×23.1 GB | 1×13.0 GB | 1×7.9 GB |
| Gemma 2 27B | 1×62.9 GB | 1×33.0 GB | 1×18.0 GB |
| Phi-3 Mini 3.8B | 1×11.6 GB | 1×7.4 GB | 1×5.3 GB |
| Phi-3 Medium 14B | 1×32.5 GB | 1×17.1 GB | 1×9.4 GB |
| DeepSeek R1 Distill Qwen 32B | 1×74.3 GB | 1×38.2 GB | 1×20.2 GB |
| DeepSeek R1 Distill Llama 70B | 1×158.0 GB | 1×80.3 GB | 1×41.5 GB |
| DeepSeek V3 671B | 16×1,477 GB | 8×738.7 GB | 4×369.6 GB |