GPU / L40S
NVIDIA L40S 48GB
Universal datacenter GPU for inference and fine-tuning
Spec sheet
NVIDIA
- Vendor
- NVIDIA
- Architecture
- Ada Lovelace
- Memory
- 48 GB GDDR6 ECC
- Bandwidth
- 864 GB/s
- Power
- 350 W
- Class
- Datacenter
- Form factor
- PCIe card
- Interconnect
- PCIe 4.0
- Released
- 2023
- Workloads
- Inference · Fine-tuning
Model fit / Inference
8K ctx · batch 1 · ≥10% headroom
| Model | FP16 | INT8 | INT4 |
|---|---|---|---|
| Llama 3.2 1B | 1×3.0 GB | 1×1.6 GB | 1×0.95 GB |
| Llama 3.2 3B | 1×8.0 GB | 1×4.5 GB | 1×2.7 GB |
| Llama 3.1 8B | 1×18.7 GB | 1×9.9 GB | 1×5.5 GB |
| Llama 3.1 70B | 4×158.0 GB | 2×80.3 GB | 1×41.5 GB |
| Llama 3.3 70B | 4×158.0 GB | 2×80.3 GB | 1×41.5 GB |
| Llama 3.1 405B | 24×897.2 GB | 16×450.7 GB | 8×227.5 GB |
| Qwen2.5 1.5B | 1×3.6 GB | 1×1.9 GB | 1×1.1 GB |
| Qwen2.5 3B | 1×7.1 GB | 1×3.7 GB | 1×2.0 GB |
| Qwen2.5 7B | 1×17.2 GB | 1×8.9 GB | 1×4.7 GB |
| Qwen2.5 14B | 1×34.0 GB | 1×17.8 GB | 1×9.7 GB |
| Qwen2.5 32B | 2×73.6 GB | 1×37.9 GB | 1×20.0 GB |
| Qwen2.5 72B | 4×162.6 GB | 2×82.7 GB | 1×42.7 GB |
| Mistral 7B | 1×17.0 GB | 1×9.0 GB | 1×5.1 GB |
| Mistral NeMo 12B | 1×28.2 GB | 1×14.8 GB | 1×8.1 GB |
| Mistral Small 24B | 2×53.3 GB | 1×27.3 GB | 1×14.3 GB |
| Mixtral 8x7B | 4×103.8 GB | 2×52.4 GB | 1×26.8 GB |
| Mixtral 8x22B | 8×312.1 GB | 4×157.0 GB | 2×79.4 GB |
| Gemma 2 9B | 1×23.1 GB | 1×13.0 GB | 1×7.9 GB |
| Gemma 2 27B | 2×62.9 GB | 1×33.0 GB | 1×18.0 GB |
| Phi-3 Mini 3.8B | 1×11.6 GB | 1×7.4 GB | 1×5.3 GB |
| Phi-3 Medium 14B | 1×32.5 GB | 1×17.1 GB | 1×9.4 GB |
| DeepSeek R1 Distill Qwen 32B | 2×74.3 GB | 1×38.2 GB | 1×20.2 GB |
| DeepSeek R1 Distill Llama 70B | 4×158.0 GB | 2×80.3 GB | 1×41.5 GB |
| DeepSeek V3 671B | 40×1,477 GB | 24×738.7 GB | 16×369.6 GB |