▸ DEVICE UNDER TEST
NVIDIA Quadro P2000 — 5 GB VRAM.
▸ QUADRO P2000 SPEC
- BRAND
- NVIDIA
- VRAM
- 5 GB GDDR5
- BANDWIDTH
- 140.2 GB/s
- FP16 COMPUTE
- 6 TFLOPS
- FP32 COMPUTE
- 3 TFLOPS
- CUDA CORES
- 1,024
- TDP
- 75 W
- ARCHITECTURE
- Pascal
▸ AI CAPABILITY
113/ 449 models @ Q4
With 5 GB VRAM and 140.2 GB/s bandwidth, this GPU handles models up to 6.24B parameters.
Speed ≈ bandwidth / model_size × efficiency. A 7B model at Q4 runs at ~16 tok/s.
§ 01TOP MODELS FOR QUADRO P2000
113 FIT · SHOWING 20| MODEL | SIZE | VRAM Q4 | TOK/S | AVG |
|---|---|---|---|---|
| ChatGLM2 6B | 6.24B | 4.3 GB | 18 | 20.7 |
| ChatGLM3 6B | 6.24B | 4.3 GB | 18 | 42.7 |
| Yi-1.5 6B | 6.06B | 4.2 GB | 19 | 28.6 |
| Yi 6B | 6B | 4.2 GB | 19 | 23.2 |
| Phi-4-multimodal 14B | 5.57B | 3.9 GB | 20 | 42.0 |
| Gemma 3n E2B | 5.44B | 3.8 GB | 21 | 21.7 |
| Gemma 4 E2B | 5.1B | 3.6 GB | 22 | 25.7 |
| TranslateGemma 4B | 4.97B | 3.5 GB | 23 | 5.5 |
| Qwen 3.5 4B | 4.66B | 3.3 GB | 24 | 47.4 |
| InternLM2 5B | 4.5B | 3.2 GB | 25 | 47.6 |
| Qwen3-VL 4B Instruct | 4.44B | 3.2 GB | 25 | 26.6 |
| MedGemma 1.5 4B | 4.3B | 3.1 GB | 26 | 5.5 |
| Gemma 3 4B | 4.3B | 3.1 GB | 26 | 22.8 |
| Ministral 3 3B Reasoning | 4.25B | 3.1 GB | 26 | — |
| Qwen 1.5 4B | 4B | 2.9 GB | 28 | 12.6 |
| Qwen3 4B | 4B | 2.9 GB | 28 | 40.7 |
| Qwen3-4B Instruct 2507 | 4B | 2.9 GB | 28 | 37.2 |
| Qwen3-Embedding 4B | 4B | 2.9 GB | 28 | — |
| Granite Vision 4.1 4B | 4B | 2.9 GB | 28 | — |
| Nemotron 3 Nano 4B | 3.97B | 2.9 GB | 28 | 32.0 |