▸ SPEC SHEET
Qwen3-VL 4B Instruct — 4.44B Dense.
▸ SPECIFICATIONS
- PARAMETERS
- 4.44B
- ARCHITECTURE
- Dense Transformer
- CONTEXT LENGTH
- 256K tokens
- CAPABILITIES
- chat, vision, multilingual
- RELEASE DATE
- 2025-10-15
- PROVIDER
- Alibaba
- FAMILY
- qwen
▸ VRAM REQUIREMENTS
| QUANT | BPW | VRAM | QUALITY |
|---|---|---|---|
| Q4_K_M | 4.89 | 3.2 GB | 94% |
| Q5_K_S | 5.57 | 3.6 GB | 96% |
| Q5_K_M | 5.7 | 3.7 GB | 96% |
| Q6_K | 6.56 | 4.1 GB | 97% |
| Q8_0 | 8.5 | 5.2 GB | 100% |
| FP16 | 16 | 9.4 GB | 100% |
§ 01BENCHMARK SCORES
MMLU-PRO36.5
MATH49.6
IFEval75.6
BBH34.9
GPQA6.4
MUSR8.7
GPQA Diamond37.1
LiveCodeBench29.0
AIME37.0
HLE3.7
AA Intelligence9.6
AA Coding4.6
AA Math37.0
aa_ifbench31.8
aa_tau223.4
aa_scicode13.7
aa_lcr13.0
§ 02RUN COMMAND
Run Qwen3-VL 4B Instruct locally with Ollama — needs 3.2 GB VRAM at Q4_K_M:
$
ollama run qwen3-vl:4b§ 03COMPATIBLE GPUs
30 @ Q4_K_MNVIDIA Tesla C1080
4 GB · 102 GB/s
NVIDIA Tesla K10
4 GB · 160 GB/s
NVIDIA Tesla M4
4 GB · 88 GB/s
NVIDIA GeForce GTX 1050 Ti
4 GB · 112 GB/s
AMD Radeon Instinct MI8
4 GB · 512 GB/s
NVIDIA GeForce GTX 1650
4 GB · 128 GB/s
NVIDIA GeForce GTX 1650 SUPER
4 GB · 192 GB/s
AMD Radeon RX 5300 XT OEM
4 GB · 112 GB/s
AMD Radeon RX 5500 OEM
4 GB · 224 GB/s
AMD Radeon RX 5500 XT
4 GB · 224 GB/s
AMD Radeon RX 5500M
4 GB · 224 GB/s
NVIDIA GeForce GTX 1650 GDDR6
4 GB · 192 GB/s
NVIDIA GeForce GTX 1650 TU106
4 GB · 192 GB/s
NVIDIA GeForce GTX 1650 TU116
4 GB · 192 GB/s
NVIDIA GeForce GTX 1630
4 GB · 96 GB/s