IBM/Dense

Granite 4.1 8B

Name: Granite 4.1 8B
Author: IBM

chatcodingreasoningtool_usemultilingual

Parameters

512K

Context length

Benchmarks

Quantizations

Architecture

Dense

Released

2026-04-29

Layers

KV Heads

Head Dim

128

Family

granite

Quantization Options

Quant	Bits	VRAM	Quality
Q4_K_M	4.89	5.4 GB	good
Q5_K_S	5.57	6.1 GB	good
Q5_K_M	5.7	6.2 GB	good
Q6_K	6.56	7.0 GB	excellent
Q8_0	8.5	9.0 GB	lossless
FP16	16	16.5 GB	lossless

Select your GPU above to see speed estimates and compatibility for each quantization.

▸ READY TO RUN THIS?RENT BY THE HOUR

RENT A GPU AND RUN GRANITE 4.1 8B NOW

Rent on RunPod →Or Vast.ai →

Spin up an A100 / H100 / 4090 in ~60s. Pay by the second. Cancel anytime.

Community Ratings

Loading ratings...

Benchmarks (14)

IFEval72.7

GPQA Diamond43.3

IFBench38.6

BBH34.7

MMLU-PRO27.9

τ²-Bench27.8

MATH23.8

SciCode21.8

MUSR16.8

AA Intelligence12.4

AA Long Context12.0

GPQA8.7

AA Coding7.3

HLE3.8

Run this model

▸Easiest way to get started·Beginners

DOCS ↗

curl -fsSL https://ollama.com/install.sh | sh

$ollama run granite:8b-q4_K_M

Tag may need adjustment — check ollama.com/library/granite for available tags.

▸ SETUP GUIDE

Auto-setup with fitmyllm CLI

Detects your GPU, recommends the best model, downloads it, and starts chatting — zero config. Benchmarks your speed and contributes anonymous data to improve predictions.

pip install fitmyllmthen run fitmyllmLearn more

Auto-detect GPULive tok/s in chatSpeed benchmarks9 inference engines

HuggingFace GGUF Downloads Build Hardware

GPUs that can run this model

At Q4_K_M quantization. Sorted by minimum VRAM.

NVIDIA RTX 3050 6GB

6 GB VRAM • 168 GB/s

NVIDIA

$169

Amazon Newegg eBay PCPartPicker

Intel Arc A380

6 GB VRAM • 186 GB/s

INTEL

$129

Amazon Newegg eBay PCPartPicker

NVIDIA RTX 2060 6GB

6 GB VRAM • 336 GB/s

NVIDIA

$150

Amazon Newegg eBay PCPartPicker

NVIDIA GTX 1660 SUPER

6 GB VRAM • 336 GB/s

NVIDIA

$150

Amazon Newegg eBay PCPartPicker

NVIDIA GTX 1660 Ti

6 GB VRAM • 288 GB/s

NVIDIA

$140

Amazon Newegg eBay PCPartPicker

NVIDIA GTX 1060 6GB

6 GB VRAM • 192 GB/s

NVIDIA

$80

Amazon Newegg eBay PCPartPicker

NVIDIA Tesla C2070

6 GB VRAM • 143 GB/s

NVIDIA

NVIDIA Tesla C2075

6 GB VRAM • 150 GB/s

NVIDIA

NVIDIA Tesla C2090

6 GB VRAM • 177 GB/s

NVIDIA

NVIDIA Tesla M2070

6 GB VRAM • 150 GB/s

NVIDIA

NVIDIA Tesla M2070-Q

6 GB VRAM • 150 GB/s

NVIDIA

NVIDIA Tesla M2075

6 GB VRAM • 150 GB/s

NVIDIA

NVIDIA Tesla M2090

6 GB VRAM • 177 GB/s

NVIDIA

NVIDIA Tesla X2070

6 GB VRAM • 177 GB/s

NVIDIA

NVIDIA Tesla X2090

6 GB VRAM • 177 GB/s

NVIDIA

NVIDIA Tesla K20X

6 GB VRAM • 250 GB/s

NVIDIA

NVIDIA Tesla K20Xm

6 GB VRAM • 250 GB/s

NVIDIA

NVIDIA GeForce GTX 1060 6 GB

6 GB VRAM • 192 GB/s

NVIDIA

Amazon Newegg eBay PCPartPicker

NVIDIA GeForce GTX 1060 6 GB 9Gbps

6 GB VRAM • 217 GB/s

NVIDIA

Amazon Newegg eBay PCPartPicker

NVIDIA GeForce GTX 1060 6 GB GDDR5X

6 GB VRAM • 192 GB/s

NVIDIA

Amazon Newegg eBay PCPartPicker

NVIDIA GeForce GTX 1060 6 GB GP104

6 GB VRAM • 192 GB/s

NVIDIA

Amazon Newegg eBay PCPartPicker

NVIDIA GeForce GTX 1060 6 GB Rev. 2

6 GB VRAM • 192 GB/s

NVIDIA

Amazon Newegg eBay PCPartPicker

NVIDIA GeForce GTX 1660

6 GB VRAM • 192 GB/s

NVIDIA

Amazon Newegg eBay PCPartPicker

NVIDIA GeForce GTX 1660 SUPER

6 GB VRAM • 336 GB/s

NVIDIA

Amazon Newegg eBay PCPartPicker

NVIDIA GeForce GTX 1660 Ti

6 GB VRAM • 288 GB/s

NVIDIA

Amazon Newegg eBay PCPartPicker

NVIDIA GeForce RTX 2060

6 GB VRAM • 336 GB/s

NVIDIA

$140

Amazon Newegg eBay PCPartPicker

NVIDIA GeForce RTX 2060 TU104

6 GB VRAM • 336 GB/s

NVIDIA

$140

Amazon Newegg eBay PCPartPicker

AMD Radeon RX 5600 OEM

6 GB VRAM • 288 GB/s

AMD

Amazon Newegg eBay PCPartPicker

AMD Radeon RX 5600 XT

6 GB VRAM • 288 GB/s

AMD

$90

Amazon Newegg eBay PCPartPicker

AMD Radeon RX 5600M

6 GB VRAM • 288 GB/s

AMD

Amazon Newegg eBay PCPartPicker

Find the best GPU for Granite 4.1 8B

Build Hardware for Granite 4.1 8B

Granite 4.1 8B

Quantization Options

Community Ratings

Benchmarks (14)

Run this model

Auto-setup with fitmyllm CLI

GPUs that can run this model

Granite 4.1 8B — 8B Dense.