AMD · datacenter

Instinct MI210

Instinct MI210 has 64 GB of VRAM at 1638 GB/s — about 59.52 GiB usable after driver and compositor overhead. 2063 of 2118 indexed models fit at 4K context with q8_0 KV.

Spec sheet· bandwidth, theoreticalFrom the file· fit from summed bytesPredicted· speed
Memory
64 GB
HBM2e
Bandwidth
1638 GB/s
4096-bit bus
Tensor FP16
181 TF
dense
TDP
300 W
KV cachef16q8_0q4_0quantizing the KV cache is a ~2× lever on the dominant term at long context
text 1774vision language 185image 2audio asr 39audio tts 21video 16embedding 26

What fits at 4K context

largest quantization that fits, per model · 2063 of 2118 indexed
ModelBest quantParamsWeightsKVTotal in memoryHeadroomtok/s
llm-surgery-dark-arts-gpt-oss-60b-96a12MoEI1-Q6_K60.9B58.56 GiB0.06 GiB59.50 GiB0.02 GiB54±37%
gpt-oss-120b-uncensored-bf16MoEQ4_K_M117B58.53 GiB0.09 GiB59.50 GiB0.02 GiB98±37%
gpt-oss-120bMoEQ4_K_M120B58.46 GiB0.09 GiB59.44 GiB0.08 GiB98±37%
gpt-oss-safeguard-120bMoEQ4_K_M120B58.46 GiB0.09 GiB59.44 GiB0.08 GiB98±37%
MiMo-V2-FlashMoEKV unresolvedI1-IQ1_S310B58.20 GiB0.25 GiB59.40 GiB0.12 GiB96±37%
Qwen3.5-REAP-212B-A17BMoEIQ2_XS212B58.30 GiB0.06 GiB59.31 GiB0.21 GiB93±37%
command-a-plus-05-2026-bf16MoEIQ2_XXS219B57.98 GiB0.27 GiB59.15 GiB0.37 GiB75±37%
gemma-4-31B-itBF1631.3B57.20 GiB0.95 GiB59.13 GiB0.39 GiB18±26.5%
Gemma4-Gutenberg-31BBF1631.3B57.20 GiB0.95 GiB59.13 GiB0.39 GiB18±26.5%
Wanabi-Gemma4-31BBF1631.3B57.20 GiB0.95 GiB59.13 GiB0.39 GiB18±26.5%
Gemma4-Gutenberg-31B-HereticBF1631.3B57.20 GiB0.95 GiB59.13 GiB0.39 GiB18±26.5%
G4-MeroMero-31B-uncensored-hereticBF1631.3B57.20 GiB0.95 GiB59.13 GiB0.39 GiB18±26.5%
gemma-4-31B-it-Claude-Opus-Distill-v2BF1632.7B57.20 GiB0.95 GiB59.13 GiB0.39 GiB18±26.5%
gemma-4-31B-it-uncensored-hereticBF1631.3B57.20 GiB0.95 GiB59.13 GiB0.39 GiB18±26.5%
gemma4-31B-Fable-5-DistilledF1631.3B57.20 GiB0.95 GiB59.13 GiB0.39 GiB18±26.5%
Glistening-Gem-31B-v1.0BF1631.3B57.20 GiB0.95 GiB59.13 GiB0.39 GiB18±26.5%
Gemma-4-31B-Fable-5-Agent-DistillBF1632.7B57.20 GiB0.95 GiB59.13 GiB0.39 GiB18±26.5%
G4-MeroMero-31BBF1631.3B57.20 GiB0.95 GiB59.13 GiB0.39 GiB18±26.5%
G4-Alice-v1.2-31BBF1631.3B57.20 GiB0.95 GiB59.13 GiB0.39 GiB18±26.5%
gemma-4-Ortenzya-The-Creative-Wordsmith-31B-it-uncensored-hereticBF1631.3B57.20 GiB0.95 GiB59.13 GiB0.39 GiB18±26.5%
Equinox-31BBF1631.3B57.20 GiB0.95 GiB59.13 GiB0.39 GiB18±26.5%
Gemma-4-Gembrain-31B-it-uncensored-hereticBF1631.3B57.20 GiB0.95 GiB59.13 GiB0.39 GiB18±26.5%
Gemma-4-31B-Storymaxxed3F1631.3B57.20 GiB0.95 GiB59.13 GiB0.39 GiB18±26.5%
Gemma-4-Harmonia-31B-uncensored-hereticBF1631.3B57.20 GiB0.95 GiB59.13 GiB0.39 GiB18±26.5%
gemma-4-31B-MergemaxxedF1631.3B57.20 GiB0.95 GiB59.13 GiB0.39 GiB18±26.5%
gemma-4-31B-it-qat-q4_0-unquantized-hereticF1631.3B57.20 GiB0.95 GiB59.13 GiB0.39 GiB18±26.5%
gemma-4-31B-it-abliteratedF1631.3B57.20 GiB0.95 GiB59.13 GiB0.39 GiB18±26.5%
Gemma-4-Garnet-V2-31B-it-ultra-uncensored-hereticBF1631.3B57.20 GiB0.95 GiB59.13 GiB0.39 GiB18±26.5%
Gemma-4-Queen-31B-it-uncensored-hereticBF1631.3B57.20 GiB0.95 GiB59.13 GiB0.39 GiB18±26.5%
Gemma-4-31B-storymaxxed2F1631.3B57.20 GiB0.95 GiB59.13 GiB0.39 GiB18±26.5%
gemma-4-31B-it-SDFT-Heretic-RPBF1630.7B57.20 GiB0.95 GiB59.13 GiB0.39 GiB18±26.5%
gemma-4-31B-anthologyF1631.3B57.20 GiB0.95 GiB59.13 GiB0.39 GiB18±26.5%
gemma-4-31BBF1632.7B57.20 GiB0.95 GiB59.13 GiB0.39 GiB18±26.5%
Hypernova-60B-2605MoEQ8_058.7B58.13 GiB0.08 GiB59.10 GiB0.42 GiB84±37%
dots.llm1.instMoEQ2_K143B56.10 GiB2.06 GiB59.08 GiB0.44 GiB69±37%
Qwen3.5-88BMoEI1-Q5_K_M87.7B58.10 GiB0.05 GiB59.08 GiB0.44 GiB89±37%
Step-3.7-FlashIQ2_XS201B56.76 GiB1.34 GiB59.03 GiB0.49 GiB18±26.5%
Qwen3-235B-A22B-abliteratedMoEI1-IQ2_XXS235B57.55 GiB0.39 GiB58.88 GiB0.64 GiB75±37%
Qwen3.5-99BMoEI1-Q4_199.0B57.88 GiB0.05 GiB58.86 GiB0.66 GiB93±37%
GLM-4.6VMoEQ4_0108B57.48 GiB0.38 GiB58.79 GiB0.73 GiB75±37%
grok-2MoEIQ1_M270B57.16 GiB0.53 GiB58.74 GiB0.78 GiB33±37%
Mixtral-8x22B-Instruct-v0.1MoEQ3_K_S141B57.28 GiB0.46 GiB58.71 GiB0.81 GiB33±37%
Mixtral-8x22B-v0.1MoEQ3_K_S141B57.28 GiB0.46 GiB58.70 GiB0.82 GiB33±37%
Mixtral-8x22B-v0.1MoEQ3_K_S141B57.27 GiB0.46 GiB58.70 GiB0.82 GiB33±37%
Qwen3.5-122B-A10BMoEUD-IQ4_XS125B57.67 GiB0.05 GiB58.65 GiB0.87 GiB99±37%
Llama-4-Scout-17B-16E-InstructMoEKV unresolvedQ4_K_S109B57.23 GiB0.40 GiB58.56 GiB0.96 GiB75±37%
NVIDIA-Nemotron-3-Super-120B-A12B-BF16MoEUD-Q3_K_M124B57.47 GiB0.18 GiB58.55 GiB0.97 GiB89±37%
DeepSeek-Coder-V2-Instruct-0724MoEIQ2_XXS236B57.28 GiB0.14 GiB58.36 GiB1.16 GiB94±37%
DeepSeek-V2.5MoEIQ2_XXS236B57.28 GiB0.14 GiB58.36 GiB1.16 GiB94±37%
DeepSeek-Coder-V2-InstructMoEIQ2_XXS236B57.28 GiB0.14 GiB58.36 GiB1.16 GiB94±37%
Devstral-2-123B-Instruct-2512Q3_K_M125B56.46 GiB0.73 GiB58.24 GiB1.28 GiB18±26.5%
Mistral-Medium-3.5-128BI1-Q3_K_M128B56.46 GiB0.73 GiB58.24 GiB1.28 GiB18±26.5%
XORTRON-NXTXPRTXXLI1-Q3_K_M128B56.46 GiB0.73 GiB58.24 GiB1.28 GiB18±26.5%
MiniMax-M2.1-REAP-139B-A10BMoEI1-IQ3_M139B56.81 GiB0.51 GiB58.21 GiB1.31 GiB80±37%
m51Lab-MiniMax-M2.7-REAP-139B-A10BMoEI1-IQ3_M139B56.81 GiB0.51 GiB58.21 GiB1.31 GiB80±37%
GLM-4.7-REAP-218B-A32BMoEUD-IQ1_S218B56.46 GiB0.76 GiB58.16 GiB1.36 GiB64±37%
Assistant_Pepe_70BQ6_K_L70.6B56.43 GiB0.66 GiB58.12 GiB1.40 GiB18±26.5%
MiniMax-M2.7MoEIQ2_XXS229B56.67 GiB0.51 GiB58.07 GiB1.45 GiB94±37%
Qwen3-Coder-30B-A3B-InstructMoEBF1630.5B56.90 GiB0.20 GiB57.99 GiB1.53 GiB77±37%
Salience-1.5-FlashMoEBF1631.1B56.90 GiB0.20 GiB57.99 GiB1.53 GiB77±37%
From the filePredictedwhat these mean

Speed is modeled, not measured: decode is memory-bandwidth bound, so tokens per second is bytes read per token against achievable bandwidth. Mixture-of-experts models carry a wider band because only the routed experts are read each step, and few have been measured publicly.

Questions people ask

What AI models can a Instinct MI210 run?
2063 of 2118 indexed open-weight models fit a Instinct MI210 at 4,096 context with q8_0 KV cache, the largest being llm-surgery-dark-arts-gpt-oss-60b-96a12 at I1-Q6_K. That covers text, vision-language, image, video and speech models.
How much usable memory does a Instinct MI210 actually have?
Its nameplate is 64 GB, but about 59.52 GiB is available to a model once driver and compositor overhead is accounted for.
Is a Instinct MI210 fast for local AI?
Its memory bandwidth is 1638 GB/s, and that figure — not teraflops — is what governs token generation speed. Capacity decides what you can run; bandwidth decides how fast it runs.