Skip to content

VRAM-calculator

Schat het VRAM in dat een LLM nodig heeft — gewichten per kwantisatie plus de KV-cache voor je context en batch — en zie welke consumenten- en datacenter-GPU's het aankunnen.

AI & Agents
cosmodev ~/tools/vram-calculator-
Params:
14 GB
Gewichten · fp16 · 2 B/gewicht
1.07 GB
KV-cache · batch 1
15.07 GB
Totaal VRAM · gewichten + KV-cache
KaartklasseVRAMVrij na ladenStatus
RTX 3060 Ti / RTX 4060 / RX 76008 GB—Te klein
RTX 3060 12 GB / RTX 407012 GB—Te klein
RTX 4060 Ti 16 GB / RTX 508016 GB0.93 GBPast
RTX 3090 / RTX 409024 GB8.93 GBPast
RTX A6000 / L40S48 GB32.93 GBPast
A100 80 GB / H100 / H20080 GB64.93 GBPast

gewichten = params × bytes/gewicht · KV = 2 × lagen × context × kvHeads × headDim × 2 B × batch · decimale GB (10⁹ bytes); activaties en runtime-overhead niet meegerekend