Skip to content

Kalkulator ng VRAM

Tantyahin ang VRAM na kailangan ng isang LLM — weights ayon sa quantization kasama ang KV cache para sa iyong context at batch — at tingnan kung aling consumer at datacenter GPUs ang kaya ito.

AI & Agents
cosmodev ~/tools/vram-calculator-
Params:
14 GB
Weights · fp16 · 2 B/weight
1.07 GB
KV cache · batch 1
15.07 GB
Kabuuang VRAM · weights + KV cache
Card classVRAMLibre pagkatapos i-loadStatus
RTX 3060 Ti / RTX 4060 / RX 76008 GB—Maliit ang VRAM
RTX 3060 12 GB / RTX 407012 GB—Maliit ang VRAM
RTX 4060 Ti 16 GB / RTX 508016 GB0.93 GBKakayanin
RTX 3090 / RTX 409024 GB8.93 GBKakayanin
RTX A6000 / L40S48 GB32.93 GBKakayanin
A100 80 GB / H100 / H20080 GB64.93 GBKakayanin

weights = params × bytes/weight · KV = 2 × layers × context × kvHeads × headDim × 2 B × batch · decimal GB (10⁹ bytes); hindi kasama ang activations at runtime overhead