Skip to content

VRAM-Rechner

Schätzen Sie den VRAM-Bedarf eines LLM – Gewichtungen nach Quantisierung plus KV-Cache für Ihren Kontext und Batch – und sehen Sie, welche Consumer- und Datacenter-GPUs ihn fassen.

AI & Agents
cosmodev ~/tools/vram-calculator-
Parameter:
14 GB
Gewichte · fp16 · 2 B/Gewicht
1.07 GB
KV-Cache · Batch 1
15.07 GB
VRAM gesamt · Gewichte + KV-Cache
KartenklasseVRAMFrei nach LadenStatus
RTX 3060 Ti / RTX 4060 / RX 76008 GB—Zu klein
RTX 3060 12 GB / RTX 407012 GB—Zu klein
RTX 4060 Ti 16 GB / RTX 508016 GB0.93 GBPasst
RTX 3090 / RTX 409024 GB8.93 GBPasst
RTX A6000 / L40S48 GB32.93 GBPasst
A100 80 GB / H100 / H20080 GB64.93 GBPasst

Gewichte = Params × Bytes/Gewicht · KV = 2 × Layer × Kontextlänge × KV-Heads × Head-Dimension × 2 B × Batch · dezimale GB (10⁹ Bytes); Aktivierungen und Laufzeit-Overhead nicht enthalten