Skip to content

מחשבון VRAM

אומדן כמות ה-VRAM שדרושה ל-LLM — המשקלים לפי רמת quantization, ובנוסף KV cache לפי ההקשר וה-batch — ובדיקה אילו GPU צרכניים ושל מרכזי נתונים מסוגלים להכיל אותה.

AI & Agents
cosmodev ~/tools/vram-calculator-
פרמטרים:
14 GB
משקולות · fp16 · 2 B/משקולת
1.07 GB
מטמון KV · batch 1
15.07 GB
VRAM כולל · משקולות + מטמון KV
מחלקת כרטיסVRAMפנוי אחרי טעינהסטטוס
RTX 3060 Ti / RTX 4060 / RX 76008 GB—קטן מדי
RTX 3060 12 GB / RTX 407012 GB—קטן מדי
RTX 4060 Ti 16 GB / RTX 508016 GB0.93 GBנכנס
RTX 3090 / RTX 409024 GB8.93 GBנכנס
RTX A6000 / L40S48 GB32.93 GBנכנס
A100 80 GB / H100 / H20080 GB64.93 GBנכנס

משקולות = params × bytes/weight · KV = 2 × layers × context × kvHeads × headDim × 2 B × batch · GB עשרוני (10⁹ בייטים); לא כולל activations ותקורת זמן ריצה