Skip to content

ตัวคำนวณ VRAM

ประมาณปริมาณ VRAM ที่ LLM ต้องใช้ — น้ำหนักโมเดลตามระดับ quantization บวก KV cache จากขนาด context และ batch ของคุณ — พร้อมบอกว่า GPU สำหรับผู้ใช้ทั่วไปและระดับดาต้าเซ็นเตอร์รุ่นไหนรองรับได้

AI & Agents
cosmodev ~/tools/vram-calculator-
พารามิเตอร์:
14 GB
น้ำหนัก · fp16 · 2 B/น้ำหนัก
1.07 GB
แคช KV · แบตช์ 1
15.07 GB
VRAM รวม · น้ำหนัก + แคช KV
ระดับการ์ดVRAMเหลือหลังโหลดสถานะ
RTX 3060 Ti / RTX 4060 / RX 76008 GB—เล็กเกินไป
RTX 3060 12 GB / RTX 407012 GB—เล็กเกินไป
RTX 4060 Ti 16 GB / RTX 508016 GB0.93 GBพอ
RTX 3090 / RTX 409024 GB8.93 GBพอ
RTX A6000 / L40S48 GB32.93 GBพอ
A100 80 GB / H100 / H20080 GB64.93 GBพอ

น้ำหนัก = params × ไบต์/น้ำหนัก · KV = 2 × layers × context × kvHeads × headDim × 2 B × batch · GB แบบทศนิยม (10⁹ ไบต์) ไม่รวม activation และโอเวอร์เฮดรันไทม์