Skip to content

ماشین‌حساب VRAM

VRAM مورد نیاز یک LLM را تخمین بزنید — وزن‌ها بر پایهٔ کوانتیزه‌سازی به‌همراه کش KV برای context و batch شما — و ببینید کدام GPUهای مصرفی و دیتاسنتر آن را پوشش می‌دهند.

AI & Agents
cosmodev ~/tools/vram-calculator-
پارامترها:
14 GB
وزن‌ها · fp16 · 2 بایت/وزن
1.07 GB
کش KV · batch 1
15.07 GB
VRAM کل · وزن‌ها + کش KV
کلاس کارتVRAMآزاد پس از بارگذاریوضعیت
RTX 3060 Ti / RTX 4060 / RX 76008 GB—خیلی کوچک است
RTX 3060 12 GB / RTX 407012 GB—خیلی کوچک است
RTX 4060 Ti 16 GB / RTX 508016 GB0.93 GBجا می‌شود
RTX 3090 / RTX 409024 GB8.93 GBجا می‌شود
RTX A6000 / L40S48 GB32.93 GBجا می‌شود
A100 80 GB / H100 / H20080 GB64.93 GBجا می‌شود

وزن‌ها = params × bytes/weight · KV = 2 × layers × context × kvHeads × headDim × 2 B × batch · GB دهدهی (10⁹ بایت)؛ فعال‌سازی‌ها و سربار زمان اجرا شامل نمی‌شود