Anassbzdd telah merilis FitCheck, sebuah alat yang memperkirakan kebutuhan VRAM puncak untuk LoRA, QLoRA, dan fine-tuning penuh model bahasa besar tanpa memerlukan GPU atau PyTorch. Estimator ini menganalisis config.json Hugging Face dan metadata jumlah parameter untuk melaporkan rincian memori, kapasitas yang dapat digunakan, ruang cadangan, dan mikro-batch terbesar yang diperkirakan muat.
- Mendukung estimasi penyajian berdasarkan bobot model dan KV cache.
- Termasuk penasihat untuk mengeksplorasi ukuran batch, panjang urutan, dan rank LoRA.
- Mencapai kesalahan absolut rata-rata 2,4% di seluruh 57 jalanan kalibrasi terhadap pengukuran Tesla T4 nyata.
- Menghasilkan 12/12 putusan batas kecocokan yang benar dalam uji holdout terpisah 12 jalanan.
Alat ini membantu pengguna menentukan apakah konfigurasi mereka muat dalam memori GPU sebelum memulai pekerjaan LLM, bertujuan mengurangi tebakan dan kesalahan out-of-memory.