FitCheck adalah alat baru yang memperkirakan kebutuhan VRAM puncak untuk LoRA, QLoRA, dan penyetelan penuh model bahasa besar tanpa memerlukan PyTorch, CUDA, atau perangkat keras GPU aktual.
- Alat ini menganalisis config.json model di Hugging Face dan metadata jumlah parameter untuk melaporkan rincian memori, kapasitas yang dapat digunakan, ruang cadangan, dan verdict kecocokan.
- Alat ini mendukung estimasi layanan berdasarkan bobot model dan cache KV, bersama dengan penasihat untuk mengeksplorasi ukuran batch, panjang urutan, dan rank LoRA.
- Pengujian pada Tesla T4 menunjukkan kesalahan mutlak rata-rata 2,4% di seluruh 57 jalankan kalibrasi dan menghasilkan 12/12 verdict batas kecocokan yang benar dalam tes holdout terpisah.
Alat ini membantu pengguna menentukan apakah konfigurasi LLM mereka akan muat dalam memori GPU sebelum memulai pekerjaan, dengan tujuan mengurangi tebakan dan kesalahan out-of-memory.