Artikel ini menghitung model bahasa besar terbuka mana yang muat di Mac seri Apple M5 baru (Mac mini, Mac Studio) dengan menganalisis batasan memori alih-alih menjalankan benchmark. Kapasitas ditentukan berdasarkan ukuran file GGUF Q4_K_M, kebutuhan cache KV, dan overhead runtime terhadap GPU memory yang dapat digunakan.
- Mac mini M6 16 GB mendukung 14 model pada konteks 8K dan 10 pada 32K, dengan Gemma 4 12B sebagai pilihan utama.
- Mac mini M5 Pro 24 GB muat 16 model pada 8K dan 14 pada 32K, mengutamakan gpt-oss 20B.
- Mac Studio M5 Max 36 GB menampung 25 model pada 8K dan 22 pada 32K, dengan Qwen3-Coder 30B-A3B sebagai opsi yang disukai.
- Mac Studio M5 Ultra 96 GB menyimpan 31 model terlepas dari panjang konteks, dengan Qwen3-Coder Next sebagai kecocokan terbesar yang nyaman.
Analisis menyoroti bahwa Mac mini 16 GB adalah mesin kelas 12B yang dibatasi oleh jendela konteks alih-alih ukuran model, sementara cache besar pada Ultra membuat panjang konteks tidak relevan untuk kecocokan. Penulis mencatat bahwa angka-angka ini tidak menunjukkan kecepatan generasi, meskipun perbedaan bandwidth antar model signifikan.