Bonsai 2: ecco come un modello da 27mld di parametri occupa meno di 6 GB, e può girare nel browser
Prism ML ha compresso Qwen3.8-27B, modello da 27 miliardi di parametri, in un file ternario di appena 5,95 GB: gira anche nel browser via WebGPU e conserva il 98,2% delle prestazioni della versione FP16 originale da 53,8 GB