{"verdict":"no","receipt":"https://fitllm.run/r/glm-4-7-flash-q4_k_m-on-rtx-3060-12gb","model":"GLM-4.7-Flash","hardware":"RTX 3060 12GB","quant":"Q4_K_M","kvBits":16,"ctx":8192,"memory":{"usedGB":21.87,"totalGB":12,"freeGB":-9.87,"breakdown":{"weightsGB":17.09,"kvCacheGB":0.41,"overheadGB":2.36,"reserveGB":2}},"maxContext":0,"fix":"RTX 4090 (24GB) would fit.","note":"usedGB = total required to run: weights + KV cache + runtime overhead + OS/GPU reserve. Runtime resident-weights measurements (e.g. oMLX actual_size) read lower — a different metric, not a prediction error.","source":"https://fitllm.run","engine":"fitllm-engine (MIT)","data":"https://fitllm.run/data (CC0)"}