第2章 INT4 量化原理与方法 导读:这一章是整本教程的理论内核,也是「从照抄命令到真正懂行」的分水岭。我们会先把 INT4 量化的数学讲透——scale 与 zero-point 是怎么把浮点数「塞进」4 个比特的;再解释为什么需要校准集(calibration set);最后对比三条主流路径:GPTQ、AWQ 与基于 GGUF/llama.cpp 的后训练量化。读完你应能根据「手头硬件、模型规模、可接受工期」选出适合自己的那一条路。 我建议你把这一章当「慢读章」:公式别跳,手算例子别抄答案。这一章多花的一小时,会在第 4 章实战里替你省下整整一天的瞎调。