清华 SIGS 刚开源的 VeriLoop Coder-E1(仓库级代码修复方向)有个数字很有意思:上线首日原始权重仓库下载 413 次,而第三方做的 GGUF 量化仓库是 955 次,反超了一倍多。看起来大家的第一反应并不是“能不能跑满精度”,而是“能不能在我自己这台机器上跑起来”。我自己的体感也差不多,代码类模型只要能进 Ollama 或 LM Studio,愿意接受一定的精度损失。想问下大家在选自部署模型时,量化到什么位宽是心理底线?像仓库级代码修复这种需要多轮工具调用的任务,低精度量化对稳定性的影响明显吗?
相似问题