模型压缩 量化 剪枝 蒸馏 部署优化AI模型压缩进阶踩坑记录要把一个 7B 语言模型塞进 8GB 内存的边缘设备——这不是"优化一下体验",是硬件硬顶在那儿。 醉月思📁 技术实践📅 2023-06-11