指尖魔法屋
  • 文章
  • 分类
  • 标签
  • 时间轴
  • 关于
  • 联系
  • 🔍

模型压缩

模型蒸馏 知识蒸馏 模型压缩
AI模型蒸馏折腾手记
这次的具体需求有三个硬指标: 1. 模型大小要控制在 500MB 以内(目标设备是 4GB …
醉月思 醉月思
📁 技术实践
📅 2024-08-13
模型压缩 量化 剪枝 蒸馏 部署优化
AI模型压缩进阶踩坑记录
要把一个 7B 语言模型塞进 8GB 内存的边缘设备——这不是"优化一下体验",是硬件硬顶在那儿。
醉月思 醉月思
📁 技术实践
📅 2023-06-11
模型剪枝 模型压缩 神经网络
AI 剪枝踩坑记录
项目本身不复杂:一个文本分类任务,在服务器上训练好的 BERT 模型,分类准确率能达到 92% 以上,但部署时问题来了。
醉月思 醉月思
📁 技术实践
📅 2022-08-26
模型压缩 量化 剪枝 知识蒸馏 深度学习
把量化换到剪枝时踩过的坑
项目里那个 7B 参数的模型训练好了,部署到推理服务器上时,CPU 占用直接拉满,延迟干到了 3 秒多。
醉月思 醉月思
📁 技术实践
📅 2022-01-10
Copyright © 2017-2026 指尖魔法屋. All rights reserved POWERED BY thinkBlog · v6.1.0 关于 · 联系 · 隐私政策 · Cookie 政策 本站已顽强运行:加载中...
粤ICP备17055617号