指尖魔法屋
  • 文章
  • 分类
  • 标签
  • 时间轴
  • 关于
  • 联系
  • 🔍

模型部署

NLP 文本处理 模型部署 性能优化 流水线
NLP流水线实践笔记
"NLP 项目最难的" —— 一个被脏文本折腾到凌晨的人
醉月思 醉月思
📁 技术实践
📅 2024-07-26
边缘计算 模型部署 深度学习 性能优化
把云端换到边缘时踩过的坑
直接转 RKNN 会失败,中间需要经过 ONNX 中转。
醉月思 醉月思
📁 技术实践
📅 2024-05-13
模型部署 TorchServe vLLM GPU优化
AI模型部署:推理不够用了之后
先说个最实在的:项目背景是个多模态问答系统,推理环境是 4 张 A100 80GB,PyTorch 2.1.1,CUDA 12.1。
醉月思 醉月思
📁 技术实践
📅 2024-03-11
AI服务 性能优化 模型部署 系统架构
AI模型服务性能踩坑记录
线上 Llama2-7B 对话服务跑在 AWS g4dn.xlarge(单卡 T4)上,用户抱怨回答慢:首 token 延迟 2–3 秒,完整回…
醉月思 醉月思
📁 技术实践
📅 2023-06-17
Copyright © 2017-2026 指尖魔法屋. All rights reserved POWERED BY thinkBlog · v6.1.0 关于 · 联系 · 隐私政策 · Cookie 政策 本站已顽强运行:加载中...
粤ICP备17055617号