指尖魔法屋
  • 文章
  • 分类
  • 标签
  • 时间轴
  • 关于
  • 联系
  • 🔍

系统架构

AI服务 性能优化 模型部署 系统架构
AI模型服务性能踩坑记录
线上 Llama2-7B 对话服务跑在 AWS g4dn.xlarge(单卡 T4)上,用户抱怨回答慢:首 token 延迟 2–3 秒,完整回…
醉月思 醉月思
📁 技术实践
📅 2023-06-17
负载均衡 一致性哈希 Nginx 系统架构
负载均衡算法实践笔记
这次做高可用架构,调研了各种负载均衡算法,从简单的轮询到复杂的一致性哈希,各有各的适用场景。
醉月思 醉月思
📁 技术实践
📅 2021-10-02
Copyright © 2017-2026 指尖魔法屋. All rights reserved POWERED BY thinkBlog · v6.1.0 关于 · 联系 · 隐私政策 · Cookie 政策 本站已顽强运行:加载中...
粤ICP备17055617号