指尖魔法屋
  • 文章
  • 分类
  • 标签
  • 时间轴
  • 关于
  • 联系
  • 🔍

文章列表

按发布时间倒序浏览指尖魔法屋的全部文章,涵盖前端开发、Python、人工智能、边缘设备、系统配置和博客折腾记录。

GLM 智谱AI ChatGLM 大模型实践
AI GLM踩坑记录
团队本来在用一些国外模型,但有两个问题绕不开: 1. **中文表达总有点"翻译腔"**,特别是写产品文案、用户沟通这种场景,模型说出来的话不够…
醉月思 醉月思
📁 技术实践
📅 2024-11-20
GPT Decoder 文本生成
AI GPT架构折腾手记
最近在做一个对话系统,用了开源的 GPT 模型,但发现几个问题: 1. 生成质量时好时坏,不…
醉月思 醉月思
📁 技术实践
📅 2024-11-18
Xverse 混元 腾讯
从腾讯走到开源:AI Xverse笔记
之前试过几个方案:
醉月思 醉月思
📁 技术实践
📅 2024-11-16
DeepSeekCoder 代码模型 推理优化
AI DeepSeek Coder:这次怎么落地的
先复现,再谈优化。 先说说我这个项目的具体需求: 1. **本地运行**:不能依赖外部 AP…
醉月思 醉月思
📁 技术实践
📅 2024-11-09
llm-training distributed-training data-parallel tensor-parallel pipeline-parallel
从数据并行走到模型并进:大模型训练加速技术笔记
大语言模型(LLM)的训练需要庞大的计算资源和时间成本。
醉月思 醉月思
📁 技术实践
📅 2024-11-06
Yi 01模型 零一万物
AI Yi踩坑记录
但最近几个项目里,我确实需要找一批能稳定用的中文模型来实际跑业务——GPT-4 固然好,但价格和延迟摆在那里;国产模型选择不少,但稳定性和文档友…
醉月思 醉月思
📁 技术实践
📅 2024-11-05
Qwen 通义千问 阿里
关于AI_Qwen的几点记录
最近在折腾 AI 模型的实际落地,说实话,国内能用的模型不算多,选来选去还是看上了通义千问(Qwen)。
醉月思 醉月思
📁 技术实践
📅 2024-11-03
Transformer Attention BERT
AI_Transformer实践笔记
在我的实际项目中,具体遇到了这些问题: 1. **长文档分类**:需要对500-1000字的技术文档进行分类,RNN经常记不住文档的主题 2.…
醉月思 醉月思
📁 技术实践
📅 2024-10-27
注意力机制 Attention Transformer
从全局走到重点:AI注意力机制笔记
测试时我们发现:当关键信息出现在 token 序列的前 20% 时,准确率会比出现在后 20% 低 15 个百分点。
醉月思 醉月思
📁 技术实践
📅 2024-10-23
AI监控 模型监控 可观测性
AI监控折腾手记
这些是最基础的,没有它们就没法理解系统行为:
醉月思 醉月思
📁 技术实践
📅 2024-10-22
上一页 1 ... 4 5 6 ... 52 下一页
Copyright © 2017-2026 指尖魔法屋. All rights reserved POWERED BY thinkBlog · v6.1.0 关于 · 联系 · 隐私政策 · Cookie 政策 本站已顽强运行:加载中...
粤ICP备17055617号