技术实践
最近在折腾 AI 模型的实际落地,说实话,国内能用的模型不算多,选来选去还是看上了通义千问(Qwen)。
📁
技术实践
📅
2024-11-03
在我的实际项目中,具体遇到了这些问题: 1. **长文档分类**:需要对500-1000字的技术文档进行分类,RNN经常记不住文档的主题 2.…
📁
技术实践
📅
2024-10-27
测试时我们发现:当关键信息出现在 token 序列的前 20% 时,准确率会比出现在后 20% 低 15 个百分点。
📁
技术实践
📅
2024-10-23
日常做些小项目时,我一直在用 Llama-3-8B 或 Qwen-14B 这类中等规模模型。
📁
技术实践
📅
2024-10-18
我的个人项目需要满足这些需求:
📁
技术实践
📅
2024-10-17
AI Mistral相关的坑,多半出在边界条件上。
📁
技术实践
📅
2024-10-10
最近在做一个医疗文本分类项目,训练数据只有 200 条标注样本,模型怎么调都过拟合。
📁
技术实践
📅
2024-10-06