Claude Anthropic 大模型AI Claude踩坑记录先复现,再谈优化。记录从 OpenAI 切到 Claude 后,代码审查、写作辅助和排障三个场景里真正管用的用法和踩过的坑。 醉月思📁 技术实践📅 2024-10-03
大模型 微调 RLHF 指令微调 奖励建模关于大模型微调进阶的几点记录我第一个项目是一个代码助手微调,用 Python 代码片段和注释做训练数据,大概 5 万条。 醉月思📁 技术实践📅 2024-07-10
零样本学习 Prompt工程 大模型AI零样本学习:训练与推理笔记我分析了几个失败的例子,发现: 1. **类别定义模糊**:有些文献涉及多个领域,模型不知道优先选哪个 2. **摘要缺乏约束**:模型不知道… 醉月思📁 技术实践📅 2023-09-10
深度学习 分布式训练 流水线并行 Megatron-LM 大模型AI流水线并行折腾手记GPT-3的论文里就提了这种思路,Megatron-LM也把它用得挺狠。 醉月思📁 技术实践📅 2023-05-17
GPT OpenAI 大模型从GPT-3走到GPT-4:AI GPT笔记GPT-4 很强,但项目里要不要全换?记一次从 GPT-3.5 到混合调度的成本与效果权衡。 醉月思📁 技术实践📅 2023-04-17
Prompt工程 Prompt设计 大模型AI Prompt工程:混乱不够用了之后让 AI「写个 Python 脚本处理 CSV」,第一次只做清洗,第二次加了异常处理却把核心逻辑改了,第三次要格式化输出,它又把前面重构一轮。 醉月思📁 技术实践📅 2023-04-12