长度惩罚 生成控制 长度优化AI长度惩罚折腾手记文档生成项目里有个反差:用户问「Python 快速排序怎么实现」,模型回一行「平均复杂度 O(n log n)」就收工;换到 API 文档场景,… 醉月思📁 技术实践📅 2025-12-31
重复惩罚 生成优化 重复检测AI重复惩罚:这次怎么落地的批量生成博客草稿时,同一个 prompt 连跑十几遍,头几次结构还正常,后面就开始出现整段复制:「首先…其次…最后」的骨架固定下来,连举例子的产… 醉月思📁 技术实践📅 2025-12-29
核采样 p采样 Top-pAI核采样:Top-k不够用了之后本地跑 7B 模型写技术摘要,Temperature 设 0.7 时句子顺得可疑,同一段落里「此外」「另外」来回出现;调到 1.2,又开始编造不… 醉月思📁 技术实践📅 2025-12-28
Top-k采样 采样策略 文本生成AI_Top-k采样踩坑记录调对话生成模型时,我碰到一个很烦的现象:同一个问题问三遍,措辞几乎一模一样,连举例子的顺序都不变。 醉月思📁 技术实践📅 2025-12-27
分词 Tokenization BPE把文本换到Token时踩过的坑在开始动手之前,我先想清楚了自己的需求: 1. **词表可控**:我需要能根据自己的语料库来构建词表,而不是依赖别人预训练好的词表 2. **… 醉月思📁 技术实践📅 2025-12-18
Python 语音识别使用智谱api将长语音转文本智谱AI API虽性能优异但仅支持30秒以内音频文件。本文详细介绍如何基于pyannote.audio的语音活动检测技术实现智能音频分块,通过批量API调用构建完整的长语音转文本系统,包含完整的环境配置、代码实现和部署方案。 醉月思📁 技术实践📅 2025-12-16
DeepSeek 量化模型 代码模型AI DeepSeek:量化不够用了之后年初的时候,我的主力开发机器是一台 16GB 显存的 4080 本地机,跑个 7B 模型还得精打细算,13B … 醉月思📁 技术实践📅 2025-12-11