Python 语音识别使用智谱api将长语音转文本智谱AI API虽性能优异但仅支持30秒以内音频文件。本文详细介绍如何基于pyannote.audio的语音活动检测技术实现智能音频分块,通过批量API调用构建完整的长语音转文本系统,包含完整的环境配置、代码实现和部署方案。 醉月思📁 技术实践📅 2025-12-16
语音识别 ASR Whisper 实时转文字 音频处理把ASR换到实时语音转文字时踩过的坑从静态ASR到实时语音转文字,我用过哪些方案,踩过哪些坑,最后怎么走到现在的。 醉月思📁 技术实践📅 2024-07-01