如何把通话录音转成文字
分步教程:几分钟内通过 API 把电话录音转成文字,包含 Python 和 C# 代码示例、响应格式说明,以及常见错误的处理办法。
语音消息转文字:Telegram、WhatsApp 及其他即时通讯工具
如何自动把语音消息转成文字:处理 ogg/opus 格式、提升短录音准确率、应对静音,以及可直接使用的聊天机器人代码。
如何从 OpenAI Whisper API 迁移到其他服务
OpenAI Whisper API 迁移指南:代码要改哪两行、响应和错误格式有何差异,以及切换生产流量之前如何对比识别质量。
从视频和网络研讨会自动生成 SRT 与 VTT 字幕
如何从录播视频或网络研讨会得到带时间轴的现成字幕:提取音轨、SRT 与 VTT 的区别、代码示例,以及常见问题的解决办法。
如何把会议录音转成可用的会议纪要
把 Zoom、Teams 和 Google Meet 的录音变成可检索的文字和结构化纪要:文件在哪里、如何转录、如何提取决议和待办事项。
播客转录:节目笔记、章节和可被搜索的单集页面
如何自动转录播客单集,并把文字变成节目笔记、章节时间轴和搜索引擎读得懂的页面。附代码示例与发布清单。
如何提高语音识别准确率:八个实用方法
真正能改善转录质量的八件事:音频预处理、指定语种、prompt 词表、切分策略、响应格式,以及如何测量字错率。
如何为音频存档搭建批量转录流水线
转录上万条录音而不丢失任何一条:任务队列、并发控制、重试策略、崩溃后续跑,以及如何把账单控制在预期之内。
语音转文字计费:你实际在为什么付费
转录服务如何计费、音频里哪些部分在花钱、什么时候自建 GPU 比调用 API 更划算,以及如何估算自己每月的支出。