99 种语言,零配置
语种自动判定:中文、英语、西班牙语、日语等数十种语言在同一条流里处理。
把通话、语音消息和访谈录音转成文字,支持 99 种语言。接入只需一行代码:只换地址和密钥。
免费 10 分钟 — 确认邮箱后立即计入余额
超出额度后 — 每分钟音频最高 0.006 USD,按量付费
语种自动判定:中文、英语、西班牙语、日语等数十种语言在同一条流里处理。
一分钟音频几秒钟转录完,文字在同一个请求里返回——没有队列,不用轮询。
录音和转录文本保存不超过 24 小时——仅供核对质量——之后自动删除。
只换地址和密钥:调用、参数和响应解析都不用动,响应和错误格式完全一致。
我们提供的服务:通过 API 把音频转成文字。新用户注册即送 10 分钟。只对成功处理的请求计费——出错的请求不消耗分钟数。结算币种为 USD。
每分钟音频 0.006 USD
每秒最多 2 个请求
付款方式为在客户后台自助充值余额:加密货币转账自动到账,通常几分钟即可。按实际处理的分钟数扣费;余额归零后请求会被拒绝,充值即刻恢复。余额、请求历史和账期金额都在后台查看。需要开具账单或用量较大,请发信至 support@voicesscribe.com,价格另议。
已经在别处做转录?改两行即可。
from openai import OpenAI
client = OpenAI(base_url="https://voicesscribe.com/v1", api_key="your key")
r = client.audio.transcriptions.create(model="whisper-1", file=open("call.ogg", "rb"))
print(r.text)
注册只需一分钟,密钥连同客户后台访问权限立即发放。
官方 openai-sdk 直接可用:把 base_url 指向我们并填入密钥——其余代码原样不动。
分钟数、转录历史和账期金额都在客户后台,实时更新。
单一接口 POST /v1/audio/transcriptions — 其余都靠参数控制。
ogg · opus · mp3 · wav · m4a · webm — 最大 25 MB
json · text · verbose_json · srt · vtt
prompt 参数提高名称、人名和编号的识别准确率。
现成的 srt 和 vtt,或 verbose_json 里带时间的分段。
常见任务的分步说明——附代码与错误处理。
如何把电话对话转成文字并纳入常规流程。
处理即时通讯工具的 ogg/opus,以及短录音的准确率。
一个请求就从网络研讨会或视频得到现成字幕。
真正能改善你自己音频字错率的八个方法。
不用。请求、参数和响应格式与标准转录接口一致——只换地址和密钥即可。识别在我们自己的硬件上运行。
99 种语言,包括中文、英语、西班牙语和德语。语种根据音频自动判定,无需指定。
一分钟音频几秒钟处理完。文字在同一个请求里返回——不需要轮询任务状态。
录音和转录文本保存不超过 24 小时——仅供核对质量——之后自动删除。
ogg、opus、mp3、wav、m4a、webm 等常见格式,单次最大 25 MB。响应可选 json、text、verbose_json、srt 和 vtt。
按音频分钟计费:每分钟最高 0.006 USD,量大另议。只对成功处理的请求计费——出错的请求不消耗分钟数。