99 языков без настройки
Язык определяется автоматически: русский, английский, испанский, польский и десятки других в одном потоке.
Расшифровка звонков, голосовых сообщений и интервью на 99 языках. Подключение — одна строка кода: меняются только адрес и ключ.
10 минут бесплатно — падают на баланс, как только подтвердите почту
Дальше — до 0.006 USD за минуту аудио, оплата по факту
Язык определяется автоматически: русский, английский, испанский, польский и десятки других в одном потоке.
Минута записи расшифровывается за пару секунд, текст возвращается в том же запросе — без очередей и опроса статуса.
Записи и расшифровки живут не дольше суток — только для проверки качества, — затем удаляются автоматически.
Меняются только адрес и ключ — вызовы, параметры и разбор ответа остаются прежними. Форматы ответов и ошибок те же.
Услуга — расшифровка аудио в текст через API. Новым клиентам — 10 минут бесплатно на старте. Тарифицируются только успешно обработанные запросы: ошибки минут не расходуют. Валюта расчётов — USD.
0.006 USD за минуту аудио
До 2 запр./сек
Оплата — пополнением баланса прямо из личного кабинета: перевод криптовалютой зачисляется автоматически, обычно за несколько минут. Списание идёт по факту обработанных минут; когда баланс дойдёт до нуля, запросы отклоняются, и пополнение сразу снимает блокировку. Остаток, история запросов и счёт за период видны там же. Нужен счёт на оплату или идёт большой объём — напишите на support@voicesscribe.com, ставку обсудим отдельно.
Если вы уже расшифровываете аудио где-то ещё — замените две строки.
from openai import OpenAI
client = OpenAI(base_url="https://voicesscribe.com/v1", api_key="ваш ключ")
r = client.audio.transcriptions.create(model="whisper-1", file=open("call.ogg", "rb"))
print(r.text)
Регистрация занимает минуту, ключ выдаётся сразу вместе с доступом в личный кабинет.
Официальный openai-sdk работает как есть: укажите наш base_url и свой ключ — остальной код остаётся прежним.
Минуты, история расшифровок и счёт за период — в личном кабинете, в реальном времени.
Один эндпоинт POST /v1/audio/transcriptions — всё остальное задаётся параметрами.
ogg · opus · mp3 · wav · m4a · webm — до 25 МБ
json · text · verbose_json · srt · vtt
Параметр prompt помогает точнее распознавать названия, имена и коды.
Готовые srt и vtt либо сегменты с временем в verbose_json.
Пошаговые инструкции по типовым задачам — с кодом и разбором ошибок.
Как перевести телефонные разговоры в текст и поставить это на поток.
Работа с ogg/opus из мессенджеров и точность на коротких записях.
Готовые субтитры из вебинара или ролика одним запросом.
Восемь приёмов, которые действительно снижают долю ошибок на вашем аудио.
Нет. Запросы, параметры и форматы ответов те же, что у стандартного API транскрибации, — меняются только адрес и ключ. Распознавание идёт на наших мощностях.
99 языков, включая русский, английский, испанский, немецкий и польский. Язык определяется автоматически по звуку, указывать его необязательно.
Минута аудио обрабатывается за пару секунд. Текст приходит в ответе на тот же запрос — не нужно опрашивать статус задачи.
Записи и расшифровки хранятся не дольше суток — только чтобы вы могли проверить качество, — затем удаляются автоматически.
ogg, opus, mp3, wav, m4a, webm и другие популярные форматы до 25 МБ. Ответ доступен в json, text, verbose_json, srt и vtt.
Оплата за минуты аудио: до 0.006 USD за минуту, при больших объёмах — по договорённости. Тарифицируются только успешно обработанные запросы — ошибки минут не расходуют.