99 idiomas, sem configurar nada
O idioma é detectado sozinho: português, inglês, espanhol, japonês e dezenas de outros passam pelo mesmo fluxo.
Transforme gravações de chamadas, mensagens de voz e entrevistas em texto, em 99 idiomas. A integração cabe em uma linha de código: mudam só o endereço e a chave.
10 minutos grátis — creditados no saldo assim que você confirmar o e-mail
Depois da cota gratuita — no máximo 0.006 USD por minuto de áudio, pagando pelo que usar
O idioma é detectado sozinho: português, inglês, espanhol, japonês e dezenas de outros passam pelo mesmo fluxo.
Um minuto de áudio é transcrito em poucos segundos e o texto volta na mesma requisição — sem fila e sem polling.
Gravações e transcrições duram no máximo 24 horas — apenas para conferência de qualidade — e depois são apagadas automaticamente.
Troque só o endereço e a chave: chamadas, parâmetros e leitura da resposta continuam iguais. Os formatos de resposta e de erro são idênticos.
O que entregamos: áudio transformado em texto por uma API. Clientes novos começam com 10 minutos grátis. A cobrança é apenas sobre requisições processadas com sucesso — requisições com erro não consomem minutos. A moeda de faturamento é USD.
0.006 USD por minuto de áudio
Até 2 requisições por segundo
O pagamento é feito recarregando o saldo na própria área do cliente: a transferência em cripto é creditada automaticamente, normalmente em alguns minutos. O desconto segue os minutos efetivamente processados; quando o saldo zera, as requisições passam a ser recusadas, e uma recarga libera na hora. Saldo, histórico de requisições e o valor do período ficam no mesmo lugar. Precisa de fatura ou tem grande volume — escreva para support@voicesscribe.com e combinamos o preço.
Já transcreve em outro serviço? São duas linhas para mudar.
from openai import OpenAI
client = OpenAI(base_url="https://voicesscribe.com/v1", api_key="sua chave")
r = client.audio.transcriptions.create(model="whisper-1", file=open("chamada.ogg", "rb"))
print(r.text)
O cadastro leva um minuto; a chave e o acesso à área do cliente saem na hora.
O openai-sdk oficial funciona como está: aponte a base_url para o nosso endpoint e informe a sua chave — o resto do código fica como está.
Minutos, histórico de transcrições e o valor do período ficam na área do cliente, atualizados em tempo real.
Um único endpoint POST /v1/audio/transcriptions — todo o resto é parâmetro.
ogg · opus · mp3 · wav · m4a · webm — até 25 MB
json · text · verbose_json · srt · vtt
O parâmetro prompt melhora a precisão em marcas, sobrenomes e códigos de produto.
Arquivos srt e vtt prontos, ou segmentos com tempos no verbose_json.
Passo a passo para as tarefas mais comuns — com código e tratamento de erros.
Como transformar conversas telefônicas em texto e colocar isso na rotina.
Lidando com o ogg/opus dos mensageiros e com a precisão em gravações curtas.
Arquivos de legenda prontos a partir de um webinar ou vídeo em uma requisição.
Oito ajustes que de fato reduzem a taxa de erro no seu próprio áudio.
Não. Chamadas, parâmetros e formatos de resposta são os mesmos da API de transcrição padrão — basta trocar o endereço e a chave. O reconhecimento roda no nosso próprio hardware.
99 idiomas, incluindo português, inglês, espanhol e alemão. O idioma é detectado automaticamente a partir do áudio, sem precisar informá-lo.
Um minuto de áudio é processado em segundos. O texto volta na mesma requisição — não é preciso consultar o status de um trabalho.
Gravações e transcrições duram no máximo 24 horas — apenas para conferência de qualidade — e depois são apagadas automaticamente.
Formatos comuns como ogg, opus, mp3, wav, m4a e webm, com até 25 MB por requisição. A resposta pode ser json, text, verbose_json, srt e vtt.
A cobrança é por minuto de áudio: no máximo 0.006 USD por minuto, com preço negociável em grandes volumes. Só requisições processadas com sucesso são cobradas — as que falham não consomem minutos.