{"audio_file":"https://lf19-captcha-sign.ibytedtos.com/obj/captcha-dl-usa-us/voice_2385_e54b0377092077062522133365b5eaa3d3682d4b.mp3?lk3s=e1df38e3&x-expires=1729436903&x-signature=MeVqtoI%2F3zxdUUAf5A4gW38yunE%3D","output":{"text":"GENIE EL VENIE F W"}}
curl --location --request POST 'https://zylalabs.com/api/303/english+speech+to+text+api/250/submit+files+for+transcript?url=https://getwoord.s3.amazonaws.com/158847701616663713926352cf4095d8d0.50369171.mp3' --header 'Authorization: Bearer YOUR_API_KEY'
Após se cadastrar, cada desenvolvedor recebe uma chave de acesso à API pessoal, uma combinação única de letras e dígitos para acessar nosso endpoint de API. Para autenticar com a Reconhecimento de fala em inglês API basta incluir seu token Bearer no cabeçalho Authorization.
| Cabeçalho | Descrição |
|---|---|
Authorization
|
Obrigatório
Deve ser Bearer access_key. Veja "Sua chave de acesso à API" acima quando você estiver inscrito.
|
Sem compromisso de longo prazo. Faça upgrade, downgrade ou cancele a qualquer momento. O teste gratuito inclui até 50 requisições.
(Economize 2 meses com cobrança anual 🎉)
Sobre a API:
Esta API tem a capacidade de transcrever qualquer áudio que você enviar para ela. Ela filtra palavras desnecessárias como "uh" e "hum" para que você tenha uma transcrição mais limpa. Receba seus áudios em texto e comece a usá-los da maneira que precisar.
Esta API receberá uma URL de áudio e entregará o texto transcrito.
Transcrição de reuniões: Ser capaz de transcrever qualquer reunião que você tenha com sua equipe e também com clientes. Tenha suas reuniões transcritas para que você tenha acesso ao que aconteceu nessas reuniões mais rápido do que nunca.
Assistentes Inteligentes: Empresas que desenvolvem assistentes inteligentes em eletrodomésticos, carros e casas podem usar a conversão de voz em texto para habilitar consultas de busca por interface natural ou recursos de comando e controle por voz.
Transcrições de Call Center: Os clientes frequentemente gravam conversas com seus usuários finais em cenários como chamadas de suporte ao cliente. Gravações de áudio podem ser enviadas para esta API para transcrições, assim você terá um melhor controle sobre como os clientes estão sendo atendidos.
Digitação por Voz: Aplicativos podem permitir que os usuários usem a voz para ditar textos longos. A digitação por voz pode ser usada para inserir texto em mensagens, e-mails e documentos.
Além do número de chamadas da API por mês, não há outras limitações.
Este endpoint retorna uma resposta JSON contendo o texto transcrito do arquivo de áudio enviado. Os campos principais incluem a URL do arquivo de áudio original e o texto de saída, que representa a transcrição limpa da fala
Os dados da resposta incluem dois campos principais: "audio_file", que fornece a URL do áudio enviado, e "output", que contém o campo "text" com a fala transcrita
Os dados de resposta estão estruturados no formato JSON. Consiste em um objeto com a URL do "audio_file" e um objeto "output" que inclui o texto transcrito, facilitando o parsing e a utilização em aplicações
O parâmetro principal para este endpoint é a URL do áudio, que deve apontar para um arquivo de áudio válido. Os usuários podem personalizar suas solicitações garantindo que o arquivo de áudio esteja em um formato suportado, como MP3
A API utiliza algoritmos avançados de reconhecimento de fala que filtram palavras de preenchimento e melhoram a precisão da transcrição Atualizações e melhorias contínuas nos modelos subjacentes ajudam a manter resultados de alta qualidade
Casos de uso comuns incluem transcrições de reuniões para referência rápida melhorando assistentes inteligentes com comandos de voz e gerando transcrições para chamadas de suporte ao cliente para melhorar a qualidade do serviço
Os usuários podem integrar o texto transcrito em aplicativos para documentação análise ou funcionalidades de busca A saída limpa permite fácil legibilidade e pode ser armazenada ou processada conforme necessário
Se a transcrição retornar resultados parciais ou vazios, os usuários devem verificar a qualidade e clareza do áudio Reenviar um áudio mais claro ou garantir que o arquivo de áudio esteja completo pode ajudar a melhorar a precisão da transcrição