{"audio_file":"https://lf19-captcha-sign.ibytedtos.com/obj/captcha-dl-usa-us/voice_2385_e54b0377092077062522133365b5eaa3d3682d4b.mp3?lk3s=e1df38e3&x-expires=1729436903&x-signature=MeVqtoI%2F3zxdUUAf5A4gW38yunE%3D","output":{"text":"GENIE EL VENIE F W"}}
curl --location --request POST 'https://zylalabs.com/api/303/english+speech+to+text+api/250/submit+files+for+transcript?url=https://getwoord.s3.amazonaws.com/158847701616663713926352cf4095d8d0.50369171.mp3' --header 'Authorization: Bearer YOUR_API_KEY'
Después de registrarte, a cada desarrollador se le asigna una clave de acceso a la API personal, una combinación única de letras y dígitos proporcionada para acceder a nuestro endpoint de la API. Para autenticarte con el Texto de voz a texto en inglés API simplemente incluye tu token de portador en el encabezado de Autorización.
| Encabezado | Descripción |
|---|---|
Autorización
|
Requerido
Debería ser Bearer access_key. Consulta "Tu Clave de Acceso a la API" arriba cuando estés suscrito.
|
Sin compromiso a largo plazo. Mejora, reduce o cancela en cualquier momento. La Prueba Gratuita incluye hasta 50 solicitudes.
(Ahorra 2 meses pagando anualmente 🎉)
Acerca de la API:
Esta API tiene la capacidad de transcribir cualquier audio que le envíes. Filtra palabras innecesarias como "eh" y "hm" para que tengas una transcripción más limpia. Recibe tus audios en texto y comienza a usarlos de la manera que necesites.
Esta API recibirá una URL de audio y entregará el texto transcrito.
Transcripción de reuniones: Poder transcribir cualquier reunión que tengas con tu equipo y también con clientes. Ten tus reuniones transcritas para tener acceso a lo que ocurrió en esas reuniones más rápido que nunca.
Asistentes Inteligentes: Las empresas que desarrollan asistentes inteligentes en electrodomésticos, automóviles y hogares pueden usar el reconocimiento de voz a texto para habilitar consultas de búsqueda en interfaces naturales o características de comando y control por voz.
Transcripciones de Call Center: Los clientes a menudo graban conversaciones con sus usuarios finales en escenarios como llamadas de soporte al cliente. Las grabaciones de audio pueden ser enviadas a esta API para transcripciones, de modo que tengas un mejor control sobre cómo se están manejando los clientes.
Escritura por voz: Las aplicaciones pueden permitir a los usuarios usar la voz para dictar textos largos. La escritura por voz puede utilizarse para ingresar texto para mensajes, correos electrónicos y documentos.
Aparte del número de llamadas a la API por mes, no hay otras limitaciones.
Este endpoint devuelve una respuesta en JSON que contiene el texto transcrito del archivo de audio enviado. Los campos clave incluyen la URL del archivo de audio original y el texto de salida, que representa la transcripción limpia del discurso.
Los datos de respuesta incluyen dos campos clave: "audio_file", que proporciona la URL del audio enviado, y "output", que contiene el campo "text" con el discurso transcrito.
Los datos de respuesta están estructurados en formato JSON. Consiste en un objeto con la URL "audio_file" y un objeto "output" que incluye el texto transcrito, lo que facilita su análisis y uso en aplicaciones.
El parámetro principal para este punto final es la URL de audio, que debe apuntar a un archivo de audio válido. Los usuarios pueden personalizar sus solicitudes asegurándose de que el archivo de audio esté en un formato compatible, como MP3.
La API emplea algoritmos avanzados de reconocimiento de voz que filtran palabras de relleno y mejoran la precisión de la transcripción. Las actualizaciones y mejoras continuas de los modelos subyacentes ayudan a mantener resultados de alta calidad.
Los casos de uso comunes incluyen transcripciones de reuniones para referencia rápida, mejorar asistentes inteligentes con comandos de voz y generar transcripciones de llamadas de atención al cliente para mejorar la calidad del servicio.
Los usuarios pueden integrar el texto transcrito en aplicaciones para documentación, análisis o funcionalidades de búsqueda. La salida limpiada permite una fácil legibilidad y puede ser almacenada o procesada más allá según sea necesario.
Si la transcripción devuelve resultados parciales o vacíos, los usuarios deben verificar la calidad y claridad del audio. Volver a cargar un audio más claro o asegurarse de que el archivo de audio esté completo puede ayudar a mejorar la precisión de la transcripción.