{
"status": "success",
"message": "Successfully converted text to speech",
"data": {
"audioData": "base64 encoding of audio",
"audioFormat": "wav",
"speechMarks": {
"type": "sentence",
"value": "Hii I am Erica",
"start": 0,
"end": 14,
"startTime": 0,
"endTime": 2162,
"chunks": [
{
"type": "word",
"value": "Hii",
"start": 0,
"end": 3,
"startTime": 0,
"endTime": 1267
},
{
"type": "word",
"value": "I",
"start": 4,
"end": 5,
"startTime": 1267,
"endTime": 1437
},
{
"type": "word",
"value": "am",
"start": 6,
"end": 8,
"startTime": 1437,
"endTime": 1565
},
{
"type": "word",
"value": "Erica",
"start": 9,
"end": 14,
"startTime": 1565,
"endTime": 2162
}
]
},
"contextToken": "context:ed2ca304-2006-42b7-90c4-10b643313cda"
},
"status_code": 200
}
curl --location --request POST 'https://zylalabs.com/api/9144/text+to+speech+api+-+speechify+api/16541/convert+text+to+speech' --header 'Authorization: Bearer YOUR_API_KEY'
--data-raw '{
"text": "Hi, how are you?",
"voice": "Erica",
"language": "English"
}'
{
"status": "success",
"message": "Available languages and voices",
"data": [
{
"language": "English",
"voices": [
{
"voice": "Erica",
"gender": "Female"
}
]
}
],
"status_code": 200
}
curl --location --request GET 'https://zylalabs.com/api/9144/text+to+speech+api+-+speechify+api/16542/language+and+voice+details' --header 'Authorization: Bearer YOUR_API_KEY'
Después de registrarte, a cada desarrollador se le asigna una clave de acceso a la API personal, una combinación única de letras y dígitos proporcionada para acceder a nuestro endpoint de la API. Para autenticarte con el API de texto a voz - Speechify API simplemente incluye tu token de portador en el encabezado de Autorización.
| Encabezado | Descripción |
|---|---|
Autorización
|
Requerido
Debería ser Bearer access_key. Consulta "Tu Clave de Acceso a la API" arriba cuando estés suscrito.
|
Sin compromiso a largo plazo. Mejora, reduce o cancela en cualquier momento. La Prueba Gratuita incluye hasta 50 solicitudes.
(Ahorra 2 meses pagando anualmente 🎉)
🌍🔊 Genera audio sin esfuerzo, personaliza el idioma y la voz, y explora todas las opciones disponibles con una sola llamada.
Perfecto para chatbots, accesibilidad, creación de contenidos y más—¡da vida a tus palabras con solo una solicitud de API! 🚀🎧
El endpoint POST Convertir texto a voz devuelve datos de audio en formato base64, junto con marcas de discurso que detallan el tiempo y la estructura del texto hablado. El endpoint GET Detalles del idioma y la voz devuelve una lista de idiomas admitidos y sus voces correspondientes.
Los campos clave en la respuesta POST incluyen "estado," "mensaje," "audioData," "audioFormat," y "speechMarks." Para la respuesta GET, los campos clave incluyen "estado," "mensaje," y "datos," que contienen detalles de idioma y voz.
El endpoint POST acepta tres parámetros: "text" (hasta 500 caracteres), "language" (en mayúsculas y minúsculas) y "voice" (en mayúsculas y minúsculas). Los usuarios pueden personalizar sus solicitudes seleccionando diferentes idiomas y voces disponibles en el sistema.
Los datos de respuesta están estructurados en un formato JSON. Para el endpoint POST, incluye un mensaje de estado y un objeto de datos que contiene información de audio y marcas de discurso. El endpoint GET devuelve una lista de idiomas y sus voces asociadas en una estructura JSON similar.
Los casos de uso típicos incluyen mejorar los chatbots con habla natural, mejorar la accesibilidad para usuarios con discapacidad visual y generar contenido de audio para fines educativos o de entretenimiento. La API se puede integrar en diversas aplicaciones que requieren funcionalidad de texto a voz.
Los usuarios pueden decodificar los datos de audio codificados en base64 para reproducir el habla generada en sus aplicaciones. Las marcas de habla pueden usarse para sincronizar la visualización de texto con la reproducción de audio, mejorando la experiencia del usuario en aplicaciones interactivas.
El endpoint GET proporciona información sobre los idiomas compatibles y sus voces disponibles, incluyendo el género de cada voz. Esto permite a los usuarios seleccionar opciones adecuadas para sus necesidades de texto a voz.
La precisión de los datos se mantiene a través de actualizaciones regulares y controles de calidad en los conjuntos de datos de idioma y voz. La API asegura que las voces sean expresivas y suenen naturales, mejorando la experiencia general del usuario.