{
"id": "chatcmpl-80295b9fe82b5625",
"object": "chat.completion",
"created": 1789543771,
"model": "glm-5.3",
"choices": [
{
"index": 0,
"message": {
"role": "assistant",
"content": "Hello, it's wonderful to connect with you!",
"refusal": null,
"annotations": null,
"audio": null,
"function_call": null,
"reasoning": "The user wants a simple greeting in one sentence. Let me provide that."
},
"logprobs": null,
"finish_reason": "stop",
"stop_reason": 154827,
"token_ids": null,
"routed_experts": null
}
],
"service_tier": null,
"system_fingerprint": "vllm-0.29.0-tp8-7a362382",
"usage": {
"prompt_tokens": 18,
"total_tokens": 45,
"completion_tokens": 27,
"prompt_tokens_details": null,
"completion_tokens_details": {
"reasoning_tokens": 15
}
},
"prompt_logprobs": null,
"prompt_token_ids": null,
"prompt_text": null,
"kv_transfer_params": null,
"ec_transfer_params": null,
"metrics": null
}
curl --location --request POST 'https://zylalabs.com/api/13821/glm-5-3+flash+chat+api/31703/chat+completions' --header 'Authorization: Bearer YOUR_API_KEY'
--data-raw '{
"model": "glm-5.3",
"messages": [
{
"role": "user",
"content": "Say hello in one sentence."
}
],
"stream": false,
"max_tokens": 256
}'
注册后,每个开发者都会被分配一个个人 API 访问密钥,这是一个唯一的字母和数字组合,用于访问我们的 API 端点。要使用 GLM-5-3闪聊 API 进行身份验证,只需在 Authorization 标头中包含您的 bearer token。
| 标头 | 描述 |
|---|---|
授权
|
必需
应为 Bearer access_key. 订阅后,请查看上方的"您的 API 访问密钥"。
|
无长期承诺。随时升级、降级或取消。 免费试用包括最多 50 个请求。
(年度计费可节省 2 个月 🎉)
与OpenAI兼容的GLM-5.3 Flash聊天完成API 支持文本聊天完成和流式响应
GLM-5-3 Flash API以JSON格式返回聊天完成响应 每个响应包括一个ID 模型信息 和一个包含助手消息的选择列表 包括响应的内容和推理
响应中的关键字段包括“id”(唯一标识符)、“model”(使用的模型)、“choices”(响应数组)和“usage”(令牌计数)。每个选择包含“message”,其中有“role”和“content”,为助手的回复提供了上下文
响应数据结构为一个 JSON 对象,包含顶层字段如“id”“object”“created”和“choices”。“choices”字段是一个数组,其中每个条目包含关于助手响应的详细信息,包括消息和推理
该端点接受参数,例如以OpenAI兼容方式格式化的一系列聊天消息 用户可以通过包含特定消息 角色(用户或助手)和对话上下文来自定义请求以引导响应
典型的用例包括构建聊天机器人 虚拟助手 和客户支持工具 该API可用于生成对话响应 回答问题或根据用户输入以聊天格式提供信息
用户可以通过从“choices”数组中的“message”字段提取“content”来使用返回的数据,以显示助手的响应。“reasoning”字段还可以提供有关响应生成方式的见解,从而增强用户理解
数据准确性通过基础模型在多样化数据集上的培训得以维持,确保其能够生成上下文相关的回应。对模型的持续更新和改进也有助于随着时间的推移提高响应质量
如果API返回部分或空结果,用户应检查“choices”数组以获取可用的响应。在应用程序中实施错误处理可以帮助管理此类情况,允许重试或替代提示以提高响应质量