chat
接口名称
Windows命令(CMD):curl.exe -X POST "{BASE_URL}/chat" -H "Content-Type: application/json" -d "{\"messages\": [{\"role\": \"user\", \"content\": \"{对话内容}\", \"name\": \"{模型名称}\"}]}"
Windows命令(PowerShell):curl.exe -X POST "{BASE_URL}/chat" -H "Content-Type: application/json" -d '{\"messages\": [{\"role\": \"user\", \"content\": \"{对话内容}\", \"name\": \"{模型名称}\"}]}'
Linux/MacOS命令:curl -X POST "{BASE_URL}/chat" -H "Content-Type: application/json" -d '{\"messages\": [{\"role\": \"user\", \"content\": \"{对话内容}\", \"name\": \"{模型名称}\"}]}'
接口描述
用于调用config.yaml文件中配置好的大模型api接口,进行对话。
参数说明
参数 |
参数选项 |
参数说明 |
|---|---|---|
messages |
- |
必选参数,与大模型进行对话的消息。 |
name |
- |
可选参数,模型名称(别名),即指定选择某个模型。 |
enable_thinking |
true/false |
可选参数,是否开启思考模式,默认为false。
|
temperature |
- |
可选参数,模型温度。默认值为0.7,可选范围为0 ~ 2。功能为控制模型输出文本的随机性和多样性,数值越大,创造性越强。 |
max_tokens |
- |
可选参数,模型最大输出tokens数量,默认为空。 |
max_retries |
- |
可选参数,模型最大重试次数。正整数,默认为3。 |
stream |
true/false |
可选参数,是否流式输出对话内容,默认为False。
|
使用示例
Windows命令(CMD):
curl.exe -X POST "http://xxx.xxx.xxx.xxx:xxx/chat" -H "Content-Type: application/json" -d "{\"messages\": [{\"role\": \"user\", \"content\": \"你能帮我做什么\", \"name\": \"glm-5\"}]}"
Windows命令(PowerShell):
curl.exe -X POST "http://xxx.xxx.xxx.xxx:xxx/chat" -H "Content-Type: application/json" -d '{\"messages\": [{\"role\": \"user\", \"content\": \"你能帮我做什么\", \"name\": \"glm-5\"}]}'
Linux/MacOS命令:
curl -X POST "http://xxx.xxx.xxx.xxx:xxx/chat" -H "Content-Type: application/json" -d '{\"messages\": [{\"role\": \"user\", \"content\": \"你能帮我做什么\", \"name\": \"glm-5\"}]}'
- -H:curl命令参数,用于指定请求头的Content-Type。
- -d:curl命令参数,用于指定请求中待发送的数据内容。
- 使用示例中BASE_URL、对话内容、模型名称等参数请根据实际情况进行替换,BASE_URL为后端服务地址,格式为http://<IP地址>:<端口>。
返回值
返回JSON格式的数据,主要是对话内容和数据信息。
{
"content": "我可以帮你回答问题、提供信息和进行对话交流。作为Z.ai训练的GLM大语言模型,我能够理解自然语言并生成回复,协助你完成各种语言任务。\n\n我的能力包括解答知识问题、撰写各类文本、翻译多种语言、总结长文档内容,以及提供创意建议等。不过请注意,我无法浏览网页、执行程序或访问数据库,只能基于已 学习的知识与你交流。\n\n有什么具体问题或任务需要我协助解决吗?我很乐意根据你的需求提供帮助。",
"type": "ai",
"response_metadata": {
"token_usage": {
"completion_tokens": 323,
"prompt_tokens": 7,
"total_tokens": 330,
"completion_tokens_details": {
"accepted_prediction_tokens": null,
"audio_tokens": null,
"reasoning_tokens": 216,
"rejected_prediction_tokens": null
},
"prompt_tokens_details": {
"audio_tokens": null,
"cached_tokens": 0
}
},
"model_provider": "openai",
"model_name": "glm-5",
"system_fingerprint": null,
"id": "chatcmpl-ae421189-61a7-9aa9-876e-447c8795801d",
"finish_reason": "stop",
"logprobs": null
},
"usage_metadata": {
"input_tokens": 7,
"output_tokens": 323,
"total_tokens": 330,
"input_token_details": {
"cache_read": 0
},
"output_token_details": {
"reasoning": 216
}
}
}