开发者
资源
文档评分
获取效率
正确性
完整性
易理解
在线提单
论坛求助

chat

接口名称

Windows命令(CMD):curl.exe -X POST "{BASE_URL}/chat" -H "Content-Type: application/json" -d "{\"messages\": [{\"role\": \"user\", \"content\": \"{对话内容}\", \"name\": \"{模型名称}\"}]}"

Windows命令(PowerShell):curl.exe -X POST "{BASE_URL}/chat" -H "Content-Type: application/json" -d '{\"messages\": [{\"role\": \"user\", \"content\": \"{对话内容}\", \"name\": \"{模型名称}\"}]}'

Linux/MacOS命令:curl -X POST "{BASE_URL}/chat" -H "Content-Type: application/json" -d '{\"messages\": [{\"role\": \"user\", \"content\": \"{对话内容}\", \"name\": \"{模型名称}\"}]}'

接口描述

用于调用config.yaml文件中配置好的大模型api接口,进行对话。

参数说明

参数

参数选项

参数说明

messages

-

必选参数,与大模型进行对话的消息。

name

-

可选参数,模型名称(别名),即指定选择某个模型。

enable_thinking

true/false

可选参数,是否开启思考模式,默认为false。

  • true:开启思考模式。
  • false:关闭思考模式。

temperature

-

可选参数,模型温度。默认值为0.7,可选范围为0 ~ 2。功能为控制模型输出文本的随机性和多样性,数值越大,创造性越强。

max_tokens

-

可选参数,模型最大输出tokens数量,默认为空。

max_retries

-

可选参数,模型最大重试次数。正整数,默认为3。

stream

true/false

可选参数,是否流式输出对话内容,默认为False。

  • true:开启流式输出。
  • false:关闭流式输出。

使用示例

Windows命令(CMD):

curl.exe -X POST "http://xxx.xxx.xxx.xxx:xxx/chat" -H "Content-Type: application/json" -d "{\"messages\": [{\"role\": \"user\", \"content\": \"你能帮我做什么\", \"name\": \"glm-5\"}]}"

Windows命令(PowerShell):

curl.exe -X POST "http://xxx.xxx.xxx.xxx:xxx/chat" -H "Content-Type: application/json" -d '{\"messages\": [{\"role\": \"user\", \"content\": \"你能帮我做什么\", \"name\": \"glm-5\"}]}'

Linux/MacOS命令:

curl -X POST "http://xxx.xxx.xxx.xxx:xxx/chat" -H "Content-Type: application/json" -d '{\"messages\": [{\"role\": \"user\", \"content\": \"你能帮我做什么\", \"name\": \"glm-5\"}]}'
  1. -H:curl命令参数,用于指定请求头的Content-Type。
  2. -d:curl命令参数,用于指定请求中待发送的数据内容。
  3. 使用示例中BASE_URL、对话内容、模型名称等参数请根据实际情况进行替换,BASE_URL为后端服务地址,格式为http://<IP地址>:<端口>。

返回值

返回JSON格式的数据,主要是对话内容和数据信息。

{
    "content": "我可以帮你回答问题、提供信息和进行对话交流。作为Z.ai训练的GLM大语言模型,我能够理解自然语言并生成回复,协助你完成各种语言任务。\n\n我的能力包括解答知识问题、撰写各类文本、翻译多种语言、总结长文档内容,以及提供创意建议等。不过请注意,我无法浏览网页、执行程序或访问数据库,只能基于已 学习的知识与你交流。\n\n有什么具体问题或任务需要我协助解决吗?我很乐意根据你的需求提供帮助。",
    "type": "ai",
    "response_metadata": {
        "token_usage": {
            "completion_tokens": 323,
            "prompt_tokens": 7,
            "total_tokens": 330,
            "completion_tokens_details": {
                "accepted_prediction_tokens": null,
                "audio_tokens": null,
                "reasoning_tokens": 216,
                "rejected_prediction_tokens": null
            },
            "prompt_tokens_details": {
                "audio_tokens": null,
                "cached_tokens": 0
            }
        },
        "model_provider": "openai",
        "model_name": "glm-5",
        "system_fingerprint": null,
        "id": "chatcmpl-ae421189-61a7-9aa9-876e-447c8795801d",
        "finish_reason": "stop",
        "logprobs": null
    },
    "usage_metadata": {
        "input_tokens": 7,
        "output_tokens": 323,
        "total_tokens": 330,
        "input_token_details": {
            "cache_read": 0
        },
        "output_token_details": {
            "reasoning": 216
        }
    }
}