跳转到内容
中文

智能响应

POST Base URL: https://api.hiapi.ai /v1/responses

POST /v1/responses 是 HiAPI 为支持 Responses 协议的新文本模型推荐的接入端点。它与其他已开放模型共用同一个 HiAPI API Key,但请求与响应结构不同于 Chat Completions,也不同于媒体模型的异步接口。

Terminal window
curl -X POST "https://api.hiapi.ai/v1/responses" \
-H "Authorization: Bearer YOUR_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "YOUR_RESPONSES_MODEL_ID",
"input": [{
"type": "message",
"role": "user",
"content": [{"type": "input_text", "text": "请解释稀疏注意力。"}]
}],
"reasoning": {"effort": "medium"},
"stream": false
}'

modelinput 为必填字段。input 可以是文本,也可以是带类型的对话项目数组。常用可选字段包括 instructionsstreammax_output_tokensreasoningtexttools;具体支持范围以模型页为准。

不要把某个文本模型的参数直接套用到另一个模型。推理档位、存储、多轮状态、工具类型和流式要求都可能因模型而异。

非流式调用从 output 中 content 类型为 output_text 的项目读取文本,并从 usage 读取 Token 用量。

流式调用按 SSE 事件的 type 分发:持续拼接 response.output_text.delta,收到 response.completed 后结束,并显式处理 response.incompleteresponse.failed。Responses 接口不保证发送 Chat Completions 风格的 data: [DONE]

只有模型页明确列出 /v1/responses 时才使用 Responses。DeepSeek V4 Pro 原生支持 Responses,并保留 POST /v1/chat/completions 兼容入口;DeepSeek V4 Flash 仍只使用 Chat Completions。图片、视频和音频生成继续使用 POST /v1/tasks

请查看各模型页确认其推理、状态、结构化输出和工具能力边界。

GPT-6 Astra 使用流式 Responses:input 必须为数组,stream=true,store=false;推理可选 low、medium、high、xhigh、max。示例和 Playground 选择 medium;直接调用 API 时请显式设置 reasoning.effort。请使用该模型的专属示例;不要套用本页 DeepSeek 的非流式、字符串输入、none 或 max_output_tokens 示例。

参见 DeepSeek V4.1 Flash Preview 的 Responses 与 Chat Completions 接入契约;Responses 支持 none、high、max 推理档位,使用无状态对话。