跳转到内容
中文

智能响应

POST /v1/responses 是 HiAPI 为支持 Responses 协议的新文本模型推荐的接入端点。它与其他已开放模型共用同一个 HiAPI API Key,但请求与响应结构不同于 Chat Completions,也不同于媒体模型的异步接口。

Terminal window
curl -X POST "https://api.hiapi.ai/v1/responses" \
-H "Authorization: Bearer YOUR_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "YOUR_RESPONSES_MODEL_ID",
"input": [{
"type": "message",
"role": "user",
"content": [{"type": "input_text", "text": "请解释稀疏注意力。"}]
}],
"reasoning": {"effort": "medium"},
"stream": false
}'

modelinput 为必填字段。input 可以是文本,也可以是带类型的对话项目数组。常用可选字段包括 instructionsstreammax_output_tokensreasoningtexttools;具体支持范围以模型页为准。

不要把某个文本模型的参数直接套用到另一个模型。推理档位、存储、多轮状态、工具类型和流式要求都可能因模型而异。

非流式调用从 output 中 content 类型为 output_text 的项目读取文本,并从 usage 读取 Token 用量。

流式调用按 SSE 事件的 type 分发:持续拼接 response.output_text.delta,收到 response.completed 后结束,并显式处理 response.incompleteresponse.failed。Responses 上游不一定会发送 Chat Completions 的 data: [DONE]

只有模型页明确列出 /v1/responses 时才使用 Responses。DeepSeek V4 Flash 使用 POST /v1/chat/completions。图片、视频和音频生成继续使用 POST /v1/tasks

请查看各模型页确认其推理、状态、结构化输出和工具能力边界。