智能响应
POST /v1/responses 是 HiAPI 为支持 Responses 协议的新文本模型推荐的接入端点。它与其他已开放模型共用同一个 HiAPI API Key,但请求与响应结构不同于 Chat Completions,也不同于媒体模型的异步接口。
curl -X POST "https://api.hiapi.ai/v1/responses" \ -H "Authorization: Bearer YOUR_API_KEY" \ -H "Content-Type: application/json" \ -d '{ "model": "YOUR_RESPONSES_MODEL_ID", "input": [{ "type": "message", "role": "user", "content": [{"type": "input_text", "text": "请解释稀疏注意力。"}] }], "reasoning": {"effort": "medium"}, "stream": false }'model 和 input 为必填字段。input 可以是文本,也可以是带类型的对话项目数组。常用可选字段包括 instructions、stream、max_output_tokens、reasoning、text 和 tools;具体支持范围以模型页为准。
不要把某个文本模型的参数直接套用到另一个模型。推理档位、存储、多轮状态、工具类型和流式要求都可能因模型而异。
非流式调用从 output 中 content 类型为 output_text 的项目读取文本,并从 usage 读取 Token 用量。
流式调用按 SSE 事件的 type 分发:持续拼接 response.output_text.delta,收到 response.completed 后结束,并显式处理 response.incomplete 或 response.failed。Responses 上游不一定会发送 Chat Completions 的 data: [DONE]。
只有模型页明确列出 /v1/responses 时才使用 Responses。DeepSeek V4 Flash 使用 POST /v1/chat/completions。图片、视频和音频生成继续使用 POST /v1/tasks。
请查看各模型页确认其推理、状态、结构化输出和工具能力边界。