DeepSeek V4 Pro 正式版(0813)面向复杂推理、代码生成与 Agent 工作流,原生支持 Responses API,并兼容 Chat Completions。
提供商: DeepSeek
类型: 文本生成
接口: /v1/responses
状态: 已开放
消耗: --
DeepSeek V4 Pro 正式版(0813)面向复杂推理、代码生成与 Agent 工作流,原生支持 Responses API,并兼容 Chat Completions。
API 接入
Endpoint
POST /v1/responses
Base URL
https://www.hiapi.ai
使用 OpenAI Responses 格式并要求流式调用;同一个 HiAPI Key 可切换所有已开放模型。
输入价格
1,000 积分
/ 百万 Token
输出价格
2,000 积分
/ 百万 Token
Context
1M
上下文窗口
Max output
384K
最大输出 Token
输入一个问题,页面会以流式方式展示回答,并在完成后显示 Token 用量、耗时和估算费用。
使用 OpenAI Responses 格式流式调用 DeepSeek V4 Pro。下面提供 cURL、Python 和 Node.js 三种可直接复制的示例。
/v1/responsescurl -N -X POST "https://www.hiapi.ai/v1/responses" \
-H "Authorization: Bearer YOUR_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "deepseek-v4-pro",
"input": [
{
"type": "message",
"role": "user",
"content": [
{
"type": "input_text",
"text": "分析一个复杂代码库中的性能瓶颈,并给出可验证的优化方案。"
}
]
}
],
"stream": true,
"max_output_tokens": 1024,
"reasoning": {
"effort": "high"
}
}'提示: 请将 YOUR_API_KEY 替换为您在 API 密钥 页面创建的密钥。
使用 OpenAI Responses 格式;请保留 stream: true,input 使用消息数组,并通过 reasoning.effort 设置推理强度。
示例默认使用 reasoning.effort=high;最大推理强度改为 max,关闭推理则改为 none。
Responses API
先完成基础字段,再按任务启用高级能力。
组成一次有效请求的必要信息
按任务需要启用推理、输出控制与工具
DeepSeek Responses 是无状态接口,不支持 previous_response_id 或 conversation。请在下一轮 input 中重新传入仍需使用的上下文;请求中无需传入 store。
按实际输入、输出及缓存 Token 用量计费,以下价格统一按 100 万 Token 展示。
发送给模型的提示词与上下文
模型生成的回答与推理内容
以下规格对应 HiAPI 当前公开的文本请求契约;未披露的能力不会由页面自行推断。
DeepSeek V4 Pro 正式版(0813)面向复杂推理、代码生成与 Agent 工作流,原生支持 Responses API,并兼容 Chat Completions。
HiAPI 通过 /v1/responses 提供该模型。你可以先在本页 Playground 验证提示词与参数,再使用同一个 HiAPI API Key 接入服务端。
在线调试与 API 接入共享同一个模型 ID,可以用三个步骤从提示词验证过渡到生产调用。
步骤 1
在 Playground 中测试 instructions、input 和 reasoning.effort。
步骤 2
登录后查看已有密钥或按需新建;同一个密钥可切换所有已开放模型。
步骤 3
向 /v1/responses 发送请求,并根据 usage 字段记录成本。
DeepSeek V4 Pro 0813 是 DeepSeek V4 Pro API 模型的正式版,面向高难度推理、编程和 Agent 工作负载,支持 100 万 Token 上下文、最高 38.4 万 Token 输出,以及思考和非思考模式。
model 固定填写 deepseek-v4-pro。HiAPI 推荐使用 POST /v1/responses,同时保留 POST /v1/chat/completions 兼容入口。
Responses 使用 reasoning.effort,可选 none、low、high、max,默认 high;Chat Completions 使用 thinking.type 和 reasoning_effort。
不会。该接口为无状态模式,不要传 store、previous_response_id、conversation 或 background;下一轮需要在 input 中重新传入上下文。
HiAPI 按实际输入、输出和缓存读取 Token 分别计费;最终扣费以响应 usage、实时定价页和使用日志为准。
Codex 类工作流推荐使用 Responses。现有 Chat Completions 客户端可以保留 messages 请求结构,只替换 base URL、API Key 和模型 ID。