HiAPI
概览模型广场API 密钥用量统计调用日志充值账单推荐奖励在线试用产物存储更新公告联系我们账号设置
金额单位
N
Powered by hiapi
账号设置

欢迎

联系我们

DeepSeek V4 Flash Vision Exp 支持文本与图片输入,面向多模态理解和 Agent 工作流,原生支持 Responses API,并兼容 Chat Completions。

提供商: DeepSeek

类型: 文本生成

接口: /v1/responses

状态: 已开放

消耗: --

返回模型市场
DeepSeekText API在线

DeepSeek V4 Flash Vision Exp

DeepSeek V4 Flash Vision Exp 支持文本与图片输入,面向多模态理解和 Agent 工作流,原生支持 Responses API,并兼容 Chat Completions。

API 接入

Endpoint

POST /v1/responses

Base URL

https://api.hiapi.ai

使用 OpenAI Responses 格式调用;同一个 HiAPI Key 可切换所有已开放模型。

输入价格

572 积分

/ 百万 Token

输出价格

1,715 积分

/ 百万 Token

Context

1.05M

上下文窗口

Max output

262.1K

最大输出 Token

在线调试API 接入定价能力参数模型介绍

运行参数

在线调试将使用当前登录账户并从账户余额扣费,无需额外填写 API Key。通过代码调用 API 时,仍需使用 HiAPI API Key。

开始测试 DeepSeek V4 Flash Vision Exp

输入问题,或上传、粘贴图片。页面会流式展示回答,并在完成后显示 Token 用量、耗时和估算费用。

支持上传或粘贴,最多 4 张,每张不超过 10 MB。图片会经过安全审核。

DeepSeek V4 Flash Vision Exp API 快速开始

使用 OpenAI Responses 格式流式调用 DeepSeek V4 Flash Vision Exp。下面提供 cURL、Python 和 Node.js 三种可直接复制的示例。

代码示例
API 端点:/v1/responses
curl -N -X POST "https://api.hiapi.ai/v1/responses" \
  -H "Authorization: Bearer YOUR_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
  "model": "deepseek-v4-flash-vision-exp",
  "input": [
    {
      "type": "message",
      "role": "user",
      "content": [
        {
          "type": "input_text",
          "text": "分析一张图片并结合文字要求给出可执行的结论。"
        }
      ]
    }
  ],
  "stream": true,
  "store": false,
  "max_output_tokens": 1024,
  "reasoning": {
    "effort": "high"
  }
}'

提示: 请将 YOUR_API_KEY 替换为您在 API 密钥 页面创建的密钥。

使用 OpenAI Responses 格式;请保留 stream: true,input 使用消息数组,并通过 reasoning.effort 设置推理强度。

图片理解示例

在同一个 input 消息中组合 input_text 与 input_image。图片可以使用公开 HTTPS URL;Playground 上传后会自动填入临时安全 URL。

API 端点:/v1/responses
curl -N -X POST "https://api.hiapi.ai/v1/responses" \
  -H "Authorization: Bearer YOUR_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
  "model": "deepseek-v4-flash-vision-exp",
  "input": [
    {
      "type": "message",
      "role": "user",
      "content": [
        {
          "type": "input_text",
          "text": "Describe the main subject, setting, and important visual details."
        },
        {
          "type": "input_image",
          "image_url": "https://static.hiapi.ai/example/subject-1.jpg",
          "detail": "low"
        }
      ]
    }
  ],
  "stream": true,
  "store": false,
  "max_output_tokens": 1024,
  "reasoning": {
    "effort": "high"
  }
}'

提示: 请将 YOUR_API_KEY 替换为您在 API 密钥 页面创建的密钥。

使用 OpenAI Responses 格式;请保留 stream: true,input 使用消息数组,并通过 reasoning.effort 设置推理强度。

Responses API

请求参数一览

先完成基础字段,再按任务启用高级能力。

3 个必填4 个能力字段

基础字段

组成一次有效请求的必要信息

model
必填
使用本页展示的模型 ID。
input
必填
使用消息数组传入当前对话上下文。
stream
必填
必须设为 true。
store
固定
固定为 false,示例中显式传入。

能力字段

按任务需要启用推理、上下文与工具

reasoning.effort
可选
none、low、medium、high。示例和 Playground 默认 high;API 请求请显式设置。
instructions
可选
定义角色和回答要求。
previous_response_id
条件使用
仅用于兼容的存储与链式响应;store=false 时由客户端回放上下文。
tools / tool_choice
可选
声明并控制函数工具调用。
i

Max output 是模型规格上限,不代表每次请求都会生成到该长度。示例仅展示当前已开放并完成验证的运行参数。

管理 API Key同一个 HiAPI Key 可切换所有已开放模型。

DeepSeek V4 Flash Vision Exp API 定价

按实际输入、输出及缓存 Token 用量计费,以下价格统一按 100 万 Token 展示。

输入 Token
572 积分/ 100 万 Token

发送给模型的提示词与上下文

输出 Token
1,715 积分/ 100 万 Token

模型生成的回答与推理内容

缓存读取
178 积分/ 100 万 Token
缓存写入
-

DeepSeek V4 Flash Vision Exp 模型规格

以下规格对应 HiAPI 当前公开的文本请求契约;未披露的能力不会由页面自行推断。

流式响应
支持
Tool calling
支持
结构化 JSON
支持
推理模式
支持
输入模态
text · image
输出模态
text
推理档位
none · low · medium · high
最大输出
262.1K

关于 DeepSeek V4 Flash Vision Exp

DeepSeek V4 Flash Vision Exp 支持文本与图片输入,面向多模态理解和 Agent 工作流,原生支持 Responses API,并兼容 Chat Completions。

HiAPI 通过 /v1/responses 提供该模型。你可以先在本页 Playground 验证提示词与参数,再使用同一个 HiAPI API Key 接入服务端。

提供商
DeepSeek
接口
/v1/responses
上下文窗口
1.05M
发布日期
2026-08-21

如何使用 DeepSeek V4 Flash Vision Exp

在线调试与 API 接入共享同一个模型 ID,可以用三个步骤从提示词验证过渡到生产调用。

  1. 步骤 1

    在线验证

    在 Playground 中测试 instructions、input 和 reasoning.effort。

  2. 步骤 2

    管理 API Key

    登录后查看已有密钥或按需新建;同一个密钥可切换所有已开放模型。

  3. 步骤 3

    接入服务端

    向 /v1/responses 发送请求,并根据 usage 字段记录成本。

常见问题

这个模型可以生成图片吗?

它接受文本和图片输入,返回文本。适合图片描述、文档与图表理解、视觉问答,以及结合图片进行推理;生成或编辑图片需要选择对应的图像模型。

应该使用哪个模型 ID 和接口?

model 填写 deepseek-v4-flash-vision-exp。推荐 POST /v1/responses,使用 input 传入内容;也可使用 POST /v1/chat/completions,通过 messages 传入内容。两个接口的图片格式不同,请使用对应示例。

图片怎么上传?支持多张图片吗?

Playground 支持上传或粘贴 JPEG、PNG、WebP、GIF,每条消息最多 4 张、每张不超过 10 MB。API 可使用公开 HTTPS 图片 URL 或 base64 data URL:Responses 使用 input_image,Chat Completions 使用 image_url 内容块。上述上传数量和大小是 Playground 限制。

如何选择或关闭推理?

Responses 使用 reasoning.effort,页面提供 none、low、medium、high,默认 high。none 关闭推理;其他档位用于推理任务,实际耗时和 Token 用量取决于问题。Chat Completions 关闭推理时使用 reasoning.enabled=false。

上下文和输出长度是多少?为什么回答会被截断?

本页上下文窗口为 1,048,576 Token,输出预算上限为 262,144 Token;Playground 和默认示例使用 1,024。输出预算包含推理 Token,较复杂的问题可能在生成正文前消耗较多预算。遇到截断时可提高 max_output_tokens,或关闭推理后重试;输入与输出总量仍需满足上下文限制。

图片、推理和缓存 Token 如何计费?

图片 Token 计入输入,推理 Token 计入输出,缓存命中的输入按缓存输入单价结算。输入、输出与缓存单价查看本页实时价格区。Responses 的 usage.input_tokens、usage.output_tokens 和 input_tokens_details.cached_tokens 可用于对照调用日志;缓存命中不等于整次请求免费。

多轮对话需要重新发送历史吗?

本页示例使用 store:false,每轮在 input 中重新传入需要保留的上下文。服务端不会仅凭上一轮返回的文本自动记住整段对话;使用 Chat Completions 时,把所需历史放入 messages。

支持 JSON 输出和函数调用吗?

支持。Responses 可用 text.format.type=json_object 请求 JSON,用 tools 和 tool_choice 声明及选择函数。模型返回函数调用后,由你的应用执行函数,再回传 call_id 匹配的 function_call_output。模型不会代替应用执行本地代码;完整请求见 API 文档示例。

流式响应怎么判断结束?

Responses 用 response.output_text.delta 接收正文增量,在 response.completed 中读取最终 usage;也要处理 response.incomplete 和 response.failed。不要等待 Responses 返回 Chat Completions 的 [DONE] 标记,后者只用于 Chat Completions 流。

现有 HiAPI API Key 可以直接用吗?

可以,前提是 Key 有该模型的调用权限且账户余额充足。OpenAI SDK 的 base_url 使用 https://api.hiapi.ai/v1,并选择 responses.create 或 chat.completions.create。网页 Playground 使用登录态,无需粘贴 API Key。