HiAPI
概览模型广场API 密钥用量统计调用日志充值账单推荐奖励在线试用产物存储更新公告联系我们账号设置
金额单位
N
Powered by hiapi
账号设置

欢迎

联系我们

DeepSeek V4 Flash 是面向高吞吐文本生成、推理、编程与 Agent 工作流的开源大语言模型,支持 100 万 Token 上下文、思考与非思考模式、JSON 输出和工具调用。

提供商: DeepSeek

类型: 文本生成

接口: /v1/chat/completions

状态: 已开放

消耗: --

返回模型市场
DeepSeekText API在线

DeepSeek V4 Flash

DeepSeek V4 Flash 是面向高吞吐文本生成、推理、编程与 Agent 工作流的开源大语言模型,支持 100 万 Token 上下文、思考与非思考模式、JSON 输出和工具调用。

API 接入

Endpoint

POST /v1/chat/completions

Base URL

https://api.hiapi.ai

兼容 OpenAI Chat Completions;同一个 HiAPI Key 可切换所有已开放模型。

输入价格

280 积分

/ 百万 Token

输出价格

560 积分

/ 百万 Token

Context

1M

上下文窗口

Max output

-

最大输出 Token

在线调试API 接入定价能力参数模型介绍

运行参数

正在检查免费活动资格…

开始测试 DeepSeek V4 Flash

输入一个问题,页面会以流式方式展示回答,并在完成后显示 Token 用量、耗时和估算费用。

DeepSeek V4 Flash API 快速开始

使用 OpenAI Chat Completions 兼容格式调用 DeepSeek V4 Flash。下面提供 cURL、Python 和 Node.js 三种可直接复制的示例。

代码示例
API 端点:/v1/chat/completions
curl -X POST "https://api.hiapi.ai/v1/chat/completions" \
  -H "Authorization: Bearer YOUR_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
  "model": "deepseek-v4-flash",
  "stream": false,
  "messages": [
    {
      "role": "user",
      "content": "请用三句话解释量子计算,并给出一个生活化的类比。"
    }
  ],
  "thinking": {
    "type": "enabled"
  },
  "reasoning_effort": "high"
}'

提示: 请将 YOUR_API_KEY 替换为您在 API 密钥 页面创建的密钥。

兼容 OpenAI Chat Completions 格式,只需替换 base URL、API Key 和模型名即可接入。

示例默认开启思考模式并使用 reasoning_effort=high;最大思考强度改为 max。关闭思考时将 thinking.type 设为 disabled,并省略 reasoning_effort。

DeepSeek V4 Flash 完整 API 文档管理 API Key同一个 HiAPI Key 可切换所有已开放模型。

DeepSeek V4 Flash API 定价

按 usage 中实际产生的输入、输出及缓存 Token 计费,以下价格统一按 100 万 Token 展示。

输入 Token
280 积分/ 100 万 Token

发送给模型的提示词与上下文

输出 Token
560 积分/ 100 万 Token

模型生成的回答与推理内容

缓存读取
70 积分/ 100 万 Token

DeepSeek V4 Flash 模型规格

以下规格对应 HiAPI 当前公开的文本请求契约;未披露的能力不会由页面自行推断。

流式响应
支持
Tool calling
支持
结构化 JSON
支持
推理模式
支持
输入模态
text
输出模态
text
推理档位
high · max(最大档请使用 max)
最大输出
-

关于 DeepSeek V4 Flash

DeepSeek V4 Flash 是面向高吞吐文本生成、推理、编程与 Agent 工作流的开源大语言模型,支持 100 万 Token 上下文、思考与非思考模式、JSON 输出和工具调用。

HiAPI 通过 /v1/chat/completions 提供该模型。你可以先在本页 Playground 验证提示词与参数,再使用同一个 HiAPI API Key 接入服务端。

提供商
DeepSeek
接口
/v1/chat/completions
上下文窗口
1M
发布日期
2026-04-24

如何使用 DeepSeek V4 Flash

在线调试与 API 接入共享同一个模型 ID,可以用三个步骤从提示词验证过渡到生产调用。

  1. 步骤 1

    在线验证

    在 Playground 中测试 系统提示词、输出长度和模型支持的推理选项。

  2. 步骤 2

    管理 API Key

    登录后查看已有密钥或按需新建;同一个密钥可切换所有已开放模型。

  3. 步骤 3

    接入服务端

    向 /v1/chat/completions 发送请求,并根据 usage 字段记录成本。

DeepSeek V4 Family

相关模型

对比 DeepSeek V4 Pro 与 Flash 的接口、能力和价格,再按任务复杂度与吞吐需求选择。

复杂任务

DeepSeek V4 Pro

deepseek-v4-pro

面向复杂推理、代码生成与 Agent 工作流,原生支持 Responses API。

查看模型→
高吞吐当前模型

DeepSeek V4 Flash

deepseek-v4-flash

面向高吞吐文本、推理与编程,支持 Chat Completions、工具调用和 JSON 输出。

正在查看
需要比较不同模型和计费档位?查看全部模型实时价格

常见问题

什么是 DeepSeek V4 Flash?

DeepSeek V4 Flash 是 DeepSeek V4 系列中面向速度与成本效率的开源权重 MoE 文本模型。DeepSeek 官方资料显示,它拥有 2840 亿总参数、每个 Token 激活 130 亿参数,支持 100 万 Token 上下文;官方将其定位为参数规模更小、响应更快的 V4 版本,并提供非思考、Think High 和 Think Max 三种模式。

如何调整 DeepSeek V4 Flash 的思考模式和推理强度?

模型默认开启思考模式。在本页 Playground 中可关闭思考模式,或在开启时选择 High(标准思考)和 Max(最大思考强度)。API 请求使用 thinking.type=enabled/disabled 与 reasoning_effort=high/max;最大档必须明确传 max,xhigh 在 DeepSeek V4 Flash 上实际按 high 执行。

DeepSeek V4 Flash API 使用哪个端点和模型 ID?

向 POST /v1/chat/completions 发送请求,将 model 设置为 deepseek-v4-flash,并使用 HiAPI API Key 鉴权。文本模型使用 Chat Completions;图片、视频和音频模型仍使用 /v1/tasks。

DeepSeek V4 Flash API 如何计费?

HiAPI 按实际输入、输出和缓存读取 Token 分别计费;思考模式返回的推理内容属于模型输出。模型页和价格页展示当前实时售价,最终扣费与响应 usage 及使用日志一致。

如何迁移现有的 OpenAI SDK 客户端?

保留 Chat Completions 的 messages 请求结构,将 base_url 改为 https://api.hiapi.ai/v1,使用 HiAPI API Key,并将 model 改为 deepseek-v4-flash。思考模式需要额外传入 thinking 和 reasoning_effort。