跳转到内容
中文

Claude Sonnet 4.6 API

POST Base URL: https://api.hiapi.ai /v1/chat/completions

该模型使用兼容 OpenAI 的 Chat Completions 接口。同一个 HiAPI API Key 可调用账户分组内已开放模型;切换到图片、视频或音频模型时,需要改用 /v1/tasks 及对应请求结构。

模型概览

模型名称Claude Sonnet 4.6
提供方Anthropic
类型文本生成 · Chat Completions
流式输出支持
工具调用支持
价格HiAPI 实时 Token 价格

通过 HiAPI 的 OpenAI 兼容 Chat Completions API 调用 Anthropic Claude Sonnet 4.6,适合文本对话、代码辅助和工具工作流。

生产建议

请求契约
  • 使用 POST /v1/chat/completions,并传入 model=claude-sonnet-4-6 与 messages。
  • 设置 stream=true 获取 SSE。本版本支持文本、流式输出和工具调用续轮。
  • 同一个 HiAPI API Key 可调用账户中已开放的模型。媒体模型使用 /v1/tasks 和不同的请求结构。

适用场景

文本对话

通用应用对话与内容工作流。

messages
代码辅助

代码解释、评审与实现辅助。

messagesstream
工具工作流

声明函数,并在下一轮带回工具结果。

toolstool_choice

请求参数

model string 必填

使用此完整公共模型 ID。

示例 claude-sonnet-4-6 可选值: claude-sonnet-4-6
messages array 必填

按顺序传入对话消息。

role enum 必填

消息角色。

可选值: systemuserassistanttool
content string | array | null 可选

普通消息使用文本内容。带有 tool_calls 的 assistant 消息可以省略 content 或设为 null;tool 消息需包含 tool_call_id 和工具结果。

tool_calls array 可选

assistant 工具调用消息返回的调用数组。

id string 必填

需在结果消息中保留的工具调用 ID。

type string 必填
可选值: function
function object 必填
name string 必填
arguments string 必填

JSON 编码的函数参数。

reasoning_details array 可选

续轮时原样保留 assistant 返回的思考元数据,包括带索引的文本、签名分片与隐藏块。不要展示或手工构造签名。

tool_call_id string 可选

tool 结果消息必填;与 assistant tool_calls 中的 id 对应。

stream boolean 可选

设为 true 返回 Server-Sent Events。

默认 false
thinking.type enum 可选

adaptive 开启思考;disabled 关闭思考。

默认 adaptive 可选值: adaptivedisabled
output_config.effort enum 可选

adaptive 思考时的强度。

可选值: lowmediumhighmax
messages[].content string | array 可选

图片输入使用 type=image_url 与 image_url.url 内容块。

system content cache_control object 可选

可选 5m 或 1h system 内容缓存控制;发送请求不保证命中缓存。

tools array 可选

OpenAI 兼容的函数定义。

tool_choice string | object 可选

使用 auto 或兼容的显式选择。

API 接入示例

调用示例

流式响应

设置 stream=true,持续读取 SSE 增量内容直到 [DONE]。

请求体
{
  "model": "claude-sonnet-4-6",
  "messages": [
    {
      "role": "user",
      "content": "请用三段简短文字解释 HTTP 缓存的工作方式。"
    }
  ],
  "stream": true,
  "thinking": {
    "type": "adaptive"
  },
  "output_config": {
    "effort": "high"
  }
}
Adaptive 思考

开启 adaptive 思考并选择强度档位。

请求体
{
  "model": "claude-sonnet-4-6",
  "messages": [
    {
      "role": "user",
      "content": "比较两种方案并说明取舍。"
    }
  ],
  "stream": false,
  "thinking": {
    "type": "adaptive"
  },
  "output_config": {
    "effort": "medium"
  }
}
函数工具

声明函数并执行返回的调用,然后在下一轮请求中带回 assistant 工具调用和 tool 结果。

请求体
{
  "model": "claude-sonnet-4-6",
  "messages": [
    {
      "role": "user",
      "content": "查询任务 demo-123 的状态。"
    }
  ],
  "stream": false,
  "thinking": {
    "type": "adaptive"
  },
  "output_config": {
    "effort": "high"
  },
  "tools": [
    {
      "type": "function",
      "function": {
        "name": "get_task_status",
        "description": "Look up a task by ID.",
        "parameters": {
          "type": "object",
          "properties": {
            "task_id": {
              "type": "string"
            }
          },
          "required": [
            "task_id"
          ],
          "additionalProperties": false
        }
      }
    }
  ],
  "tool_choice": "auto"
}
工具调用续轮

带回 assistant 的 tool_calls 项和匹配的 tool_call_id 结果消息。

请求体
{
  "model": "claude-sonnet-4-6",
  "messages": [
    {
      "role": "user",
      "content": "查询任务 demo-123 的状态。"
    },
    {
      "role": "assistant",
      "content": null,
      "tool_calls": [
        {
          "id": "call_123",
          "type": "function",
          "function": {
            "name": "get_task_status",
            "arguments": "{\"task_id\":\"demo-123\"}"
          }
        }
      ]
    },
    {
      "role": "tool",
      "tool_call_id": "call_123",
      "content": "{\"status\":\"completed\"}"
    }
  ],
  "stream": false
}

响应结构

非流式响应遵循 Chat Completions 结构。从 choices[0].message.content 读取文本;工具调用轮次会返回 tool_calls,供下一轮请求带回。可读思考位于 reasoning_content。续轮时原样保留 reasoning_details,签名是元数据而非展示文本。计费明细以 usage 为准。

{
  "id": "chatcmpl_example",
  "object": "chat.completion",
  "model": "claude-sonnet-4-6",
  "choices": [
    {
      "index": 0,
      "message": {
        "role": "assistant",
        "content": "稀疏注意力只计算部分关键 Token 之间的关联。"
      },
      "finish_reason": "stop"
    }
  ],
  "usage": {
    "prompt_tokens": 24,
    "completion_tokens": 18,
    "total_tokens": 42,
    "prompt_tokens_details": {
      "cached_tokens": 0
    }
  }
}
  1. 从 choices[0].message.content 读取文本。
  2. 流式调用拼接 choices[0].delta.content,并处理 [DONE]。
  3. 从 usage 读取输入和输出 Token 数量。

常见问题

Claude Sonnet 4.6 是什么模型?

这是 Anthropic 的 Claude Sonnet 4.6。本页区分提供方描述的能力与 HiAPI 本次发布已验证的能力。

应该使用哪个端点和模型 ID?

使用 POST /v1/chat/completions,并将 model 设置为 claude-sonnet-4-6。

可以复用同一个 HiAPI API Key 吗?

可以。同一个 HiAPI API Key 可调用已开放的模型。媒体模型使用不同请求结构的 /v1/tasks。

如何控制思考模式和强度?

使用 thinking.type=adaptive 与 output_config.effort 控制思考。当前已验证 low、medium、high、max 四档,默认是 adaptive/high;关闭思考时使用 thinking.type=disabled 并省略 effort。

可以发送图片吗?

当实时模型目录为本模型启用图片输入时,在 messages 中发送内容数组,包含文字块和 image_url.url 图片块。Playground 复用现有图片上传流程。

是否支持流式输出?

支持。设置 stream=true,读取 SSE chunk 中的 choices[0].delta.content,直到 [DONE]。

是否支持工具调用?

支持。传入 OpenAI 兼容的 tools,执行返回的函数,并在下一轮 messages 中带回 assistant 工具调用和 tool 结果。

提示词缓存如何工作?

可以在 system 内容中加入带 5m 或 1h TTL 的 cache_control。适用时 usage 可能出现缓存写入或读取字段;发送控制字段不保证命中。请检查响应 usage 与 HiAPI 日志。

如何计费?

输入和输出 Token 按 HiAPI 模型页与定价页显示的实时费率计费,最终以 usage 和账户用量日志为准。 查看实时价格。

请求失败时应该检查什么?

检查准确的模型 ID、端点、API Key 权限与余额、messages 内容结构,以及当前实时契约是否支持所选 thinking 或缓存字段。API 错误体和 usage/日志明细是首要排查依据。

可以复用 OpenAI SDK 客户端吗?

可以。将 base URL 设置为 https://api.hiapi.ai/v1,使用 HiAPI API Key,并保留 Chat Completions 的 messages 结构。

下一步