Claude Sonnet 4.6 API
https://api.hiapi.ai /v1/chat/completions 该模型使用兼容 OpenAI 的 Chat Completions 接口。同一个 HiAPI API Key 可调用账户分组内已开放模型;切换到图片、视频或音频模型时,需要改用 /v1/tasks 及对应请求结构。
模型概览
| 模型名称 | Claude Sonnet 4.6 |
|---|---|
| 提供方 | Anthropic |
| 类型 | 文本生成 · Chat Completions |
| 流式输出 | 支持 |
| 工具调用 | 支持 |
| 价格 | HiAPI 实时 Token 价格 |
通过 HiAPI 的 OpenAI 兼容 Chat Completions API 调用 Anthropic Claude Sonnet 4.6,适合文本对话、代码辅助和工具工作流。
生产建议
- 使用 POST /v1/chat/completions,并传入 model=claude-sonnet-4-6 与 messages。
- 设置 stream=true 获取 SSE。本版本支持文本、流式输出和工具调用续轮。
- 同一个 HiAPI API Key 可调用账户中已开放的模型。媒体模型使用 /v1/tasks 和不同的请求结构。
适用场景
通用应用对话与内容工作流。
messages代码解释、评审与实现辅助。
messagesstream声明函数,并在下一轮带回工具结果。
toolstool_choice请求参数
model string 必填 使用此完整公共模型 ID。
messages array 必填 按顺序传入对话消息。
role enum 必填 消息角色。
content string | array | null 可选 普通消息使用文本内容。带有 tool_calls 的 assistant 消息可以省略 content 或设为 null;tool 消息需包含 tool_call_id 和工具结果。
tool_calls array 可选 assistant 工具调用消息返回的调用数组。
id string 必填 需在结果消息中保留的工具调用 ID。
type string 必填 function object 必填 name string 必填 arguments string 必填 JSON 编码的函数参数。
reasoning_details array 可选 续轮时原样保留 assistant 返回的思考元数据,包括带索引的文本、签名分片与隐藏块。不要展示或手工构造签名。
tool_call_id string 可选 tool 结果消息必填;与 assistant tool_calls 中的 id 对应。
stream boolean 可选 设为 true 返回 Server-Sent Events。
thinking.type enum 可选 adaptive 开启思考;disabled 关闭思考。
output_config.effort enum 可选 adaptive 思考时的强度。
messages[].content string | array 可选 图片输入使用 type=image_url 与 image_url.url 内容块。
system content cache_control object 可选 可选 5m 或 1h system 内容缓存控制;发送请求不保证命中缓存。
tools array 可选 OpenAI 兼容的函数定义。
tool_choice string | object 可选 使用 auto 或兼容的显式选择。
API 接入示例
调用示例
设置 stream=true,持续读取 SSE 增量内容直到 [DONE]。
{
"model": "claude-sonnet-4-6",
"messages": [
{
"role": "user",
"content": "请用三段简短文字解释 HTTP 缓存的工作方式。"
}
],
"stream": true,
"thinking": {
"type": "adaptive"
},
"output_config": {
"effort": "high"
}
}开启 adaptive 思考并选择强度档位。
{
"model": "claude-sonnet-4-6",
"messages": [
{
"role": "user",
"content": "比较两种方案并说明取舍。"
}
],
"stream": false,
"thinking": {
"type": "adaptive"
},
"output_config": {
"effort": "medium"
}
}声明函数并执行返回的调用,然后在下一轮请求中带回 assistant 工具调用和 tool 结果。
{
"model": "claude-sonnet-4-6",
"messages": [
{
"role": "user",
"content": "查询任务 demo-123 的状态。"
}
],
"stream": false,
"thinking": {
"type": "adaptive"
},
"output_config": {
"effort": "high"
},
"tools": [
{
"type": "function",
"function": {
"name": "get_task_status",
"description": "Look up a task by ID.",
"parameters": {
"type": "object",
"properties": {
"task_id": {
"type": "string"
}
},
"required": [
"task_id"
],
"additionalProperties": false
}
}
}
],
"tool_choice": "auto"
}带回 assistant 的 tool_calls 项和匹配的 tool_call_id 结果消息。
{
"model": "claude-sonnet-4-6",
"messages": [
{
"role": "user",
"content": "查询任务 demo-123 的状态。"
},
{
"role": "assistant",
"content": null,
"tool_calls": [
{
"id": "call_123",
"type": "function",
"function": {
"name": "get_task_status",
"arguments": "{\"task_id\":\"demo-123\"}"
}
}
]
},
{
"role": "tool",
"tool_call_id": "call_123",
"content": "{\"status\":\"completed\"}"
}
],
"stream": false
}响应结构
非流式响应遵循 Chat Completions 结构。从 choices[0].message.content 读取文本;工具调用轮次会返回 tool_calls,供下一轮请求带回。可读思考位于 reasoning_content。续轮时原样保留 reasoning_details,签名是元数据而非展示文本。计费明细以 usage 为准。
{
"id": "chatcmpl_example",
"object": "chat.completion",
"model": "claude-sonnet-4-6",
"choices": [
{
"index": 0,
"message": {
"role": "assistant",
"content": "稀疏注意力只计算部分关键 Token 之间的关联。"
},
"finish_reason": "stop"
}
],
"usage": {
"prompt_tokens": 24,
"completion_tokens": 18,
"total_tokens": 42,
"prompt_tokens_details": {
"cached_tokens": 0
}
}
} - 从 choices[0].message.content 读取文本。
- 流式调用拼接 choices[0].delta.content,并处理 [DONE]。
- 从 usage 读取输入和输出 Token 数量。
常见问题
Claude Sonnet 4.6 是什么模型?
这是 Anthropic 的 Claude Sonnet 4.6。本页区分提供方描述的能力与 HiAPI 本次发布已验证的能力。
应该使用哪个端点和模型 ID?
使用 POST /v1/chat/completions,并将 model 设置为 claude-sonnet-4-6。
可以复用同一个 HiAPI API Key 吗?
可以。同一个 HiAPI API Key 可调用已开放的模型。媒体模型使用不同请求结构的 /v1/tasks。
如何控制思考模式和强度?
使用 thinking.type=adaptive 与 output_config.effort 控制思考。当前已验证 low、medium、high、max 四档,默认是 adaptive/high;关闭思考时使用 thinking.type=disabled 并省略 effort。
可以发送图片吗?
当实时模型目录为本模型启用图片输入时,在 messages 中发送内容数组,包含文字块和 image_url.url 图片块。Playground 复用现有图片上传流程。
是否支持流式输出?
支持。设置 stream=true,读取 SSE chunk 中的 choices[0].delta.content,直到 [DONE]。
是否支持工具调用?
支持。传入 OpenAI 兼容的 tools,执行返回的函数,并在下一轮 messages 中带回 assistant 工具调用和 tool 结果。
提示词缓存如何工作?
可以在 system 内容中加入带 5m 或 1h TTL 的 cache_control。适用时 usage 可能出现缓存写入或读取字段;发送控制字段不保证命中。请检查响应 usage 与 HiAPI 日志。
如何计费?
输入和输出 Token 按 HiAPI 模型页与定价页显示的实时费率计费,最终以 usage 和账户用量日志为准。 查看实时价格。
请求失败时应该检查什么?
检查准确的模型 ID、端点、API Key 权限与余额、messages 内容结构,以及当前实时契约是否支持所选 thinking 或缓存字段。API 错误体和 usage/日志明细是首要排查依据。
可以复用 OpenAI SDK 客户端吗?
可以。将 base URL 设置为 https://api.hiapi.ai/v1,使用 HiAPI API Key,并保留 Chat Completions 的 messages 结构。