Grok 4.6 是 xAI 文本推理模型,通过 Chat Completions 提供流式响应、JSON 对象、工具调用与四档推理强度。
提供商: Grok
类型: 文本生成
接口: /v1/chat/completions
状态: 已开放
消耗: --
Grok 4.6 是 xAI 文本推理模型,通过 Chat Completions 提供流式响应、JSON 对象、工具调用与四档推理强度。
API 接入
Endpoint
POST /v1/chat/completions
Base URL
https://api.hiapi.ai
兼容 OpenAI Chat Completions;同一个 HiAPI Key 可切换所有已开放模型。
输入价格
1,680 积分
/ 百万 Token · 总输入 ≤ 200,000 Token
输出价格
5,040 积分
/ 百万 Token · 总输入 ≤ 200,000 Token
Context
-
上下文窗口
Max output
-
最大输出 Token
输入一个问题,页面会以流式方式展示回答,并在完成后显示 Token 用量、耗时和估算费用。
使用 OpenAI Chat Completions 兼容格式调用 Grok 4.6。下面提供 cURL、Python 和 Node.js 三种可直接复制的示例。
/v1/chat/completionscurl -X POST "https://api.hiapi.ai/v1/chat/completions" \
-H "Authorization: Bearer YOUR_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "grok-4.6",
"messages": [
{
"role": "user",
"content": "A cat walking on the beach at sunset"
}
],
"stream": false,
"reasoning_effort": "high"
}'提示: 请将 YOUR_API_KEY 替换为您在 API 密钥 页面创建的密钥。
兼容 OpenAI Chat Completions 格式,只需替换 base URL、API Key 和模型名即可接入。
按 usage 中实际产生的输入、输出及缓存 Token 计费,以下价格统一按 100 万 Token 展示。
总输入 ≤ 200,000 Token
发送给模型的提示词与上下文
模型生成的回答与推理内容
档位按单次请求的总输入 Token(含缓存读取与写入)确定。超过阈值后,整次请求的输入、输出及缓存均使用该档价格,不只对超出部分加价。
| 计费项目 | 总输入 ≤ 200,000 Token | 总输入 > 200,000 Token |
|---|---|---|
| 输入 | 1,680 积分 | 3,360 积分 |
| 输出 | 5,040 积分 | 10,080 积分 |
| 缓存读取 | 420 积分 | 840 积分 |
以上价格均按 100 万 Token 计算。
以下规格对应 HiAPI 当前公开的文本请求契约;未披露的能力不会由页面自行推断。
Grok 4.6 是 xAI 文本推理模型,通过 Chat Completions 提供流式响应、JSON 对象、工具调用与四档推理强度。
HiAPI 通过 /v1/chat/completions 提供该模型。你可以先在本页 Playground 验证提示词与参数,再使用同一个 HiAPI API Key 接入服务端。
在线调试与 API 接入共享同一个模型 ID,可以用三个步骤从提示词验证过渡到生产调用。
步骤 1
在 Playground 中测试 系统提示词、输出长度和模型支持的推理选项。
步骤 2
登录后查看已有密钥或按需新建;同一个密钥可切换所有已开放模型。
步骤 3
向 /v1/chat/completions 发送请求,并根据 usage 字段记录成本。
Grok 4.6 是 xAI 的文本模型,HiAPI 通过 Chat Completions 提供文本输入和文本输出。
使用 POST /v1/chat/completions,并将 model 设置为 grok-4.6。
使用 reasoning_effort=low、medium、high 或 xhigh,默认 high,推理 Token 计入输出 Token。
支持。使用 stream=true、response_format.type=json_object 和 tools/tool_choice。工具续轮需带回 assistant 工具调用和匹配的工具结果。
它们不属于首期 HiAPI 公共契约,请使用 Chat Completions 的文本 messages。
输入、输出和缓存输入按模型页与定价页实时费率计费;推理计入输出。长上下文完成验收前,首期不承诺超过 200K 的使用范围。