GPT-5.6 Terra
gpt-5.6-terra兼顾能力、延迟和成本的日常开发与 Agent 任务。
正在查看GPT-5.6 Terra 在智能水平、速度与成本之间取得平衡,适合日常编程、文档处理和常规 Agent 工作流。HiAPI 当前通过流式 Responses API 提供文本、多轮与函数工具调用。
提供商: OpenAI
类型: 文本生成
接口: /v1/responses
状态: 已开放
消耗: --
GPT-5.6 Terra 在智能水平、速度与成本之间取得平衡,适合日常编程、文档处理和常规 Agent 工作流。HiAPI 当前通过流式 Responses API 提供文本、多轮与函数工具调用。
API 接入
Endpoint
POST /v1/responses
Base URL
https://api.hiapi.ai
使用 OpenAI Responses 格式并要求流式调用;同一个 HiAPI Key 可切换所有已开放模型。
输入价格
5,000 积分
/ 百万 Token
输出价格
30,000 积分
/ 百万 Token
Context
1.05M
上下文窗口
Max output
128K
最大输出 Token
输入一个问题,页面会以流式方式展示回答,并在完成后显示 Token 用量、耗时和估算费用。
使用 OpenAI Responses 格式流式调用 GPT-5.6 Terra。下面提供 cURL、Python 和 Node.js 三种可直接复制的示例。
/v1/responsescurl -N -X POST "https://api.hiapi.ai/v1/responses" \
-H "Authorization: Bearer YOUR_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "gpt-5.6-terra",
"input": [
{
"type": "message",
"role": "user",
"content": [
{
"type": "input_text",
"text": "把这份需求拆成技术任务、验收标准和风险清单,并给出推荐的实施顺序。"
}
]
}
],
"stream": true,
"store": false,
"reasoning": {
"effort": "medium"
}
}'提示: 请将 YOUR_API_KEY 替换为您在 API 密钥 页面创建的密钥。
使用 OpenAI Responses 格式;请保留 stream: true,input 使用消息数组,并通过 reasoning.effort 设置推理强度。
Responses API
先完成基础字段,再按任务启用高级能力。
组成一次有效请求的必要信息
按任务需要启用推理、上下文与工具
Max output 是模型规格上限,不代表每次请求都会生成到该长度。示例仅展示当前已开放并完成验证的运行参数。
按实际输入、输出及缓存 Token 用量计费,以下价格统一按 100 万 Token 展示。
发送给模型的提示词与上下文
模型生成的回答与推理内容
以下规格对应 HiAPI 当前公开的文本请求契约;未披露的能力不会由页面自行推断。
GPT-5.6 Terra 在智能水平、速度与成本之间取得平衡,适合日常编程、文档处理和常规 Agent 工作流。HiAPI 当前通过流式 Responses API 提供文本、多轮与函数工具调用。
HiAPI 通过 /v1/responses 提供该模型。你可以先在本页 Playground 验证提示词与参数,再使用同一个 HiAPI API Key 接入服务端。
在线调试与 API 接入共享同一个模型 ID,可以用三个步骤从提示词验证过渡到生产调用。
步骤 1
在 Playground 中测试 instructions、input 和 reasoning.effort。
步骤 2
登录后查看已有密钥或按需新建;同一个密钥可切换所有已开放模型。
步骤 3
向 /v1/responses 发送请求,并根据 usage 字段记录成本。
GPT-5.6 Terra 是 GPT-5.6 系列的均衡档,面向需要兼顾能力、延迟和成本的日常开发与 Agent 工作流。 HiAPI 当前通过流式 Responses API 提供文本、多轮对话和函数工具调用,使用统一 HiAPI API Key 即可接入。
Sol 面向质量优先的复杂专业任务,Terra 适合能力、延迟和成本均衡的通用工作负载,Luna 适合成本敏感和高吞吐场景。建议用同一组真实提示词分别测试三档,再结合回答质量、首 Token 延迟、总耗时和实际 Token 成本决定默认模型。
向 POST /v1/responses 发送请求,将 model 设置为 gpt-5.6-terra,使用 input 消息数组、stream=true 和 store=false,并通过 Authorization: Bearer HIAPI_API_KEY 鉴权。该接口使用 Responses 格式,请不要把 messages 或 choices 作为请求、响应字段。
在 reasoning.effort 中可传 none、low、medium、high、xhigh 或 max,省略时默认为 medium。none/low 适合低延迟任务,medium 适合作为通用起点,high/xhigh 适合质量优先任务,max 留给最困难且可接受更高延迟与 Token 消耗的请求。
当前接口要求 stream=true,并返回 Responses API 的类型化 SSE 事件。正文增量读取 response.output_text.delta,完成状态读取 response.completed,错误读取 error;不要沿用 Chat Completions 的 choices[0].delta 解析方式。
本页示例使用 store=false,因此最稳妥的方式是由客户端保存会话状态,并在下一次请求的 input 中回放仍需要的用户、助手和工具结果。只有在所用存储与链式响应策略兼容时才使用 previous_response_id;无论采用哪种方式,上一轮重新进入上下文的 Token 仍会计费。
支持函数工具调用。通过 tools 声明函数,以 tool_choice 控制选择;模型返回 function_call 后,执行本地工具并使用相同 call_id 回传 function_call_output,再继续请求。当前页面仅列出 HiAPI 已完成验证的工具能力,未列出的托管工具不视为已支持。
OpenAI 当前公开规格为 1,050,000 Token 上下文、922,000 最大输入和 128,000 最大输出,上下文预算同时受到输入、输出及推理 Token 影响。页面中的最大输出是模型规格;可用运行参数以本页 API 示例和能力参数为准。
HiAPI 按实际输入、输出和缓存读取 Token 分别计费,推理 Token 计入输出。模型页与价格页展示当前实时售价,单次请求的最终用量和扣费以 Responses API 返回的 usage 及 HiAPI 使用日志为准。
将 SDK base_url 设置为 https://api.hiapi.ai/v1,使用 HiAPI API Key,并调用 client.responses.create;把 messages 改为 input,将 model 改为 gpt-5.6-terra。调用 HiAPI 时需保留 stream=true,并按类型化 SSE 事件消费结果。