基础文本响应
POST v1/responses请求参数
Authorization
在 Header 添加参数 Authorization,其值为在 Bearer 之后拼接 Token。
Authorization: Bearer ******************Body 参数
Content-Type: application/json
| 参数名 | 类型 | 必填 | 说明 |
|---|---|---|---|
| model | string | 必需 | 要使用的模型 ID。 |
| input | array [object] | 必需 | 输入消息列表。包含 role (可选), content (可选) 等字段。 |
| include | array[string] | 可选 | 指定要在模型响应中包含的附加输出数据。 |
| instructions | string | 可选 | 作为系统消息插入到模型上下文的最前面。注意:当使用 previous_response_id 时,之前的指令不会自动带入,方便切换指令。 |
| max_output_tokens | integer | 可选 | 响应生成的最大 token 数(包含可见输出和推理 token)。 |
| metadata | object | 可选 | 最多包含 16 个键值对的元数据对象,用于存储额外信息。键最长 64 字符,值最长 512 字符。 |
| parallel_tool_calls | boolean | 可选 | 是否在工具调用期间启用并行执行。 |
| previous_response_id | string | 可选 | 前一次响应的唯一 ID,用于创建多轮对话。 |
| reasoning | object | 可选 | 仅适用于 o 系列模型。配置模型的推理行为。 |
| service_tier | string | 可选 | 指定处理请求的延迟层级(如 auto, default, flex)。未设置时默认为 auto。 |
| store | boolean | 可选 | 是否将此请求的输出存储用于模型蒸馏或评估。 |
| stream | boolean | 可选 | 如果为 true,将通过服务器发送事件流式返回响应。 |
| temperature | number | 可选 | 采样温度 (0-2)。值越高输出越随机,值越低越确定。建议只调整此参数或 top_p 其中之一。 |
| text | object | 可选 | 文本响应的配置。可配置 { "type": "json_schema" } 以启用结构化输出。 |
| tool_choice | array[string] | 可选 | 模型可调用的工具列表(目前仅支持函数)。最多支持 128 个函数。 |
| top_p | number | 可选 | 核采样参数 (0-1)。例如 0.1 意味着只考虑概率质量前 10% 的 token。 |
| truncation | string | 可选 | 用于模型响应的截断策略。 |
| user | string | 可选 | 最终用户的唯一标识符,有助于 OpenAI 监控和检测滥用行为。 |
请求示例 (JSON)
{
"model": "gpt-4.1",
"input": [
{
"role": "user",
"content": "Hello!"
}
]
}返回响应
200 成功
Content-Type: application/json
响应参数
| 参数 | 类型 | 必填 | 说明 |
|---|---|---|---|
| id | string | 必需 | 聊天补全对象的唯一标识符。 |
| object | string | 必需 | 对象类型,通常为 "chat.completion"。 |
| created | integer | 必需 | 补全创建时的 Unix 时间戳(秒)。 |
| choices | array [object] | 必需 | 模型生成的补全列表。 |
| └─index | integer | 可选 | 此补全在其列表中的索引。 |
| └─message | object | 可选 | 包含模型生成的响应消息的对象。 |
| └─finish_reason | string | 可选 | 模型停止生成补全的原因。可能是 "stop"、"length" 或 "tool_calls"。 |
| usage | object | 必需 | 此补全请求使用的令牌统计信息。 |
| └─prompt_tokens | integer | 必需 | 提示中使用的令牌数量。 |
| └─completion_tokens | integer | 必需 | 补全中生成的令牌数量。 |
| └─total_tokens | integer | 必需 | 使用的总令牌数(提示 + 补全)。 |
响应示例
{
"id": "string",
"object": "string",
"created": 0,
"choices": [
{
"index": 0,
"message": {
"role": "string",
"content": "string"
},
"finish_reason": "string"
}
],
"usage": {
"prompt_tokens": 0,
"completion_tokens": 0,
"total_tokens": 0
}
}示例代码
python
import http.client
import json
conn = http.client.HTTPSConnection("nxaiapp.com")
payload = json.dumps({
"model": "gpt-4.1",
"input": [
{
"role": "user",
"content": "Hello!"
}
]
})
headers = {
'Authorization': 'Bearer <token>',
'Content-Type': 'application/json'
}
conn.request("POST", "/v1//responses", payload, headers)
res = conn.getresponse()
data = res.read()
print(data.decode("utf-8"))