跳转至

Responses API

POST /v1/responses 是面向响应对象的文本接口。它使用与 Chat Completions 相同的认证方式和模型目录,但输入字段是 input

最小非流式请求

请求体:

{
  "model": "gpt-5.6-terra",
  "input": "Reply with OK",
  "max_output_tokens": 32,
  "store": false,
  "stream": false
}

=== "cURL"

```bash
curl https://api.yuniversity.cc/v1/responses \
  -H "Authorization: Bearer <YOUR_API_KEY>" \
  -H "Content-Type: application/json" \
  -d '{"model":"gpt-5.6-terra","input":"Reply with OK","max_output_tokens":32,"store":false,"stream":false}'
```

=== "Python(标准库)"

```python
import json
import os
from urllib.request import Request, urlopen

payload = {
    "model": "gpt-5.6-terra",
    "input": "Reply with OK",
    "max_output_tokens": 32,
    "store": False,
    "stream": False,
}
request = Request(
    "https://api.yuniversity.cc/v1/responses",
    data=json.dumps(payload).encode(),
    headers={
        "Authorization": f"Bearer {os.environ['YUNIVERSITY_API_KEY']}",
        "Content-Type": "application/json",
    },
)
with urlopen(request) as response:
    print(json.load(response))
```

=== "JavaScript"

```javascript
const response = await fetch("https://api.yuniversity.cc/v1/responses", {
  method: "POST",
  headers: {
    "Authorization": `Bearer ${process.env.YUNIVERSITY_API_KEY}`,
    "Content-Type": "application/json",
  },
  body: JSON.stringify({
    model: "gpt-5.6-terra",
    input: "Reply with OK",
    max_output_tokens: 32,
    store: false,
    stream: false,
  }),
});
console.log(await response.json());
```

响应对象的具体字段取决于模型和协议;不要假设所有模型都产生相同的 output item。解析时优先按响应中的 output 与其内容项处理。

请求参数

参数 类型 说明
model string /v1/models 返回的模型标识。
input string 或 array 输入文本;最小用法是一个字符串。
max_output_tokens integer 生成输出上限。
store boolean 是否请求保存响应;默认行为和可用性可能受路由/上游设置影响。
stream boolean false 或省略时返回一个 JSON;设为 true 时返回 SSE。

流式请求

{
  "model": "gpt-5.6-terra",
  "input": "Explain SSE in one sentence",
  "max_output_tokens": 64,
  "store": false,
  "stream": true
}

流式事件的读取、分帧和结束标记见流式响应。不要把事件流当作单个 JSON 文档。

兼容性边界

模型专用工具和其他高级 OpenAI 字段,仅在所选路由明确接受时才可使用。不同模型/上游的参数能力可能不同;不确定时从最小请求开始,并根据实际错误调整。本文不承诺未在本页列出的 OpenAI 特性。