GPT 5.5 经济版


GPT-5.5 是 OpenAI 于 2026 年 4 月 23 日发布的前沿模型。它拥有超过 100 万 tokens 的上下文窗口,其中包括 922,000 个输入 tokens 和 128,000 个输出 tokens,并支持文本和图像输入。该模型在 SWE-bench Verified 上取得 88.7% 的成绩,在 MMLU 上取得 92.4% 的成绩;与 GPT-5.4 相比,其幻觉减少了 60%。它擅长智能体编程、计算机操作和深度研究,同时保持与 GPT-5.4 相当的单 token 延迟。

gpt-5.5

GPT-5.5 提供与 OpenAI /chat/completions 兼容的 HTTP API,支持文本与图像输入、思考模式(thinking)及流式输出。可使用任意兼容 OpenAI SDK 的客户端,将 base_url 指向 iCreat 网关即可调用。

1. 认证

API 使用 API Key 进行认证。在请求头中携带 Authorization: Bearer ${ICREAT_API_KEY}

https://icreat.ai/hub/keys 获取你的 API Key。

2. 对话补全

POST /v1/chat/completions · https://api.icreat.ai/llm/openai/v1/chat/completions

Body Parameters

messages

messages array — 必填。对话消息列表,每项包含:

  • role "system" | "user" | "assistant" — 消息角色。
  • content string — 消息内容,支持文本;也可传入多模态内容(文本与图像)。

核心字段

  • model string — 必填。模型 ID,固定为 gpt-5.5
  • stream boolean — 是否流式返回。默认 false;设为 true 时以 SSE 分块输出,详见下方 流式输出
  • thinking object — 思考模式配置。示例:{"type": "enabled"} 启用扩展推理。
  • reasoning_effort string — 推理强度。示例值:lowmediumhigh

Returns

返回 OpenAI 兼容的 ChatCompletion 对象,包含 choices[].message.contentusage 用量统计。

3. 流式输出

stream 设为 true 可请求 SSE 流式响应,适合实时展示生成内容。

流式事件说明

  • chat.completion.chunk — 增量 token 片段,读取 choices[0].delta.content
  • finish_reason: stop — 生成正常结束。
  • [DONE] — 流结束标记。

使用 OpenAI SDK 时,将 stream=True 并迭代返回对象即可,无需手动解析 SSE。