Kimi K3
Kimi K3 是 Kimi 迄今能力最强的旗舰模型。它拥有 2.8 万亿参数,基于 Kimi Delta Attention(KDA)混合线性注意力架构和 Attention Residuals 技术构建,原生支持视觉理解,并提供 100 万 tokens 的上下文窗口。 作为全球首个接近 3 万亿参数规模的开源模型,Kimi K3 专为前沿 AI 应用而设计,包括长周期编程、知识工作和推理任务。
Kimi K3
Kimi K3 是 Kimi 迄今能力最强的旗舰模型。它拥有 2.8 万亿参数,基于 Kimi Delta Attention(KDA)混合线性注意力架构和 Attention Residuals 技术构建,原生支持视觉理解,并提供 100 万 tokens 的上下文窗口。
作为全球首个接近 3 万亿参数规模的开源模型,Kimi K3 专为前沿 AI 应用而设计,包括长周期编程、知识工作和推理任务。
Base URL
https://api.icreat.ai/llm/openai/v1认证
所有 API 请求需要通过 API Key 进行认证。您可以在控制台获取 API Key。
export ICREAT_API_KEY="your-api-key-here"HTTP 请求头
import os
API_KEY = os.environ.get("ICREAT_API_KEY")
headers = {
"Content-Type": "application/json",
"Authorization": "Bearer " + API_KEY,
}保护好您的 API Key
切勿在客户端代码或公开仓库中暴露您的 API Key。请使用环境变量或后端代理。
代码示例
本模型通过 OpenAI 兼容的 Chat Completions 接口调用,支持流式与非流式两种模式。请求体中将 stream 设为 false(默认)时,服务端一次性返回完整 JSON 响应;设为 true 时,以 Server-Sent Events(SSE)逐块推送增量内容,适合实时展示生成过程。
输入参数
以下参数在请求体中被接受。
总计: 6 必填: 2 可选: 4
用于补全的模型 ID。须填写 iCreat 的 model_code(本篇模型为 kimi-k3,非厂商原始模型名)。
Example: "kimi-k3"
构成对话的消息列表。
生成的最大 token 数。
采样温度,0–2。
若为 true,则以 Server-Sent Events 流式返回。
扩展思考模式配置(若模型支持)。
输出参数
API 返回兼容 OpenAI Chat Completions 的响应格式。
总计: 6
补全的唯一标识符。
对象类型,固定为 chat.completion。
补全创建时的 Unix 时间戳。
用于补全的模型 ID。
补全选项列表。
Token 使用统计。
LLM友好的提示词
以下是一段 LLM 友好的 Markdown 提示词,可复制到 Cursor、ChatGPT 等 AI 助手中,帮助 AI 理解本模型的 API 接入方式、调用流程与关键参数。点击「复制LLM提示词」按钮或下方代码块均可复制全文。
# kimi-k3
> Kimi K3 是 Kimi 迄今能力最强的旗舰模型。
## 概述
通过 iCreat OpenAI 兼容 Chat Completions API 进行对话补全,支持流式与非流式、扩展思考模式。
## API 信息
- **Base URL**:`https://api.icreat.ai/llm/openai/v1`
- **Endpoint (POST)**:`/chat/completions`
- **Model ID**:`kimi-k3`
- **认证**:`Authorization: Bearer ${ICREAT_API_KEY}`
## 调用流程
单次 POST;`stream: false` 返回完整 JSON,`stream: true` 以 SSE 流式返回。
### 输入要点
- `model`(必填):iCreat model_code `kimi-k3`
- `messages`(必填):对话消息列表
- 常见可选:`max_tokens`(最大输出 token)、`temperature`(采样温度)、`stream`(流式开关)、`thinking`(扩展思考模式)
### 输出要点
- 从 `choices[0].message.content` 读取回复
## 注意事项
- `model` 必须使用 iCreat model_code
- 其余字段与 OpenAI Chat Completions 协议一致