API 参考
聊天补全(Chat completions)
POST /v1/chat/completions
公共端点在 https://api.corion.ai/v1/chat/completions 接受兼容 OpenAI 的聊天补全请求。请使用控制台(dashboard)中显示的 API 基础 URL。
身份验证
将完整的虚拟密钥作为 bearer token 发送:
Authorization: Bearer your-key
Content-Type: application/json
请求
{
"model": "kimi-k3",
"messages": [
{ "role": "system", "content": "Answer concisely." },
{ "role": "user", "content": "What is continuous batching?" }
],
"temperature": 0.7,
"max_tokens": 512,
"stream": false
}
| 字段 | 类型 | 必填 | 说明 |
|---|---|---|---|
model | string | 是 | 公共模型标识符:kimi-k3、deepseek-v4-pro-0813 或 deepseek-v4-flash-0731。可用性取决于已部署的提供商。 |
messages | array | 是 | 按顺序排列的聊天消息,每条消息包含受支持的角色(role)和字符串内容。 |
temperature | number | 否 | 采样控制。上游的支持情况和取值范围可能有所不同。 |
max_tokens | integer | 否 | 最大生成 token 数,受模型和账户限制约束。 |
stream | boolean | 否 | 设为 true 以获取 server-sent event 形式的增量数据块。 |
未知的可选 OpenAI 字段可能会被网关丢弃。在响应或已发布的兼容性矩阵中体现某项支持之前,请勿假定某个字段已被支持。
非流式响应
{
"id": "chatcmpl_example",
"object": "chat.completion",
"created": 0,
"model": "kimi-k3",
"choices": [
{
"index": 0,
"message": { "role": "assistant", "content": "..." },
"finish_reason": "stop"
}
],
"usage": {
"prompt_tokens": 18,
"completion_tokens": 42,
"total_tokens": 60
}
}
响应字段兼容 OpenAI,但提供商特有的元数据可能不同。请将未知字段视为可新增字段(additive)。
流式输出
当 "stream": true 时,响应的 content type 为 text/event-stream。每个事件以 data: 开头,并包含一个 JSON 数据块。流以 data: [DONE] 结束。
消费者应能容忍注释/心跳行、增量 UTF-8 内容,以及在 [DONE] 之前关闭的连接。除非可以接受重复输出,否则请勿自动重试未完成的流。
限制
在 MVP 预览期间,限制为临时性设置,不构成 SLA。应用层辅助代码默认为每个标识符每 10 秒 10 次 BFF 请求;计划中的公共密钥基线为每分钟 100 次请求。在配置共享限流存储之前,网关侧的分布式执行可能与此有所不同。429 响应及其 Retry-After 响应头为准。
BFF 的 JSON 请求体目标上限为 100 KiB,聊天补全除外,后者最多允许 1 MiB。公共网关可能会施加相同或更低的上游限制。
分页
聊天补全响应不分页。控制台集合端点属于应用内部 API,不属于公共 v1 兼容性契约的一部分。
请参阅 错误,了解通用错误封装格式和重试指导。
