Corion

API 参考

聊天补全(Chat completions)

POST /v1/chat/completions

公共端点在 https://api.corion.ai/v1/chat/completions 接受兼容 OpenAI 的聊天补全请求。请使用控制台(dashboard)中显示的 API 基础 URL。

身份验证

将完整的虚拟密钥作为 bearer token 发送:

Authorization: Bearer your-key
Content-Type: application/json

请求

{
  "model": "kimi-k3",
  "messages": [
    { "role": "system", "content": "Answer concisely." },
    { "role": "user", "content": "What is continuous batching?" }
  ],
  "temperature": 0.7,
  "max_tokens": 512,
  "stream": false
}
字段类型必填说明
modelstring公共模型标识符:kimi-k3deepseek-v4-pro-0813deepseek-v4-flash-0731。可用性取决于已部署的提供商。
messagesarray按顺序排列的聊天消息,每条消息包含受支持的角色(role)和字符串内容。
temperaturenumber采样控制。上游的支持情况和取值范围可能有所不同。
max_tokensinteger最大生成 token 数,受模型和账户限制约束。
streamboolean设为 true 以获取 server-sent event 形式的增量数据块。

未知的可选 OpenAI 字段可能会被网关丢弃。在响应或已发布的兼容性矩阵中体现某项支持之前,请勿假定某个字段已被支持。

非流式响应

{
  "id": "chatcmpl_example",
  "object": "chat.completion",
  "created": 0,
  "model": "kimi-k3",
  "choices": [
    {
      "index": 0,
      "message": { "role": "assistant", "content": "..." },
      "finish_reason": "stop"
    }
  ],
  "usage": {
    "prompt_tokens": 18,
    "completion_tokens": 42,
    "total_tokens": 60
  }
}

响应字段兼容 OpenAI,但提供商特有的元数据可能不同。请将未知字段视为可新增字段(additive)。

流式输出

"stream": true 时,响应的 content type 为 text/event-stream。每个事件以 data: 开头,并包含一个 JSON 数据块。流以 data: [DONE] 结束。

消费者应能容忍注释/心跳行、增量 UTF-8 内容,以及在 [DONE] 之前关闭的连接。除非可以接受重复输出,否则请勿自动重试未完成的流。

限制

在 MVP 预览期间,限制为临时性设置,不构成 SLA。应用层辅助代码默认为每个标识符每 10 秒 10 次 BFF 请求;计划中的公共密钥基线为每分钟 100 次请求。在配置共享限流存储之前,网关侧的分布式执行可能与此有所不同。429 响应及其 Retry-After 响应头为准。

BFF 的 JSON 请求体目标上限为 100 KiB,聊天补全除外,后者最多允许 1 MiB。公共网关可能会施加相同或更低的上游限制。

分页

聊天补全响应不分页。控制台集合端点属于应用内部 API,不属于公共 v1 兼容性契约的一部分。

请参阅 错误,了解通用错误封装格式和重试指导。