Kimi K3 API

Kimi K3 是月之暗面面向長程程式設計與端到端知識工作的旗艦模型, 1M token 上下文, 始終開啟思考模式 (reasoning_content 計入 token 消耗). 支援工具呼叫 / tool_choice / JSON Mode / 結構化輸出 / 聯網搜尋 / Partial Mode.

POST /v1/chat/completions

用 OpenAI 相容協議呼叫 Kimi K3。

请求参数

参数类型必填说明
modelstring要调用的模型名, 填模型广场里的名称。
messagesarray对话消息列表, 每项含 role 与 content。role 可为 system / user / assistant / tool。
streamboolean是否流式返回。true 时以 SSE 逐块推送, 适合需要边生成边展示的场景。
temperaturenumber采样温度, 越大输出越发散、越小越稳定。
max_tokensinteger本次回复最多生成多少 token。不传则由模型自行决定, 不会被截断。
top_pnumber核采样, 只在累计概率前 top_p 的候选里挑。与 temperature 选一个调即可。
toolsarray可供模型调用的工具列表。模型需要时会返回 tool_calls, 由你执行后把结果以 role=tool 回填。
tool_choicestring控制是否/如何选用工具: auto 由模型决定, none 禁用, 也可指定某个具体工具。需与 tools 一起使用。
response_formatobject指定输出格式, 如要求返回 JSON。
stoparray遇到其中任一字符串就停止生成, 该字符串不包含在结果里。
ninteger一次返回几条候选回复。按全部候选的总用量计费。
seedinteger固定随机种子, 相同输入尽量复现相同输出。
frequency_penaltynumber按 token 已出现频次降低其再次出现的概率, 用于抑制重复。
presence_penaltynumber按 token 是否已出现降低其再次出现的概率, 用于鼓励换话题。
logit_biasobject按 token id 调整选中概率, 可用来强推或压制特定词。
parallel_tool_callsboolean是否允许模型一次返回多个工具调用。需与 tools 一起使用。
logprobsboolean是否返回所选 token 的对数概率。
top_logprobsinteger每个位置额外返回多少个候选 token 的概率。需同时开启 logprobs。
max_completion_tokensinteger回复长度上限。部分较新模型用这个字段替代 max_tokens。
reasoning_effortstring推理强度。调高会让模型思考更久、通常更准, 同时消耗更多 token。仅推理类模型有效。 可选: minimal / low / medium / high
verbositystring回复详略程度。 可选: low / medium / high
modalitiesarray期望的输出模态, 如仅文本或文本加音频。仅多模态模型有效。
audioobject音频输出设置, 如音色与音频格式。需在 modalities 中包含音频。
predictionobject预测输出。已知回复大部分内容时提供它可以加快生成。
stream_optionsobject流式相关设置, 如是否在最后一帧附带用量统计。需 stream=true。
storeboolean是否在模型服务侧留存本次对话。
metadataobject自定义键值对, 会随请求一起带上, 便于你自己归类检索。
userstring代表终端用户的标识, 便于你区分自己的用户来源。
prompt_cache_keystring提示词缓存键。相同前缀的请求带同一个键更容易命中缓存, 从而更快更省。
prompt_cache_retentionstring提示词缓存保留时长。

请求示例

curl https://api.router.ai/v1/chat/completions \
  -H "Authorization: Bearer sk-你的令牌" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "kimi-k3",
    "messages": [{"role": "user", "content": "你好"}]
  }'

接口通用说明: 建立對話請求 (OpenAI 相容)

POST /v1/messages

用 Anthropic 原生協議呼叫 Kimi K3。

请求参数

参数类型必填说明
modelstring要调用的模型名, 填模型广场里的名称。
messagesarray对话消息数组, 每项含 role 与 content。role 只能是 user / assistant, 系统提示词走独立的 system 字段而不是放进这里。
max_tokensinteger本次回复最多生成多少 token。这个协议下是必填项。
systemstring系统提示词。可传字符串, 也可传数组以便对不同片段单独设置。
streamboolean是否流式返回。true 时以 SSE 逐块推送。
temperaturenumber采样温度, 越大输出越发散、越小越稳定。
toolsarray可供模型调用的工具列表。模型需要时会返回 tool_use 内容块, 由你执行后以 tool_result 回填。
tool_choiceobject控制是否/如何选用工具: 由模型决定、强制使用、或指定某个具体工具。需与 tools 一起使用。
stop_sequencesarray遇到其中任一字符串就停止生成。
top_pnumber核采样, 只在累计概率前 top_p 的候选里挑。与 temperature 选一个调即可。
top_kinteger只在概率最高的 k 个候选里挑。
thinkingobject扩展思考设置, 让模型在回答前先推理。开启后思考过程会作为独立内容块返回, 并计入输出用量。仅支持该能力的模型有效。
metadataobject自定义元信息, 便于你自己归类检索。

请求示例

curl https://api.router.ai/v1/messages \
  -H "Authorization: Bearer sk-你的令牌" \
  -H "anthropic-version: 2023-06-01" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "kimi-k3",
    "max_tokens": 1024,
    "messages": [{"role": "user", "content": "你好"}]
  }'

接口通用说明: 建立訊息請求 (Claude 原生)