Qwen3.7 系列规模最大的旗舰模型, 面向智能体场景, 在编程 / 长周期任务 / 推理上有强势表现. 1M context.
qwen3.7-max用 OpenAI 兼容协议调用 Qwen3.7-Max。
| 参数 | 类型 | 必填 | 说明 |
|---|---|---|---|
model | string | 是 | 要调用的模型名, 填模型广场里的名称。 |
messages | array | 是 | 对话消息列表, 每项含 role 与 content。role 可为 system / user / assistant / tool。 |
stream | boolean | 否 | 是否流式返回。true 时以 SSE 逐块推送, 适合需要边生成边展示的场景。 |
temperature | number | 否 | 采样温度, 越大输出越发散、越小越稳定。 |
max_tokens | integer | 否 | 本次回复最多生成多少 token。不传则由模型自行决定, 不会被截断。 |
top_p | number | 否 | 核采样, 只在累计概率前 top_p 的候选里挑。与 temperature 选一个调即可。 |
tools | array | 否 | 可供模型调用的工具列表。模型需要时会返回 tool_calls, 由你执行后把结果以 role=tool 回填。 |
tool_choice | string | 否 | 控制是否/如何选用工具: auto 由模型决定, none 禁用, 也可指定某个具体工具。需与 tools 一起使用。 |
response_format | object | 否 | 指定输出格式, 如要求返回 JSON。 |
stop | array | 否 | 遇到其中任一字符串就停止生成, 该字符串不包含在结果里。 |
n | integer | 否 | 一次返回几条候选回复。按全部候选的总用量计费。 |
seed | integer | 否 | 固定随机种子, 相同输入尽量复现相同输出。 |
frequency_penalty | number | 否 | 按 token 已出现频次降低其再次出现的概率, 用于抑制重复。 |
presence_penalty | number | 否 | 按 token 是否已出现降低其再次出现的概率, 用于鼓励换话题。 |
logit_bias | object | 否 | 按 token id 调整选中概率, 可用来强推或压制特定词。 |
parallel_tool_calls | boolean | 否 | 是否允许模型一次返回多个工具调用。需与 tools 一起使用。 |
logprobs | boolean | 否 | 是否返回所选 token 的对数概率。 |
top_logprobs | integer | 否 | 每个位置额外返回多少个候选 token 的概率。需同时开启 logprobs。 |
max_completion_tokens | integer | 否 | 回复长度上限。部分较新模型用这个字段替代 max_tokens。 |
reasoning_effort | string | 否 | 推理强度。调高会让模型思考更久、通常更准, 同时消耗更多 token。仅推理类模型有效。 可选: minimal / low / medium / high |
verbosity | string | 否 | 回复详略程度。 可选: low / medium / high |
modalities | array | 否 | 期望的输出模态, 如仅文本或文本加音频。仅多模态模型有效。 |
audio | object | 否 | 音频输出设置, 如音色与音频格式。需在 modalities 中包含音频。 |
prediction | object | 否 | 预测输出。已知回复大部分内容时提供它可以加快生成。 |
stream_options | object | 否 | 流式相关设置, 如是否在最后一帧附带用量统计。需 stream=true。 |
store | boolean | 否 | 是否在模型服务侧留存本次对话。 |
metadata | object | 否 | 自定义键值对, 会随请求一起带上, 便于你自己归类检索。 |
user | string | 否 | 代表终端用户的标识, 便于你区分自己的用户来源。 |
prompt_cache_key | string | 否 | 提示词缓存键。相同前缀的请求带同一个键更容易命中缓存, 从而更快更省。 |
prompt_cache_retention | string | 否 | 提示词缓存保留时长。 |
curl https://api.router.ai/v1/chat/completions \
-H "Authorization: Bearer sk-你的令牌" \
-H "Content-Type: application/json" \
-d '{
"model": "qwen3.7-max",
"messages": [{"role": "user", "content": "你好"}]
}'用 Anthropic 原生协议调用 Qwen3.7-Max。
| 参数 | 类型 | 必填 | 说明 |
|---|---|---|---|
model | string | 是 | 要调用的模型名, 填模型广场里的名称。 |
messages | array | 是 | 对话消息数组, 每项含 role 与 content。role 只能是 user / assistant, 系统提示词走独立的 system 字段而不是放进这里。 |
max_tokens | integer | 是 | 本次回复最多生成多少 token。这个协议下是必填项。 |
system | string | 否 | 系统提示词。可传字符串, 也可传数组以便对不同片段单独设置。 |
stream | boolean | 否 | 是否流式返回。true 时以 SSE 逐块推送。 |
temperature | number | 否 | 采样温度, 越大输出越发散、越小越稳定。 |
tools | array | 否 | 可供模型调用的工具列表。模型需要时会返回 tool_use 内容块, 由你执行后以 tool_result 回填。 |
tool_choice | object | 否 | 控制是否/如何选用工具: 由模型决定、强制使用、或指定某个具体工具。需与 tools 一起使用。 |
stop_sequences | array | 否 | 遇到其中任一字符串就停止生成。 |
top_p | number | 否 | 核采样, 只在累计概率前 top_p 的候选里挑。与 temperature 选一个调即可。 |
top_k | integer | 否 | 只在概率最高的 k 个候选里挑。 |
thinking | object | 否 | 扩展思考设置, 让模型在回答前先推理。开启后思考过程会作为独立内容块返回, 并计入输出用量。仅支持该能力的模型有效。 |
metadata | object | 否 | 自定义元信息, 便于你自己归类检索。 |
curl https://api.router.ai/v1/messages \
-H "Authorization: Bearer sk-你的令牌" \
-H "anthropic-version: 2023-06-01" \
-H "Content-Type: application/json" \
-d '{
"model": "qwen3.7-max",
"max_tokens": 1024,
"messages": [{"role": "user", "content": "你好"}]
}'