Qwen3.7-Flash

通义千问 3.7 Flash 原生视觉语言模型: 多模态理解与 Agent 执行能力全面升级, 万物识别/空间智能增强, 多模态 Coding 优化, 1M 上下文 + 推理

模型 ID: qwen3.7-flash · 类型: chat · 厂商: Alibaba

可用端点: /v1/chat/completions · /v1/messages

定价

输入 (每 1M tokens)$0.021 USD
输出 (每 1M tokens)$0.091 USD
缓存命中 (每 1M tokens)$0.0021 USD
缓存创建 5m (每 1M tokens)$0.0266 USD

上下文分档定价

≤ 32000 tokens$0.021 / 1M in$0.091 / 1M out
≤ 256000 tokens$0.07 / 1M in$0.28 / 1M out
> 256000$0.14 / 1M in$0.56 / 1M out
from openai import OpenAI

client = OpenAI(api_key="sk-...", base_url="https://api.router.ai/v1")
resp = client.chat.completions.create(
    model="qwen3.7-flash",
    messages=[{"role": "user", "content": "Hello"}],
)
print(resp.choices[0].message.content)

常见问题

Qwen3.7-Flash 在 370.AI 上的价格是多少?

Qwen3.7-Flash (`qwen3.7-flash`) 按用量计费, $0.021/1M in · $0.091/1M out (美元)。最新价格见 https://370.ai/models/qwen3.7-flash。

怎么通过 370.AI 调用 Qwen3.7-Flash?

向 https://api.router.ai/v1/v1/chat/completions 发请求, 带请求头 `Authorization: Bearer <你的 API Key>`, body 里 `"model": "qwen3.7-flash"`。接口与 OpenAI 兼容, 用任何 OpenAI SDK 只需把 base_url 改成 https://api.router.ai/v1, 其余代码不用动。

Qwen3.7-Flash 支持哪些接口端点?

Qwen3.7-Flash 可通过以下端点调用: /v1/chat/completions; /v1/messages.

Qwen3.7-Flash 的上下文窗口有多大?

Qwen3.7-Flash 最多接受 1,000,000 个输入 token, 最多返回 65,536 个输出 token。超出输入上限的请求会在到达模型前被拒绝。

Qwen3.7-Flash 支持哪些能力?

Qwen3.7-Flash 支持: vision.

Qwen3.7-Flash 是哪家厂商的模型?

Qwen3.7-Flash 是 Alibaba 的 chat 模型, 通过 370.AI 网关调用, 与其他所有模型共用同一个 API Key。

通过 370.AI 的 OpenAI 兼容接口调用 (API Base: https://api.router.ai/v1). AI agent 可经 MCP (https://mcp.router.ai/mcp) 直接发现并调用本网关的全部模型, 无需人工集成.

API 文档 · 全部模型