GLM-5.3-FlashX

GLM-5.3-FlashX 智譜多模態理解模型,1M上下文,推理速度達 200 tokens/s,提供更快、更流暢的模型體驗。

模型 ID: glm-5.3-flashx · 類型: chat · 廠商: Zhipu

可用端點: /v1/chat/completions · /v1/messages · /v1/responses

定價

輸入 (每 1M tokens)$0.1665 USD
輸出 (每 1M tokens)$0.5625 USD
快取命中 (每 1M tokens)$0.03375 USD
from openai import OpenAI

client = OpenAI(api_key="sk-...", base_url="https://api.router.ai/v1")
resp = client.chat.completions.create(
    model="glm-5.3-flashx",
    messages=[{"role": "user", "content": "Hello"}],
)
print(resp.choices[0].message.content)

常见问题

GLM-5.3-FlashX 在 370.AI 上的價格是多少?

GLM-5.3-FlashX (`glm-5.3-flashx`) 按用量計費, $0.1665/1M in · $0.5625/1M out (美元)。最新價格見 https://370.ai/models/glm-5.3-flashx。

怎麼通過 370.AI 呼叫 GLM-5.3-FlashX?

向 https://api.router.ai/v1/v1/chat/completions 發請求, 帶請求頭 `Authorization: Bearer <你的 API Key>`, body 裡 `"model": "glm-5.3-flashx"`。介面與 OpenAI 相容, 用任何 OpenAI SDK 只需把 base_url 改成 https://api.router.ai/v1, 其餘程式碼不用動。

GLM-5.3-FlashX 支援哪些介面端點?

GLM-5.3-FlashX 可通過以下端點呼叫: /v1/chat/completions; /v1/messages; /v1/responses.

GLM-5.3-FlashX 的上下文視窗有多大?

GLM-5.3-FlashX 最多接受 1,048,576 個輸入 token, 最多返回 131,072 個輸出 token。超出輸入上限的請求會在到達模型前被拒絕。

GLM-5.3-FlashX 支援哪些能力?

GLM-5.3-FlashX 支援: vision, function_calling, prompt_caching.

GLM-5.3-FlashX 是哪家廠商的模型?

GLM-5.3-FlashX 是 Zhipu 的 chat 模型, 通過 370.AI 閘道器呼叫, 與其他所有模型共用同一個 API Key。

通過 370.AI 的 OpenAI 相容介面呼叫 (API Base: https://api.router.ai/v1). AI agent 可經 MCP (https://mcp.router.ai/mcp) 直接發現並呼叫本閘道器的全部模型, 無需人工整合.

API 文件 · 全部模型