GLM-5.3 與 GLM-5.3-Flash 的逐項對比: 輸入/輸出單價、能力、可用端點, 資料即時取自 370.AI。兩者用同一個 API Key 即可切換。
| 專案 | GLM-5.3 | GLM-5.3-Flash |
|---|---|---|
| 輸入 (每 1M tokens) | $0.77 | $0.0825 |
| 輸出 (每 1M tokens) | $2.42 | $0.275 |
| 快取命中 顯式 (每 1M tokens) | $0.143 | $0.0165 |
| 專案 | GLM-5.3 | GLM-5.3-Flash |
|---|---|---|
| 上下文視窗 | 1,048,576 | 1,048,576 |
| 最大輸出 | 131,072 | 131,072 |
| 專案 | GLM-5.3 | GLM-5.3-Flash |
|---|---|---|
| function_calling | 支援 | 支援 |
| prompt_caching | 支援 | 支援 |
輸入側 GLM-5.3-Flash 更便宜 (每百萬 token $0.77 vs $0.0825);輸出側 GLM-5.3-Flash 更便宜 (每百萬 token $2.42 vs $0.275)。價格均為美元。
兩者都支援 function_calling, prompt_caching。
不需要。兩者都在 370.AI 上, 共用同一個 API Key 和同一個 OpenAI 相容端點, 切換隻需把請求裡的 model 從 "glm-5.3" 改成 "glm-5.3-flash", 其餘程式碼不動。
兩者都在 370.AI 上, 用同一個 API Key 呼叫 —— 換模型只需要改請求裡的 model 欄位, 其餘程式碼不用動, 所以可以按任務分別選用而不必二選一。
GLM-5.3 · GLM-5.3-Flash · 全部模型