GLM 5.2 的 API 按量收費:未快取輸入每百萬 Token 1.40 美元、快取輸入 0.26 美元、輸出 4.40 美元;用量持續增加,帳單冇天然上限。[1] 對 Coding Agent 而言,輸出 Token 會用喺計劃、改碼、測試、工具呼叫同反覆修正;所以只睇輸入單價,容易低估成本。 GLM Coding Plan 同 Qoder 都設有積分、滾動時段或月度額度;「訂閱」唔等於無限使用,重度用戶要睇清楚用盡後嘅規則。[2][17]
研究答案

Create a landscape editorial hero image for this Studio Global article: Why do domestic Chinese LLMs that appear cheaper per token—such as GLM-5.2 at $1.4/$4.4 per million input/output tokens versus GPT-5.6 Sol a. Article summary: The apparent contradiction is mostly a comparison of two different pricing models: per-token API billing versus subsidized, quota-governed consumer subscriptions. A lower token price wins for modest or predictable usage;. Topic tags: general, documentation, general web, user generated. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks,
平價模型可以同時係「每粒 Token 平」而「每位開發者好貴」。原因唔矛盾:前者講緊按量 API,後者講緊有使用守則嘅寫碼訂閱。
對會不停掃描 repository、攜帶長上下文、反覆產生程式碼同測試結果嘅 Coding Agent,問題唔應該只係「邊個模型每百萬 Token 最平」,而係:用量一多,邊度開始加錢?個計劃又可唔可以穩定頂住呢類工作?
GLM-5.2 的公開價格係:未快取輸入每 100 萬 Token 1.40 美元、快取輸入 0.26 美元、輸出 4.40 美元。1 一般 API 用法之下,呢個價的確有吸引力;但去到極大量使用,數字會好快累積:
最後一項尤其值得留意。寫碼 Agent 唔止會讀程式碼同文件,仲會產生任務計劃、程式修改、測試、解釋、工具呼叫同多輪迭代。只要輸出量高,實際成本可以遠超只睇「輸入 Token 好平」時嘅直覺。
快取可以大幅改變結果。重用嘅上下文以較低嘅快取輸入價計費;但最後支出仍取決於未快取輸入、快取輸入同輸出各自佔幾多。1
有人將 GLM-5.2 API 成本講成約每日 ¥7,800,並同低得多嘅固定訂閱成本比較。呢個比較確實反映咗「按量計費」同「訂閱額度」係兩種唔同產品;不過,當中嘅 Token 用量需要更多背景先可以評估。
按照 GLM-5.2 公開費率,只計數以百億計嘅未快取輸入 Token,每日已經會係數萬美元級;如果係同等規模嘅輸出,成本會更高。1 因此,¥7,800 一日可能對應較低嘅實際可計費用量、極高快取比例、某種特定輸入/輸出組合、折扣,或者另一套計價基準。
實際比較一個 AI 寫碼流程,至少要拆開以下五項:
訂閱制冇令推理成本消失,而係改變咗邊個承擔用量波動。
如果固定月費方案容許某位重度用戶繼續使用,佢可能獲得遠超 API 按量價所對應嘅服務價值。用戶預算會較容易預計;供應商則透過滾動時段、速率限制、優先級、積分同其他公平使用機制管理風險。
所以,某模型 API 價可以較低,而另一個寫碼訂閱又可以對高用量用戶更抵。API 價係直接按邊際運算量收費;訂閱則係附帶限制嘅打包服務。後者未必保證無限吞吐量,只係限制可能足夠應付某些人的日常工作。
關鍵唔係中國模型定海外模型,而係產品本質上係冇上限嘅 Token 計費、預付積分錢包,定係有重設機制而且額度充足嘅訂閱。
GLM Coding Plan 明確設有兩重限制:滾動 5 小時積分額度,以及每週積分額度。Pro 為每 5 小時 12,000 分、每週 60,000 分;Max 則為每 5 小時 28,000 分、每週 140,000 分。其消耗按輸入、快取輸入、輸出 Token 乘以不同模型系數計算。2
Qoder 對 Credits(積分)嘅安排更加直接:付費計劃分別提供每月 2,000、6,000 或 20,000 Credits 予高階模型;Credits 用盡後,系統會切換到訊息數受限嘅基礎模型。Qoder 亦表示,計劃內高階模型資源等同訂閱費價值加上額外贈送資源。17
對於經常跑長時間、自動化 Agent 任務嘅開發者,呢類設計感覺上就未必係「任用」訂閱,而更似係用月費包裝嘅有限預付用量。
限制唔止係總額度;供應商亦可以喺繁忙時段加快扣減額度。
Z.ai 現行文件顯示,GLM-5.3 非高峰期以 1 倍扣減,高峰期以 3 倍扣減;GLM-5.3-Flash 則分別為 0.4 倍及 1.2 倍。4 GLM Coding Plan 概覽亦列出,工作日 14:00 至 18:00(UTC+8)為高峰時段。
2
呢個本質上係容量管理:月費唔變,但同一筆額度喺繁忙時間可換到嘅工作量會少咗。要留意,呢項現行條款係針對文件列出嘅 GLM-5.3 設定,唔應該直接套用到所有 GLM-5.2 方案或所有時期;買之前要核實所選計劃嘅最新細則。
有關每日額度售罄、GLM-5.2 供應減少、快取保留期短、跨用戶批次處理較弱,以及個別供應商推理資源不足嘅說法,未必毫無可能,但現有材料唔足以逐項證實。
可由一手文件清楚確認嘅,係額度上限、按 Token 權重扣積分,以及按時段調整倍率。2
4 不過,文件本身未有為每一種傳聞嘅存取問題提供特定原因。對採購決策而言,非官方個案較適合視為要測試嘅警號,而唔係已證實事實。
比較務實嘅做法,係喺團隊真正工作嘅時段做負載測試:repository 規模、快取表現、輸出長度、並行 Agent 數量、排隊情況,以及額度用盡後嘅降級方式,都比一個宣傳單價更重要。
低價中國 API 對輕量、用量可預測嘅推理工作仍然有吸引力,尤其係可以重用大量快取上下文嘅流程。1 如果團隊需要直接控制 API,而且能夠嚴格管理 Token 預算,佢可以係好選擇。
但高強度 AI 寫碼係另一類採購問題。當 Agent 長時間、大量消耗資源,真正值得比較嘅通常係以下幾點:
一句講晒:唔好淨係比較 API 標價,應該比較每月實際可完成幾多有用工作。用量受控時,平價按量 API 可以勝出;但訂閱只有喺限制透明,而且額度真係足夠配合實際 Agent 工作量時,先至有優勢。
Studio Global AI
此頁麵包含一個有來源支援的答案,您可以在 Studio Global 內繼續。
GLM 5.2 的 API 按量收費:未快取輸入每百萬 Token 1.40 美元、快取輸入 0.26 美元、輸出 4.40 美元;用量持續增加,帳單冇天然上限。[1]
GLM 5.2 的 API 按量收費:未快取輸入每百萬 Token 1.40 美元、快取輸入 0.26 美元、輸出 4.40 美元;用量持續增加,帳單冇天然上限。[1] 對 Coding Agent 而言,輸出 Token 會用喺計劃、改碼、測試、工具呼叫同反覆修正;所以只睇輸入單價,容易低估成本。
GLM Coding Plan 同 Qoder 都設有積分、滾動時段或月度額度;「訂閱」唔等於無限使用,重度用戶要睇清楚用盡後嘅規則。[2][17]