問問貓 › AI 工具總表 › Perplexity
Perplexity 悄悄上架便宜 9 倍的 GLM 5.3 Flash:輸入 US$0.15、輸出 US$0.50,什麼情況該換過去
文章最後更新:2026-09-05
Perplexity 在 9 月的官方更新紀錄裡加了一個模型,沒有發新聞稿,但價格差距大到值得看一眼:GLM 5.3 Flash,輸入每百萬 token US$0.15、輸出 US$0.50。
同一份更新紀錄裡,8 月上架的完整版 GLM 5.3 是 US$1.40 輸入、US$4.40 輸出。也就是說 Flash 版的輸入價大約是九分之一,輸出價大約是九分之一。
先講白話:這是誰在用的東西
這裡講的不是你在瀏覽器裡用的 Perplexity 搜尋,而是 Perplexity 的 Agent API 和 Router API——讓你自己寫的程式或自動化流程去呼叫模型的介面。它的賣點是「一個介面接很多家模型」,你換模型只要換名字,不用改程式。
所以這則消息的實際意義是:同一支程式,把模型名稱從 perplexity/glm-5.3 換成 perplexity/glm-5.3-flash,帳單有機會掉到原本的九分之一左右。 前提是任務吃得下比較小的模型。
兩個版本的官方價目
| 項目(每百萬 token) | GLM 5.3 | GLM 5.3 Flash |
|---|---|---|
| 輸入(未命中快取) | US$1.40 | US$0.15 |
| 輸入(命中快取) | US$0.26 | US$0.03 |
| 輸出 | US$4.40 | US$0.50 |
(以上兩筆都直接引自 Perplexity 官方更新紀錄;Flash 為 2026 年 9 月條目、標準版為 8 月條目。)
怎麼換算成有感的數字:假設你的流程每天處理 200 萬 token 輸入、30 萬 token 輸出——
- GLM 5.3:2 × 1.40 + 0.3 × 4.40 = 約 US$4.12/天
- GLM 5.3 Flash:2 × 0.15 + 0.3 × 0.50 = 約 US$0.45/天
一個月差距大約 US$110。這是算術,不是官方保證的效能對比。
什麼工作可以換、什麼不要換
模型便宜九倍,能力一定不是一樣的。官方更新紀錄只公布價格與型號,沒有公布兩者的能力對照表,所以下面是使用原則,不是官方評測結論:
可以先換的
- 分類、標籤、抽取欄位這種「格式固定、答案短」的工作
- 大量但重複性高的批次處理(例如把幾千則留言分成三類)
- 第一階段的粗篩:先用便宜模型過濾,只把難的丟給貴模型
不建議直接換的
- 需要多步推理、會影響決策的內容
- 要寫給客戶看的長文
- 任何錯了就要人工收拾的流程
務實做法是同一批真實資料各跑一次,人工看 30 筆。省下九倍的錢如果換來 20% 要重做,那並不划算。
同一份更新紀錄裡,兩個會讓帳單「變貴」的變動
看新模型的同時,這兩則也在同一份官方紀錄裡,容易被忽略:
- fast preset 換模型了:Agent API 的 fast preset 改成用
openai/gpt-5.6-luna、最小推理強度,並且走 priority processing——官方明寫 priority 是該模型標準價格的 2 倍。如果你用的是動態 preset,這個改動會自動套用到你身上。用凍結設定(frozen configuration)的人則要自己更新。 - Gemini 3.7 Flash 在 8 月 27 日漲價:改為輸入 US$0.75、快取輸入 US$0.075、輸出與推理 token US$3.75(每百萬)。
另外有一則對你有利的:preset 現在會自動使用穩定的提示快取鍵,讓相同 preset 的獨立請求共用系統提示與工具定義的前綴,官方說常用 preset 的應用大約可省 5%,不需要改程式。
你今天可以做的三件事
- 打開你的用量帳單,看輸入 token 佔比。輸入佔大宗的流程,換 Flash 的效益最大(輸入價差最誇張)。
- 檢查你是不是在用 fast preset。是的話,確認你知道自己現在被算的是 2 倍的 priority 價。
- 把提示裡固定不變的部分(系統提示、工具定義)放在最前面,讓快取更容易命中——命中之後輸入價從 US$0.15 掉到 US$0.03。
常見問題
為什麼官方定價頁上找不到 GLM 5.3 Flash?
Perplexity 的模型與定價頁是動態產生的網頁,本站在 2026-09-05 直讀時無法取得完整模型清單。本文的價格數字全部取自官方更新紀錄頁面上的原文條目。證據等級:官方一手,但只有單一官方頁面佐證,不是兩份官方文件交叉。
GLM 是誰做的模型?
GLM 系列由中國的智譜(Z.ai)開發。這裡談的是「Perplexity 平台上以什麼價格提供它」,不是模型本身的評測。要在意資料落地與合規的團隊,模型來源本身就是需要納入評估的因素。
我用網頁版 Perplexity,這則消息跟我有關嗎?
沒有直接關係。網頁版與 Pro/Max 訂閱的計費方式是另一套(點數制),我們另外寫過 Perplexity 點數怎麼算、用完怎麼辦。API 是給要把模型接進自己程式的人用的。
資料來源:Perplexity 官方更新紀錄 docs.perplexity.ai/changelog/changelog(2026 年 9 月 GLM 5.3 Flash 條目、8 月 GLM 5.3 條目、8 月 presets 提示快取條目、8 月 fast preset 條目、8 月 27 日 Gemini 3.7 Flash 價格條目),2026-09-05 直讀。 查不到的部分:GLM 5.3 與 Flash 版的能力對照、上下文長度、速率限制——官方模型頁為動態頁面,本站當日無法直讀,不補猜測。 幣別:本文金額皆為美元(US$),取自官方英文頁原始標價,未做匯率換算。 延伸:Perplexity 工具頁、Perplexity 點數制實查、Perplexity 方案拆解
阿莫和皮米怎麼看
查資料、寫報告:免費版基本搜尋就夠用。需要Pro搜尋和來源品質把關:年繳US$200比月繳划算。但企業方案價格未經官方確認,簽約前務必自己上官網核實。

