累計 位不重複訪客
快速找分類 🤖 AI 對話 🎨 AI 生圖 🎬 AI 影片 🎵 語音音樂 💻 寫程式 ✍️ 寫作文案 ⚡ 辦公效率 🔍 搜尋研究 🦾 AI 代理 🎁 免費總表
首頁 問問貓說 AI

問問貓AI 工具總表OpenRouter

OpenRouter 怎麼指定便宜的供應商?order/only/sort/max_price 四招,附可以直接貼的 JSON(2026 教學)

文章最後更新:2026-09-05

用 OpenRouter 最常見的誤會是:「它會自動幫我挑最便宜的供應商」——不會。

官方文件寫的預設行為是依價格加權的負載平衡:權重是價格平方的反比,並優先避開近期出過狀況的供應商。官方自己舉的例子是,一個 US$1/百萬 token 的供應商,會拿到比 US$3/百萬 token 供應商多 9 倍的流量。

9 倍很多,但不是全部。你的請求還是有機會落在貴的那一個。而同一顆模型的價差可以到四倍(例如 GPT-6 Astra 的五個端點,輸出從 US$25 到 US$100)。

這篇教你把它鎖住。

一、先看懂:所有設定都放在 provider

不管哪一招,都是在請求 body 裡加一個 provider 物件。以下每一段都可以直接複製。

二、第一招:指定順序(order)

照你寫的順序去試:

{
  "provider": {
    "order": ["anthropic", "openai", "together"]
  }
}

注意:預設情況下,清單裡的都失敗時,它仍然會退到清單外的供應商。想完全不退,看第五招。

適用:你有明確偏好的第一順位,但也接受備援。

三、第二招:白名單(only)/黑名單(ignore)

只准用這幾家:

{
  "provider": {
    "only": ["azure", "openai"]
  }
}

或反過來,就是不要某一家:

{
  "provider": {
    "ignore": ["deepinfra"]
  }
}

適用:有合規或資料落地要求(只能走特定雲),或你實測過某一家品質不穩。

四、第三招:直接叫它按價格排(sort)

{
  "provider": {
    "sort": "price"
  }
}

sort 可用的值有三個:

效果
"price"優先最低價
"throughput"優先最高每秒 token 數
"latency"優先最低反應時間

這一招最重要的副作用sort關掉負載平衡,改成依序路由。也就是說,你要的是「一直走最便宜那個」,就是這一招。

適用:省錢優先、沒人在螢幕前面等的批次工作 → price;使用者在等 → latency

五、第四招:設價格天花板(max_price)

{
  "provider": {
    "max_price": {
      "prompt": 1.0,
      "completion": 2.0,
      "request": 0.5,
      "image": 0.1
    }
  }
}

超過門檻的供應商不會被用——請求會直接失敗,而不是偷偷路由到更貴的地方。

這是四招裡防呆效果最好的一個。 前面三招是「我希望走便宜的」,這一招是「貴的絕對不准動我的錢」。做自動化、做無人值守的排程,建議直接把這個加上去。

六、關掉備援(allow_fallbacks)

{
  "provider": {
    "allow_fallbacks": false
  }
}

預設是 true。設成 false 之後,指定的供應商不能用時就直接失敗,不會找別家頂替。

要不要關? 看你怕什麼:怕帳單暴增就關(寧可失敗);怕服務中斷就別關(寧可貴一點)。兩個都想要的話,用 max_price + 保留備援——這樣還是會退到別家,但退不到貴的那一家。

七、順便設一下資料政策

同一個 provider 物件裡還可以放資料相關的要求:

{
  "provider": {
    "data_collection": "deny",
    "zdr": true
  }
}
  • data_collection"allow"(預設,允許供應商記錄)或 "deny"(排除會儲存輸入的供應商)
  • zdr:要求零資料保留(Zero Data Retention)

如果你送的是公司內部資料,這兩行比省錢那幾行更該先加。

八、進階:確保功能相容與效能門檻

只走支援你所有參數的供應商(避免你設了 tools 卻被路由到不支援的家):

{
  "provider": {
    "require_parameters": true
  }
}

指定量化等級(開源模型才會有差):

{
  "provider": {
    "quantizations": ["int4", "fp8"]
  }
}

設效能門檻(以百分位表示,統計視窗為滾動 5 分鐘):

{
  "provider": {
    "preferred_min_throughput": {"p50": 100, "p90": 50},
    "preferred_max_latency": {"p90": 3}
  }
}

被降級的端點仍會保留作為備援,不是直接排除。

九、三種常見情境,直接抄

A. 半夜跑的批次工作,只要便宜:

{
  "provider": {
    "sort": "price",
    "max_price": {"prompt": 6.0, "completion": 30.0}
  }
}

B. 使用者在螢幕前等,要快但不要被坑:

{
  "provider": {
    "sort": "latency",
    "max_price": {"prompt": 12.0, "completion": 60.0}
  }
}

C. 公司資料,合規優先:

{
  "provider": {
    "only": ["azure", "openai"],
    "data_collection": "deny",
    "require_parameters": true
  }
}

十、最後提醒

  • 設完要驗:送一次請求,看回應裡實際用了哪一家、實際扣了多少錢。沒看過帳單就說設好了,等於沒設。
  • 價格會變:供應商清單與價格隨時調整,max_price 的門檻要定期回頭看一次。
  • 省錢有上限:路由設得再好,也比不上把重複內容做快取。兩件事一起做才有感。

官方連結

站內延伸

本文設定寫法為 2026-09-05 直讀官方文件所得,參數可能調整,實作前請以官方文件為準。

阿莫和皮米怎麼看

AMO 阿莫 專挑毛病
彈性歸彈性,Enterprise 月 US$200,000 以內免手續費、超過收 5%,這門檻對中小企業根本是看得到吃不到,我尾巴甩給你看。
PIMI 皮米 說優勢
大企業的事先不管,至少支援信用卡和加密貨幣,台灣可付,這個我覺得算貼心。
所以到底要不要付錢?

開發者要一次接多模型:免費版每日 50 次先試。穩定用量:Pay-as-you-go 最彈性,但 5.5% 手續費是隱形成本,大量使用前算清楚。

接下來看這些

前往官方網站

本頁部分連結為聯盟連結,經由連結購買本站可能獲得分潤,不影響你的價格,也不影響本站的資料與評價。

🐾 3 秒找最划算:回答三題,雙貓直接推薦