Groq API 免費額度多少次?70B與GPT OSS 120B每日卡在1000次請求
- 免費版:有
- 最低付費方案:US$0/月起
- 免費額度:免費層(Free Plan)不需綁卡,各模型有各自的每分鐘/每日上限(2026-08-09 …
- 最後查核:2026-10-06
文章最後更新:2026-10-05
一分鐘快查: Groq API 免費額度不用綁卡,註冊就發 API 金鑰,開源模型(Llama、GPT OSS 系列)都能叫得到,而且免費層的推論速度跟付費層完全一樣,一樣跑在 Groq 自家的 LPU 晶片上。但免費不是沒有上限:根據 Groq 官方文件(console.groq.com/docs/rate-limits,查核日 2026-08-09),Llama 3.1 8B Instant 每分鐘 30 次請求、每日 14,400 次;Llama 3.3 70B Versatile 跟 GPT OSS 120B/20B 都只有每分鐘 30 次、每日 1,000 次;額度用完直接收到 HTTP 429 錯誤碼。這篇的價格與額度資料最後驗證於 2026-10-03。
問問貓這次開一個新企劃,叫《免費仔生存指南》:不管什麼工具,只用免費版,看能活多久、能撐住哪些工作、走到哪一步一定會被逼著刷卡。這次挑 Groq,是因為它的免費層條件寫得特別分散——官方定價頁跟技術文件根本是兩套說法,一般人只看首頁價目表,根本不會發現額度數字藏在另一個網址。接下來問問貓把官方頁面拼起來給你看,免費仔在 Groq 到底能撐到哪一步,哪一步會卡死。
註冊就拿金鑰,但速率上限藏在另一個網址
Groq 的免費層入門門檻很低:你不用輸入信用卡資料,註冊帳號之後系統就直接發一支 API 金鑰,馬上可以呼叫開源模型。官網直讀資料寫得很清楚,免費層可用的模型以 Llama、GPT OSS 這類開源模型為主,推論速度跟付費層是同一套,因為兩邊都跑在同樣的 LPU 硬體上——這也是 Groq 整個平台最大的賣點,官網主打的不是「便宜」,是「快」。
但有一件事,問問貓要先點出來:如果你只看 Groq 官網的定價頁(groq.com/pricing),你找不到免費層每分鐘、每日能打幾次的具體數字。定價頁上的免費層說明停在「有免費 API 金鑰、可以商用、沒有水印限制」這幾點,沒有列出速率表。真正的數字放在另一個技術文件網址,也就是 console.groq.com/docs/rate-limits,裡面才按模型分別列出每分鐘次數、每日次數、每分鐘 token 數、每日 token 數。這代表你想知道「免費到底能打幾次」,得自己多翻一層,光看行銷頁面是看不到的。
對接案或學生來說,這個起步條件其實算友善:不用先掏錢試水溫,而且官方資料寫明免費層也可以商用,沒有強制加水印,這兩點對想拿去做小專案、甚至接外包案的人是實際的好消息。但問問貓還是要提醒,想認真評估能不能用在正式工作上,記得直接去看 console.groq.com/docs/rate-limits 這個頁面的即時數字,不要只看行銷頁的文字敘述,因為兩邊寫的詳細程度差很多。

圖:groq.com 官方頁面,2026-10-05 擷取。
小模型額度放得開,大模型額度收得緊
免費層不是每個模型都給一樣的額度,Groq 把額度分成好幾個等級,差距其實不小。Llama 3.1 8B Instant 是免費層裡最大方的:每分鐘 30 次請求、每日 14,400 次,每分鐘 6,000 token、每日 50 萬 token。相對地,Llama 3.3 70B Versatile 跟 GPT OSS 120B/20B 這幾個比較聰明的模型,額度直接砍到每分鐘 30 次、每日只有 1,000 次,token 上限也縮到每分鐘 8,000 到 12,000、每日 10 萬到 20 萬之間。

圖:同樣是免費使用,輕量模型能享有如瀑布般的豐沛調用額度,聰明的大模型水龍頭卻被鎖鏈緊緊鎖住只剩涓涓細流。
Groq Compound(它的代理型/工具呼叫模式)額度更緊,每分鐘 30 次、每日只有 250 次,每分鐘 token 上限 7 萬。語音轉文字的 Whisper Large V3 則是另一套算法,每分鐘 20 次、每日 2,000 次,音訊時長上限是每小時 7,200 秒、每日 28,800 秒。
這個分配方式說明一件事:Groq 把「量」留給小模型,把「次數」卡在大模型身上。如果你的工作是大量短查詢、對準確度要求不高,8B 模型每日 14,400 次的額度其實很夠用,一般的個人測試或小型玩具專案幾乎不會撞到頂。但只要你換成 70B 或 GPT OSS 120B 這種比較聰明的模型,每日 1,000 次聽起來不少,實際拿去做一個有使用者在用的小工具,一天 1,000 次很快就會見底,尤其每分鐘還鎖 30 次,稍微湧入一波流量就會開始跳 429。
另一個容易被忽略的細節是:快取命中的輸入 token 不算進額度上限。也就是說,如果你的應用常常重複問類似的問題,命中快取的部分不會把你的免費額度吃光,這對重複性高的查詢是一個實際的緩衝,只是官網把這條規則寫得很小、不仔細看文件根本不會注意到。
正式產品那一步,免費仔一定會被攔下來
免費層適合拿來做什麼、不適合做什麼,答案藏在額度數字裡,不用猜。學生寫作業、個人測試一個小腳本、或者做一個只給自己玩的玩具專案,8B 模型每日 14,400 次、每分鐘 30 次的額度幾乎用不完,這種規模的流量很難撞到牆。
但如果你想拿 Groq 做正式產品、接到有真實使用者的前端介面,情況完全不同。70B 跟 GPT OSS 120B 這兩個比較適合做正式功能的模型,額度都卡在每日 1,000 次、每分鐘 30 次,稍微做幾輪完整測試、或者同時有幾個使用者在線上,額度就會燒得很快。一旦撞到上限,系統回應的是 HTTP 429,應用程式會直接打不通,這時候除了等額度重置(官網沒標示重置時間),就只剩升級成付費 API 一條路。
升級成付費之後,計價方式是依 token 用量收費,不是月費制:Llama 3.1 8B Instant 每百萬輸入 token 收 US$0.05、輸出收 US$0.08;GPT OSS 20B 輸入 US$0.075、輸出 US$0.30;GPT OSS 120B 輸入 US$0.15、輸出 US$0.60;Llama 3.3 70B Versatile 輸入 US$0.59、輸出 US$0.79。官網還列出 Batch API(非同步批次處理)可以再省一半費用,命中快取的輸入 token 也只收半價,這兩個是用量大的人可以善用的省錢手段。
還有一個很多人會漏看的坑:Groq 的內建工具不算在上面這套 token 費率裡,是完全另外計價。搜尋工具每千次收 US$5 到 8、瀏覽網頁工具每千次收 US$1、執行程式工具是每小時 US$0.18。如果你的應用有叫用這些內建工具,帳單上會多出一筆完全獨立的費用,不會因為你用的是便宜的 8B 模型就跟著便宜。官網把這幾項工具費率放在定價頁比較下面的位置,不是跟模型費率放在同一張表,很容易讓人以為「我用的模型這麼便宜,帳單應該也很便宜」,結果工具費率才是真正讓帳單變貴的部分。
至於模型選擇,官網直接點出 Groq 只有開源模型,沒有 GPT-5、沒有 Claude 這類封閉模型。如果你的產品一定要用到這些封閉模型,Groq 本身辦不到,得透過像 OpenRouter 這類聚合商才能拿到,Groq 的角色純粹是「開源模型跑得特別快」,不是「什麼模型都有」。

圖:問問貓依查核資料整理(查核日 2026-10-03)。
🔍 問問貓獨家實查
查核這次資料的時候,問問貓發現一個很明顯的落差:Groq 官方定價頁(groq.com/pricing)介紹免費層的時候,只寫「有免費 API 金鑰、可以商用、沒有水印」這幾個條件,完全沒有列出免費層每分鐘、每日能打幾次的數字。真正的速率表放在另一個網址,console.groq.com/docs/rate-limits,而且是按每個模型分別列出四個數字:每分鐘請求次數、每日請求次數、每分鐘 token 數、每日 token 數。這代表一般使用者光看行銷頁面的介紹,根本不會知道 70B 模型跟 GPT OSS 120B 每日只有 1,000 次請求這件事,要親自翻到技術文件才看得到。對一個決定要不要拿 Groq 做正式產品的人來說,這個數字其實是整個決策裡最關鍵的一條,卻被放在使用者最不容易看到的地方。
第二個問問貓想點出來的,是額度分配本身透露出的設計邏輯。Llama 3.1 8B Instant 每日給到 14,400 次,Llama 3.3 70B Versatile 跟 GPT OSS 120B/20B 卻只給 1,000 次,中間差了一個明顯的等級。這不是隨便訂的數字,而是 Groq 刻意把「大方的額度」留給運算量小、模型比較簡單的 8B,把「吃緊的額度」放在運算量大、比較聰明的大模型身上。換句話說,Groq 的免費層設計邏輯是「鼓勵你用小模型玩,但如果你想要認真的推理能力,免費額度就會提早把你推向付費」。這個邏輯官網不會直接寫出來,但從四組模型的額度數字並排放在一起看,就能看得很清楚。
第三點是最容易讓人在帳單上嚇一跳的地方:內建工具的計價方式跟一般 token 費率是分開算的,而且分開的幅度不小。搜尋工具每千次 US$5 到 8、瀏覽網頁每千次 US$1、執行程式每小時 US$0.18,這三個數字完全獨立於前面列出的模型 token 費率表之外。一個開發者如果只看到 Llama 3.1 8B Instant 每百萬 token 輸入才 US$0.05 這麼便宜,很容易誤以為整個應用的成本都會壓得很低,但只要你的應用有叫用 Groq 內建的搜尋或瀏覽網頁功能,帳單上馬上會出現一筆跟模型費率無關、而且計價單位完全不同(按次數、按小時,不是按 token)的費用。這個資訊官網寫在定價頁比較靠下面的位置,跟模型費率表不是放在一起,稍微掃過去很容易漏掉。
第四點是從查核紀錄本身看到的事:從 2026-09-12 一路核實到 2026-09-30,Groq 的價格與額度數字每一次都顯示「與官網實查一致,已核實無更動」。這代表在這段將近三週的時間裡,Groq 官方沒有調整過任何一項價格或額度,是一個相對穩定、沒有常常偷偷改價的服務。對比有些工具動不動就調整免費額度或悄悄下架方案,Groq 這段期間的穩定度算是一個值得留意的正面紀錄。
最後要老實說一句:查核時真正查不到的一個關鍵數字,是免費層額度重置的具體時間點。官網沒有標示額度是以台灣時間、美國時間,還是 UTC 時間的哪個時間點重置,只知道額度會用完、會回 HTTP 429。如果你打算拿 Groq 做會員制或排程型的應用,這個重置時間點其實會影響你怎麼設計請求節流,建議自己實際呼叫 API 觀察幾天,看額度什麼時候恢復,官網文件目前沒有把這點寫清楚。
☀️ 阿莫(AMO)精打細算派怎麼看

阿莫看 Groq 這套免費層,第一個反應是:這不是「大方到誇張」那種免費版,而是「設計得很精準」的免費版。官方資料寫得很明白,8B 模型每日給 14,400 次、每分鐘 6,000 token,這個量級拿來寫個人腳本、跑學校作業、或者自己玩的小工具,根本用不完,而且完全不用綁卡,這對學生跟剛開始接案的人是實打實的省錢起點。阿莫特別在意「要不要先掏錢」這件事,Groq 這點做得漂亮——免費層可以商用、沒有水印,表示就算你拿免費額度做出來的東西去接案交件,官方條款也沒有擋你。
但阿莫同時提醒一件事:免費層的大方只給了小模型,70B 跟 GPT OSS 120B 這兩個比較聰明的選項,每日卡在 1,000 次,這代表「免費仔」只要想認真用強一點的模型做正式功能,很快就會被逼著面對 429 錯誤。阿莫算過(用資料裡的費率數字看,不是自己換算),升級成付費之後是依 token 用量計費,不是整包月費,這種計價方式對小流量、間歇性使用的人反而比固定月費划算,因為沒用就不用付,比起很多訂閱制工具每月固定收費的模式更彈性。
阿莫的結論是:如果你是學生、自己寫個小工具、或者流量很低的個人專案,免費層這組額度幾乎可以當成夠用來看待,不用急著掏錢。但如果你已經在規劃一個會有使用者、會頻繁呼叫大模型的產品,阿莫會建議直接抓預算升級付費,因為免費層在大模型那一塊卡得很緊,硬撐只會讓你的應用常常回 429,體驗反而更差。真正精打細算的做法,是先用免費額度把小模型的流程跑熟,等確定要上大模型、要上線,再切付費,不要在免費層硬扛正式產品的流量。
結論:誰該用、誰別碰
該用免費層的人很明確:學生、個人測試、玩具專案、低頻使用的接案小工具。這群人不用綁卡就能拿到 API 金鑰,8B 模型每日 14,400 次的額度幾乎用不完,而且官方條款寫明可以商用、沒有水印限制,拿去交作業或做小案子都沒有條款上的問題。如果你只是想感受一下 Groq 主打的高速推論,免費層的速度跟付費層完全一樣,不用花一分錢就能體驗到它最大的賣點。
該直接刷卡、別硬撐免費層的人也很明確:打算接正式產品、會有真實使用者頻繁呼叫、或者需要用到 70B、GPT OSS 120B 這類較強模型做核心功能的人。這群人會很快撞上每日 1,000 次、每分鐘 30 次的天花板,免費層撐不住正式流量,升級成依 token 計費的付費方案才是正解。另外要特別注意內建工具(搜尋、瀏覽網頁、執行程式)是完全獨立計價,規劃預算的時候要把這塊單獨算進去,不要只看模型本身的 token 費率就以為算完了。還有一點要先想清楚:Groq 只有開源模型,沒有 GPT-5、沒有 Claude,如果你的產品一定要用到這些封閉模型,Groq 本身解決不了,得另外找聚合商或直接用那些模型自己的 API。
大家也在問
Groq API 免費版能商用嗎?
官網直讀資料寫明免費層可以商用,也沒有強制加水印,接小案子或外包作品都符合條款。
Groq 免費額度用完會怎樣?
額度用完會收到 HTTP 429 錯誤碼,應用程式打不通,只能等額度重置或升級付費方案。
Groq 一個月多少錢?
Groq 付費不是月費制,是依 token 用量計費,例如 Llama 3.1 8B Instant 每百萬輸出 token 收 US$0.08。
Groq 跟 OpenRouter 差在哪?
Groq 只提供開源模型如 Llama、GPT OSS,沒有 GPT-5、Claude;要用封閉模型得透過 OpenRouter 這類聚合商。
Groq 免費版速度會比較慢嗎?
官網直讀資料顯示免費層推論速度跟付費層完全一樣,同樣跑在 Groq 自家 LPU 晶片上。
Groq 有 GPT-5 或 Claude 嗎?
官網寫明 Groq 只有開源模型,沒有 GPT-5、沒有 Claude 這類封閉模型可用。
Groq 免費額度什麼時候重置?
官網沒有公開具體重置時間點,本站標為待查核,只知道額度用完會回傳 429 錯誤。
Groq 搜尋工具另外收費嗎?
是,搜尋、瀏覽網頁、執行程式等內建工具獨立計價,不算進模型 token 費率裡。
本文撰寫:2026-10-05 價格最後驗證:2026-10-03 工具最後健檢:2026-10-05
🔗 延伸比較
📎 資料來源
本文所有價格與額度數字取自問問貓對 Groq 的實查資料(價格最後驗證:2026-10-03),一手來源:
🐾 認識問問貓:阿莫與皮米
問問貓是台灣的 AI 工具比價站,口號是「訂閱之前,先問問貓」。站上兩隻貓各有立場:
- ☀️ 阿莫(AMO)——精打細算派,永遠先問「免費版夠不夠用、這筆錢值不值」。
- 🌙 皮米(PIMI)——效能派,在意「好不好用、快不快、能不能做到我要的」。
兩隻貓吵完,你就知道該不該付錢。每篇文章的數字都是問問貓自己查的,文末附最後查核日期。
🐾 問問貓姐妹站也幫你查了
接下來看這些
同一工具的其他實查文
- 【實察文】Groq 免費層真實額度大公開——看你能跑多少、要不要付費
- 免費 AI API 額度實查:Groq 同一家內每日上限差 14 倍,OpenRouter 儲值另收 5.5%
- 【2026 實查】Groq 免費 API 的 Llama 8/16 已下架:官方 Quickstart 照抄會壞,換 gpt-oss 的完整設定教學
