Groq 價格拆解:LPU 晶片跑出「光速」!但沒有 GPT-5,這筆錢花得划算嗎?
文章最後更新:2026-08-18
各位問問貓的讀者大家好!今天我們要來聊一個在 AI 圈掀起旋風的平台——Groq。如果你對 AI 模型的「速度」有極致要求,那 Groq 絕對會讓你眼睛一亮。它用自家研發的 LPU 晶片,把開源模型跑出市面上最快的推論速度,簡直是光速等級!但別高興得太早,Groq 的最大罩門是:它不提供 GPT-5 或 Claude 這類主流的閉源模型。那麼,這家「速度之王」的價格到底怎麼算?對我們來說划不划算?今天就來好好拆解。
LPU 晶片加持:快到你不敢相信的「光速」推論
Groq 的核心賣點只有一個字:快!它不是自己訓練模型,而是專注於用獨特的 LPU 晶片,把現有的開源模型推論速度拉到極致。這到底有多快?數據會說話:
- Llama 3.1 8B Instant 模型:生成速度約 840 TPS(每秒生成 Token 數)。
- GPT OSS 20B 模型:生成速度約 1,000 TPS。
- 即使是更大型的 Llama 3.3 70B Versatile,也能達到約 394 TPS。
這些數字比一般雲端服務快上好幾倍,對於需要即時回應的應用,例如客服機器人、即時翻譯,或是任何對延遲敏感的服務,Groq 的速度優勢簡直是降維打擊。更棒的是,即使是免費層,你也能享受到同樣的 LPU 晶片加速,體驗到這種「光速」推論的快感。
免費額度超大方,付費價格超親民?
Groq 採用的是「按用量計費」模式,沒有月費,用多少付多少。對於開發者來說,這彈性非常大。
首先,它的免費層就已經很佛心了,而且不需要綁定信用卡:
- Llama 3.1 8B Instant:每分鐘 30 次請求、每日 14,400 次;每分鐘 6,000 token、每日 50 萬 token。
- Llama 3.3 70B Versatile:每分鐘 30 次請求、每日 1,000 次;每分鐘 12,000 token、每日 10 萬 token。
- GPT OSS 120B/20B:每分鐘 30 次請求、每日 1,000 次;每分鐘 8,000 token、每日 20 萬 token。
- 甚至連語音轉文字的 Whisper Large V3 都有:每分鐘 20 次請求、每日 2,000 次;每小時 7,200 音訊秒、每日 28,800 音訊秒。
這些免費額度對於測試、開發小型專案,甚至一些低用量的應用來說,都非常夠用。
至於付費 API 的價格,同樣是以每百萬 token 計費,相當透明:
- Llama 3.1 8B Instant:輸入 US$0.05、輸出 US$0.08。
- GPT OSS 20B:輸入 US$0.075、輸出 US$0.30。
- GPT OSS 120B:輸入 US$0.15、輸出 US$0.60。
- Llama 3.3 70B Versatile:輸入 US$0.59、輸出 US$0.79。
這些價格在市場上算是相當有競爭力,尤其考量到它提供的速度。此外,Groq 還提供了一些省錢小撇步:
- 使用 Batch API 非同步處理,可以省下 50% 的費用。
- 快取命中的輸入 token 只收半價。 這些折扣對於大規模應用來說,能進一步降低成本。
致命傷:沒有 GPT-5 或 Claude,還有額外工具費
講了這麼多優點,Groq 的缺點也必須明講。它最大的限制就是:它只支援開源模型。這意味著,如果你是 GPT-5、Claude 或是其他閉源模型(例如 Gemini)的重度使用者,Groq 無法滿足你的需求。它沒有這些模型,這是一個「有或無」的問題,不是價格高低的問題。
此外,Groq 雖然提供推論加速,但內建的工具服務是另外計費的:
- 搜尋:US$5–8/千次。
- 瀏覽網頁:US$1/千次。
- 執行程式:US$0.18/小時。
如果你需要模型具備這些進階功能,這些額外費用也必須納入考量。
☀️ AMO 精打細算派怎麼看
對於精打細算的 AMO 派來說,Groq 的免費層簡直是天上掉下來的禮物。每日 50 萬 token 的 Llama 3.1 8B 額度,足以讓你進行大量的測試和開發,甚至跑一些輕量級的應用。付費後的 token 價格也相對親民,加上 Batch API 省 50%、快取輸入半價的優惠,對於那些對成本敏感,同時又需要極致速度來跑開源模型的專案,Groq 是個非常划算的選擇。只要你的應用場景不需要 GPT-5 或 Claude,Groq 能讓你用更低的成本,享受到頂級的推論速度。
🌙 PIMI 效能派怎麼看
PIMI 效能派會為 Groq 的速度瘋狂!840 TPS、1,000 TPS 的生成速度,在許多需要即時互動的 AI 應用中,是決定使用者體驗的關鍵。想像一下,你的 AI 聊天機器人能以幾乎無延遲的速度回應,或是即時翻譯服務能瞬間完成語音轉換,這將帶來巨大的競爭優勢。對於追求極致效能、高吞吐量,且願意擁抱開源模型的開發者和企業來說,Groq 提供的 LPU 晶片加速平台,是目前市場上無可取代的選擇。它讓開源模型不再只是「堪用」,而是真正能扛起高壓、高流量的商業應用。
結論:誰該用、誰別碰
誰該用 Groq?
- 對速度有極致要求的開發者或企業:例如需要建構即時客服機器人、語音助理、即時翻譯或任何低延遲應用。
- 開源模型愛好者:如果你主要使用 Llama、GPT OSS 等開源模型,並希望它們能跑出最佳效能。
- 成本敏感型用戶:免費層額度大方,付費價格具競爭力,加上折扣機制,能有效控制成本。
- 需要彈性計費的專案:按用量計費,無月費,適合用量波動大的專案。
誰別碰 Groq?
- 非 GPT-5 或 Claude 不可的用戶:如果你對這些閉源模型的特定能力有剛性需求,Groq 目前無法提供。
- 預期所有進階功能都內建且免費的用戶:Groq 的搜尋、瀏覽網頁、執行程式等工具是額外收費的,這點需要注意。
總結來說,Groq 是一個專為「速度」而生的平台,它讓開源模型煥發出前所未有的光彩。如果你能接受它只跑開源模型的限制,那麼 Groq 將會是你在 AI 推論領域,一個既省錢又高效的強大工具。
阿莫和皮米怎麼看
要最快推論速度的開發者:免費金鑰先試,量大了用 Batch API 省一半。但免費層速率不透明,生產環境要有備案。
