模型與定價
瞭解 CoffeeRouter 的計費單位、計費類型(按量與按次)以及如何閱讀模型廣場。
CoffeeRouter 采用完全透明、按量付費的扣費機制。所有可用模型的價格、計費類型、折扣以及兼容端點,均在模型廣場實時公開。

一、如何閱讀模型價格
在模型廣場中,您可以非常直觀地看懂每一個模型的收費細節。
1. 計費類型
平台上的模型主要分為以下兩種計費方式:
- 按量計費:根據您的輸入(Prompt)和輸出(Completion)所消耗的 Token 數量進行收費。價格通常按每百萬 Token 展示,您可以按需切換為每千 Token 的價格。
- 按次計費:部分多模態、工具類或特殊模型采用固定單次請求計費,無論輸入輸出多少內容,單次調用扣除固定積分。
2. 缓存計費規則(Context Caching)
為了說明使用者最大化降低長文本(如長程式碼庫、長文件對話)的調用成本,CoffeeRouter 針對支援缓存的模型提供細致的缓存計費:
- 輸入(Input):正常發送未命中的提示詞價格。
- 缓存(Read Cache / Cache Hit):命中缓存時的超低價格。
- 寫缓存(Write Cache / Cache Creation):首次將大文本寫入缓存時的價格。
3. 活動與折扣
在模型名稱和價格右側會顯示實時的折扣標簽。系統會自動將折後價格計算好展示在頁面上,您無需手動折算。
4. 過濾器與端點兼容性
- 可用 API Key 分組:左側篩選欄支援切換
default、vip、insider等不同的 API 密鑰分組。 - 可用端點類型:展示該模型目前支援的 API 調用協議格式,包括
openai、openai-response、anthropic、gemini。
二、積分與換算規則
CoffeeRouter 的所有 API 調用都統一折算為系統積分進行實時扣費。
積分換算公式
1 USD = 200 積分,即 1 積分 = 0.005 美元。
按量計費公式
當您調用一個按量計費的模型時,單次調用的實際積分扣除公式如下:
單次積分消耗 = [(輸入 Token 數 × 輸入單價) + (輸出 Token 數 × 輸出單價) + (缓存 Token 數 × 缓存單價)] × 200
提示:實際扣費會在 API 調用成功後,根據上遊返回的真實 Token 使用量在您的帳戶餘額中秒級完成扣減。
三、成本優化建議
- 按需選擇模型:對於程式碼補全、格式化、輕量級對話,推薦使用
deepseek-chat或gemini-2.5-flash等低成本模型;對於高難度推理和編程,則推薦使用更強的 Claude 模型。 - 善用上下文缓存(Context Caching):在開發工具中,盡量保持 Prompt 前半部分結構穩定,這樣可以頻繁命中缓存,顯著節省輸入成本。
- 設定單次額度限制:在建立 API Key 時,為開發、測試等不同的 Key 分配獨立的最大額度,防止程式碼因死循環或異常調用導致意外透支。