Skip to content

Flex 經濟檔 ​

Flex 是一檔用等待時間換價格的選項。模型、上下文長度與輸出品質與標準檔完全一致,唯一的差別是排隊優先權較低——換來的是便宜 40%。

本站不是 OpenAI、Anthropic 或 xAI 的官方服務,與上述公司沒有隸屬、授權或合作關係。

價格對比 ​

單位為每 100 萬 token(輸入 / 輸出):

模型標準檔Flex 檔
gpt-5.5$10 / $60$6 / $36
gpt-5.6-terra$4 / $24$2.4 / $14.4
gpt-5.4-mini$1.5 / $9$0.9 / $5.4
gpt-5.6-luna$0.4 / $2.4$0.24 / $1.44

所有模型統一便宜 40%。

代價 ​

  • 請求會排隊,延遲不可預期,同一個請求可能幾秒返回,也可能等上幾分鐘。
  • 上游負載高時會直接返回 429,需要你自己重試。
  • 建議把用戶端逾時放寬到 300 秒以上,否則容易把排隊誤判成服務故障。

什麼時候用 ​

適合:批次處理、離線分析、文件翻譯、程式碼審查、資料清洗——這類任務你不會盯著螢幕等結果。

不適合:Claude Code、IDE 外掛、聊天介面等互動式場景。那些請繼續用標準檔,否則會明顯感到卡頓。

怎麼用 ​

  1. 開啟控制台的「令牌」頁
  2. 新建令牌,把分組選為 Flex
  3. 用這個令牌的 Key 呼叫即可,模型名稱不用改
bash
curl https://api.treenew.online/v1/chat/completions \
  -H "Authorization: Bearer <你的 Flex 令牌 Key>" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "gpt-5.5",
    "messages": [{"role": "user", "content": "你好"}]
  }'

建議同時持有兩個令牌

標準檔與 Flex 檔各建一個令牌,依任務性質分別使用:互動式用標準檔,批次處理用 Flex 檔。

常見問題 ​

Flex 檔的輸出品質會變差嗎?

不會。模型與參數完全一樣,只有排隊優先權不同。

我怎麼確認請求確實走了 Flex?

回應內容裡會帶 "service_tier": "flex" 欄位。標準檔則是 "service_tier": "default"。

排隊要等多久?

不承諾具體時間。空閒時與標準檔差別不大,尖峰時可能明顯變慢甚至返回 429。如果你的任務對時間敏感,請用標準檔。