Flex 經濟檔
Flex 是一檔用等待時間換價格的選項。模型、上下文長度與輸出品質與標準檔完全一致,唯一的差別是排隊優先權較低——換來的是便宜 40%。
本站不是 OpenAI、Anthropic 或 xAI 的官方服務,與上述公司沒有隸屬、授權或合作關係。
價格對比
單位為每 100 萬 token(輸入 / 輸出):
| 模型 | 標準檔 | Flex 檔 |
|---|---|---|
gpt-5.5 | $10 / $60 | $6 / $36 |
gpt-5.6-terra | $4 / $24 | $2.4 / $14.4 |
gpt-5.4-mini | $1.5 / $9 | $0.9 / $5.4 |
gpt-5.6-luna | $0.4 / $2.4 | $0.24 / $1.44 |
所有模型統一便宜 40%。
代價
- 請求會排隊,延遲不可預期,同一個請求可能幾秒返回,也可能等上幾分鐘。
- 上游負載高時會直接返回 429,需要你自己重試。
- 建議把用戶端逾時放寬到 300 秒以上,否則容易把排隊誤判成服務故障。
什麼時候用
適合:批次處理、離線分析、文件翻譯、程式碼審查、資料清洗——這類任務你不會盯著螢幕等結果。
不適合:Claude Code、IDE 外掛、聊天介面等互動式場景。那些請繼續用標準檔,否則會明顯感到卡頓。
怎麼用
- 開啟控制台的「令牌」頁
- 新建令牌,把分組選為 Flex
- 用這個令牌的 Key 呼叫即可,模型名稱不用改
bash
curl https://api.treenew.online/v1/chat/completions \
-H "Authorization: Bearer <你的 Flex 令牌 Key>" \
-H "Content-Type: application/json" \
-d '{
"model": "gpt-5.5",
"messages": [{"role": "user", "content": "你好"}]
}'建議同時持有兩個令牌
標準檔與 Flex 檔各建一個令牌,依任務性質分別使用:互動式用標準檔,批次處理用 Flex 檔。
常見問題
Flex 檔的輸出品質會變差嗎?
不會。模型與參數完全一樣,只有排隊優先權不同。
我怎麼確認請求確實走了 Flex?
回應內容裡會帶 "service_tier": "flex" 欄位。標準檔則是 "service_tier": "default"。
排隊要等多久?
不承諾具體時間。空閒時與標準檔差別不大,尖峰時可能明顯變慢甚至返回 429。如果你的任務對時間敏感,請用標準檔。