Flex エコノミー
Flex は待ち時間と引き換えに価格を下げるティアです。モデル、コンテキスト長、出力品質は標準ティアとまったく同じで、違いはキューの優先度が低いことだけ。その代わり 40% 安くなります。
当サイトは OpenAI、Anthropic、xAI の公式サービスではなく、これらの企業との提携・認可・協力関係はありません。
価格比較
100 万トークンあたり(入力 / 出力):
| モデル | 標準ティア | Flex ティア |
|---|---|---|
gpt-5.5 | $10 / $60 | $6 / $36 |
gpt-5.6-terra | $4 / $24 | $2.4 / $14.4 |
gpt-5.4-mini | $1.5 / $9 | $0.9 / $5.4 |
gpt-5.6-luna | $0.4 / $2.4 | $0.24 / $1.44 |
すべてのモデルが一律 40% 安くなります。
代償
- リクエストはキューに入ります。 遅延は予測できず、同じリクエストでも数秒で返ることもあれば数分待つこともあります。
- 上流の負荷が高いときは 429 が返るため、リトライは自分で行う必要があります。
- クライアントのタイムアウトは 300 秒以上に設定してください。そうしないとキュー待ちを障害と誤認します。
どんなときに使うか
向いている用途:バッチ処理、オフライン分析、ドキュメント翻訳、コードレビュー、データクレンジングなど、画面の前で結果を待たない処理。
向かない用途:Claude Code、IDE プラグイン、チャット UI などの対話的な用途。これらは標準ティアのままにしてください。体感で明らかに遅くなります。
使い方
- コンソールの「トークン」ページを開く
- トークンを新規作成し、グループを Flex に設定する
- そのトークンの Key で呼び出すだけ。モデル名は変更不要です
bash
curl https://api.treenew.online/v1/chat/completions \
-H "Authorization: Bearer <あなたの Flex トークンの Key>" \
-H "Content-Type: application/json" \
-d '{
"model": "gpt-5.5",
"messages": [{"role": "user", "content": "こんにちは"}]
}'トークンは 2 つ持つことを推奨
標準ティアと Flex ティアでトークンを分けて作り、用途で使い分けてください。対話的な作業は標準、バッチ処理は Flex。
よくある質問
Flex では出力品質が落ちますか?
落ちません。モデルもパラメータも同じで、違うのはキューの優先度だけです。
実際に Flex で処理されたか確認するには?
レスポンスに "service_tier": "flex" が含まれます。標準ティアなら "service_tier": "default" です。
どのくらい待ちますか?
保証はありません。空いているときは標準ティアとほぼ変わりませんが、ピーク時は明らかに遅くなったり 429 が返ったりします。時間に厳しい処理には標準ティアを使ってください。