Skip to content

Offre Flex ​

Flex échange du temps d'attente contre un tarif réduit. Les modèles, la longueur de contexte et la qualité des réponses sont identiques à l'offre standard — la seule différence est une priorité de file d'attente plus basse, en échange de 40 % d'économie.

Ce site n'est pas un service officiel d'OpenAI, Anthropic ou xAI, et n'a aucun lien d'affiliation, d'autorisation ou de partenariat avec ces entreprises.

Comparaison des tarifs ​

Par million de tokens (entrée / sortie) :

ModèleStandardFlex
gpt-5.5$10 / $60$6 / $36
gpt-5.6-terra$4 / $24$2.4 / $14.4
gpt-5.4-mini$1.5 / $9$0.9 / $5.4
gpt-5.6-luna$0.4 / $2.4$0.24 / $1.44

Tous les modèles sont 40 % moins chers.

Contreparties ​

  • Les requêtes sont mises en file d'attente. La latence est imprévisible : une même requête peut répondre en quelques secondes ou prendre plusieurs minutes.
  • En cas de forte charge en amont, vous recevrez un 429 et devrez réessayer vous-même.
  • Portez le délai d'expiration de votre client à 300 secondes ou plus, sinon l'attente ressemblera à une panne.

Quand l'utiliser ​

Adapté : traitement par lots, analyse hors ligne, traduction de documents, revue de code, nettoyage de données — tout ce pour quoi vous n'attendez pas devant l'écran.

Peu adapté : Claude Code, extensions d'IDE, interfaces de chat et autres usages interactifs. Gardez l'offre standard pour ceux-là, sinon la lenteur sera perceptible.

Comment l'utiliser ​

  1. Ouvrez la page « Jetons » de la console
  2. Créez un jeton et définissez son groupe sur Flex
  3. Appelez l'API avec la clé de ce jeton — les noms de modèles ne changent pas
bash
curl https://api.treenew.online/v1/chat/completions \
  -H "Authorization: Bearer <clé de votre jeton Flex>" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "gpt-5.5",
    "messages": [{"role": "user", "content": "Bonjour"}]
  }'

Conservez deux jetons

Créez un jeton par offre et choisissez selon la charge de travail : standard pour l'interactif, Flex pour les traitements par lots.

Questions fréquentes ​

La qualité des réponses est-elle moindre en Flex ?

Non. Même modèle, mêmes paramètres — seule la priorité de file d'attente diffère.

Comment vérifier qu'une requête est bien passée en Flex ?

La réponse contient "service_tier": "flex". En offre standard, c'est "service_tier": "default".

Combien de temps dure l'attente ?

Aucune garantie. Aux heures creuses, c'est proche de l'offre standard ; aux heures de pointe, cela peut être nettement plus lent, voire renvoyer un 429. Si votre tâche est sensible au temps, utilisez l'offre standard.