Offre Flex
Flex échange du temps d'attente contre un tarif réduit. Les modèles, la longueur de contexte et la qualité des réponses sont identiques à l'offre standard — la seule différence est une priorité de file d'attente plus basse, en échange de 40 % d'économie.
Ce site n'est pas un service officiel d'OpenAI, Anthropic ou xAI, et n'a aucun lien d'affiliation, d'autorisation ou de partenariat avec ces entreprises.
Comparaison des tarifs
Par million de tokens (entrée / sortie) :
| Modèle | Standard | Flex |
|---|---|---|
gpt-5.5 | $10 / $60 | $6 / $36 |
gpt-5.6-terra | $4 / $24 | $2.4 / $14.4 |
gpt-5.4-mini | $1.5 / $9 | $0.9 / $5.4 |
gpt-5.6-luna | $0.4 / $2.4 | $0.24 / $1.44 |
Tous les modèles sont 40 % moins chers.
Contreparties
- Les requêtes sont mises en file d'attente. La latence est imprévisible : une même requête peut répondre en quelques secondes ou prendre plusieurs minutes.
- En cas de forte charge en amont, vous recevrez un 429 et devrez réessayer vous-même.
- Portez le délai d'expiration de votre client à 300 secondes ou plus, sinon l'attente ressemblera à une panne.
Quand l'utiliser
Adapté : traitement par lots, analyse hors ligne, traduction de documents, revue de code, nettoyage de données — tout ce pour quoi vous n'attendez pas devant l'écran.
Peu adapté : Claude Code, extensions d'IDE, interfaces de chat et autres usages interactifs. Gardez l'offre standard pour ceux-là, sinon la lenteur sera perceptible.
Comment l'utiliser
- Ouvrez la page « Jetons » de la console
- Créez un jeton et définissez son groupe sur Flex
- Appelez l'API avec la clé de ce jeton — les noms de modèles ne changent pas
curl https://api.treenew.online/v1/chat/completions \
-H "Authorization: Bearer <clé de votre jeton Flex>" \
-H "Content-Type: application/json" \
-d '{
"model": "gpt-5.5",
"messages": [{"role": "user", "content": "Bonjour"}]
}'Conservez deux jetons
Créez un jeton par offre et choisissez selon la charge de travail : standard pour l'interactif, Flex pour les traitements par lots.
Questions fréquentes
La qualité des réponses est-elle moindre en Flex ?
Non. Même modèle, mêmes paramètres — seule la priorité de file d'attente diffère.
Comment vérifier qu'une requête est bien passée en Flex ?
La réponse contient "service_tier": "flex". En offre standard, c'est "service_tier": "default".
Combien de temps dure l'attente ?
Aucune garantie. Aux heures creuses, c'est proche de l'offre standard ; aux heures de pointe, cela peut être nettement plus lent, voire renvoyer un 429. Si votre tâche est sensible au temps, utilisez l'offre standard.