Flex 经济档
Flex 是一档用等待时间换价格的选项。模型、上下文长度和输出质量与标准档完全一致,唯一的区别是排队优先级更低——换来的是便宜 40%。
本站不是 OpenAI、Anthropic 或 xAI 的官方服务,与上述公司没有隶属、授权或合作关系。
价格对比
单位为每 100 万 token(输入 / 输出):
| 模型 | 标准档 | Flex 档 |
|---|---|---|
gpt-5.5 | $10 / $60 | $6 / $36 |
gpt-5.6-terra | $4 / $24 | $2.4 / $14.4 |
gpt-5.4-mini | $1.5 / $9 | $0.9 / $5.4 |
gpt-5.6-luna | $0.4 / $2.4 | $0.24 / $1.44 |
所有模型统一便宜 40%。
代价
- 请求会排队,延迟不可预期,同一个请求可能几秒返回,也可能等上几分钟。
- 上游负载高时会直接返回 429,需要你自己重试。
- 建议把客户端超时放宽到 300 秒以上,否则容易把排队误判成服务故障。
什么时候用
适合:批量处理、离线分析、文档翻译、代码审查、数据清洗——这类任务你不会盯着屏幕等结果。
不适合:Claude Code、IDE 插件、聊天界面等交互式场景。那些请继续用标准档,否则会明显感到卡顿。
怎么用
- 打开控制台的「令牌」页
- 新建令牌,把分组选为 Flex
- 用这个令牌的 Key 调用即可,模型名不用改
bash
curl https://api.treenew.online/v1/chat/completions \
-H "Authorization: Bearer <你的 Flex 令牌 Key>" \
-H "Content-Type: application/json" \
-d '{
"model": "gpt-5.5",
"messages": [{"role": "user", "content": "你好"}]
}'建议同时持有两个令牌
标准档和 Flex 档各建一个令牌,按任务性质分别使用:交互式用标准档,批处理用 Flex 档。
常见问题
Flex 档的输出质量会变差吗?
不会。模型和参数完全一样,只有排队优先级不同。
我怎么确认请求确实走了 Flex?
响应体里会带 "service_tier": "flex" 字段。标准档则是 "service_tier": "default"。
排队要等多久?
不承诺具体时间。空闲时和标准档差别不大,高峰时可能明显变慢甚至返回 429。如果你的任务对时间敏感,请用标准档。