Skip to content

Flex 经济档 ​

Flex 是一档用等待时间换价格的选项。模型、上下文长度和输出质量与标准档完全一致,唯一的区别是排队优先级更低——换来的是便宜 40%。

本站不是 OpenAI、Anthropic 或 xAI 的官方服务,与上述公司没有隶属、授权或合作关系。

价格对比 ​

单位为每 100 万 token(输入 / 输出):

模型标准档Flex 档
gpt-5.5$10 / $60$6 / $36
gpt-5.6-terra$4 / $24$2.4 / $14.4
gpt-5.4-mini$1.5 / $9$0.9 / $5.4
gpt-5.6-luna$0.4 / $2.4$0.24 / $1.44

所有模型统一便宜 40%。

代价 ​

  • 请求会排队,延迟不可预期,同一个请求可能几秒返回,也可能等上几分钟。
  • 上游负载高时会直接返回 429,需要你自己重试。
  • 建议把客户端超时放宽到 300 秒以上,否则容易把排队误判成服务故障。

什么时候用 ​

适合:批量处理、离线分析、文档翻译、代码审查、数据清洗——这类任务你不会盯着屏幕等结果。

不适合:Claude Code、IDE 插件、聊天界面等交互式场景。那些请继续用标准档,否则会明显感到卡顿。

怎么用 ​

  1. 打开控制台的「令牌」页
  2. 新建令牌,把分组选为 Flex
  3. 用这个令牌的 Key 调用即可,模型名不用改
bash
curl https://api.treenew.online/v1/chat/completions \
  -H "Authorization: Bearer <你的 Flex 令牌 Key>" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "gpt-5.5",
    "messages": [{"role": "user", "content": "你好"}]
  }'

建议同时持有两个令牌

标准档和 Flex 档各建一个令牌,按任务性质分别使用:交互式用标准档,批处理用 Flex 档。

常见问题 ​

Flex 档的输出质量会变差吗?

不会。模型和参数完全一样,只有排队优先级不同。

我怎么确认请求确实走了 Flex?

响应体里会带 "service_tier": "flex" 字段。标准档则是 "service_tier": "default"。

排队要等多久?

不承诺具体时间。空闲时和标准档差别不大,高峰时可能明显变慢甚至返回 429。如果你的任务对时间敏感,请用标准档。