Skip to content

Gói Flex ​

Flex đánh đổi thời gian chờ lấy giá rẻ. Model, độ dài ngữ cảnh và chất lượng đầu ra hoàn toàn giống gói tiêu chuẩn — khác biệt duy nhất là mức ưu tiên hàng đợi thấp hơn, bù lại bạn trả ít hơn 40%.

Trang web này không phải dịch vụ chính thức của OpenAI, Anthropic hay xAI, và không có quan hệ trực thuộc, ủy quyền hay hợp tác với các công ty đó.

So sánh giá ​

Trên mỗi 1 triệu token (đầu vào / đầu ra):

ModelTiêu chuẩnFlex
gpt-5.5$10 / $60$6 / $36
gpt-5.6-terra$4 / $24$2.4 / $14.4
gpt-5.4-mini$1.5 / $9$0.9 / $5.4
gpt-5.6-luna$0.4 / $2.4$0.24 / $1.44

Mọi model đều rẻ hơn 40%.

Cái giá phải trả ​

  • Yêu cầu sẽ phải xếp hàng. Độ trễ không đoán trước: cùng một yêu cầu có thể trả về sau vài giây, cũng có thể mất vài phút.
  • Khi tải phía nhà cung cấp cao, bạn sẽ nhận 429 và phải tự thử lại.
  • Hãy nâng thời gian chờ (timeout) của client lên 300 giây trở lên, nếu không việc xếp hàng sẽ bị hiểu nhầm thành lỗi dịch vụ.

Khi nào nên dùng ​

Phù hợp: xử lý hàng loạt, phân tích ngoại tuyến, dịch tài liệu, review mã nguồn, làm sạch dữ liệu — những việc bạn không ngồi chờ trước màn hình.

Không phù hợp: Claude Code, plugin IDE, giao diện chat và các tình huống tương tác khác. Hãy giữ gói tiêu chuẩn cho chúng, nếu không bạn sẽ thấy chậm rõ rệt.

Cách sử dụng ​

  1. Mở trang «Token» trong bảng điều khiển
  2. Tạo token mới và đặt nhóm thành Flex
  3. Gọi API bằng Key của token đó — không cần đổi tên model
bash
curl https://api.treenew.online/v1/chat/completions \
  -H "Authorization: Bearer <Key token Flex của bạn>" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "gpt-5.5",
    "messages": [{"role": "user", "content": "Xin chào"}]
  }'

Nên giữ hai token

Tạo mỗi gói một token và chọn theo tính chất công việc: tiêu chuẩn cho tương tác, Flex cho xử lý hàng loạt.

Câu hỏi thường gặp ​

Chất lượng đầu ra của Flex có kém hơn không?

Không. Cùng model, cùng tham số — chỉ khác mức ưu tiên hàng đợi.

Làm sao xác nhận yêu cầu thực sự chạy qua Flex?

Phản hồi sẽ có trường "service_tier": "flex". Gói tiêu chuẩn là "service_tier": "default".

Phải chờ bao lâu?

Không cam kết thời gian cụ thể. Lúc rảnh thì gần như không khác gói tiêu chuẩn; lúc cao điểm có thể chậm rõ rệt hoặc trả về 429. Nếu tác vụ nhạy cảm về thời gian, hãy dùng gói tiêu chuẩn.