Trả trước, tính tiền theo token thật. Cache thông minh giúp hóa đơn rẻ hơn tới 50%. Đổi 2 dòng code là chạy — dùng ngay SDK OpenAI bạn đang có.
# pip install openai — that's it from openai import OpenAI client = OpenAI( base_url="https://api.clfaigateway.dev/v1", api_key="sk-gw-...", ) r = client.chat.completions.create( model="kimi-k2.6", messages=[{"role": "user", "content": "Xin chào!"}], stream=True, )
Xây cho developer — minh bạch từng token, từng đồng.
Đổi base_url và api_key — SDK Python/Node/Vercel AI chạy nguyên bản. Streaming, function calling, JSON mode đầy đủ.
Prefix cache tự động rẻ hơn ~6× cho input lặp lại; trúng cache toàn phần chỉ tính 10% giá. Tiết kiệm hiện ngay trên dashboard.
Biết chính xác model nào chạy, bao nhiêu token (kể cả reasoning), tốc độ đo thật. Không markup ẩn, không model 'giả danh'.
Nạp bằng chuyển khoản VietQR (tự động trong 15 giây) hoặc thẻ quốc tế. Dashboard song ngữ Việt–Anh.
Giá theo 1 triệu token (USD). Nguồn chạy công khai — bạn biết chính xác mình mua gì.
| Model | Khả năng | Context | Input | Input (cache) | Output |
|---|---|---|---|---|---|
| glm-5.2 @cf/zai-org/glm-5.2 |
toolsreasoningjson | 262K | $1.96 | $0.364 | $6.16 |
| kimi-k2.7-code @cf/moonshotai/kimi-k2.7-code |
toolsvisionreasoning | 262K | $1.33 | $0.266 | $5.60 |
| kimi-k2.6 @cf/moonshotai/kimi-k2.6 |
toolsvisionreasoning | 262K | $1.33 | $0.224 | $5.60 |
| glm-4.7-flash @cf/zai-org/glm-4.7-flash |
toolsreasoning⚡ fast | 131K | $0.084 | — | $0.56 |
Trúng cache toàn phần: chỉ tính 10% giá thường. Giá có thể điều chỉnh trước khi ra mắt.
Không thẻ tín dụng bắt buộc. Không hợp đồng.
Đăng ký, nhận API key sk-gw-... trong 30 giây.
VietQR tự động xác nhận trong ~15 giây, hoặc thẻ Visa/Mastercard.
Trỏ SDK OpenAI về api.clfaigateway.dev — xong. Theo dõi usage & chi phí realtime.