协议不变,账单减半。
多渠道智能路由故障自动转移缓存命中自动降价
100 亿Token/日
99.99%SLA
<300ms首字
30+模型
官方牌价
单价为人民币/百万 tokens
| 模型 | 输入 | 输出 |
|---|---|---|
| GLM 5.2quark/glm-5.2 | ¥8 | ¥28 |
| GLM 5.2 Salequark/glm-5.2-sale | ¥2 | ¥7 |
| GLM 5.2 Fastquark/glm-5.2-fast | ¥12 | ¥42 |
| GLM 5.1quark/glm-5.1 | ¥8 | ¥28 |
| DeepSeek V4 Proquark/deepseek-v4-pro | ¥3 | ¥6 |
| DeepSeek V4 Flashquark/deepseek-v4-flash | ¥1 | ¥2 |
| Kimi K3quark/kimi-k3 | ¥20 | ¥100 |
| Kimi K2.7 Codequark/kimi-k2.7-code | ¥6.5 | ¥27 |
| Kimi K2.6quark/kimi-k2.6 | ¥6.5 | ¥27 |
单价为人民币/百万 tokens;牌价变动同步生效。
改一行,跑起来。
Streaming, Function Calling, JSON Mode
from openai import OpenAI client = OpenAI( base_url="https://<node>.quark.ink/v1", # <node> 在控制台查看 api_key="qk_****", ) resp = client.chat.completions.create( model="glm-5.2", messages=[{"role": "user", "content": "你好,Quark"}], stream=True, )
网关替你操心。
智能路由按延迟与成功率自动调度
弹性吞吐高峰自动扩容,无需报备
缓存降价命中前缀自动打折
安全合规不留存、不训练、全程加密
实时账单用量成本分钟级可视化
企业通道SLA 合同与专线部署