QuarkMux

一个入口,所有模型。

协议不变,账单减半。

多渠道智能路由故障自动转移缓存命中自动降价
100 亿Token/日
99.99%SLA
<300ms首字
30+模型

官方牌价

单价为人民币/百万 tokens

模型输入输出
GLM 5.2quark/glm-5.2¥8¥28
GLM 5.2 Salequark/glm-5.2-sale¥2¥7
GLM 5.2 Fastquark/glm-5.2-fast¥12¥42
GLM 5.1quark/glm-5.1¥8¥28
DeepSeek V4 Proquark/deepseek-v4-pro¥3¥6
DeepSeek V4 Flashquark/deepseek-v4-flash¥1¥2
Kimi K3quark/kimi-k3¥20¥100
Kimi K2.7 Codequark/kimi-k2.7-code¥6.5¥27
Kimi K2.6quark/kimi-k2.6¥6.5¥27
查看全部模型

单价为人民币/百万 tokens;牌价变动同步生效。

改一行,跑起来。

Streaming, Function Calling, JSON Mode

quark.py
from openai import OpenAI

client = OpenAI(
    base_url="https://<node>.quark.ink/v1",  # <node> 在控制台查看
    api_key="qk_****",
)

resp = client.chat.completions.create(
    model="glm-5.2",
    messages=[{"role": "user", "content": "你好,Quark"}],
    stream=True,
)
完整 API 文档

网关替你操心。

智能路由按延迟与成功率自动调度
弹性吞吐高峰自动扩容,无需报备
缓存降价命中前缀自动打折
安全合规不留存、不训练、全程加密
实时账单用量成本分钟级可视化
企业通道SLA 合同与专线部署

把模型调用,交给 QuarkMux。