Quark

一个入口,所有模型。

协议不变,账单减半。

多渠道智能路由故障自动转移缓存命中自动降价
100 亿Token/日
99.99%SLA
<300ms首字
30+模型

价目 · 对比官方牌价

模型输入输出缓存
glm-5.2Zhipu旗舰推理3.4 折3.0 折2.5 折
deepseek-v4-proDeepSeek深度推理6.6 折6.9 折9.3 折
deepseek-v4-flashDeepSeek极速高并发2.7 折2.7 折2.9 折
kimi-k2.7-codeMoonshot代码特化2.8 折2.8 折2.8 折
minimax-m3MiniMax新一代2.8 折2.8 折2.8 折
qwen3.7-plusAlibaba最新 Plus3.9 折3.9 折
查看全部 30+ 模型 →

折扣按官方牌价实时换算,牌价变动同步生效。

改一行,跑起来。

Streaming · Function Calling · JSON Mode

quark.py
from openai import OpenAI

client = OpenAI(
    base_url="https://api.quark.ink/v1",  # 只改这行
    api_key="qk_****",
)

resp = client.chat.completions.create(
    model="deepseek-v4-pro",
    messages=[{"role": "user", "content": "你好,Quark"}],
    stream=True,
)
完整 API 文档 →

网关替你操心。

智能路由按延迟与成功率自动调度
弹性吞吐高峰自动扩容,无需报备
缓存降价命中前缀自动打折
安全合规不留存、不训练、全程加密
实时账单用量成本分钟级可视化
企业通道SLA 合同与专线部署

把模型调用,交给 Quark。