协议不变,账单减半。
多渠道智能路由故障自动转移缓存命中自动降价
100 亿Token/日
99.99%SLA
<300ms首字
30+模型
价目 · 对比官方牌价
| 模型 | 输入 | 输出 | 缓存 |
|---|---|---|---|
| glm-5.2Zhipu — 旗舰推理 | 3.4 折 | 3.0 折 | 2.5 折 |
| deepseek-v4-proDeepSeek — 深度推理 | 6.6 折 | 6.9 折 | 9.3 折 |
| deepseek-v4-flashDeepSeek — 极速高并发 | 2.7 折 | 2.7 折 | 2.9 折 |
| kimi-k2.7-codeMoonshot — 代码特化 | 2.8 折 | 2.8 折 | 2.8 折 |
| minimax-m3MiniMax — 新一代 | 2.8 折 | 2.8 折 | 2.8 折 |
| qwen3.7-plusAlibaba — 最新 Plus | 3.9 折 | 3.9 折 | — |
折扣按官方牌价实时换算,牌价变动同步生效。
改一行,跑起来。
Streaming · Function Calling · JSON Mode
from openai import OpenAI client = OpenAI( base_url="https://api.quark.ink/v1", # 只改这行 api_key="qk_****", ) resp = client.chat.completions.create( model="deepseek-v4-pro", messages=[{"role": "user", "content": "你好,Quark"}], stream=True, )
网关替你操心。
智能路由按延迟与成功率自动调度
弹性吞吐高峰自动扩容,无需报备
缓存降价命中前缀自动打折
安全合规不留存、不训练、全程加密
实时账单用量成本分钟级可视化
企业通道SLA 合同与专线部署