DeepSeek V4 Flash主推
quark/deepseek-v4-flash极致吞吐与首字延迟,高并发生产负载的默认路由。
上下文1M
最大输出384K
输入类型
输出类型
价目
输入$0.14/百万 tokens
输出$0.28/百万 tokens
缓存命中$0.0028/百万 tokens
单价为美元/百万 tokens;牌价变动同步生效。
规格
厂商DeepSeek
定位极速高并发
能力通用对话
接口协议OpenAI Chat Completions 兼容
接入示例
from openai import OpenAI client = OpenAI( base_url="https://<node>.quark.ink/v1", # <node> 在控制台查看 api_key="qk_****", ) resp = client.chat.completions.create( model="quark/deepseek-v4-flash", messages=[{"role": "user", "content": "你好,Quark"}], stream=True, )
替换 model 字段即可切换任意模型,其余代码零改动。