DeepSeek V4 Flash主推

quark/deepseek-v4-flash

已切换至 deepseek-v4-flash-0731 版,DeepSWE 54.4。高吞吐、低延迟,适用于高并发在线服务与批量处理。

上下文1M
最大输出384K
输入类型
输出类型

价目

输入¥1.5/百万 tokens
输出¥4.5/百万 tokens
缓存命中¥0.05/百万 tokens

单价为人民币/百万 tokens;牌价变动同步生效。

规格

厂商DeepSeek
定位极速高并发
能力通用对话
接口协议OpenAI Chat Completions 兼容

接入示例

quark.py
from openai import OpenAI

client = OpenAI(
    base_url="https://<node>.quark.ink/v1",  # <node> 在控制台查看
    api_key="qk_****",
)

resp = client.chat.completions.create(
    model="quark/deepseek-v4-flash",
    messages=[{"role": "user", "content": "你好,Quark"}],
    stream=True,
)

替换 model 字段即可切换任意模型,其余代码零改动。

获取 API Key查看 API 文档