DeepSeek V4 Flash主推
quark/deepseek-v4-flash已切换至 deepseek-v4-flash-0731 版,DeepSWE 54.4。高吞吐、低延迟,适用于高并发在线服务与批量处理。
上下文1M
最大输出384K
输入类型
输出类型
价目
输入¥1.5/百万 tokens
输出¥4.5/百万 tokens
缓存命中¥0.05/百万 tokens
单价为人民币/百万 tokens;牌价变动同步生效。
规格
厂商DeepSeek
定位极速高并发
能力通用对话
接口协议OpenAI Chat Completions 兼容
接入示例
from openai import OpenAI client = OpenAI( base_url="https://<node>.quark.ink/v1", # <node> 在控制台查看 api_key="qk_****", ) resp = client.chat.completions.create( model="quark/deepseek-v4-flash", messages=[{"role": "user", "content": "你好,Quark"}], stream=True, )
替换 model 字段即可切换任意模型,其余代码零改动。