DeepSeek
DeepSeek V4 Flash
DeepSeek 面向高并发、低延迟场景的 V4 Flash 模型,支持文本输入与文本输出
模型类型大语言模型 (LLM)
多模态支持文本输入,文本输出
API 可用性支持 Chat Completions API
定价与规格
💰 定价
输入$3 / M tokens
输出$9 / M tokens
缓存命中$0.1 / M tokens
⚙️ 规格
模型类型大语言模型 (LLM)
多模态支持文本输入,文本输出
API 可用性支持 Chat Completions API
缓存支持支持缓存输入计费(Cached Input)
定位面向低延迟、高并发、成本敏感场景优化
提供方DeepSeek
API 调用示例
Python (OpenAI SDK)
from openai import OpenAI
client = OpenAI(
api_key="your-api-key",
base_url="https://api.yairouter.com/v1"
)
response = client.chat.completions.create(
model="deepseek-v4-flash",
messages=[
{"role": "user", "content": "请帮我总结这段需求并拆成开发任务"}
]
)
print(response.choices[0].message.content)cURL (OpenAI API)
curl https://api.yairouter.com/v1/chat/completions \
-H "Content-Type: application/json" \
-H "Authorization: Bearer YOUR_API_KEY" \
-d '{
"model": "deepseek-v4-flash",
"messages": [
{"role": "user", "content": "请帮我总结这段需求并拆成开发任务"}
]
}'