deepseek-v4.1-flash

文本

DeepSeek-V4.1-Flash 是 DeepSeek 当前主力模型,官方 API 模型名为 deepseek-flash。支持 1M 上下文与最大 384K 输出,默认可切换思考/非思考模式,具备图像理解、工具调用、JSON Output,并兼容 OpenAI 与 Anthropic API。

输入价格

$0.096935% 折扣

市场价:$0.1491

/ M

输出价格

$0.387535% 折扣

市场价:$0.5962

/ M

缓存读

$0.001935% 折扣

市场价:$0.0029

/ M

输入

文本

输出

文本

按峰谷计费

价格随 北京时间 时段浮动

当前为高峰时段

分时价格表

  • 输入
    平时$0.0969
    高峰时段$0.1937
  • 输出
    平时$0.3875
    高峰时段$0.775
  • 缓存读取
    平时$0.0019
    高峰时段$0.0039
字段平时高峰时段
输入$0.0969$0.1937
输出$0.3875$0.775
缓存读取$0.0019$0.0039

高峰时段(北京时间),每日:09:00 - 12:00、14:00 - 18:00

API

快速开始

复制即用,通过 EasyAPI 的 OpenAI 兼容 API 调用本模型。

1

获取 API 令牌

在控制台创建 API 令牌,并设置为环境变量:

将 sk-xxxxxxxx 替换为控制台颁发的 API 令牌(Bearer Token)。

创建 API 令牌
shell
export EASYAPI_API_KEY=sk-xxxxxxxx
2

发起第一次请求

使用 deepseek/deepseek-v4.1-flash 调用 EasyAPI:

cURL
curl https://token.easyapi.com/v1/chat/completions \
  -H "Content-Type: application/json" \
  -H "Authorization: Bearer $EASYAPI_API_KEY" \
  -d '{"model":"deepseek/deepseek-v4.1-flash","messages":[{"role":"user","content":"Hello!"}]}'
3

启用流式输出

在请求体中加入 "stream": true,并以 SSE 方式接收响应:

curl
curl -N https://token.easyapi.com/v1/chat/completions \
  -H "Content-Type: application/json" \
  -H "Authorization: Bearer $EASYAPI_API_KEY" \
  -d '{"model":"deepseek/deepseek-v4.1-flash","messages":[{"role":"user","content":"Hello!"}],"stream":true}'

端点

向模型发送对话补全请求,支持流式与非流式。

POSThttps://token.easyapi.com/v1/chat/completions
Authorization
Bearer $EASYAPI_API_KEY
Content-Type
application/json
Model
deepseek/deepseek-v4.1-flash

发送对话补全请求,支持流式与非流式。 文档

GEThttps://token.easyapi.com/v1/models
Authorization
Bearer $EASYAPI_API_KEY

获取当前账户可用模型列表。 文档

参数

名称类型默认值说明
modelstring模型 ID,如 openai/gpt-4o、anthropic/claude-3-5-sonnet
messagesarray对话消息列表,每项含 role 与 content
streambooleanfalse设为 true 时以 SSE 流式返回
temperaturefloat1采样温度,越高越随机
max_tokensinteger单次回复最大生成 Token 数
top_pfloat1核采样,限制候选词累积概率
frequency_penaltyfloat0频率惩罚,降低重复用词
presence_penaltyfloat0存在惩罚,鼓励新话题

使用第三方 SDK

OpenAI、Anthropic 等官方 SDK 均可通过替换 base_url 接入,详见 标准接入文档