deepseek-v4.1-flash

文本

DeepSeek-V4.1-Flash 是 DeepSeek 当前主力模型,官方 API 模型名为 deepseek-flash。支持 1M 上下文与最大 384K 输出,默认可切换思考/非思考模式,具备图像理解、工具调用、JSON Output,并兼容 OpenAI 与 Anthropic API。

入力価格

$0.096935% オフ

市場価格:$0.1491

/ M

出力価格

$0.387535% オフ

市場価格:$0.5962

/ M

キャッシュ読取

$0.001935% オフ

市場価格:$0.0029

/ M

入力

テキスト

出力

テキスト

ピーク/オフピーク課金

価格は UTC+8 の時間帯で変動します

現在ピーク

時間帯別価格表

  • 入力
    オフピーク$0.0969
    ピーク$0.1937
  • 出力
    オフピーク$0.3875
    ピーク$0.775
  • キャッシュ読取
    オフピーク$0.0019
    ピーク$0.0039
段階オフピークピーク
入力$0.0969$0.1937
出力$0.3875$0.775
キャッシュ読取$0.0019$0.0039

ピーク(UTC+8):09:00 - 12:00、14:00 - 18:00

API

クイックスタート

EasyAPI の OpenAI 互換 API でこのモデルを呼び出す、コピーして使えるコード。

1

API キーを取得

コンソールで API トークンを作成し、環境変数に設定します:

sk-xxxxxxxx をコンソールで発行した API トークン(Bearer Token)に置き換えてください。

API トークンを作成
shell
export EASYAPI_API_KEY=sk-xxxxxxxx
2

最初のリクエストを送信

モデル ID deepseek/deepseek-v4.1-flash を使って EasyAPI を呼び出します:

cURL
curl https://token.easyapi.com/v1/chat/completions \
  -H "Content-Type: application/json" \
  -H "Authorization: Bearer $EASYAPI_API_KEY" \
  -d '{"model":"deepseek/deepseek-v4.1-flash","messages":[{"role":"user","content":"Hello!"}]}'
3

ストリーミングを有効化

リクエストボディに "stream": true を追加し、SSE で応答を受け取ります:

curl
curl -N https://token.easyapi.com/v1/chat/completions \
  -H "Content-Type: application/json" \
  -H "Authorization: Bearer $EASYAPI_API_KEY" \
  -d '{"model":"deepseek/deepseek-v4.1-flash","messages":[{"role":"user","content":"Hello!"}],"stream":true}'

エンドポイント

チャット補完リクエストを送信します。ストリーミングと非ストリーミングに対応。

POSThttps://token.easyapi.com/v1/chat/completions
Authorization
Bearer $EASYAPI_API_KEY
Content-Type
application/json
Model
deepseek/deepseek-v4.1-flash

チャット補完リクエストを送信します。ストリーミング/非ストリーミングの両方に対応。 ドキュメント

GEThttps://token.easyapi.com/v1/models
Authorization
Bearer $EASYAPI_API_KEY

現在のアカウントで利用可能なモデル一覧を取得します。 ドキュメント

パラメータ

名前デフォルト説明
modelstringモデル ID(例:openai/gpt-4o、anthropic/claude-3-5-sonnet)
messagesarray会話メッセージのリスト。各要素に role と content を含みます
streambooleanfalsetrue の場合、SSE でストリーミング返却します
temperaturefloat1サンプリング温度。高いほどランダムになります
max_tokensinteger1 回の応答で生成する最大トークン数
top_pfloat1核サンプリング。候補トークンの累積確率を制限します
frequency_penaltyfloat0頻度ペナルティ。同じ語の繰り返しを減らします
presence_penaltyfloat0存在ペナルティ。新しい話題を促します

サードパーティ SDK の利用

OpenAI など公式 SDK は base URL を差し替えるだけで利用できます。詳細は 統合ガイド