deepseek-v4.1-flash

文本

DeepSeek-V4.1-Flash 是 DeepSeek 当前主力模型,官方 API 模型名为 deepseek-flash。支持 1M 上下文与最大 384K 输出,默认可切换思考/非思考模式,具备图像理解、工具调用、JSON Output,并兼容 OpenAI 与 Anthropic API。

Prix d'entrée

$0.096935 % de réduction

Marché : $0.1491

/ M

Prix de sortie

$0.387535 % de réduction

Marché : $0.5962

/ M

Lecture cache

$0.001935 % de réduction

Marché : $0.0029

/ M

Entrée

Texte

Sortie

Texte

Heures creuses / heures de pointe

Les prix varient selon l'heure (UTC+8)

Actuellement en heures de pointe

Tarifs selon l'heure

  • Entrée
    Heures creuses$0.0969
    Heures de pointe$0.1937
  • Sortie
    Heures creuses$0.3875
    Heures de pointe$0.775
  • Lecture cache
    Heures creuses$0.0019
    Heures de pointe$0.0039
PosteHeures creusesHeures de pointe
Entrée$0.0969$0.1937
Sortie$0.3875$0.775
Lecture cache$0.0019$0.0039

Heures de pointe (UTC+8) : 09:00 - 12:00、14:00 - 18:00

API

Démarrage rapide

Code prêt à copier pour appeler ce modèle via l'API compatible OpenAI d'EasyAPI.

1

Obtenir votre clé API

Créez un jeton API dans la console et définissez-le comme variable d'environnement :

Remplacez sk-xxxxxxxx par votre jeton API depuis la console (Bearer Token).

Créer un jeton API
shell
export EASYAPI_API_KEY=sk-xxxxxxxx
2

Effectuer votre première requête

Utilisez deepseek/deepseek-v4.1-flash avec l'API EasyAPI :

cURL
curl https://token.easyapi.com/v1/chat/completions \
  -H "Content-Type: application/json" \
  -H "Authorization: Bearer $EASYAPI_API_KEY" \
  -d '{"model":"deepseek/deepseek-v4.1-flash","messages":[{"role":"user","content":"Hello!"}]}'
3

Activer le streaming

Ajoutez "stream": true au corps de la requête pour recevoir les réponses en SSE :

curl
curl -N https://token.easyapi.com/v1/chat/completions \
  -H "Content-Type: application/json" \
  -H "Authorization: Bearer $EASYAPI_API_KEY" \
  -d '{"model":"deepseek/deepseek-v4.1-flash","messages":[{"role":"user","content":"Hello!"}],"stream":true}'

Point de terminaison

Envoie une requête de complétion de chat. Prend en charge le streaming et le mode non-streaming.

POSThttps://token.easyapi.com/v1/chat/completions
Authorization
Bearer $EASYAPI_API_KEY
Content-Type
application/json
Model
deepseek/deepseek-v4.1-flash

Envoie une requête de complétion de chat, en streaming ou non. Docs

GEThttps://token.easyapi.com/v1/models
Authorization
Bearer $EASYAPI_API_KEY

Liste les modèles disponibles pour le compte actuel. Docs

Paramètres

NomTypePar défautDescription
modelstringID du modèle, par ex. openai/gpt-4o ou anthropic/claude-3-5-sonnet
messagesarrayListe des messages de la conversation, chacun avec role et content
streambooleanfalseSi true, la réponse est diffusée en SSE
temperaturefloat1Température d’échantillonnage ; plus elle est élevée, plus la sortie est aléatoire
max_tokensintegerNombre maximal de tokens générés par réponse
top_pfloat1Échantillonnage nucleus ; limite la probabilité cumulée des tokens candidats
frequency_penaltyfloat0Pénalité de fréquence ; réduit les répétitions
presence_penaltyfloat0Pénalité de présence ; encourage de nouveaux sujets

Utiliser des SDK tiers

Les SDK officiels OpenAI et autres fonctionnent en changeant le base URL. Voir guide d'intégration