gemini-3.5-flash

Text

Designed for efficient multimodal AI tasks, offering strong coding, reasoning, real-time chat, and agent execution at Flash-tier cost and speed.

Prix d'entrée

$1.27515 % de réduction

Marché : $1.5

/ M

Prix de sortie

$7.6515 % de réduction

Marché : $9

/ M

Lecture cache

$0.127515 % de réduction

Marché : $0.15

/ M

Écriture du cache

$0.070815 % de réduction

Marché : $0.0833

/ M

Entrée

Texte

Sortie

Texte

API

Démarrage rapide

Code prêt à copier pour appeler ce modèle via l'API compatible OpenAI d'EasyAPI.

1

Obtenir votre clé API

Créez un jeton API dans la console et définissez-le comme variable d'environnement :

Remplacez sk-xxxxxxxx par votre jeton API depuis la console (Bearer Token).

Créer un jeton API
shell
export EASYAPI_API_KEY=sk-xxxxxxxx
2

Effectuer votre première requête

Utilisez google/gemini-3.5-flash avec l'API EasyAPI :

cURL
curl https://token.easyapi.com/v1/chat/completions \
  -H "Content-Type: application/json" \
  -H "Authorization: Bearer $EASYAPI_API_KEY" \
  -d '{"model":"google/gemini-3.5-flash","messages":[{"role":"user","content":"Hello!"}]}'
3

Activer le streaming

Ajoutez "stream": true au corps de la requête pour recevoir les réponses en SSE :

curl
curl -N https://token.easyapi.com/v1/chat/completions \
  -H "Content-Type: application/json" \
  -H "Authorization: Bearer $EASYAPI_API_KEY" \
  -d '{"model":"google/gemini-3.5-flash","messages":[{"role":"user","content":"Hello!"}],"stream":true}'

Point de terminaison

Envoie une requête de complétion de chat. Prend en charge le streaming et le mode non-streaming.

POSThttps://token.easyapi.com/v1/chat/completions
Authorization
Bearer $EASYAPI_API_KEY
Content-Type
application/json
Model
google/gemini-3.5-flash

发送对话补全请求,支持流式与非流式。 Docs

GEThttps://token.easyapi.com/v1/models
Authorization
Bearer $EASYAPI_API_KEY

获取当前账户可用模型列表。 Docs

Paramètres

NomTypePar défautDescription
modelstring模型 ID,如 openai/gpt-4o、anthropic/claude-3-5-sonnet
messagesarray对话消息列表,每项含 role 与 content
streambooleanfalse设为 true 时以 SSE 流式返回
temperaturefloat1采样温度,越高越随机
max_tokensinteger单次回复最大生成 Token 数
top_pfloat1核采样,限制候选词累积概率
frequency_penaltyfloat0频率惩罚,降低重复用词
presence_penaltyfloat0存在惩罚,鼓励新话题

Utiliser des SDK tiers

Les SDK officiels OpenAI et autres fonctionnent en changeant le base URL. Voir guide d'intégration