glm-4.6

Text

Text-only model in the GLM-4 family with improved coding benchmarks and tool calls during reasoning, suited for software development and agent workflows.

Prix d'entrée

$0.487915 % de réduction

Marché : $0.574

/ M

Prix de sortie

$1.949915 % de réduction

Marché : $2.294

/ M

Lecture cache

$0.097715 % de réduction

Marché : $0.1149

/ M

Écriture du cache

$015 % de réduction

/ M

Entrée

Texte

Sortie

Texte

API

Démarrage rapide

Code prêt à copier pour appeler ce modèle via l'API compatible OpenAI d'EasyAPI.

1

Obtenir votre clé API

Créez un jeton API dans la console et définissez-le comme variable d'environnement :

Remplacez sk-xxxxxxxx par votre jeton API depuis la console (Bearer Token).

Créer un jeton API
shell
export EASYAPI_API_KEY=sk-xxxxxxxx
2

Effectuer votre première requête

Utilisez zai/glm-4.6 avec l'API EasyAPI :

cURL
curl https://token.easyapi.com/v1/chat/completions \
  -H "Content-Type: application/json" \
  -H "Authorization: Bearer $EASYAPI_API_KEY" \
  -d '{
  "model": "zai/glm-4.6",
  "messages": [
    {
      "role": "user",
      "content": "Hello!"
    }
  ]
}'
3

Activer le streaming

Ajoutez "stream": true au corps de la requête pour recevoir les réponses en SSE :

curl
curl -N https://token.easyapi.com/v1/chat/completions \
  -H "Content-Type: application/json" \
  -H "Authorization: Bearer $EASYAPI_API_KEY" \
  -d '{"model":"zai/glm-4.6","messages":[{"role":"user","content":"Hello!"}],"stream":true}'

Point de terminaison

Envoie une requête de complétion de chat. Prend en charge le streaming et le mode non-streaming.

POSThttps://token.easyapi.com/v1/chat/completions
Authorization
Bearer $EASYAPI_API_KEY
Content-Type
application/json
Model
zai/glm-4.6

Envoie une requête de complétion de chat, en streaming ou non. Docs

GEThttps://token.easyapi.com/v1/models
Authorization
Bearer $EASYAPI_API_KEY

Liste les modèles disponibles pour le compte actuel. Docs

Paramètres

NomTypePar défautDescription
modelstringID du modèle, par ex. openai/gpt-4o ou anthropic/claude-3-5-sonnet
messagesarrayListe des messages de la conversation, chacun avec role et content
streambooleanfalseSi true, la réponse est diffusée en SSE
temperaturefloat1Température d’échantillonnage ; plus elle est élevée, plus la sortie est aléatoire
max_tokensintegerNombre maximal de tokens générés par réponse
top_pfloat1Échantillonnage nucleus ; limite la probabilité cumulée des tokens candidats
frequency_penaltyfloat0Pénalité de fréquence ; réduit les répétitions
presence_penaltyfloat0Pénalité de présence ; encourage de nouveaux sujets

Utiliser des SDK tiers

Les SDK officiels OpenAI et autres fonctionnent en changeant le base URL. Voir guide d'intégration