glm-4.6v
Z.AI
Multimodal model with strong image + text understanding.
$0.255/ M
$0.765/ M
$0.0467/ M
$0/ M
Text-only model in the GLM-4 family with improved coding benchmarks and tool calls during reasoning, suited for software development and agent workflows.
Prix d'entrée
Marché : $0.574
/ M
Prix de sortie
Marché : $2.294
/ M
Lecture cache
Marché : $0.1149
/ M
Écriture du cache
/ M
Entrée
Texte
Sortie
Texte
{
"model": "zai/glm-4.6",
"messages": [
{
"role": "user",
"content": "Bonjour ! Présente-toi d’abord : tes principales capacités, les cas d’usage adaptés, et donne un court exemple d’utilisation."
}
],
"stream": false
}{}API
Code prêt à copier pour appeler ce modèle via l'API compatible OpenAI d'EasyAPI.
Créez un jeton API dans la console et définissez-le comme variable d'environnement :
Remplacez sk-xxxxxxxx par votre jeton API depuis la console (Bearer Token).
Créer un jeton APIexport EASYAPI_API_KEY=sk-xxxxxxxxUtilisez zai/glm-4.6 avec l'API EasyAPI :
curl https://token.easyapi.com/v1/chat/completions \
-H "Content-Type: application/json" \
-H "Authorization: Bearer $EASYAPI_API_KEY" \
-d '{
"model": "zai/glm-4.6",
"messages": [
{
"role": "user",
"content": "Hello!"
}
]
}'Ajoutez "stream": true au corps de la requête pour recevoir les réponses en SSE :
curl -N https://token.easyapi.com/v1/chat/completions \
-H "Content-Type: application/json" \
-H "Authorization: Bearer $EASYAPI_API_KEY" \
-d '{"model":"zai/glm-4.6","messages":[{"role":"user","content":"Hello!"}],"stream":true}'Envoie une requête de complétion de chat. Prend en charge le streaming et le mode non-streaming.
https://token.easyapi.com/v1/chat/completionsBearer $EASYAPI_API_KEYapplication/jsonzai/glm-4.6Envoie une requête de complétion de chat, en streaming ou non. Docs
https://token.easyapi.com/v1/modelsBearer $EASYAPI_API_KEYListe les modèles disponibles pour le compte actuel. Docs
| Nom | Type | Par défaut | Description |
|---|---|---|---|
model | string | — | ID du modèle, par ex. openai/gpt-4o ou anthropic/claude-3-5-sonnet |
messages | array | — | Liste des messages de la conversation, chacun avec role et content |
stream | boolean | false | Si true, la réponse est diffusée en SSE |
temperature | float | 1 | Température d’échantillonnage ; plus elle est élevée, plus la sortie est aléatoire |
max_tokens | integer | — | Nombre maximal de tokens générés par réponse |
top_p | float | 1 | Échantillonnage nucleus ; limite la probabilité cumulée des tokens candidats |
frequency_penalty | float | 0 | Pénalité de fréquence ; réduit les répétitions |
presence_penalty | float | 0 | Pénalité de présence ; encourage de nouveaux sujets |
Les SDK officiels OpenAI et autres fonctionnent en changeant le base URL. Voir guide d'intégration
Z.AI
Multimodal model with strong image + text understanding.
$0.255/ M
$0.765/ M
$0.0467/ M
$0/ M
Z.AI
Balanced model with strong Chinese understanding.
$0.5015/ M
$1.9975/ M
$0.4675/ M
$0/ M
Z.AI
Ultra-fast for Chinese. Very cheap.
$0.085/ M
$0.3655/ M
$0.0085/ M
$0/ M
Z.AI
Competitive general-purpose Chinese model.
$0.748/ M
$2.7455/ M
$0.1462/ M
$0/ M