glm-4.6

Text

Text-only model in the GLM-4 family with improved coding benchmarks and tool calls during reasoning, suited for software development and agent workflows.

Цена ввода

$0.4879Скидка 15%

Рынок: $0.574

/ M

Цена вывода

$1.9499Скидка 15%

Рынок: $2.294

/ M

Чтение кэша

$0.0977Скидка 15%

Рынок: $0.1149

/ M

Запись кэша

$0Скидка 15%

/ M

Ввод

Текст

Вывод

Текст

API

Быстрый старт

Готовый код для вызова этой модели через OpenAI-совместимый API EasyAPI.

1

Получите API-ключ

Создайте API-токен в консоли и задайте его как переменную окружения:

Замените sk-xxxxxxxx на API-токен из консоли (Bearer Token).

Создать API-токен
shell
export EASYAPI_API_KEY=sk-xxxxxxxx
2

Отправьте первый запрос

Используйте zai/glm-4.6 с API EasyAPI:

cURL
curl https://token.easyapi.com/v1/chat/completions \
  -H "Content-Type: application/json" \
  -H "Authorization: Bearer $EASYAPI_API_KEY" \
  -d '{
  "model": "zai/glm-4.6",
  "messages": [
    {
      "role": "user",
      "content": "Hello!"
    }
  ]
}'
3

Включите потоковую передачу

Добавьте "stream": true в тело запроса для получения ответов через SSE:

curl
curl -N https://token.easyapi.com/v1/chat/completions \
  -H "Content-Type: application/json" \
  -H "Authorization: Bearer $EASYAPI_API_KEY" \
  -d '{"model":"zai/glm-4.6","messages":[{"role":"user","content":"Hello!"}],"stream":true}'

Эндпоинт

Отправляет запрос chat completion. Поддерживает потоковый и обычный режим.

POSThttps://token.easyapi.com/v1/chat/completions
Authorization
Bearer $EASYAPI_API_KEY
Content-Type
application/json
Model
zai/glm-4.6

Отправляет запрос на завершение диалога с потоковой или обычной выдачей. Документация

GEThttps://token.easyapi.com/v1/models
Authorization
Bearer $EASYAPI_API_KEY

Возвращает список моделей, доступных текущему аккаунту. Документация

Параметры

ИмяТипПо умолчаниюОписание
modelstringID модели, например openai/gpt-4o или anthropic/claude-3-5-sonnet
messagesarrayСписок сообщений диалога, каждое с полями role и content
streambooleanfalseПри значении true ответ передаётся потоком через SSE
temperaturefloat1Температура сэмплирования: чем выше, тем случайнее ответ
max_tokensintegerМаксимальное число токенов в одном ответе
top_pfloat1Nucleus-сэмплирование: ограничивает суммарную вероятность токенов-кандидатов
frequency_penaltyfloat0Штраф за частоту: снижает повторы слов
presence_penaltyfloat0Штраф за присутствие: поощряет новые темы

Сторонние SDK

Официальные SDK OpenAI и других работают при замене base URL. См. руководство по интеграции