Платформы workflow и low-code
Использовать модели в Dify, n8n и FastGPT
В workflow каждый узел — это вызов: большой объём, короткие запросы. OpenAI-совместимый API EasyAPI настраивается один раз как провайдер «OpenAI-API-compatible», после чего любой узел может выбрать наши модели.
Рекомендуемые модели, доступные сейчас
Подобраны для workflow: дёшево, быстро и достаточно для массовых узлов вроде классификации, извлечения и переписывания. Переводите на сильную модель только узлы, которым нужно качество рассуждений.
Цены платформы за 1 млн токенов, оплата по факту. Список следует за живым API цен; снятые модели здесь не появляются. Выберите модель, и конфигурация с расчётом ниже подстроятся.
Точная конфигурация
Адрес API и выбранная модель qwen3.8-flash уже подставлены. Замените ключ на свой.
# Dify → Settings → Model Provider → OpenAI-API-compatible → Add model
Model Type: LLM
Model Name: qwen3.8-flash
API Key: sk-your-key
API endpoint URL: https://token.easyapi.com/v1
Completion mode: Chat
Model context size: see the model detail page
# enable both "Function calling" and "Stream"Сначала добейтесь одного успешного запроса
Подставьте ключ и выполните как есть. Ответ 200 означает, что адрес, ключ и модель верны; иначе сверьте ошибку со списком ниже.
curl https://token.easyapi.com/v1/chat/completions \
-H "Authorization: Bearer sk-your-key" \
-H "Content-Type: application/json" \
-d '{"model":"qwen3.8-flash","messages":[{"role":"user","content":"Hello"}]}'Что нужно знать
- Выпадающие списки платформ обычно не показывают пользовательские модели. Введите имя модели вручную; берите его с карточки модели.
- Dify просит вручную указать размер контекста и максимальный вывод. Завышенные значения не дают ошибку, но вводят платформу в заблуждение; скопируйте их с карточки модели.
- Стоимость массового workflow определяется числом вызовов, а не ценой за единицу. Пример ниже рассчитан на 5 000 вызовов в день; пересчитайте под число узлов.
- Для узлов с вызовами инструментов или структурированным выводом убедитесь, что модель их поддерживает, и включите Function calling в настройках провайдера.
Частые ошибки
- Проверка не проходит при добавлении модели
- Адрес должен заканчиваться на /v1, имя модели чувствительно к регистру и без префикса вендора. Сначала проверьте ключ и имя модели curl-запросом с этой страницы.
- Узел падает с 401 / 403
- 401 — неверный или отключённый ключ; 403 — белый список моделей ключа не включает эту модель. Оба исправляются на странице токенов.
- Узлы иногда отваливаются по таймауту
- По умолчанию на платформах часто 60 секунд. Увеличьте таймаут на узлах с длинным выводом или перейдите на стриминг. На карточке модели есть перцентили задержки за 24 часа.
- Расходы выше ожидаемых
- Отфильтруйте логи консоли по модели и ключу. В workflow узел часто вызывается многократно внутри цикла. Отдельный ключ с лимитом держит workflow под контролем.
Пример стоимости
По текущей цене qwen3.8-flash, типичный запрос 1,500 токенов на входе + 300 на выходе, 5,000 раз в день:
Платите только за реально использованные токены. Без платы за платформу, маршрутизацию и месячного минимума. Реальное потребление видно по каждому запросу в логах консоли.
Подключайтесь сейчас
После регистрации на главной консоли появится гид, который сгенерирует готовую к копированию конфигурацию для вашего ключа и модели, и останется до первого успешного вызова.
Другие решения: Подключить Claude Code, Cursor и Codex к API · Строить агентов на OpenAI-совместимом API