qwen3.7-flash

Chat

Qwen3.7 系列轻量档视觉语言推理模型,擅长物体识别、空间理解与真实场景视觉感知。面向多模态 Agent、视觉 Coding、搜索与计算机操作。

输入价格

$0.03

/ M

输出价格

$0.13

/ M

缓存读

$0.006

/ M

缓存写

$0.038

/ M

输入

文本

输出

文本

动态计费

价格根据用量档位和请求条件动态调整

分档价格表

  • baseLength < 32K
    输入$0.03
    输出$0.13
    缓存读取$0.006
    缓存写入$0.038
  • tier_2Length > 32K && Output < 256K
    输入$0.1
    输出$0.4
    缓存读取$0.02
    缓存写入$0.125
  • tier_3
    输入$0.2
    输出$0.8
    缓存读取$0.04
    缓存写入$0.25
档位输入输出缓存读取缓存写入
baseLength < 32K
$0.03$0.13$0.006$0.038
tier_2Length > 32K && Output < 256K
$0.1$0.4$0.02$0.125
tier_3
$0.2$0.8$0.04$0.25

API

快速开始

复制即用,通过 EasyAPI 的 OpenAI 兼容 API 调用本模型。

1

获取 API 令牌

在控制台创建 API 令牌,并设置为环境变量:

将 sk-xxxxxxxx 替换为控制台颁发的 API 令牌(Bearer Token)。

创建 API 令牌
shell
export EASYAPI_API_KEY=sk-xxxxxxxx
2

发起第一次请求

使用 qwen/qwen3.7-flash 调用 EasyAPI:

cURL
curl https://token.easyapi.com/v1/chat/completions \
  -H "Content-Type: application/json" \
  -H "Authorization: Bearer $EASYAPI_API_KEY" \
  -d '{"model":"qwen/qwen3.7-flash","messages":[{"role":"user","content":"Hello!"}]}'
3

启用流式输出

在请求体中加入 "stream": true,并以 SSE 方式接收响应:

curl
curl -N https://token.easyapi.com/v1/chat/completions \
  -H "Content-Type: application/json" \
  -H "Authorization: Bearer $EASYAPI_API_KEY" \
  -d '{"model":"qwen/qwen3.7-flash","messages":[{"role":"user","content":"Hello!"}],"stream":true}'

端点

向模型发送对话补全请求,支持流式与非流式。

POSThttps://token.easyapi.com/v1/chat/completions
Authorization
Bearer $EASYAPI_API_KEY
Content-Type
application/json
Model
qwen/qwen3.7-flash

发送对话补全请求,支持流式与非流式。 文档

GEThttps://token.easyapi.com/v1/models
Authorization
Bearer $EASYAPI_API_KEY

获取当前账户可用模型列表。 文档

参数

名称类型默认值说明
modelstring模型 ID,如 openai/gpt-4o、anthropic/claude-3-5-sonnet
messagesarray对话消息列表,每项含 role 与 content
streambooleanfalse设为 true 时以 SSE 流式返回
temperaturefloat1采样温度,越高越随机
max_tokensinteger单次回复最大生成 Token 数
top_pfloat1核采样,限制候选词累积概率
frequency_penaltyfloat0频率惩罚,降低重复用词
presence_penaltyfloat0存在惩罚,鼓励新话题

使用第三方 SDK

OpenAI、Anthropic 等官方 SDK 均可通过替换 base_url 接入,详见 标准接入文档