deepseek-v4.1-flash
DeepSeek
DeepSeek-V4.1-Flash 是 DeepSeek 当前主力模型,官方 API 模型名为 deepseek-flash。支持 1M 上下文与最大 384K 输出,默认可切换思考/非思考模式,具备图像理解、工具调用、JSON Output,并兼容 OpenAI 与 Anthropic API。
¥0.4194/ M
¥1.6775/ M
¥0.0084/ M
—
AI Models
Browse and compare AI models from top providers
Found 76 models
DeepSeek
DeepSeek-V4.1-Flash 是 DeepSeek 当前主力模型,官方 API 模型名为 deepseek-flash。支持 1M 上下文与最大 384K 输出,默认可切换思考/非思考模式,具备图像理解、工具调用、JSON Output,并兼容 OpenAI 与 Anthropic API。
¥0.4194/ M
¥1.6775/ M
¥0.0084/ M
—
Qwen
Qwen3.8 系列 Flash 档,多模态推理,面向编程与 Agent 工作流,支持文档、代码库与长视频理解。
¥0.9286/ M
¥2.7859/ M
¥0.0929/ M
¥1.1608/ M
Z.AI
GLM-5.3 系列 Flash 档,原生多模态,面向高效编程与长链路 Agent,长上下文稳定,适合生产级应用。
¥0.5528/ M
¥1.8425/ M
¥0.1106/ M
—
Qwen
Qwen3.8 系列旗舰推理模型,支持多模态输入,面向复杂推理、视觉理解、编程与 Agent 工作流。
¥8.9732/ M
¥26.9196/ M
¥0.7478/ M
¥1.8722/ M
Moonshot
多模态推理模型,面向复杂编程、知识工作与长程 Agent 流程。擅长在大型代码库里调用工具、调试,并读取图像、日志与测试反馈来修正结果。
¥15.8346/ M
¥79.1728/ M
¥1.5835/ M
—
DeepSeek
DeepSeek V4 系列旗舰,深度推理与代码生成能力达系列高位,适合全代码库分析、多步骤自动化与高难度指令场景。
¥1.9899/ M
¥5.9697/ M
¥0.0663/ M
—
Z.AI
旗舰定位,面向复杂软件工程与长程 Agent 任务,多轮工具调用与长链路执行稳定,适合代码库级重构与自动化研发。
¥7.1573/ M
¥25.0504/ M
¥1.7893/ M
—
Z.AI
GLM 5.2 是大型推理模型,支持百万上下文,适合长程 Agent、代码库编程与多步自动化。
¥3.5628/ M
¥12.4697/ M
¥0.6998/ M
¥0/ M
Moonshot AI
Kimi K2 系列编程模型,接受文字与图像输入,默认开启思维链,适合长流程 Agent 编程与多轮调试。
¥4.503/ M
¥18.7046/ M
¥0.9006/ M
¥5.2964/ M
ByteDance
Seedream-5.0-pro是字节跳动发布的最新图像创作模型。该模型将图像创作推进到可控生产的新阶段,本次更新的主要亮点是编辑更可控、生产更落地、效果更自然。
—
¥0.1947/ image
—
—
ByteDance
Seedance 系列主力版本,文生视频与图生视频兼容,擅长保持角色一致性、视觉风格与镜头运镜,适合广告与创意短视频量产。
| Resolution | Without video input | With video input |
|---|---|---|
| 480p | ¥45.4568/ M | ¥27.669/ M |
| 720p | ¥45.4568/ M | ¥27.669/ M |
| 1080p | ¥50.384/ M | ¥30.6681/ M |
ByteDance
Seed 2.0系列轻量档,主打高并发与低延迟,支持多级思考强度调节,适合批量处理、内容审核、分类标注等高吞吐场景。
¥0.1861/ M
¥1.8606/ M
¥0.0372/ M
—
ByteDance
Seedance 2.0 mini 是面向更广泛视频生成需求推出的新一代高性价比视频生成模型。在保持竞争力效果的同时,将视频生成能力带入更低门槛、更高频、更规模化的应用场景。
| Resolution | Without video input | With video input |
|---|---|---|
| 480p | ¥23.45/ M | ¥14.07/ M |
| 720p | ¥23.45/ M | ¥14.07/ M |
ByteDance
Seedance 2.0 系列轻量版,生成速度与成本优先,支持文生视频、首尾帧控制与多参考图生视频,适合快速试样与量产化视频流水线。
| Resolution | Without video input | With video input |
|---|---|---|
| 480p | ¥21.9672/ M | ¥13.0615/ M |
| 720p | ¥21.9672/ M | ¥13.0615/ M |
ByteDance
Seed 2.0系列轻量档,主打高并发与低延迟,支持多级思考强度调节,适合批量处理、内容审核、分类标注等高吞吐场景。
¥1.139/ M
¥4.556/ M
¥0.1139/ M
¥0.0475/ M
ByteDance
Seed 2.0 系列旗舰款,擅长复杂推理与长链路 Agent 任务,指令遵循与工具调用表现稳定,适合科研辅助与多步代理工作流。
¥2.9769/ M
¥14.8845/ M
¥0.5954/ M
—
ByteDance
Seed 2.0 系列旗舰款,擅长复杂推理与长链路 Agent 任务,指令遵循与工具调用表现稳定,适合科研辅助与多步代理工作流。
¥5.695/ M
¥34.17/ M
¥1.139/ M
¥0.0475/ M
Qwen
面向智能体场景的旗舰推理模型,擅长代码开发、办公生产力与可长时间自主运行的复杂任务,配备 1M 超长上下文。
¥8.3131/ M
¥24.9394/ M
¥1.6626/ M
¥10.394/ M
ByteDance
From ByteDance, supports 文本 and 多模态 and more—call it via the standard API.
¥5.0924/ M
¥25.462/ M
¥1.0185/ M
¥0.0144/ M
ByteDance
From ByteDance, supports 文本 and 多模态 and more—call it via the standard API.
¥5.0924/ M
¥25.462/ M
¥1.0185/ M
¥0.0144/ M
ByteDance
Seed 2.0 系列轻量档,延迟低、调用成本可控,智能体、编程与 GUI 任务表现稳定,适合高频交互场景与大批量任务分发。
¥0.5582/ M
¥3.349/ M
¥0.1116/ M
—
ByteDance
Seed 2.0 系列轻量档,延迟低、调用成本可控,智能体、编程与 GUI 任务表现稳定,适合高频交互场景与大批量任务分发。
¥2.8475/ M
¥22.78/ M
¥0.5695/ M
¥0.0475/ M
Moonshot AI
K2 系列最新多模态版本,专注长链路编程、代码驱动的 UI/UX 生成与多智能体编排,适合复杂工程自动化与 Agent 协作场景。
¥4.503/ M
¥18.7046/ M
¥0.762/ M
¥5.6288/ M
MiniMax
MiniMax 系列首款多模态版本,支持图像与视频输入。长上下文推理成本更低、响应更快,可胜任多步 Agent 流程与 Computer Use 场景。
¥6.834/ M
¥27.336/ M
¥0.6834/ M
¥0/ M
Z.AI
长任务自主执行的工程级编码模型
¥3.5628/ M
¥14.2511/ M
¥0.7719/ M
—
DeepSeek
DeepSeek V4 系列中速度更快、成本更低的版本,保留主力版推理与编程基础,适合高并发对话、编程辅助与对延迟敏感的 Agent 场景。
¥0.649/ M
¥2.5961/ M
¥0.013/ M
—
ByteDance
Seedance 2.5 是豆包大模型团队推出的新一代多模态视频创作模型,已迈入「长叙事 × 多素材 × 强编辑 × 多语言」的工业级新阶段。
| Resolution | Without video input | With video input |
|---|---|---|
| 480 | ¥0.6888/ s | ¥0.6888/ s |
| 720 | ¥1.5484/ s | ¥1.5484/ s |
Qwen
Qwen 3.7 系列 Plus 档,多模态输入,能读屏操作 GUI,可在手机 App 内端到端完成任务,适合 Agent 工作流与工具调用。
¥1.3958/ M
¥5.5833/ M
¥0.2792/ M
¥1.7448/ M
Tencent
开启高强度推理模式,面向复杂推理与多步 Agent 工作流,适合需要深度思考与稳定执行的生产级智能体任务。
¥1.0251/ M
¥3.417/ M
¥0.3417/ M
¥0/ M
Xiaomi
旗舰级代码与 Agent 模型,可维持千次工具调用的长程自主任务,适合复杂软件工程、编译器开发与自动化研发流程。
¥2.4773/ M
¥4.9546/ M
¥0.0205/ M
¥0/ M

MiniMax
支持文生与图生视频,可输出 6-10 秒、768p/1080p 画面,支持精细运镜指令控制,运动流畅、主体稳定,适合短视频创意内容。
| Resolution | Without video input | With video input |
|---|---|---|
| 1080p | ¥11.8188/ M | ¥11.8188/ M |
| 768p | ¥13.5072/ M | ¥13.5072/ M |
Alibaba
Wan2.7-T2V,演绎能力全面升级,文戏情感细腻自然,动作戏激烈拳拳到肉,搭配更富有戏剧性和节奏感的镜头切换,实现更强表演能力。
| Resolution | Without video input | With video input |
|---|---|---|
| 720 | ¥0.4275/ s | ¥0.4275/ s |
| 1080 | ¥0.7126/ s | ¥0.7126/ s |

MiniMax
支持文生与图生视频,可输出 6-10 秒、512p/768p/1080p 多档画质,支持运镜指令控制,在画质与成本间灵活平衡。
| Resolution | Without video input | With video input |
|---|---|---|
| 1080p | ¥11.8188/ M | ¥11.8188/ M |
| 512p | ¥3.618/ M | ¥3.618/ M |
| 768p | ¥13.5072/ M | ¥13.5072/ M |
Alibaba
从文本提示生成 720p/1080p 视频并自带同步音轨,画面具备电影级美学与复杂运动表现,适合创意视频创作。
| Resolution | Without video input | With video input |
|---|---|---|
| 720p | ¥0.603/ s | ¥0.603/ s |
| 1080p | ¥0.9045/ s | ¥0.9045/ s |
Qwen
千问系列首个图像编辑模型,成功将Qwen-Image的文本渲染能力拓展到编辑任务上。支持精准的中英双语文字编辑、视觉外观与语义双重编辑、具备强大的跨基准性能表现。
—
¥0.1633/ image
—
—
Qwen
生成与编辑统一于同一模型;原生 2K,支持专业排版与信息图。
—
¥0.1652/ image
—
—
生成与编辑融合;文字渲染更专业,写实纹理与场景细节更丰富。
—
¥0.2474/ image
—
—
ByteDance
新一代统一架构,集成生成与编辑;支持知识型生成与参考图一致性,最高 4K。
—
¥0.1909/ image
—
—
ByteDance
模型整体扩容后全面提升;多图编辑主体识别更准,参考图细节保留更严,密集文字渲染更强。
—
¥0.2326/ image
—
—
ByteDance
引入深度推理能力,更好理解复杂描述并结合常识,编辑前后一致性更强。
—
¥0.2047/ image
—
—
MiniMax
M2.7 高速版,输出与标准版一致但推理更快,面向编程、Agent 工具调用与办公自动化等对延迟敏感的场景。
¥3.417/ M
¥13.668/ M
¥0.3417/ M
¥2.1356/ M
Qwen
Qwen3.7 系列轻量档视觉语言推理模型,擅长物体识别、空间理解与真实场景视觉感知。面向多模态 Agent、视觉 Coding、搜索与计算机操作。
¥0.201/ M
¥0.871/ M
¥0.0402/ M
¥0.2546/ M
MiniMax
M2.5 系列的加速版本,推理质量与标准版一致,吞吐约提升至三倍,主打编程与智能体工具调用,适合对延迟敏感的 Agent 交互与批量任务。
¥3.417/ M
¥13.668/ M
¥0.1709/ M
¥2.1356/ M
Xiaomi
系列中端型号,原生处理图像、音频与视频,面向 Agent 工作流与编码场景,以低于 Pro 的成本贴近其表现,适合长流程代理与多模态分析。
¥0.7973/ M
¥1.5946/ M
¥0.2437/ M
¥0/ M
ByteDance
面向 Agent 場景的通用基座,工具調用與複雜指令遵循能力明顯提升,適合 GUI Agent、搜索 Agent 與多步驟任務編排。
¥2.8475/ M
¥22.78/ M
¥0.2848/ M
¥0.0475/ M
ByteDance
面向 Agent 工作流的代码预览模型,在 SWE-Bench、LiveCodeBench 上跑出接近一线的成绩,适合自主编码智能体与多语言工程任务。
¥5.695/ M
¥34.17/ M
¥0.5695/ M
¥0.0475/ M
Alibaba
系列中端轻量款,主打低延迟与高吞吐,编码与工具调用能力可支撑 Agent 任务,适合实时交互与长文档处理场景。
¥0.1652/ M
¥1.6345/ M
¥0/ M
¥0/ M
Alibaba
面向 Agentic 编程的开源模型,擅长仓库级代码理解与终端命令执行,推理成本可控,适合接入代码助手与自动化开发流程。
¥1.4124/ M
¥8.4571/ M
¥0/ M
¥0/ M
Alibaba
通义千问中端模型,主打多步推理与智能体规划执行,在编程与思维链任务上表现稳定,体积适合私有化部署与本地推理场景。
¥0.4898/ M
¥3.9182/ M
¥0/ M
¥0/ M
Alibaba
开源稠密模型的思考模式版本,输出显式思维链,以 27B 规模在数学、编码与多步推理基准上超越前代 397B-A17B 开源旗舰,适合科研辅助与 Agent 规划场景。
¥2.3496/ M
¥14.0973/ M
¥0/ M
¥0/ M
Qwen
Qwen3.5 系列多模态主力,支持图像与视频理解,内置可切换的思考模式,适合文档解析、视觉问答、长视频分析与多模态智能体场景。
¥0.6549/ M
¥3.9182/ M
¥0.3246/ M
¥4.0833/ M
Alibaba
开源中端文本 MoE 模型,原生支持思维链推理与多步规划,在 function-calling 与复杂推理基准上表现稳定,适合企业自部署的智能体工作流。
¥0.6549/ M
¥5.2223/ M
¥0/ M
¥0/ M
Qwen
Qwen3-VL 系列的 Plus 主力视觉语言模型,支持图像、视频与文本联合输入,擅长文档图表解析、视频理解、空间定位与智能体工具调用,适合多模态问答与视觉自动化场景。
¥0.8201/ M
¥8.1666/ M
¥0.1652/ M
¥3.0696/ M
Z.AI
GLM-4 系列通用文本模型,coding 基准与 Agent 框架表现较前代提升,推理时可调用工具,适合软件开发、Agent 任务与角色扮演对话。
¥3.2689/ M
¥13.0643/ M
¥0.6549/ M
¥0/ M
Kling
Kling O1 是为创作者打造的全新创意引擎,解锁无限创意可能。基于多模态视觉语言(MVL)概念,使用自然语言结合视频、图片、元素等多模态描述,精准理解您的创作意图。
| Resolution | Without video input | With video input |
|---|---|---|
| 720p | ¥0.3888/ s | ¥0.3888/ s |
| 1080p | ¥0.5185/ s | ¥0.5185/ s |
Kling
可灵3.0 Omni是旗舰模型,提供卓越的视频质量、先进的语义理解和增强的伪影修正。基于视频3.0的基础,Omni为专业创作者提供极致品质,具有更精细的细节、更流畅的运动动态和更高的成功率。
| Resolution | Without video input | With video input |
|---|---|---|
| 720p | ¥0.3888/ s | ¥0.3888/ s |
| 1080p | ¥0.5185/ s | ¥0.5185/ s |
Kling
可灵视频 3.0 配备革命性智能分镜系统,自动编排多镜头序列,实现电影级转场效果。单次生成最长15秒视频,具备增强的角色一致性、原生级文字叠加和多语言音频混合能力。
| Resolution | Without video input | With video input |
|---|---|---|
| 720p | ¥0.3888/ s | ¥0.3888/ s |
| 1080p | ¥0.5185/ s | ¥0.5185/ s |
| 4k | ¥1.9442/ s | ¥1.9442/ s |
| 2k | ¥0.6481/ s | ¥0.6481/ s |
Kling
VIDEO 2.6 模型一次生成视觉画面、自然配音、匹配音效和环境氛围,连接「声音」与「视觉」的世界。无论是输入文字还是上传图片,都能即时创建一个完整的动态视频,包含声音、节奏和沉浸感。
| Resolution | Without video input | With video input |
|---|---|---|
| 720p | ¥0.1944/ s | ¥0.1944/ s |
| 1080p | ¥0.324/ s | ¥0.324/ s |
Kling
Kling 2.5 Turbo 针对速度和性价比进行了优化,非常适合大批量视频生成需求。在显著缩短生成时间的同时保持良好的质量。
| Resolution | Without video input | With video input |
|---|---|---|
| 720p | ¥0.1944/ s | ¥0.1944/ s |
| 1080p | ¥0.324/ s | ¥0.324/ s |
Kling
Kling 2.1 显著提升了语义响应、动态质量和画面质感。是稳定、高质量视频生成的首选。
| Resolution | Without video input | With video input |
|---|---|---|
| 720p | ¥0.2592/ s | ¥0.2592/ s |
| 1080p | ¥0.4536/ s | ¥0.4536/ s |
Kling
Kling 2.0 大师版针对专业创作场景优化,为高要求项目提供电影级输出质量。
| Resolution | Without video input | With video input |
|---|---|---|
| 720p | ¥0.2592/ s | ¥0.2592/ s |
| 1080p | ¥0.4536/ s | ¥0.4536/ s |
Alibaba
From Alibaba, supports 视频 and more—call it via the standard API.
| Resolution | Without video input | With video input |
|---|---|---|
| 720 | ¥0.335/ s | ¥0.335/ s |
| 1080 | ¥0.5025/ s | ¥0.5025/ s |
Alibaba
From Alibaba, supports 视频 and more—call it via the standard API.
| Resolution | Without video input | With video input |
|---|---|---|
| 720 | ¥0.67/ s | ¥0.67/ s |
| 1080 | ¥1.005/ s | ¥1.005/ s |
Qwen
Qwen 3.6 系列轻量版,支持文字、图像、视频输入。延迟低、成本低,适合高并发分类、提取、摘要,也能处理简单的 Agent 任务。
¥0.8297/ M
¥4.9803/ M
¥0.0825/ M
¥1.0374/ M
Moonshot AI
指令微调版本聚焦智能体工作流,工具调用稳定,中英编码与推理表现均衡,适合多轮工具链调度的编排场景。
¥3.2689/ M
¥13.0985/ M
¥0.6549/ M
¥0/ M
Moonshot AI
开源思考型模型,擅长长链推理与连续工具调用,可稳定执行数百步自主研究、编码与多轮智能体任务,适合复杂分析与 Agent 工作流。
¥3.417/ M
¥14.2375/ M
¥0.8543/ M
¥0/ M
Qwen
通义千问增强版,中英双语理解出色,擅长长文本分析与结构化输出。
¥1.3855/ M
¥8.3131/ M
¥0.1386/ M
¥1.7319/ M
Xiaomi
面向智能体的旗舰模型,擅长复杂流程编排与工程级任务执行
¥11.39/ M
¥34.17/ M
¥2.278/ M
¥0/ M
MiniMax
多智能体协作模型,支持复杂任务规划与生产级工作流执行
¥1.4548/ M
¥5.8192/ M
¥0.291/ M
¥0/ M
Z.AI
综合能力均衡,中文理解与推理表现较好,通用任务适配面广。
¥3.36/ M
¥13.3833/ M
¥3.1322/ M
¥0/ M
Z.AI
视觉增强版本,兼顾图像理解与文本推理,适合多模态输入场景。
¥1.7085/ M
¥5.1255/ M
¥0.3132/ M
¥0/ M
MiniMax
性价比导向的通用模型,在对话与内容生产任务中速度和质量较均衡。
¥1.7655/ M
¥7.0049/ M
¥0.1765/ M
¥2.2211/ M
Z.AI
专为 OpenClaw 等基于代理的场景而设计。
¥6.834/ M
¥22.78/ M
¥1.3668/ M
¥0/ M
Moonshot AI
顶级中英双语模型,强大的长上下文能力。
¥3.417/ M
¥17.1476/ M
¥0.8543/ M
¥4.089/ M
Z.AI
有竞争力的通用中文模型。
¥5.0116/ M
¥18.3949/ M
¥0.9795/ M
¥0/ M
Z.AI
超快中文处理,极其便宜。
¥0.5695/ M
¥2.4489/ M
¥0.057/ M
¥0/ M