AI 模型

模型广场

浏览和对比来自顶级供应商的 AI 模型

找到 76 个模型

DeepSeek-V4.1-Flash 是 DeepSeek 当前主力模型,官方 API 模型名为 deepseek-flash。支持 1M 上下文与最大 384K 输出,默认可切换思考/非思考模式,具备图像理解、工具调用、JSON Output,并兼容 OpenAI 与 Anthropic API。

文本
41折
输入价格

¥0.41/ M

输出价格

¥1.64/ M

缓存读

¥0.0082/ M

缓存写

—


Qwen3.8 系列 Flash 档,多模态推理,面向编程与 Agent 工作流,支持文档、代码库与长视频理解。

文本多模态
8折
输入价格

¥0.8/ M

输出价格

¥2.4/ M

缓存读

¥0.08/ M

缓存写

¥1/ M


GLM-5.3 系列 Flash 档,原生多模态,面向高效编程与长链路 Agent,长上下文稳定,适合生产级应用。

文本多模态
55折
输入价格

¥0.5536/ M

输出价格

¥1.8452/ M

缓存读

¥0.1107/ M

缓存写

—


Qwen3.8 系列旗舰推理模型,支持多模态输入,面向复杂推理、视觉理解、编程与 Agent 工作流。

文本多模态
75折
输入价格

¥8.9866/ M

输出价格

¥26.9598/ M

缓存读

¥0.7489/ M

缓存写

¥1.875/ M


kimi-k3

Moonshot

多模态推理模型,面向复杂编程、知识工作与长程 Agent 流程。擅长在大型代码库里调用工具、调试,并读取图像、日志与测试反馈来修正结果。

文本多模态
8折
输入价格

¥15.8582/ M

输出价格

¥79.291/ M

缓存读

¥1.5858/ M

缓存写

—


DeepSeek V4 系列旗舰,深度推理与代码生成能力达系列高位,适合全代码库分析、多步骤自动化与高难度指令场景。

文本
45折
输入价格

¥1.9929/ M

输出价格

¥5.9786/ M

缓存读

¥0.0664/ M

缓存写

—


旗舰定位,面向复杂软件工程与长程 Agent 任务,多轮工具调用与长链路执行稳定,适合代码库级重构与自动化研发。

Chat
9折
输入价格

¥7.168/ M

输出价格

¥25.0878/ M

缓存读

¥1.792/ M

缓存写

—


GLM 5.2 是大型推理模型,支持百万上下文,适合长程 Agent、代码库编程与多步自动化。

文本
45折
输入价格

¥3.5681/ M

输出价格

¥12.4883/ M

缓存读

¥0.7009/ M

缓存写

¥0/ M


kimi-k2.7-code

Moonshot AI

Kimi K2 系列编程模型,接受文字与图像输入,默认开启思维链,适合长流程 Agent 编程与多轮调试。

文本多模态
7折
输入价格

¥4.5097/ M

输出价格

¥18.7325/ M

缓存读

¥0.9019/ M

缓存写

¥5.3043/ M


Seedream-5.0-pro是字节跳动发布的最新图像创作模型。该模型将图像创作推进到可控生产的新阶段,本次更新的主要亮点是编辑更可控、生产更落地、效果更自然。

图片
65折
输入价格

—

输出价格

¥0.195/ 张

缓存读

—

缓存写

—


seedance-2.0

ByteDance

Seedance 系列主力版本,文生视频与图生视频兼容,擅长保持角色一致性、视觉风格与镜头运镜,适合广告与创意短视频量产。

视频
分辨率不含视频输入含视频输入
480p¥45.5247/ M¥27.7103/ M
720p¥45.5247/ M¥27.7103/ M
1080p¥50.4592/ M¥30.7139/ M

Seed 2.0系列轻量档,主打高并发与低延迟,支持多级思考强度调节,适合批量处理、内容审核、分类标注等高吞吐场景。

文本
94折
输入价格

¥0.1863/ M

输出价格

¥1.8633/ M

缓存读

¥0.0373/ M

缓存写

—


Seedance 2.0 mini 是面向更广泛视频生成需求推出的新一代高性价比视频生成模型。在保持竞争力效果的同时,将视频生成能力带入更低门槛、更高频、更规模化的应用场景。

视频
分辨率不含视频输入含视频输入
480p¥23.485/ M¥14.091/ M
720p¥23.485/ M¥14.091/ M

Seedance 2.0 系列轻量版,生成速度与成本优先,支持文生视频、首尾帧控制与多参考图生视频,适合快速试样与量产化视频流水线。

视频
分辨率不含视频输入含视频输入
480p¥22/ M¥13.081/ M
720p¥22/ M¥13.081/ M

Seed 2.0系列轻量档,主打高并发与低延迟,支持多级思考强度调节,适合批量处理、内容审核、分类标注等高吞吐场景。

文本
85折
输入价格

¥1.1407/ M

输出价格

¥4.5628/ M

缓存读

¥0.1141/ M

缓存写

¥0.0475/ M


Seed 2.0 系列旗舰款,擅长复杂推理与长链路 Agent 任务,指令遵循与工具调用表现稳定,适合科研辅助与多步代理工作流。

文本
94折
输入价格

¥2.9813/ M

输出价格

¥14.9067/ M

缓存读

¥0.5963/ M

缓存写

—


Seed 2.0 系列旗舰款,擅长复杂推理与长链路 Agent 任务,指令遵循与工具调用表现稳定,适合科研辅助与多步代理工作流。

文本
85折
输入价格

¥5.7035/ M

输出价格

¥34.221/ M

缓存读

¥1.1407/ M

缓存写

¥0.0475/ M


面向智能体场景的旗舰推理模型,擅长代码开发、办公生产力与可长时间自主运行的复杂任务,配备 1M 超长上下文。

文本
7折
输入价格

¥8.3256/ M

输出价格

¥24.9767/ M

缓存读

¥1.6651/ M

缓存写

¥10.4095/ M


ByteDance 出品,支持 文本和多模态 等能力,可通过标准 API 直接调用。

文本多模态
85折
输入价格

¥5.1/ M

输出价格

¥25.5/ M

缓存读

¥1.02/ M

缓存写

¥0.0145/ M


ByteDance 出品,支持 文本和多模态 等能力,可通过标准 API 直接调用。

文本多模态
85折
输入价格

¥5.1/ M

输出价格

¥25.5/ M

缓存读

¥1.02/ M

缓存写

¥0.0145/ M


Seed 2.0 系列轻量档,延迟低、调用成本可控,智能体、编程与 GUI 任务表现稳定,适合高频交互场景与大批量任务分发。

文本
94折
输入价格

¥0.559/ M

输出价格

¥3.354/ M

缓存读

¥0.1118/ M

缓存写

—


Seed 2.0 系列轻量档,延迟低、调用成本可控,智能体、编程与 GUI 任务表现稳定,适合高频交互场景与大批量任务分发。

文本
85折
输入价格

¥2.8518/ M

输出价格

¥22.814/ M

缓存读

¥0.5704/ M

缓存写

¥0.0475/ M


kimi-k2.6

Moonshot AI

K2 系列最新多模态版本,专注长链路编程、代码驱动的 UI/UX 生成与多智能体编排,适合复杂工程自动化与 Agent 协作场景。

文本多模态
7折
输入价格

¥4.5097/ M

输出价格

¥18.7325/ M

缓存读

¥0.7632/ M

缓存写

¥5.6372/ M


minimax-m3

MiniMax

MiniMax 系列首款多模态版本,支持图像与视频输入。长上下文推理成本更低、响应更快,可胜任多步 Agent 流程与 Computer Use 场景。

文本
85折
输入价格

¥6.8442/ M

输出价格

¥27.3768/ M

缓存读

¥0.6844/ M

缓存写

¥0/ M


长任务自主执行的工程级编码模型

文本
6折
输入价格

¥3.5681/ M

输出价格

¥14.2724/ M

缓存读

¥0.7731/ M

缓存写

—


DeepSeek V4 系列中速度更快、成本更低的版本,保留主力版推理与编程基础,适合高并发对话、编程辅助与对延迟敏感的 Agent 场景。

文本
65折
输入价格

¥0.65/ M

输出价格

¥2.6/ M

缓存读

¥0.013/ M

缓存写

—


seedance-2.5

ByteDance

Seedance 2.5 是豆包大模型团队推出的新一代多模态视频创作模型,已迈入「长叙事 × 多素材 × 强编辑 × 多语言」的工业级新阶段。

视频
分辨率不含视频输入含视频输入
480¥0.6898/ s¥0.6898/ s
720¥1.5507/ s¥1.5507/ s

Qwen 3.7 系列 Plus 档,多模态输入,能读屏操作 GUI,可在手机 App 内端到端完成任务,适合 Agent 工作流与工具调用。

文本
7折
输入价格

¥1.3979/ M

输出价格

¥5.5917/ M

缓存读

¥0.2796/ M

缓存写

¥1.7474/ M


开启高强度推理模式,面向复杂推理与多步 Agent 工作流,适合需要深度思考与稳定执行的生产级智能体任务。

文本
85折
输入价格

¥1.0266/ M

输出价格

¥3.4221/ M

缓存读

¥0.3422/ M

缓存写

¥0/ M


旗舰级代码与 Agent 模型,可维持千次工具调用的长程自主任务,适合复杂软件工程、编译器开发与自动化研发流程。

文本
85折
输入价格

¥2.481/ M

输出价格

¥4.962/ M

缓存读

¥0.0205/ M

缓存写

¥0/ M


hailuo-2.3

MiniMax

支持文生与图生视频,可输出 6-10 秒、768p/1080p 画面,支持精细运镜指令控制,运动流畅、主体稳定,适合短视频创意内容。

视频
9折
分辨率不含视频输入含视频输入
1080p¥11.8364/ M¥11.8364/ M
768p¥13.5274/ M¥13.5274/ M

wan2.7-t2v

Alibaba

Wan2.7-T2V,演绎能力全面升级,文戏情感细腻自然,动作戏激烈拳拳到肉,搭配更富有戏剧性和节奏感的镜头切换,实现更强表演能力。

视频
72折
分辨率不含视频输入含视频输入
720¥0.4282/ s¥0.4282/ s
1080¥0.7136/ s¥0.7136/ s

hailuo-02

MiniMax

支持文生与图生视频,可输出 6-10 秒、512p/768p/1080p 多档画质,支持运镜指令控制,在画质与成本间灵活平衡。

视频
9折
分辨率不含视频输入含视频输入
1080p¥11.8364/ M¥11.8364/ M
512p¥3.6234/ M¥3.6234/ M
768p¥13.5274/ M¥13.5274/ M

wan2.6-t2v

Alibaba

从文本提示生成 720p/1080p 视频并自带同步音轨,画面具备电影级美学与复杂运动表现,适合创意视频创作。

视频
9折
分辨率不含视频输入含视频输入
720p¥0.6039/ s¥0.6039/ s
1080p¥0.9059/ s¥0.9059/ s

千问系列首个图像编辑模型,成功将Qwen-Image的文本渲染能力拓展到编辑任务上。支持精准的中英双语文字编辑、视觉外观与语义双重编辑、具备强大的跨基准性能表现。

图片
55折
输入价格

—

输出价格

¥0.1635/ 张

缓存读

—

缓存写

—


生成与编辑统一于同一模型;原生 2K,支持专业排版与信息图。

图片
85折
输入价格

—

输出价格

¥0.1654/ 张

缓存读

—

缓存写

—


生成与编辑融合;文字渲染更专业,写实纹理与场景细节更丰富。

图片
5折
输入价格

—

输出价格

¥0.2478/ 张

缓存读

—

缓存写

—


seedream-4.0

ByteDance

新一代统一架构,集成生成与编辑;支持知识型生成与参考图一致性,最高 4K。

图片
95折
输入价格

—

输出价格

¥0.1912/ 张

缓存读

—

缓存写

—


seedream-4.5

ByteDance

模型整体扩容后全面提升;多图编辑主体识别更准,参考图细节保留更严,密集文字渲染更强。

图片
94折
输入价格

—

输出价格

¥0.2329/ 张

缓存读

—

缓存写

—


引入深度推理能力,更好理解复杂描述并结合常识,编辑前后一致性更强。

图片
94折
输入价格

—

输出价格

¥0.205/ 张

缓存读

—

缓存写

—


M2.7 高速版,输出与标准版一致但推理更快,面向编程、Agent 工具调用与办公自动化等对延迟敏感的场景。

文本
85折
输入价格

¥3.4221/ M

输出价格

¥13.6884/ M

缓存读

¥0.3422/ M

缓存写

¥2.1388/ M


Qwen3.7 系列轻量档视觉语言推理模型,擅长物体识别、空间理解与真实场景视觉感知。面向多模态 Agent、视觉 Coding、搜索与计算机操作。

Chat
输入价格

¥0.2013/ M

输出价格

¥0.8723/ M

缓存读

¥0.0403/ M

缓存写

¥0.255/ M


M2.5 系列的加速版本,推理质量与标准版一致,吞吐约提升至三倍,主打编程与智能体工具调用,适合对延迟敏感的 Agent 交互与批量任务。

文本
85折
输入价格

¥3.4221/ M

输出价格

¥13.6884/ M

缓存读

¥0.1711/ M

缓存写

¥2.1388/ M


mimo-v2.5

Xiaomi

系列中端型号,原生处理图像、音频与视频,面向 Agent 工作流与编码场景,以低于 Pro 的成本贴近其表现,适合长流程代理与多模态分析。

文本多模态
85折
输入价格

¥0.7985/ M

输出价格

¥1.597/ M

缓存读

¥0.2441/ M

缓存写

¥0/ M


seed-1.8

ByteDance

面向 Agent 場景的通用基座,工具調用與複雜指令遵循能力明顯提升,適合 GUI Agent、搜索 Agent 與多步驟任務編排。

文本
85折
输入价格

¥2.8518/ M

输出价格

¥22.814/ M

缓存读

¥0.2852/ M

缓存写

¥0.0475/ M


面向 Agent 工作流的代码预览模型,在 SWE-Bench、LiveCodeBench 上跑出接近一线的成绩,适合自主编码智能体与多语言工程任务。

文本
85折
输入价格

¥5.7035/ M

输出价格

¥34.221/ M

缓存读

¥0.5704/ M

缓存写

¥0.0475/ M


系列中端轻量款,主打低延迟与高吞吐,编码与工具调用能力可支撑 Agent 任务,适合实时交互与长文档处理场景。

文本
85折
输入价格

¥0.1654/ M

输出价格

¥1.6369/ M

缓存读

¥0/ M

缓存写

¥0/ M


面向 Agentic 编程的开源模型,擅长仓库级代码理解与终端命令执行,推理成本可控,适合接入代码助手与自动化开发流程。

文本
85折
输入价格

¥1.4145/ M

输出价格

¥8.4697/ M

缓存读

¥0/ M

缓存写

¥0/ M


通义千问中端模型,主打多步推理与智能体规划执行,在编程与思维链任务上表现稳定,体积适合私有化部署与本地推理场景。

文本
85折
输入价格

¥0.4905/ M

输出价格

¥3.924/ M

缓存读

¥0/ M

缓存写

¥0/ M


开源稠密模型的思考模式版本,输出显式思维链,以 27B 规模在数学、编码与多步推理基准上超越前代 397B-A17B 开源旗舰,适合科研辅助与 Agent 规划场景。

文本
85折
输入价格

¥2.3531/ M

输出价格

¥14.1184/ M

缓存读

¥0/ M

缓存写

¥0/ M


Qwen3.5 系列多模态主力,支持图像与视频理解,内置可切换的思考模式,适合文档解析、视觉问答、长视频分析与多模态智能体场景。

文本多模态
85折
输入价格

¥0.6559/ M

输出价格

¥3.924/ M

缓存读

¥0.3251/ M

缓存写

¥4.0894/ M


开源中端文本 MoE 模型,原生支持思维链推理与多步规划,在 function-calling 与复杂推理基准上表现稳定,适合企业自部署的智能体工作流。

文本
85折
输入价格

¥0.6559/ M

输出价格

¥5.2301/ M

缓存读

¥0/ M

缓存写

¥0/ M


Qwen3-VL 系列的 Plus 主力视觉语言模型,支持图像、视频与文本联合输入,擅长文档图表解析、视频理解、空间定位与智能体工具调用,适合多模态问答与视觉自动化场景。

文本多模态
85折
输入价格

¥0.8213/ M

输出价格

¥8.1788/ M

缓存读

¥0.1654/ M

缓存写

¥3.0742/ M


GLM-4 系列通用文本模型,coding 基准与 Agent 框架表现较前代提升,推理时可调用工具,适合软件开发、Agent 任务与角色扮演对话。

文本
85折
输入价格

¥3.2738/ M

输出价格

¥13.0838/ M

缓存读

¥0.6559/ M

缓存写

¥0/ M


Kling O1 是为创作者打造的全新创意引擎,解锁无限创意可能。基于多模态视觉语言(MVL)概念,使用自然语言结合视频、图片、元素等多模态描述,精准理解您的创作意图。

视频
65折
分辨率不含视频输入含视频输入
720p¥0.3894/ s¥0.3894/ s
1080p¥0.5192/ s¥0.5192/ s

可灵3.0 Omni是旗舰模型,提供卓越的视频质量、先进的语义理解和增强的伪影修正。基于视频3.0的基础,Omni为专业创作者提供极致品质,具有更精细的细节、更流畅的运动动态和更高的成功率。

视频
65折
分辨率不含视频输入含视频输入
720p¥0.3894/ s¥0.3894/ s
1080p¥0.5192/ s¥0.5192/ s

可灵视频 3.0 配备革命性智能分镜系统,自动编排多镜头序列,实现电影级转场效果。单次生成最长15秒视频,具备增强的角色一致性、原生级文字叠加和多语言音频混合能力。

视频
65折
分辨率不含视频输入含视频输入
720p¥0.3894/ s¥0.3894/ s
1080p¥0.5192/ s¥0.5192/ s
4k¥1.9471/ s¥1.9471/ s
2k¥0.649/ s¥0.649/ s

VIDEO 2.6 模型一次生成视觉画面、自然配音、匹配音效和环境氛围,连接「声音」与「视觉」的世界。无论是输入文字还是上传图片,都能即时创建一个完整的动态视频,包含声音、节奏和沉浸感。

视频
65折
分辨率不含视频输入含视频输入
720p¥0.1947/ s¥0.1947/ s
1080p¥0.3245/ s¥0.3245/ s

Kling 2.5 Turbo 针对速度和性价比进行了优化,非常适合大批量视频生成需求。在显著缩短生成时间的同时保持良好的质量。

视频
65折
分辨率不含视频输入含视频输入
720p¥0.1947/ s¥0.1947/ s
1080p¥0.3245/ s¥0.3245/ s

Kling 2.1 显著提升了语义响应、动态质量和画面质感。是稳定、高质量视频生成的首选。

视频
65折
分辨率不含视频输入含视频输入
720p¥0.2596/ s¥0.2596/ s
1080p¥0.4543/ s¥0.4543/ s

Kling 2.0 大师版针对专业创作场景优化,为高要求项目提供电影级输出质量。

视频
65折
分辨率不含视频输入含视频输入
720p¥0.2596/ s¥0.2596/ s
1080p¥0.4543/ s¥0.4543/ s

Alibaba 出品,支持 视频 等能力,可通过标准 API 直接调用。

视频
分辨率不含视频输入含视频输入
720¥0.3355/ s¥0.3355/ s
1080¥0.5033/ s¥0.5033/ s

wan2.6-r2v

Alibaba

Alibaba 出品,支持 视频 等能力,可通过标准 API 直接调用。

视频
分辨率不含视频输入含视频输入
720¥0.671/ s¥0.671/ s
1080¥1.0065/ s¥1.0065/ s

Qwen 3.6 系列轻量版,支持文字、图像、视频输入。延迟低、成本低,适合高并发分类、提取、摘要,也能处理简单的 Agent 任务。

文本
7折
输入价格

¥0.8309/ M

输出价格

¥4.9877/ M

缓存读

¥0.0827/ M

缓存写

¥1.039/ M


kimi-k2-instruct

Moonshot AI

指令微调版本聚焦智能体工作流,工具调用稳定,中英编码与推理表现均衡,适合多轮工具链调度的编排场景。

文本
85折
输入价格

¥3.2738/ M

输出价格

¥13.1181/ M

缓存读

¥0.6559/ M

缓存写

¥0/ M


kimi-k2-thinking

Moonshot AI

开源思考型模型,擅长长链推理与连续工具调用,可稳定执行数百步自主研究、编码与多轮智能体任务,适合复杂分析与 Agent 工作流。

文本
85折
输入价格

¥3.4221/ M

输出价格

¥14.2588/ M

缓存读

¥0.8555/ M

缓存写

¥0/ M


通义千问增强版,中英双语理解出色,擅长长文本分析与结构化输出。

文本多模态
7折
输入价格

¥1.3876/ M

输出价格

¥8.3256/ M

缓存读

¥0.1388/ M

缓存写

¥1.7345/ M


面向智能体的旗舰模型,擅长复杂流程编排与工程级任务执行

文本
85折
输入价格

¥11.407/ M

输出价格

¥34.221/ M

缓存读

¥2.2814/ M

缓存写

¥0/ M


多智能体协作模型,支持复杂任务规划与生产级工作流执行

文本
7折
输入价格

¥1.457/ M

输出价格

¥5.8279/ M

缓存读

¥0.2914/ M

缓存写

¥0/ M


综合能力均衡,中文理解与推理表现较好,通用任务适配面广。

文本
85折
输入价格

¥3.3651/ M

输出价格

¥13.4032/ M

缓存读

¥3.1369/ M

缓存写

¥0/ M


视觉增强版本,兼顾图像理解与文本推理,适合多模态输入场景。

文本多模态
85折
输入价格

¥1.711/ M

输出价格

¥5.1331/ M

缓存读

¥0.3137/ M

缓存写

¥0/ M


性价比导向的通用模型,在对话与内容生产任务中速度和质量较均衡。

文本
85折
输入价格

¥1.7681/ M

输出价格

¥7.0153/ M

缓存读

¥0.1768/ M

缓存写

¥2.2244/ M


专为 OpenClaw 等基于代理的场景而设计。

文本
85折
输入价格

¥6.8442/ M

输出价格

¥22.814/ M

缓存读

¥1.3688/ M

缓存写

¥0/ M


kimi-k2.5

Moonshot AI

顶级中英双语模型,强大的长上下文能力。

文本多模态
85折
输入价格

¥3.4221/ M

输出价格

¥17.1732/ M

缓存读

¥0.8555/ M

缓存写

¥4.0951/ M


glm-5

Z.AI

有竞争力的通用中文模型。

文本
85折
输入价格

¥5.0191/ M

输出价格

¥18.4223/ M

缓存读

¥0.981/ M

缓存写

¥0/ M


超快中文处理,极其便宜。

文本
85折
输入价格

¥0.5704/ M

输出价格

¥2.4525/ M

缓存读

¥0.057/ M

缓存写

¥0/ M