logologo
logo
热门活动
HOT
大模型
音视频
客户价值
文档
支持与帮助
售前咨询
banner
logo
快手万擎
企业级大模型服务与开发平台
企业级模型服务与AI算力云平台,集成高性能模型推理、低成本模型定制与全托管服务,助力企业专注于AI应用创新,无需担忧底层算力的复杂性与成本
精选模型广场,满足多元场景
GLM-5.3
GLM-5.3
输入¥8 /百万 tokens · 输出¥28 /百万 tokens
GLM-5.3 是智谱于 2026 年 8 月 14 日发布的最新旗舰模型。与 GLM-5.2 相比,基座模型未变(总参数规模 7430 亿),但通过极致的后训练 Scaling 大幅提升了模型的智能上界。模型支持 1M 上下文窗口,在编程能力、长程任务执行和网络安全等维度实现了显著突破,被业界誉为“编程能力最强的开源模型”。
深度思考
1024k
ai.svg立即体验
DeepSeek-V4-Flash-0731
DeepSeek-V4-Flash-0731
输入¥1 /百万 tokens · 输出¥2 /百万 tokens
DeepSeek-V4 Flash 0731 是面向智能体、代码与长上下文任务的高效 MoE 模型,支持 1M token 上下文及 Responses API,兼具高速推理与低调用成本。
深度思考
1024K
Agent
ai.svg立即体验
GLM-5.2
GLM-5.2
输入¥8 /百万 tokens · 输出¥28 /百万 tokens
GLM-5.2 是 GLM-5.1 的升级版本,在 Coding、长上下文理解和长程任务上有明显提升。模型支持 1M 上下文窗口,并具备更灵活的思考强度控制,适用于复杂开发、移动端全栈、代码迁移和科研复现等场景。
深度思考
1024k
ai.svg立即体验
MiniMax-M2.7
MiniMax-M2.7
输入¥2.1 /百万 tokens · 输出¥8.4 /百万 tokens
MiniMax-M2.7 是一款具备强大 Agentic 指令遵循、卓越工程编码的先进模型,专为解决复杂任务拆解、多角色协作及大规模技能调用而设计。
深度思考
200k
ai.svg立即体验
Kimi-K2.6
Kimi-K2.6
输入¥6.5 /百万 tokens · 输出¥27 /百万 tokens
月之暗面开源旗舰编程大模型,万亿 MoE 架构;代码能力对标顶级闭源模型;支持超长上下文,长时间自主完成大型全栈开发;具备智能体集群协作,自动拆任务、自查纠错、端到端交付。
图像理解
视频理解
256K
ai.svg立即体验
MiMo-V2.5-Pro
MiMo-V2.5-Pro
输入¥7 /百万 tokens · 输出¥21 /百万 tokens
综合能力对标 Claude Opus 4.6,具备1T超大参数量、1M 超长上下文,复杂长任务能力国内第一,支持近千轮工具调用;可全闭环处理大型编程、企业数据分析;Token 成本节省 40%–60%,兼容主流 Agent 框架。高性价比
深度思考
1024k
ai.svg立即体验
丰富模型能力,一站全面覆盖
模型推理集成行业主流模型,提供稳定高效的在离线推理服务,开箱即用,满足多元场景需求。
更多模型更多模型
行业头部模型、快速响应、首发支持
高性价比高性价比
性能领先、成本更优
了解详情arrow
模型定制
模型研发
数据服务
模型托管
GPU算力服务
模型推理
关键指标保障,业务运行无忧
40%arrow
推理成本持续优化
99.9%
生产级稳定保障,关键业务始终在线
TTFT P95 < 5000ms
首Token输出更快,持续输出更流畅
灵活计费,成本清晰可控
推理服务
推理服务用多少,付多少
模型精调
模型精调按需训练,灵活计费
模型单元
模型单元独占资源,稳定优先
模型研发
模型研发算力即开即用,按小时结算
模型名称
分段
输入价格
输出价格
缓存命中
价格单位
DeepSeek-V4-Flash-0731
-
3.00
9.00
0.10
元/百万 tokens
DeepSeek-V4-Flash
-
1.00
2.00
0.20
元/百万 tokens
DeepSeek-V4-Pro-0813
-
9.00
27.00
0.30
元/百万 tokens
DeepSeek-V4-Pro
-
12.00
24.00
1.00
元/百万 tokens
GLM-5.2
-
8.00
28.00
2.00
元/百万 tokens
GLM-5.1
输入长度 [0, 32K)
输入长度[32, 200K)
6.00
8.00
24.00
28.00
1.30
2.00
元/百万 tokens
元/百万 tokens
GLM-5-Turbo
输入长度 [0, 32K)
输入长度[32, 200K)
5.00
7.00
22.00
26.00
1.20
1.80
元/百万 tokens
元/百万 tokens
Qwen3.6-27B
-
3.00
18.00
-
元/百万 tokens
Qwen3.5-35B-A3B
输入长度(0, 128K]
输入长度(128, 256K]
0.40
1.60
3.20
12.80
-
-
元/百万 tokens
元/百万 tokens
Qwen3.5-27B
输入长度(0, 128K]
输入长度(128, 256K]
0.60
1.80
4.80
14.40
-
-
元/百万 tokens
元/百万 tokens
Qwen3.5-122B-A10B
输入长度(0, 128K]
输入长度(128, 256K]
0.80
2.00
6.40
16.00
-
-
元/百万 tokens
元/百万 tokens
Qwen3.5-397B-A17B
输入长度(0, 128K]
输入长度(128, 256K]
1.20
3.00
7.20
18.00
0.24
0.60
元/百万 tokens
元/百万 tokens
Kimi-K2.6
-
6.50
27.00
1.10
元/百万 tokens
Kimi-K2.5
-
4.00
21.00
0.70
元/百万 tokens
MiniMax-M2.7
-
2.10
8.40
0.42
元/百万 tokens
MiniMax-M2.5
-
2.10
8.40
0.21
元/百万 tokens
MiniMax-M2.1-lightning
-
2.10
16.80
0.21
元/百万 tokens
KAT-Coder-Pro-V2.5
-
5.00
20.00
1.00
元/百万 tokens
KAT-Coder-Air-V2.5
-
1.00
4.00
0.20
元/百万 tokens
KAT-Coder-Pro-V2
-
2.10
8.40
0.42
元/百万 tokens
查看完整定价arrow
平台动态
快手万擎
DeepSeek V4 Flash 0731 已上架
开箱即用!快手万擎已率先接入!
了解详情arrow

平台能力更新

新增 GLM-5.2-FP8 模型部署能力,支持预付费、后付费模式,丰富模型部署选择。

了解详情arrow
帮助文档
快速了解模型特征与接入
定价说明
清晰了解服务成本与计费方式
API调用
无缝集成大模型能力