汇聚百模千态,热门模型一键调用

汇聚百模千态,热门模型一键调用

旗舰新品
openPangu-2.0-Pro

基于昇腾 NPU 训练的大规模混合专家(MoE)语言模型,参数规模约 505B,每 token 激活参数规模约 18B,模型支持 512k 上下文长度,训练数据总量约34T tokens。

文本生成
Function Call
深度思考
openPangu-2.0-Flash

主打极致性价比,总参数量 92B,动态激活参数量 6B。在保留核心能力的基础上,适配轻量化部署,大幅降低落地门槛。

文本生成
Function Call
深度思考
GLM-5.2

GLM-5.2是面向长任务时代的旗舰模型。支持实测可承载项目级工程上下文,长程任务执行更稳定、工程规范遵循更可靠,开发场景成功率进一步提升。

文本生成
Function Call
ViduQ3-Turbo-T2V

支持生成最高 1080p 分辨率、最长 16 秒的连续视频片段;画面流畅且支持背景音乐、对话与音效的一体化生成。

视频生成
PixVerse-V6-T2V

以真实的画面、精准可控的创作体验,全面赋能叙事电影、广告制作与沉浸式内容开发,让每一帧都触手可及。

视频生成
openPangu-2.0-Pro

基于昇腾 NPU 训练的大规模混合专家(MoE)语言模型,参数规模约 505B,每 token 激活参数规模约 18B,模型支持 512k 上下文长度,训练数据总量约34T tokens。

文本生成
Function Call
深度思考
openPangu-2.0-Flash

主打极致性价比,总参数量 92B,动态激活参数量 6B。在保留核心能力的基础上,适配轻量化部署,大幅降低落地门槛。

文本生成
Function Call
深度思考
DeepSeek-V4-Pro

DeepSeek-V4 系列的旗舰版本,采用混合专家架构,拥有万亿级总参数与 1M(百万 Token)超长上下文窗口

文本生成
Function Call
深度思考
DeepSeek-V3.2

 在推理精度与上下文理解能力上实现显著升级,它针对复杂逻辑推理、多轮对话场景做了深度优化,兼顾高效的响应速度与精准的语义把控

文本生成
Function Call
深度思考
DeepSeek-V4-Flash

在保持 1M 超长上下文能力的同时,通过更小的模型参数与激活规模,提供更为快捷、经济的 API 服务。

文本生成
Function Call
深度思考
Qwen3-32B

拥有328亿参数,其中非嵌入参数为312亿,包含64层结构,采用GQA架构,Q有64个注意力头,KV有8个注意力头

文本生成
深度思考
GLM-5.2

GLM-5.2是面向长任务时代的旗舰模型。支持实测可承载项目级工程上下文,长程任务执行更稳定、工程规范遵循更可靠,开发场景成功率进一步提升。

文本生成
Function Call
Kimi-K2.6

Kimi-K2.6是 Kimi 最新最强模型,在通用 Agent、代码能力上全面提升,并在多个基准测试中取得行业领先成绩 

文本生成
Function Call
深度思考
DeepSeek-V3.2

 在推理精度与上下文理解能力上实现显著升级,它针对复杂逻辑推理、多轮对话场景做了深度优化,兼顾高效的响应速度与精准的语义把控

文本生成
Function Call
深度思考
ViduQ3-Turbo-T2V

支持生成最高 1080p 分辨率、最长 16 秒的连续视频片段;画面流畅且支持背景音乐、对话与音效的一体化生成。

视频生成
PixVerse-V6-T2V

以真实的画面、精准可控的创作体验,全面赋能叙事电影、广告制作与沉浸式内容开发,让每一帧都触手可及。

视频生成
Qwen2.5-VL-7B

一款开源的多模态视觉语言模型,参数规模为70亿,具备强大的视觉和语言理解能力

图像理解
Qwen2.5-VL-72B

通义千问2.5-VL-72B是多模态大模型,参数规模达720亿

图像理解
Qwen-Image-Edit

该模型的图像编辑合入了Qwen-Image的文本渲染能力,支持精准的图中文字修改

图像理解
Qwen-Image

图像生成与编辑通用能力强劲,在文本渲染的场景下表现出色

图片生成

基于您的业务场景为您推荐模型

基于您的业务场景为您推荐模型MB

应用场景
  • 代码生成
  • AI搜索
  • 用户画像分析
  • 内容翻译
  • Prompt改写与优化
代码生成

根据需求描述或注释,自动生成准确、可运行的程序代码

• 高效提效:替代手动编写基础代码,大幅缩短开发周期与人力成本

• 精准可用:贴合需求描述与注释逻辑生成代码,输出可直接运行且降低语法错误率

• 门槛兼容:支持自然语言需求输入,降低非专业开发人员的代码实现门槛

旗舰新品
openPangu-2.0-Pro

基于昇腾 NPU 训练的大规模混合专家(MoE)语言模型,参数规模约 505B,每 token 激活参数规模约 18B,模型支持 512k 上下文长度,训练数据总量约34T tokens。

文本生成 缓存命中
推荐理由

具备更强的推理与规划能力

模型价格

输入长度 [0, 32K):

缓存命中:0.8 元/ 百万tokens

输入:3.2 元/ 百万tokens

输出:14.5 元/百万tokens

输入长度 [32K+):

缓存命中:1.2 元/ 百万tokens

输入:4.8 元/ 百万tokens

输出:17.6 元/百万tokens

GLM-5.2

智谱新一代旗舰模型,专为长程任务能力而生

文本生成 深度思考 198K
推荐理由

 面向长任务时代的旗舰模型,长程任务执行更稳定、工程规范遵循更可靠,开发场景成功率进一步提升

模型价格

输入 8元/百万tokens

输出 28元/百万tokens

Kimi-K2.6

Kimi-K2.6是 Kimi 最新最强模型,在通用 Agent、代码能力上全面提升,并在多个基准测试中取得行业领先成绩

文本生成 深度思考 256K
推荐理由

具备更强、更稳的长程代码编写能力,显著增强 Agent 的自主执行能力

模型价格

输入 6.5元/百万tokens

输出 27元/百万tokens

AI搜索

深入理解用户对复杂问题的搜索意图,提供全面的答复并保留引用链接

• 语义理解:通过上下文识别真实意图,而非仅限关键词

• 知识增强:结合企业知识库与文档,提供权威、可追溯答案

• 多模态支持:覆盖文本、图片、视频,多场景一体化搜索

旗舰新品
openPangu-2.0-Flash

openPangu-2.0-Flash 是基于昇腾 NPU 训练的大规模混合专家(MoE)语言模型,参数规模约 92B,每 token 激活参数规模约 6B,模型支持 512k 上下文长度,训练数据总量约34T tokens

文本生成 512K
推荐理由

在保留核心能力的基础上,适配轻量化部署,大幅降低落地门槛。

模型价格

输入0.8元/百万tokens

输出1.6元/百万tokens

旗舰新品
DeepSeek-V4-Flash

保持 1M 超长上下文能力的同时,提供更快捷、经济的 API 服务

文本生成 1024K
推荐理由

支持超长上下文长度

低耗高效,是开发者与企业普惠首选。

模型价格

输入 1元/百万tokens

输出 2元/百万tokens

DeepSeek-V3.2

在计算效率与出色推理及代理能力之间实现出色平衡

文本生成 深度思考 128K
推荐理由

擅长拆解模糊的用户意图,规划搜索步骤,适合作为搜索Agent的大脑

模型价格

输入 2元/百万tokens

输出 3元/百万tokens

用户画像分析

深度挖掘用户数据,自动构建精准的用户特征画像

• 数据融合:融合多源数据,将分散的用户信息转化为完整的画像

• 实时更新:用户标签动态刷新,支持灵活分群和对比分析

• 价值转化:与推荐和营销系统打通,提升转化率与用户价值

旗舰新品
DeepSeek-V4-Pro

DeepSeek-V4 系列的旗舰版本,采用混合专家架构,拥有万亿级总参数与 1M(百万 Token)超长上下文窗口 

文本生成 1024K
推荐理由

支持超长上下文长度

在 Agent 能力、世界知识与推理性能上均实现开源领域领先

模型价格

输入 12元/百万tokens

输出 24元/百万tokens

旗舰新品
DeepSeek-V4-Flash

保持 1M 超长上下文能力的同时,提供更快捷、经济的 API 服务

文本生成 1024K
推荐理由

支持超长上下文长度

低耗高效,是开发者与企业普惠首选。

模型价格

输入 1元/百万tokens

输出 2元/百万tokens

DeepSeek-R1

在对话结构优化和逻辑引导方面表现突出,能够帮助构建更有条理的情感交流流程

文本生成 深度思考 128K
推荐理由

擅长将复杂情感需求转化为结构化对话,适合需要系统化情感支持的应用,如心理咨询辅助等

模型价格

输入 4元/百万tokens

输出 16元/百万tokens

内容翻译

打破语言壁垒,提供准确、流畅且符合语境的多语言互译

• 精准适配:基于业务场景语境优化翻译,避免字面化偏差

• 多语互通:支持多语种双向互译,覆盖不同地区语言习惯

• 高效流畅:输出文本自然通顺,兼顾专业性与可读性

旗舰新品
DeepSeek-V4-Pro

DeepSeek-V4 系列的旗舰版本,采用混合专家架构,拥有万亿级总参数与 1M(百万 Token)超长上下文窗口 

文本生成 1024K
推荐理由

支持超长上下文长度

在 Agent 能力、世界知识与推理性能上均实现开源领域领先

模型价格

输入 12元/百万tokens

输出 24元/百万tokens

DeepSeek-V3.2

在计算效率与出色推理及代理能力之间实现出色平衡

文本生成 深度思考 128K
推荐理由

擅长拆解模糊的用户意图,规划搜索步骤,适合作为搜索Agent的大脑

模型价格

输入 2元/百万tokens

输出 3元/百万tokens

DeepSeek-V4-Flash

保持 1M 超长上下文能力的同时,提供更快捷、经济的 API 服务

文本生成 1024K
推荐理由

支持超长上下文长度

低耗高效,是开发者与企业普惠首选。

模型价格

输入 1元/百万tokens

输出 2元/百万tokens

Prompt改写与优化

优化、精炼用户指令,以更低的成本、更精准的输入激发大模型的性能

• 成本优化:精简指令冗余内容,减少无效计算,降低模型调用成本

• 精准提效:贴合模型理解逻辑优化表述,大幅提升输出结果的匹配度

• 门槛降低:让非专业用户的模糊指令也能转化为高效输入,提升使用体验

旗舰新品
DeepSeek-V4-Pro

DeepSeek-V4 系列的旗舰版本,采用混合专家架构,拥有万亿级总参数与 1M(百万 Token)超长上下文窗口 

文本生成 1024K
推荐理由

支持超长上下文长度

在 Agent 能力、世界知识与推理性能上均实现开源领域领先

模型价格

输入 12元/百万tokens

输出 24元/百万tokens

DeepSeek-V3.2

在计算效率与出色推理及代理能力之间实现出色平衡

文本生成 深度思考 128K
推荐理由

擅长拆解模糊的用户意图,规划搜索步骤,适合作为搜索Agent的大脑

模型价格

输入 2元/百万tokens

输出 3元/百万tokens

DeepSeek-V4-Flash

保持 1M 超长上下文能力的同时,提供更快捷、经济的 API 服务

文本生成 1024K
推荐理由

支持超长上下文长度

低耗高效,是开发者与企业普惠首选。

模型价格

输入 1元/百万tokens

输出 2元/百万tokens

代码生成

根据需求描述或注释,自动生成准确、可运行的程序代码

• 高效提效:替代手动编写基础代码,大幅缩短开发周期与人力成本

• 精准可用:贴合需求描述与注释逻辑生成代码,输出可直接运行且降低语法错误率

• 门槛兼容:支持自然语言需求输入,降低非专业开发人员的代码实现门槛

openPangu-2.0-Pro
GLM-5.2
Kimi-K2.6
AI搜索

深入理解用户对复杂问题的搜索意图,提供全面的答复并保留引用链接

• 语义理解:通过上下文识别真实意图,而非仅限关键词

• 知识增强:结合企业知识库与文档,提供权威、可追溯答案

• 多模态支持:覆盖文本、图片、视频,多场景一体化搜索

推荐模型
openPangu-2.0-Flash
DeepSeek-V4-Flash
DeepSeek-V3.2
用户画像分析

深度挖掘用户数据,自动构建精准的用户特征画像

• 数据融合:融合多源数据,将分散的用户信息转化为完整的画像

• 实时更新:用户标签动态刷新,支持灵活分群和对比分析

• 价值转化:与推荐和营销系统打通,提升转化率与用户价值

DeepSeek-V4-Pro
DeepSeek-V4-Flash
DeepSeek-R1
内容翻译

打破语言壁垒,提供准确、流畅且符合语境的多语言互译

• 精准适配:基于业务场景语境优化翻译,避免字面化偏差

• 多语互通:支持多语种双向互译,覆盖不同地区语言习惯

• 高效流畅:输出文本自然通顺,兼顾专业性与可读性

DeepSeek-V4-Pro
DeepSeek-V3.2
DeepSeek-V4-Flash
Prompt改写与优化

优化、精炼用户指令,以更低的成本、更精准的输入激发大模型的性能

• 成本优化:精简指令冗余内容,减少无效计算,降低模型调用成本

• 精准提效:贴合模型理解逻辑优化表述,大幅提升输出结果的匹配度

• 门槛降低:让非专业用户的模糊指令也能转化为高效输入,提升使用体验

DeepSeek-V4-Pro
DeepSeek-V3.2
DeepSeek-V4-Flash

一图了解MaaS产品架构

一图了解MaaS产品架构

活动规则
可信安全底座
可信安全底座
端到端加密,全链路安心

在MaaS中导入模型时,支持用户选择HTTPS传输协议,为保证数据传输的安全性,推荐用户使用更加安全的HTTPS协议。 

操作全程可审计,风险全周期可控

提供对各种云资源操作记录的收集、存储和查询功能,可用于支撑安全分析、合规审计、资源跟踪和问题定位等常见应用场景。 

客户实践 算力驱动新可能

客户案例