搜索_华为云

查看诊断报告 - AI开发平台ModelArts

rank模块，html中会基于表格展示每张卡不同step的计算耗时、通信耗时和空闲耗时。基于该表格，通常关注计算耗时(compute)和空闲耗时(free)这两列，可以初步分析当前瓶颈点是计算还是任务下发，以及是否存在计算快慢卡和下发快慢卡。如下图所示，可以看到8号卡的计算耗时明显大于其他卡，因此8号卡的

 帮助中心 > AI开发平台ModelArts > 最佳实践 > GPU业务迁移至昇腾训练推理 > 迁移调优工具链 > 性能调优: MA-Advisor性能诊断
分离部署推理服务 - AI开发平台ModelArts

Prefill阶段（全量推理）将用户请求的prompt传入大模型，进行计算，中间结果写入KVCache并推出第1个token，属于计算密集型。 Decode阶段（增量推理）将请求的前1个token传入大模型，从显存读取前文产生的KVCache再进行计算，属于访存密集型。分离部署场景下，全量推理和增

 帮助中心 > AI开发平台ModelArts > 最佳实践 > LLM大语言模型训练推理 > 主流开源大模型基于Lite Server适配PyTorch NPU推理指导（6.3.911） > 部署推理服务
Standard资源管理 - AI开发平台ModelArts

专属资源池：专属资源池提供独享的计算资源，不与其他用户共享，资源更可控。使用ModelArts Standard开发平台的训练作业、部署模型以及开发环境时，可以使用Standard专属资源池的计算资源。使用前，您需要先购买创建一个专属资源池。公共资源池：公共资源池提供公共的大规模计算集群，根据用户作业参数分配使用，资源按作业隔离。

帮助中心 > AI开发平台ModelArts > 产品介绍 > 功能介绍 > Standard功能介绍
分离部署推理服务 - AI开发平台ModelArts

Prefill阶段（全量推理）将用户请求的prompt传入大模型，进行计算，中间结果写入KVCache并推出第1个token，属于计算密集型。 Decode阶段（增量推理）将请求的前1个token传入大模型，从显存读取前文产生的KVCache再进行计算，属于访存密集型。分离部署场景下，全量推理和增

 帮助中心 > AI开发平台ModelArts > 最佳实践 > LLM大语言模型训练推理 > 主流开源大模型基于Lite Server适配PyTorch NPU推理指导（6.3.908） > 部署推理服务
分离部署推理服务 - AI开发平台ModelArts

Prefill阶段（全量推理）将用户请求的prompt传入大模型，进行计算，中间结果写入KVCache并推出第1个token，属于计算密集型。 Decode阶段（增量推理）将请求的前1个token传入大模型，从显存读取前文产生的KVCache再进行计算，属于访存密集型。分离部署场景下，全量推理和增

 帮助中心 > AI开发平台ModelArts > 最佳实践 > LLM大语言模型训练推理 > 主流开源大模型基于Lite Server适配PyTorch NPU推理指导（6.3.909） > 部署推理服务
在Workflow中使用大数据能力（MRS） - AI开发平台ModelArts

在Workflow中使用大数据能力（MRS）功能介绍该节点通过调用MRS服务，提供大数据集群计算能力。主要用于数据批量处理、模型训练等场景。应用场景需要使用MRS Spark组件进行大量数据的计算时，可以根据已有数据使用该节点进行训练计算。使用案例在华为云MRS服务下查看自己账号下可用的MRS集群，

帮助中心 > AI开发平台ModelArts > ModelArts Standard用户指南 > 使用Workflow实现低代码AI开发 > 开发Workflow命令参考 > Workflow高阶能力
分离部署推理服务 - AI开发平台ModelArts

Prefill阶段（全量推理）将用户请求的prompt传入大模型，进行计算，中间结果写入KVCache并推出第1个token，属于计算密集型。 Decode阶段（增量推理）将请求的前1个token传入大模型，从显存读取前文产生的KVCache再进行计算，属于访存密集型。分离部署场景下，全量推理和增

 帮助中心 > AI开发平台ModelArts > 最佳实践 > LLM大语言模型训练推理 > 主流开源大模型基于Lite Server适配PyTorch NPU推理指导（6.3.910） > 部署推理服务
分布式训练功能介绍 - AI开发平台ModelArts

分布式训练功能介绍分布式训练分布式训练是指在多个计算节点（如多台服务器或GPU设备）上并行执行深度学习任务，以加快模型训练速度或处理更大规模的数据。通过将训练任务分配到多个节点上，每个节点负责计算模型的一部分，然后通过通信机制将计算结果同步，最终完成整个模型的训练。这种方式可以显

 帮助中心 > AI开发平台ModelArts > ModelArts Standard用户指南 > 使用ModelArts Standard训练模型 > 分布式模型训练
Notebook Cache盘告警上报 - AI开发平台ModelArts

类型的资源，ModelArts会挂载硬盘至“/cache”目录，用户可以使用此目录来储存临时文件。当前开发环境的Cache盘使用时，没有容量告警，在使用时很容易超过限制，并直接重启Notebook实例。重启后多种配置重置，会导致用户数据丢弃，环境丢失，造成很不好的使用体验。因此

 帮助中心 > AI开发平台ModelArts > ModelArts Standard用户指南 > 使用Notebook进行AI开发调试 > 管理Notebook实例
约束与限制 - AI开发平台ModelArts

中的约束和限制。规格限制表1 规格说明资源类型规格说明计算资源所有按需计费、包年/包月、套餐包中的计算资源规格，包括CPU、GPU和NPU 购买的所有类型的计算资源均不支持跨Region使用。计算资源套餐包套餐包仅用于公共资源池，不能用于专属资源池。配额限制

 帮助中心 > AI开发平台ModelArts > 产品介绍
准备资源 - AI开发平台ModelArts
准备资源 - AI开发平台ModelArts

其中，文件系统类型推荐选用500MB/s/TiB或1000MB/s/TiB，应用于AI大模型场景中。存储容量推荐使用 6.0~10.8TB ，以存储更多模型文件。图3 SFS类型和容量选择 ECS服务器挂载SFS Turbo： ECS服务器中手动挂载SFS Turbo步骤如下：用户

 帮助中心 > AI开发平台ModelArts > 最佳实践 > LLM大语言模型训练推理 > 主流开源大模型适配AscendFactory PyTorch NPU训练指导（6.5.902） > 准备工作 > ModelArts Standard
ModelArts Studio（MaaS）模型推理计费项 - AI开发平台ModelArts

Studio（MaaS）模型推理计费项计算资源计费项在MaaS进行模型推理时，会产生计算资源和存储资源的累计值计费。计算资源为运行模型服务的费用。存储资源包括数据存储到OBS的计费。具体内容如表1所示。表1 计费项计费项计费项说明适用的计费模式计费公式计算资源公共资源池使用计算资源的用量。

帮助中心 > AI开发平台ModelArts > 计费说明 > 计费项（ModelArts Studio）
DeepSeek Janus-Pro模型基于ModelArts Lite Server适配PyTorch推理指导 - AI开发平台ModelArts

是DeepSeek发布的开源多模态AI模型，主要应用于文生图领域。本方案主要介绍在ModelArts Lite Server上如何使用昇腾计算资源Ascend Snt9B开展DeepSeek Janus-Pro模型的推理过程。资源规格要求推荐使用“西南-贵阳一”Region上的Lite

帮助中心 > AI开发平台ModelArts > 最佳实践 > 文生图模型训练推理
查看训练作业资源占用情况 - AI开发平台ModelArts

er-0实例的GPU/NPU平均利用率计算方法：将作业worker-0实例的各个GPU/NPU加速卡每个时间点的利用率汇总取平均值。如何提高训练作业资源利用率适当增大batch_size：较大的batch_size可以让GPU/NPU计算单元获得更高的利用率，但是也要根据实际

 帮助中心 > AI开发平台ModelArts > ModelArts Standard用户指南 > 使用ModelArts Standard训练模型 > 管理模型训练作业
CogVideoX1.5 5b 和 CogVideoX 5b模型基于Lite Server全量8卡序列并行推理指导（6.5.901） - AI开发平台ModelArts

优于所有公开可用的模型，在机器和人类评估方面都有很大的优势。方案概览本方案介绍了在ModelArts的Lite Server上使用昇腾计算资源开展CogVideoX1.5 5b，CogVideoX 5b 8卡SP推理的详细过程。完成本方案的部署，需要先联系您所在企业的华为方技术支持购买Server资源。

帮助中心 > AI开发平台ModelArts > 最佳实践 > 文生视频模型训练推理
Lite Cluster&Server介绍 - AI开发平台ModelArts

Lite基于软硬件深度结合、垂直优化，构建开放兼容、极致性价比、长稳可靠、超大规模的云原生AI算力集群，提供一站式开通、网络互联、高性能存储、集群管理等能力，满足AI高性能计算等场景需求。目前其已在大模型训练推理、自动驾驶、AIGC、内容审核等领域广泛得到应用。 ModelArts Lite又分以下2种形态： ModelArts

帮助中心 > AI开发平台ModelArts > 产品介绍 > 功能介绍
开发环境计费项 - AI开发平台ModelArts

关于EVS的计费详情，请参见表1；关于如何删除EVS，请参见卸载并删除云硬盘。计算资源费用：如果运行Notebook实例时，使用专属资源池进行模型训练和推理，计算资源不计费。如果运行Notebook实例时，使用公共资源池进行模型训练和推理，计算资源需收费。存储资源费用：数据存储到对象存储OBS、云

 帮助中心 > AI开发平台ModelArts > 计费说明 > 计费项（ModelArts Standard）
数据管理计费项 - AI开发平台ModelArts

创建桶不收取费用，按实际使用的存储容量和时长收费计费示例以下案例中出现的费用价格仅供参考，实际价格请参见各服务价格详情。示例：存储费用假设用户于2023年4月1日10:00:00创建了一个数据集，数据是存储在OBS中的。按照存储费用结算，那么数据存储到OBS的费用计算如下：存储费用：数

 帮助中心 > AI开发平台ModelArts > 计费说明 > 计费项（ModelArts Standard）
Prefix Caching - AI开发平台ModelArts

prompt的场景，system prompt在不同的请求中但是相同的，KV Cache的计算也是相同的；多轮对话场景中，每一轮对话需要依赖所有历史轮次对话的上下文，历史轮次中的KV Cache在后续每一轮中都要被重新计算。这两种情况下，如果能把system prompt和历史轮次中的KV Ca

帮助中心 > AI开发平台ModelArts > 最佳实践 > LLM大语言模型训练推理 > 主流开源大模型基于Lite Server适配Ascend-vLLM PyTorch NPU推理指导（6.3.912） > 推理关键特性使用
精度比对 - AI开发平台ModelArts
精度比对 - AI开发平台ModelArts

中的API计算数值与CPU或GPU芯片中的API计算数值，进行问题定位。同一模型，进行迭代（模型、框架版本升级或设备硬件升级）时存在的精度下降问题，对比相同模型在迭代前后版本的API计算数值，进行问题定位。首先通过在PyTorch训练脚本中插入dump接口，跟踪计算图中算子的

 帮助中心 > AI开发平台ModelArts > 最佳实践 > GPU业务迁移至昇腾训练推理 > 迁移调优工具链 > 精度调试: msprobe

总条数： 1027

上一页
1
2
3
4
5
...
52
下一页
跳转

点击加载更多

您搜索到想要的结果了吗？

是的没搜到

意见反馈

0/200

提交反馈取消