搜索_华为云

计费样例 - AI开发平台ModelArts
计费样例 - AI开发平台ModelArts

某用户于2023/03/18 15:30:00使用一个按需计费的公共资源池进行训练，规格配置如下：规格：CPU: 8 核 32GB (modelarts.vm.cpu.8ud) 计算节点个数：1个用了一段时间后，于2023/03/20 10:30:00停止训练作业。那么在3月份，该公共资源池总共产生多少费用呢？

帮助中心 > AI开发平台ModelArts > 计费说明
如何禁止Ubuntu 20.04内核自动升级？ - AI开发平台ModelArts

如何禁止Ubuntu 20.04内核自动升级？场景描述在Ubuntu 20.04每次内核升级后，系统需要重新启动以加载新内核。如果您已经安装了自动更新功能，则系统将自动下载和安装可用的更新，这可能导致系统在不经意间被重启，如果使用的软件依赖于特定版本的内核，那么当系统自动更新

 帮助中心 > AI开发平台ModelArts > 常见问题 > Lite Server
ECS服务器挂载SFS Turbo存储 - AI开发平台ModelArts

据和算法至OBS（首次使用时需要）。 ECS服务器和SFS的共享硬盘在相同的VPC或者对应VPC能够互联。 ECS服务器基础镜像需要用Ubuntu 18.04的。 ECS服务器和SFS Turbo需要在同一子网中。操作步骤在ECS服务器中设置华为云镜像源。 sudo sed -i

帮助中心 > AI开发平台ModelArts > 最佳实践 > 历史待下线案例 > 专属资源池训练 > 基本配置
使用DCGM监控Lite Server资源 - AI开发平台ModelArts

Server资源场景描述本文主要介绍如何在Lite Server上配置DCGM监控，用于监控Lite Server上的GPU资源。 DCGM是用于管理和监控基于Linux系统的NVIDIA GPU大规模集群的一体化工具，提供多种能力，包括主动健康监控、诊断、系统验证、策略、电源和时钟管理、配置管理和审计等。

帮助中心 > AI开发平台ModelArts > ModelArts用户指南（Lite Server） > Lite Server资源管理 > 监控Lite Server资源
查询资源池列表，可通过标签、资源池状态筛选查询资源池列表 - AI开发平台ModelArts

modelarts/name" : "auto-pool-os", "os.modelarts/workspace.id" : "0", "os.modelarts/resource.id" : "maos-auto-pool-os-72w8d" },

帮助中心 > AI开发平台ModelArts > API参考 > 资源管理
（可选）本地服务器安装ModelArts SDK - AI开发平台ModelArts

（可选）本地服务器安装ModelArts SDK 如果需要在个人PC或虚拟机上使用ModelArts SDK，则需要在本地环境中安装ModelArts SDK，安装后可直接调用ModelArts SDK轻松管理数据集、创建ModelArts训练作业及创建AI应用，并将其部署为在线服务。

帮助中心 > AI开发平台ModelArts > SDK参考
部署服务 - AI开发平台ModelArts
部署服务 - AI开发平台ModelArts

公共参数。资源规格，可通过查询支持的服务部署规格可获取规格列表。当前版本可选modelarts.vm.cpu.2u/modelarts.vm.gpu.pnt004(需申请)/modelarts.vm.ai1.snt3(需申请)/custom(仅支持在部署到专属资源池时使用)，需申请的规格

 帮助中心 > AI开发平台ModelArts > API参考 > 服务管理
如何在ModelArts的Notebook中配置Conda源？ - AI开发平台ModelArts

如何在ModelArts的Notebook中配置Conda源？用户可以在Notebook开发环境中自行安装开发依赖包，方便使用。常见的依赖安装支持pip和Conda，pip源已经配置好，可以直接使用安装，Conda源需要多一步配置。本章节介绍如何在Notebook开发环境中配置Conda源。

帮助中心 > AI开发平台ModelArts > 常见问题 > Standard镜像相关
权限管理 - AI开发平台ModelArts
权限管理 - AI开发平台ModelArts

户的权限管理，各个云服务都提供了一些预置的“系统策略”供用户直接使用。如果预置的策略不能满足您的细粒度权限控制要求，则可以通过“自定义策略”来进行精细控制。表1列出了ModelArts的所有预置系统策略。表1 ModelArts系统策略策略名称描述类型 ModelArts

帮助中心 > AI开发平台ModelArts > 产品介绍
创建资源池 - AI开发平台ModelArts

准。 os.modelarts/node.prefix 否 String 自定义节点名称前缀。表6 PoolAnnotationsCreation 参数是否必选参数类型描述 os.modelarts/description 否 String 资源池的描述信息。 os.modelarts/billing

帮助中心 > AI开发平台ModelArts > API参考 > 资源管理
查询节点池列表 - AI开发平台ModelArts

"name" : "modelarts.vm.2u4g.dcc-Default" }, "spec" : { "resources" : { "nodePool" : "modelarts.vm.2u4g.dcc-Default",

帮助中心 > AI开发平台ModelArts > API参考 > 节点池管理
ma-cli configure鉴权命令 - AI开发平台ModelArts

配置文件本地路径，默认路径为~/.modelarts/ma-cli-profile.yaml。配置用户名密码鉴权以在虚拟机上使用ma-cli configure为例，介绍如何配置用户名密码进行鉴权。以下样例中所有以${}装饰的字符串都代表一个变量，用户可以根据实际情况指定对应的值。

帮助中心 > AI开发平台ModelArts > ModelArts用户指南（Standard） > 使用Notebook进行AI开发调试 > ModelArts CLI命令参考
资源购买 - AI开发平台ModelArts
资源购买 - AI开发平台ModelArts

网。购买弹性云服务器ECS 如果您需要在服务器上部署相关业务，较之物理服务器，弹性云服务器的创建成本较低，并且可以在几分钟之内快速获得基于云服务平台的弹性云服务器设施，并且这些基础设施是弹性的，可以根据需求伸缩。操作指导请参考自定义购买ECS。购买时需注意，ECS需要和SFS买到同一个VPC才能挂载SFS存储。

帮助中心 > AI开发平台ModelArts > 最佳实践 > 历史待下线案例 > 专属资源池训练
Notebook提示磁盘空间已满 - AI开发平台ModelArts

用内存，导致磁盘空间不足。磁盘配额不足。处理方法查看虚拟机所使用的存储空间，再查看回收站文件占用内存，根据实际删除回收站里不需要的大文件。在Notebook实例详情页，查看实例的存储容量。执行如下命令，排查虚拟机所使用的存储空间，一般接近存储容量，请排查回收站占用内存。

帮助中心 > AI开发平台ModelArts > 故障排除 > 开发环境 > 环境配置故障
GPU A系列裸金属服务器RoCE带宽不足如何解决？ - AI开发平台ModelArts

GPU A系列裸金属服务器RoCE带宽不足如何解决？问题现象 GP Ant8支持RoCE网卡， Ubuntu20.04场景，在进行nccl-tests时，总线带宽理论峰值可达90GB/s，但实际测试下来的结果只有35GB/s。原因分析 “nv_peer_mem”是一个Linu

帮助中心 > AI开发平台ModelArts > 故障排除 > Lite Server
以PyTorch框架创建训练作业（新版训练） - AI开发平台ModelArts

"total_count": 2, "flavors": [ { "flavor_id": "modelarts.vm.cpu.2u", "flavor_name": "Computing CPU(2U) instance", "flavor_type":

帮助中心 > AI开发平台ModelArts > API参考 > 应用示例
创建模型成功后，部署服务报错，如何排查代码问题 - AI开发平台ModelArts

创建模型成功后，部署服务报错，如何排查代码问题问题现象创建模型成功后，部署服务失败，如何定位是模型代码编写有问题。原因分析用户自定义镜像或者通过基础镜像导入的模型时，用户自己编写了很多自定义的业务逻辑，这些逻辑有问题将会导致服务部署或者预测失败，需要能够排查出哪里有问题。

帮助中心 > AI开发平台ModelArts > 故障排除 > 推理部署 > 模型管理
GPU A系列裸金属服务器节点内如何进行NVLINK带宽性能测试方法？ - AI开发平台ModelArts

A系列裸金属服务器节点内如何进行NVLINK带宽性能测试方法？场景描述本文指导如何进行节点内NVLINK带宽性能测试，适用的环境为：Ant8或者Ant1 GPU裸金属服务器，且服务器中已经安装相关GPU驱动软件，以及Pytorch2.0。 GPU A系列裸金属服务器，单台服务

 帮助中心 > AI开发平台ModelArts > 常见问题 > Lite Server
获取训练作业支持的公共规格 - AI开发平台ModelArts

{ "total_count" : 2, "flavors" : [ { "flavor_id" : "modelarts.vm.cpu.2u", "flavor_name" : "Computing CPU(2U) instance", "flavor_type"

帮助中心 > AI开发平台ModelArts > API参考 > 训练管理
昇腾迁移快速入门案例 - AI开发平台ModelArts

的密钥对。在Notebook列表，单击“操作”列的“打开”，打开Notebook实例。克隆ModelArts Ascend代码库。新建Terminal，执行下述命令将对应的repo克隆到Notebook实例。 git clone https://gitee.com/Mode

帮助中心 > AI开发平台ModelArts > 最佳实践 > GPU业务迁移至昇腾训练推理 > GPU推理业务迁移至昇腾的通用指导

总条数： 1147

上一页
1
2
3
4
5
...
58
下一页
跳转

点击加载更多

您搜索到想要的结果了吗？

是的没搜到

意见反馈

/200

提交反馈取消

计费样例 - AI开发平台ModelArts

如何禁止Ubuntu 20.04内核自动升级？ - AI开发平台ModelArts

ECS服务器挂载SFS Turbo存储 - AI开发平台ModelArts

使用DCGM监控Lite Server资源 - AI开发平台ModelArts

查询资源池列表，可通过标签、资源池状态筛选查询资源池列表 - AI开发平台ModelArts

（可选）本地服务器安装ModelArts SDK - AI开发平台ModelArts

部署服务 - AI开发平台ModelArts

如何在ModelArts的Notebook中配置Conda源？ - AI开发平台ModelArts

权限管理 - AI开发平台ModelArts

创建资源池 - AI开发平台ModelArts

查询节点池列表 - AI开发平台ModelArts

ma-cli configure鉴权命令 - AI开发平台ModelArts

资源购买 - AI开发平台ModelArts

Notebook提示磁盘空间已满 - AI开发平台ModelArts

GPU A系列裸金属服务器RoCE带宽不足如何解决？ - AI开发平台ModelArts

以PyTorch框架创建训练作业（新版训练） - AI开发平台ModelArts

创建模型成功后，部署服务报错，如何排查代码问题 - AI开发平台ModelArts

GPU A系列裸金属服务器节点内如何进行NVLINK带宽性能测试方法？ - AI开发平台ModelArts

获取训练作业支持的公共规格 - AI开发平台ModelArts

昇腾迁移快速入门案例 - AI开发平台ModelArts

意见反馈

7*24

备案

专业服务

退订

建议反馈

售前咨询热线