搜索_华为云

以PyTorch框架创建训练作业（新版训练） - AI开发平台ModelArts

n 其中，加粗的斜体字段需要根据实际值填写: “task_id”为训练作业的任务名称，一般使用work-0。 Content-Type可以设置成不同方式。text/plain，返回OBS临时预览链接。application/octet-stream，返回OBS临时下载链接。返回状态码“200

帮助中心 > AI开发平台ModelArts > API参考 > 应用示例
SDXL&SD1.5 ComfyUI插件基于DevServer适配PyTorch NPU推理指导（6.3.906） - AI开发平台ModelArts

关的初始化工作，首次推理时间较长，请耐心等待。 Step6 使用图模式功能（可选）将Ascend节点开启switch_torchair，设置值为true。图9 图模式开关按Step5 服务调用中步骤4正常推理即可，由于图模式编译过程耗时久，请耐心等待。SD1.5预估编译约10分钟，SDXL预估编译约30分钟。

帮助中心 > AI开发平台ModelArts > 最佳实践 > AIGC模型训练推理
人工标注图片数据 - AI开发平台ModelArts

表的右上角单击“选择当前页”，则当前页面所有的图片将选中。为选中图片添加标签。在右侧的“添加标签”区域中，单击“标签名”右侧的文本框中设置标签。单击“标签名”右侧的文本框，然后从下拉列表中选择已有的标签。如果已有标签无法满足要求时，直接在文本框中添加新标签。单击“确定”。

帮助中心 > AI开发平台ModelArts > ModelArts用户指南（Standard） > 数据准备与处理 > 标注ModelArts数据集中的数据 > 通过人工标注方式标注数据
Standard资源管理 - AI开发平台ModelArts

专属资源池类型归一：不再区分训练、推理专属资源池。如果业务允许，您可以在一个专属资源池中同时跑训练和推理的Workload。同时，也可以通过“设置作业类型”来开启/关闭专属资源池对特定作业类型的支持。自助专属池网络打通：可以在ModelArts管理控制台自行创建和管理专属资源池所属

 帮助中心 > AI开发平台ModelArts > 产品介绍 > 功能介绍 > Standard功能介绍
示例：创建DDP分布式训练（PyTorch+NPU） - AI开发平台ModelArts

在创建训练作业页面配置环境变量“ROUTE_PLAN”，取值为“true”，具体操作请参见管理训练容器环境变量。代码示例训练作业的启动脚本示例如下。启动脚本中设置plog生成后存放在“/home/ma-user/modelarts/log/modelarts-job-{id}/worker-{ind

帮助中心 > AI开发平台ModelArts > ModelArts用户指南（Standard） > 使用ModelArts Standard训练模型 > 分布式模型训练
查询单个智能标注样本的信息 - AI开发平台ModelArts

查询单个智能标注样本的信息功能介绍查询单个智能标注样本的信息。调试您可以在API Explorer中调试该接口，支持自动认证鉴权。API Explorer可以自动生成SDK代码示例，并提供SDK代码示例调试功能。 URI GET /v2/{project_id}/data

帮助中心 > AI开发平台ModelArts > API参考 > 历史API > 数据管理（旧版）
数据集版本发布失败 - AI开发平台ModelArts

标注信息不满足切分条件出现此故障时，建议根据如下建议，修改标注数据后重试。多标签的样本（即一张图片包含多个标签），至少需要有2张。如果启动训练时，设置了数据集切分功能，如果多标签的数据少于2张，会导致数据集切分失败。建议检查您的标注信息，保证标注多标签的图片，超过2张。数据集切分后，训

 帮助中心 > AI开发平台ModelArts > 故障排除 > 自动学习 > 准备数据
Standard资源池功能介绍 - AI开发平台ModelArts

资源池驱动进行升级。专属资源池提供了故障节点修复的功能，可参考修复Standard专属资源池故障节点修复故障节点。专属资源池提供了动态设置作业类型的功能，可参考修改Standard专属资源池支持的作业类型更新作业类型。专属资源池提供了工作空间功能，管理员可以根据工作空间，隔

 帮助中心 > AI开发平台ModelArts > ModelArts用户指南（Standard） > ModelArts Standard资源管理
SD1.5&SDXL Diffusers框架基于DevServer适配PyTorch NPU推理指导（6.3.908） - AI开发平台ModelArts

启动两个终端，并在每个终端均设置下述环境变量。 export MASTER_ADDR=127.0.0.1 export MASTER_PORT=29001 export RANK=x # x等于终端的编号，如开启2个终端，x在两个终端中依次设置为0，1 export WORLD_SIZE=2

帮助中心 > AI开发平台ModelArts > 最佳实践 > AIGC模型训练推理
附录：训练常见问题 - AI开发平台ModelArts

问题4：Error waiting on exit barrier错误错误截图：报错原因：多线程退出各个节点间超时时间默认为300s，时间设置过短。解决措施：修改容器内torch/distributed/elastic/agent/server/api.py文件参数： vim

帮助中心 > AI开发平台ModelArts > 最佳实践 > LLM大语言模型训练推理 > 主流开源大模型基于DevServer适配LlamaFactory PyTorch NPU训练指导（6.3.909）
个人用户快速配置ModelArts访问权限 - AI开发平台ModelArts

对于首次使用ModelArts新用户，请直接新增委托即可。一般用户新增普通用户权限即可满足使用要求。如果有精细化权限管理的需求，可以自定义权限按需设置。如果未获得委托授权，当打开“访问授权”页面时，ModelArts会提醒您当前用户未配置授权，需联系此IAM用户的管理员账号进行委托授权。

帮助中心 > AI开发平台ModelArts > 最佳实践 > Standard权限管理 > 典型场景配置实践
终止训练作业 - AI开发平台ModelArts

请求参数表2 请求Body参数参数是否必选参数类型描述 action_type 是 String 对训练作业的操作请求。参数值设置为terminate时，表示终止训练作业操作。响应参数状态码： 202 表3 响应Body参数参数参数类型描述 kind String

帮助中心 > AI开发平台ModelArts > API参考 > 训练管理
ma-cli dli-job提交DLI Spark作业支持的命令 - AI开发平台ModelArts

创建时用户指定的作业名称，不能超过128个字符。 --image String 否自定义镜像路径，格式为：组织名/镜像名:镜像版本。当用户设置“feature”为“custom”时，该参数生效。用户可通过与“feature”参数配合使用，指定作业运行使用自定义的Spark镜像。 -obs

帮助中心 > AI开发平台ModelArts > ModelArts用户指南（Standard） > 使用Notebook进行AI开发调试 > ModelArts CLI命令参考
在线服务预测报错ModelArts.4503 - AI开发平台ModelArts

免由服务端发起关闭连接。如您使用的Gunicorn来作为web server，可以通过Gunicorn命令的--keep-alive参数来设置该值。其他方式导入的模型，服务内部已做处理。协议错误请求报错：{"error_code":"ModelArts.4503", "error_msg":"Failed

帮助中心 > AI开发平台ModelArts > 故障排除 > 推理部署 > 服务预测
准备环境 - AI开发平台ModelArts
准备环境 - AI开发平台ModelArts

创建SFS Turbo文件系统前提条件：创建SFS Turbo文件系统前，确认已有可用的VPC。图4 创建SFS Turbo 需要由IAM用户设置SFS Turbo FullAccess权限，用于授权ModelArts云服务使用SFS Turbo。详细操作指导请参考创建SFS Turbo文件系统。

帮助中心 > AI开发平台ModelArts > 最佳实践 > LLM大语言模型训练推理 > 主流开源大模型基于Lite Cluster适配PyTorch NPU训练指导（6.3.909） > 准备工作
人工标注音频数据 - AI开发平台ModelArts

类型，可以在列表的右上角单击“选择当前页”，则当前页面所有的音频将选中。添加标签。在右侧的“添加标签”区域中，单击“标签”下侧的文本框设置标签。方式一（已存在标签）：单击“标签”下方的文本框，在快捷键下拉列表中选择快捷键，然后在标签文本输入框中选择已有的标签名称，然后单击“确定”。

帮助中心 > AI开发平台ModelArts > ModelArts用户指南（Standard） > 数据准备与处理 > 标注ModelArts数据集中的数据 > 通过人工标注方式标注数据
修改Workflow工作流 - AI开发平台ModelArts

WorkflowStorage objects Workflow包含的统一存储定义。 labels Array of strings 为Workflow工作流设置的标签。 assets Array of WorkflowAsset objects 工作流绑定的资产。 sub_graphs Array

帮助中心 > AI开发平台ModelArts > API参考 > Workflow工作流管理
创建开发环境实例 - AI开发平台ModelArts

NoDiscount instance_num Integer 当前用户创建的该规格实例的数量。 duration Integer 启动后设置的自动停止时间，单位为秒。 store_time Integer 该规格实例处于非活跃状态，在数据库最长保存的时长。单位为小时。默认为“-1”

帮助中心 > AI开发平台ModelArts > API参考 > 历史API > 开发环境（旧版）
查询训练作业详情 - AI开发平台ModelArts

是否需要安装训练平台指定的 moxing 版本。true为需要。只有填写了engine_name，engine_version，image_url参数时支持该设置。表24 TaskResponse 参数参数类型描述 role String 任务角色，该功能暂未支持。 algorithm TaskResponseAlgorithm

帮助中心 > AI开发平台ModelArts > API参考 > 训练管理
安全边界 - AI开发平台ModelArts
安全边界 - AI开发平台ModelArts

告警和故障恢复。容器应该采用https的安全传输通道，并使用业界推荐的加密套件保证业务数据的安全性。部署上线部署服务时，需要注意为服务设置合适计算节点规格，防止服务因资源不足而过载或者资源过大而浪费。尽量避免在容器中监听其他端口，有本地内部需要访问的其他端口，监听在local

帮助中心 > AI开发平台ModelArts > 产品介绍 > 安全

总条数： 686

点击加载更多

您搜索到想要的结果了吗？

是的没搜到

意见反馈

/200

提交反馈取消

以PyTorch框架创建训练作业（新版训练） - AI开发平台ModelArts

SDXL&SD1.5 ComfyUI插件基于DevServer适配PyTorch NPU推理指导（6.3.906） - AI开发平台ModelArts

人工标注图片数据 - AI开发平台ModelArts

Standard资源管理 - AI开发平台ModelArts

示例：创建DDP分布式训练（PyTorch+NPU） - AI开发平台ModelArts

查询单个智能标注样本的信息 - AI开发平台ModelArts

数据集版本发布失败 - AI开发平台ModelArts

Standard资源池功能介绍 - AI开发平台ModelArts

SD1.5&SDXL Diffusers框架基于DevServer适配PyTorch NPU推理指导（6.3.908） - AI开发平台ModelArts

附录：训练常见问题 - AI开发平台ModelArts

个人用户快速配置ModelArts访问权限 - AI开发平台ModelArts

终止训练作业 - AI开发平台ModelArts

ma-cli dli-job提交DLI Spark作业支持的命令 - AI开发平台ModelArts

在线服务预测报错ModelArts.4503 - AI开发平台ModelArts

准备环境 - AI开发平台ModelArts

人工标注音频数据 - AI开发平台ModelArts

修改Workflow工作流 - AI开发平台ModelArts

创建开发环境实例 - AI开发平台ModelArts

查询训练作业详情 - AI开发平台ModelArts

安全边界 - AI开发平台ModelArts

意见反馈

7*24

备案

专业服务

退订

建议反馈

售前咨询热线