搜索_华为云

附录：大模型推理standard常见问题 - AI开发平台ModelArts

max_model_len。解决方法：修改config.json文件中的"seq_length"的值，"seq_length"需要大于等于 --max-model-len的值。 config.json存在模型对应的路径下，例如：/data/nfs/benchmark/tokeniz

帮助中心 > AI开发平台ModelArts > 最佳实践 > LLM大语言模型训练推理 > 主流开源大模型基于Standard适配PyTorch NPU推理指导（6.3.907）
专属资源池计费项 - AI开发平台ModelArts

在ModelArts进行AI全流程开发时，会产生计算资源的计费，计算资源为进行运行自动学习、Workflow、开发环境、模型训练和部署服务的费用。具体内容如表1所示。表1 计费项计费项计费项说明适用的计费模式计费公式计算资源专属资源池使用计算资源的用量。具体费用可参见ModelArts价格详情。

帮助中心 > AI开发平台ModelArts > 计费说明 > 计费项
准备代码 - AI开发平台ModelArts
准备代码 - AI开发平台ModelArts

本方案支持的软件配套版本和依赖包获取地址如表1所示。表1 软件配套版本和获取地址软件名称说明下载地址 AscendCloud-6.3.910-xxx.zip 说明：软件包名称中的xxx表示时间戳。包含了本教程中使用到的推理部署代码和推理评测代码、推理依赖的算子包。代码包具体说明请参见模型软件包结构说明。

帮助中心 > AI开发平台ModelArts > 最佳实践 > LLM大语言模型训练推理 > 主流开源大模型基于Lite Cluster适配PyTorch NPU推理指导（6.3.910） > 准备工作
MXNet创建kvstore时程序被阻塞，无报错 - AI开发平台ModelArts

kv_store = mxnet.kv.create('dist_async') print('end') 原因分析 worker阻塞的原因可能是连不上server。处理方法将如下代码放在“启动文件”里“import mxnet”之前可以看到节点间相互通信状态，同时ps能够重新发送。 import

帮助中心 > AI开发平台ModelArts > 故障排除 > 训练作业 > 业务代码问题
准备数据 - AI开发平台ModelArts
准备数据 - AI开发平台ModelArts

准备数据本教程使用到的训练数据集是Alpaca数据集。您也可以自行准备数据集。 Alpaca数据集本教程使用Alpaca数据集，数据集的介绍及下载链接如下。 Alpaca数据集是由OpenAI的text-davinci-003引擎生成的包含52k条指令和演示的数据集。这些指令数据

 帮助中心 > AI开发平台ModelArts > 最佳实践 > LLM大语言模型训练推理 > 主流开源大模型基于DevServer适配ModelLink PyTorch NPU训练指导（6.3.907） > 准备工作
使用PyCharm ToolKit创建并调试训练作业 - AI开发平台ModelArts

Description 训练作业的简要描述。 Algorithm Source 训练算法来源，分为“常用框架”和“自定义镜像”两种，二者选一项即可。常用框架指使用ModelArts训练管理中支持的常用AI引擎，当前支持的引擎列表请参见ModelArts支持的预置镜像列表。如果您使用的AI引擎为支

 帮助中心 > AI开发平台ModelArts > ModelArts用户指南（Standard） > 使用ModelArts Standard训练模型 > 创建调试训练作业
资源池创建失败的原因与解决方法？ - AI开发平台ModelArts

资源池创建失败的原因与解决方法？本文主要介绍在ModelArts资源池创建失败时，如何查找失败原因，并解决问题。问题定位您可以参考以下步骤，查看资源池创建失败的报错信息，并根据相应的解决方法解决问题：登录ModelArts控制台，单击弹性集群，单击资源池列表上方的“操作记录”查看创建失败的资源池。

帮助中心 > AI开发平台ModelArts > 故障排除 > Lite Cluster
准备代码 - AI开发平台ModelArts
准备代码 - AI开发平台ModelArts

本方案支持的软件配套版本和依赖包获取地址如表1所示。表1 软件配套版本和获取地址软件名称说明下载地址 AscendCloud-6.3.911-xxx.zip 说明：软件包名称中的xxx表示时间戳。包含了本教程中使用到的推理部署代码和推理评测代码、推理依赖的算子包。代码包具体说明请参见模型软件包结构说明。

帮助中心 > AI开发平台ModelArts > 最佳实践 > LLM大语言模型训练推理 > 主流开源大模型基于Lite Cluster适配PyTorch NPU推理指导（6.3.911） > 准备工作
导入模型 - AI开发平台ModelArts
导入模型 - AI开发平台ModelArts

Environment实例描述模型正常运行需要的环境，如使用的python版本、tensorflow版本等。 Environment实例的示例请参见示例代码。 source_job_id 否 String 来源训练作业的ID，模型是从训练作业产生的可填写，用于溯源；如模型是从第三方元模型导入，则为空，默认值为空。

帮助中心 > AI开发平台ModelArts > SDK参考 > 模型管理
创建IAM用户并授权使用MaaS - AI开发平台ModelArts

配置ModelArts委托授权章节中介绍的一键式自动授权方式创建的委托的权限比较大，基本覆盖了依赖服务的全部权限。如果华为云账号已经能满足您的要求，则不需要创建独立的IAM用户，您可以跳过本章节，不影响您使用MaaS服务的功能。 ModelArts作为一个完备的AI开发平台，支持用户对其进行细粒度的权限配置，

帮助中心 > AI开发平台ModelArts > ModelArts用户指南（Studio） > 配置MaaS访问授权
VS Code连接开发环境失败故障处理 - AI开发平台ModelArts

Code连接开发环境失败时的排查方法远程连接出现弹窗报错：Could not establish connection to xxx 连接远端开发环境时，一直处于"Setting up SSH Host xxx: Downloading VS Code Server locally"超过10分钟以上，如何解决？

帮助中心 > AI开发平台ModelArts > 故障排除 > 开发环境
配置kubectl工具 - AI开发平台ModelArts

集群在相同vpc下的某一台机器上。单击kubectl后的“配置”按钮。按照界面提示步骤操作即可。图3 通过内网使用kubectl工具通过公网使用kubectl工具，可以将kubectl安装在任一台可以访问公网的机器。首先需要绑定公网地址，单击公网地址后的“绑定”按钮。图4

帮助中心 > AI开发平台ModelArts > ModelArts用户指南（Lite Cluster） > Lite Cluster资源配置
专属资源池VPC打通 - AI开发平台ModelArts

拉框中选择可用的VPC和子网。需要打通的对端网络不能和当前网段重叠。图2 打通VPC参数选择如果没有VPC可选，可以单击右侧的“创建虚拟私有云”，跳转到网络控制台，申请创建虚拟私有云。如果没有子网可选，可以单击右侧的“创建子网”，跳转到网络控制台，创建可用的子网。支持1

帮助中心 > AI开发平台ModelArts > 最佳实践 > 历史待下线案例 > 专属资源池训练 > 基本配置
更新API授权 - AI开发平台ModelArts

更新API授权功能介绍更新API的授权关系。API的认证方式必须为APP认证，APP的创建用户必须是API所属服务的创建者，且请求用户对API所属服务必须有更新权限。调试您可以在API Explorer中调试该接口，支持自动认证鉴权。API Explorer可以自动生成S

帮助中心 > AI开发平台ModelArts > API参考 > APP认证管理
通过Token认证的方式访问在线服务 - AI开发平台ModelArts

和预测时间有限制：请求体的大小不超过12MB，超过后请求会被拦截。因APIG（API网关）限制，平台每次请求预测的时间不超过40秒。前提条件已经获取用户Token、预测文件的本地路径、在线服务的调用地址和在线服务的输入参数信息。用户Token的获取请参见获取Token认

 帮助中心 > AI开发平台ModelArts > ModelArts用户指南（Standard） > 使用ModelArts Standard部署模型并推理预测 > 将模型部署为实时推理作业 > 访问在线服务支持的认证方式
查询推理服务标签 - AI开发平台ModelArts

CombineTmsTags objects 标签的融合结构，相同key合并。表4 CombineTmsTags 参数参数类型描述 key String 标签的key。 values Array of strings 相同key的标签value合并后的列表。状态码： 400 表5 响应Body参数

 帮助中心 > AI开发平台ModelArts > API参考 > 服务管理
新建Workflow Execution - AI开发平台ModelArts

objects 节点的输入项。 outputs 否 Array of JobOutput objects 节点的输出项。 step_uuid 否 String 节点的UUID，唯一性标识。 properties 否 Map<String,Object> 节点的属性。 events

帮助中心 > AI开发平台ModelArts > API参考 > Workflow工作流管理
ModelArts Standard使用流程 - AI开发平台ModelArts

Standard的Workflow是一套低代码的AI开发流水线工具，覆盖数据标注、数据处理、模型开发、训练、模型评估、部署上线等步骤，提供可视化的工作流运行方式。具体请参见什么是Workflow。 Standard的开发环境Notebook提供了云上JupyterLab环境和本地IDE插件，方便用户编写

 帮助中心 > AI开发平台ModelArts > ModelArts用户指南（Standard）
VS Code连接开发环境失败常见问题 - AI开发平台ModelArts

Code连接开发环境失败时的排查方法远程连接出现弹窗报错：Could not establish connection to xxx 连接远端开发环境时，一直处于"Setting up SSH Host xxx: Downloading VS Code Server locally"超过10分钟以上，如何解决？

帮助中心 > AI开发平台ModelArts > 常见问题 > Standard Notebook
在ModelArts Standard上运行GPU多机多卡训练作业 - AI开发平台ModelArts

my_deeplearning_image:v1 上述命令表示把宿主机的"/mnt/sfs_turbo"目录挂载到容器的"/sfs"目录，在宿主机和容器对应目录的所有改动都是实时同步的。分析错误时：训练镜像先看日志，推理镜像先看API的返回。可以通过命令查看容器输出到stdout的所有日志： docker logs

帮助中心 > AI开发平台ModelArts > 最佳实践 > Standard模型训练 > 基于ModelArts Standard运行GPU训练作业

总条数： 1323

上一页
1
...
44
45
46
...
67
下一页
跳转

点击加载更多

您搜索到想要的结果了吗？

是的没搜到

意见反馈

/200

提交反馈取消

附录：大模型推理standard常见问题 - AI开发平台ModelArts

专属资源池计费项 - AI开发平台ModelArts

准备代码 - AI开发平台ModelArts

MXNet创建kvstore时程序被阻塞，无报错 - AI开发平台ModelArts

准备数据 - AI开发平台ModelArts

使用PyCharm ToolKit创建并调试训练作业 - AI开发平台ModelArts

资源池创建失败的原因与解决方法？ - AI开发平台ModelArts

准备代码 - AI开发平台ModelArts

导入模型 - AI开发平台ModelArts

创建IAM用户并授权使用MaaS - AI开发平台ModelArts

VS Code连接开发环境失败故障处理 - AI开发平台ModelArts

配置kubectl工具 - AI开发平台ModelArts

专属资源池VPC打通 - AI开发平台ModelArts

更新API授权 - AI开发平台ModelArts

通过Token认证的方式访问在线服务 - AI开发平台ModelArts

查询推理服务标签 - AI开发平台ModelArts

新建Workflow Execution - AI开发平台ModelArts

ModelArts Standard使用流程 - AI开发平台ModelArts

VS Code连接开发环境失败常见问题 - AI开发平台ModelArts

在ModelArts Standard上运行GPU多机多卡训练作业 - AI开发平台ModelArts

意见反馈

7*24

备案

专业服务

退订

建议反馈

售前咨询热线