搜索_华为云

场景介绍 - AI开发平台ModelArts
场景介绍 - AI开发平台ModelArts

如果需要部署量化模型，需在Notebook中进行模型权重转换后再部署推理服务。在推理生产环境中部署推理服务介绍如何在创建AI应用，部署并启动推理服务，在线预测在线服务。父主题：主流开源大模型基于Standard适配PyTorch NPU推理指导（6.3.908）

帮助中心 > AI开发平台ModelArts > 最佳实践 > LLM大语言模型训练推理 > 主流开源大模型基于Standard适配PyTorch NPU推理指导（6.3.908）
不允许子账号使用公共资源池创建作业 - AI开发平台ModelArts

Notebook”，单击“创建”，在创建Notebook页面，资源池规格只能选择专属资源池。使用子账号用户登录ModelArts控制台，选择“模型部署 > 在线服务”，单击“部署”，在部署服务页面，资源池规格只能选择专属资源池。父主题：典型场景配置实践

 帮助中心 > AI开发平台ModelArts > 最佳实践 > Standard权限管理 > 典型场景配置实践
使用AWQ量化工具转换权重 - AI开发平台ModelArts

Step2 权重格式离线转换（可选） AutoAWQ量化完成后，使用int32对int4的权重进行打包。昇腾上使用int8对权重进行打包，在线转换会增加启动时间，可以提前对权重进行转换以减少启动时间，转换步骤如下：进入llm_tools/AutoAWQ代码目录下执行以下脚本：

帮助中心 > AI开发平台ModelArts > 最佳实践 > LLM大语言模型训练推理 > 主流开源大模型基于Standard适配PyTorch NPU推理指导（6.3.910） > 推理模型量化
创建训练作业参数 - AI开发平台ModelArts

请求参数如表2所示。表2 参数说明参数是否必选参数类型说明 config_name 是 String 训练作业参数名称。限制为1-64位只含数字、字母、下划线或者中划线的名称。 config_desc 否 String 对训练作业的描述，默认为空，字符串的长度限制为[0，256]。

帮助中心 > AI开发平台ModelArts > API参考 > 历史API > 训练管理（旧版） > 训练作业参数配置
使用ModelArts Studio的Qwen2-7B模型框架实现对话问答 - AI开发平台ModelArts

在ModelArts Studio左侧导航栏中，选择“模型部署”。在“模型部署”页面，单击“我的服务”页签，在目标模型服务右侧，单击操作列“更多 > 在线体验”，进入“模型体验”页面。在“模型体验”页面右上角，单击“参数设置”，拖动或直接输入数值配置推理参数。单击“恢复默认”可以将参数值调回默认值。

帮助中心 > AI开发平台ModelArts > 快速入门
创建数据集 - AI开发平台ModelArts

个字符，必须为大小写字母，数字和“!@#$%^&*_=|?/':.;,”其中的某一字符。 text_sample_separator 否 String 文本与标签之间的分隔符，默认为Tab键分隔，分隔符需转义。分隔符仅支持一个字符，必须为大小写字母，数字和“!@#$%^&*_=|

帮助中心 > AI开发平台ModelArts > API参考 > 历史API > 数据管理（旧版）
查询处理任务详情 - AI开发平台ModelArts

DATASET：数据集 version_id String 数据集的版本。 version_name String 数据集的版本名称，名称仅包含数字、字母、中划线和下划线，长度是0-32位。请求示例查询数据处理任务详情 GET https://{endpoint}/v2/{proj

帮助中心 > AI开发平台ModelArts > API参考 > 历史API > 数据管理（旧版）
第三方推理框架迁移到ModelArts Standard推理自定义引擎 - AI开发平台ModelArts

选择步骤3构建的镜像。图3 创建模型将创建的模型部署为在线服务，大模型加载启动的时间一般大于普通的模型创建的服务，请配置合理的“部署超时时间”，避免尚未启动完成被认为超时而导致部署失败。图4 部署为在线服务调用在线服务进行大模型推理，请求路径填写/v2/models/en

帮助中心 > AI开发平台ModelArts > 最佳实践 > Standard推理部署
查看批量服务详情 - AI开发平台ModelArts

异常的详细原因、服务被启动、停止、更新的时间点等。事件保存周期为1个月，1个月后自动清理数据。查看服务的事件类型和事件信息，请参见查看在线服务的事件日志展示当前服务下每个模型的日志信息。包含最近5分钟、最近30分钟、最近1小时和自定义时间段。自定义时间段您可以选择开始时间和结束时间。

帮助中心 > AI开发平台ModelArts > ModelArts用户指南（Standard） > 使用ModelArts Standard部署模型并推理预测 > 管理批量推理作业
场景介绍 - AI开发平台ModelArts
场景介绍 - AI开发平台ModelArts

如果需要部署量化模型，需在Notebook中进行模型权重转换后再部署推理服务。在推理生产环境中部署推理服务介绍如何在创建AI应用，部署并启动推理服务，在线预测在线服务。父主题：主流开源大模型基于Standard适配PyTorch NPU推理指导（6.3.909）

帮助中心 > AI开发平台ModelArts > 最佳实践 > LLM大语言模型训练推理 > 主流开源大模型基于Standard适配PyTorch NPU推理指导（6.3.909）
简介 - AI开发平台ModelArts
简介 - AI开发平台ModelArts

提供交互式云上开发环境，包含标准化昇腾算力资源和完整的迁移工具链，帮助用户完成昇腾迁移的调测过程，进一步可在平台上将迁移的模型一键部署成为在线服务向外提供推理服务，或者运行到自己的运行环境中。 MindSpore Lite 华为自研的AI推理引擎，后端对于昇腾有充分的适配，模型转

 帮助中心 > AI开发平台ModelArts > 最佳实践 > GPU业务迁移至昇腾训练推理 > GPU推理业务迁移至昇腾的通用指导
模型配置文件编写说明 - AI开发平台ModelArts

针对机器学习类模型，仅支持“application/json” data 在线服务-非必选批量服务-必选 String 请求体以json schema描述。参数说明请参考官方指导。表5 response结构说明参数是否必选参数类型描述 Content-type 在线服务-非必选批量服务-必选 String

帮助中心 > AI开发平台ModelArts > ModelArts用户指南（Standard） > 使用ModelArts Standard部署模型并推理预测 > 创建模型规范参考
创建并管理工作空间 - AI开发平台ModelArts

单击“创建工作空间”，进入创建页面。表1 创建工作空间参数名称说明工作空间名称必填，工作空间的名称。支持4~64位可见字符，名称可以包含字母、中文、数字、中划线（-）或下划线（_）。描述工作空间的简介。支持0~256位字符。企业项目必填，选择绑定的企业项目。当没有合适的企业项目时，

帮助中心 > AI开发平台ModelArts > ModelArts用户指南（Standard） > ModelArts Standard准备工作
更新服务配置 - AI开发平台ModelArts

请求Body参数参数是否必选参数类型描述 schedule 否 Array of Schedule objects 服务调度配置，仅在线服务可配置，默认不使用，服务长期运行。 description 否 String 服务描述，不超过100个字符，不能包含字符有!<>=&"'。不设置此参数表示不更新。

帮助中心 > AI开发平台ModelArts > API参考 > 服务管理
Llama 3.2-Vision基于Lite Server适配Pytorch NPU训练微调指导（6.3.912） - AI开发平台ModelArts

node_num/NODE_NUM：机器数量，修改${NODE_NUM}为具体数字。 node_rank/NODE_RANK：机器rank num，主机为0，其余递增，修改${NODE_RANK}为具体数字。 master_addr/MASTER_ADDR：主机IP地址，修改${MASTER_ADDR}为主机IP。

帮助中心 > AI开发平台ModelArts > 最佳实践 > MLLM多模态模型训练推理
发布ModelArts数据集中的数据版本 - AI开发平台ModelArts

表1 发布数据集的参数说明参数描述 “版本名称” 默认按V001、V002递增规则进行命名，您也可以自定义版本名称。版本名称只能包含字母、数字、中划线或下划线。 “版本格式” 仅“表格”类型数据集支持设置版本格式，支持“CSV”和“CarbonData”两种。说明：如果导出的

 帮助中心 > AI开发平台ModelArts > ModelArts用户指南（Standard） > 数据准备与处理
使用PyCharm ToolKit创建并调试训练作业 - AI开发平台ModelArts

Job Name 训练作业的名称。系统会自动生成一个名称，您可以根据业务需求重新命名，命名规则如下：支持1~64位字符。并包含大小写字母、数字、中划线（-）或下划线（_）。 Job Description 训练作业的简要描述。 Algorithm Source 训练算法来源，分为

 帮助中心 > AI开发平台ModelArts > ModelArts用户指南（Standard） > 使用ModelArts Standard训练模型 > 创建调试训练作业
Lite Server资源开通 - AI开发平台ModelArts

用部署到本地，CloudPond介绍可参考产品介绍。表3 集群配置参数说明参数名称说明服务器名称 Server的机器名称。只能包含数字、大小写字母、下划线和中划线，长度不能超过64位且不能为空。注意：订单中的服务器名称会一直保持此处下单购买时设置的名称。后期修改服务器名称后，不会在订单中同步更新。

帮助中心 > AI开发平台ModelArts > ModelArts用户指南（Lite Server）
使用CodeLab免费体验Notebook - AI开发平台ModelArts

CodeLab内置了免费算力，包含CPU和GPU两种。您可以使用免费规格，端到端体验ModelArts Notebook能力。也可使用此免费算力，在线完成您的算法开发。即开即用无需创建Notebook实例，打开即可编码。高效分享 ModelArts在AI Gallery中提供的Notebook样例，可以直接通过Run

帮助中心 > AI开发平台ModelArts > ModelArts用户指南（Standard） > 使用Notebook进行AI开发调试
创建数据集 - AI开发平台ModelArts

文本和标签之间的分割符。分隔符仅支持一个字符，必须为大小写字母，数字或@#￥%^&*_=|?/':.;,中的某一个字符，分割符需要转义。 label_separator 否 String 标签和标签之间的分割符。分隔符仅支持一个字符，必须为大小写字母，数字或@#￥%^&*_=|?/':.;,中的某一个字符，分割符需要转义。

帮助中心 > AI开发平台ModelArts > SDK参考 > 数据管理 > 数据集管理

总条数： 489

上一页
1
...
19
20
21
...
25
下一页
跳转

点击加载更多

您搜索到想要的结果了吗？

是的没搜到

意见反馈

/200

提交反馈取消

场景介绍 - AI开发平台ModelArts

不允许子账号使用公共资源池创建作业 - AI开发平台ModelArts

使用AWQ量化工具转换权重 - AI开发平台ModelArts

创建训练作业参数 - AI开发平台ModelArts

使用ModelArts Studio的Qwen2-7B模型框架实现对话问答 - AI开发平台ModelArts

创建数据集 - AI开发平台ModelArts

查询处理任务详情 - AI开发平台ModelArts

第三方推理框架迁移到ModelArts Standard推理自定义引擎 - AI开发平台ModelArts

查看批量服务详情 - AI开发平台ModelArts

场景介绍 - AI开发平台ModelArts

简介 - AI开发平台ModelArts

模型配置文件编写说明 - AI开发平台ModelArts

创建并管理工作空间 - AI开发平台ModelArts

更新服务配置 - AI开发平台ModelArts

Llama 3.2-Vision基于Lite Server适配Pytorch NPU训练微调指导（6.3.912） - AI开发平台ModelArts

发布ModelArts数据集中的数据版本 - AI开发平台ModelArts

使用PyCharm ToolKit创建并调试训练作业 - AI开发平台ModelArts

Lite Server资源开通 - AI开发平台ModelArts

使用CodeLab免费体验Notebook - AI开发平台ModelArts

创建数据集 - AI开发平台ModelArts

意见反馈

7*24

备案

专业服务

退订

建议反馈

售前咨询热线