搜索_华为云

推理性能测试 - AI开发平台ModelArts

--backend：服务类型，支持tgi、vllm、mindspore、openai、openai-chat等。本文档使用的推理接口是vllm，而llava多模态推理接口是openai-chat。 --host ${docker_ip}：服务部署的IP，${docker_ip}替换为宿主机实际的IP地址。

帮助中心 > AI开发平台ModelArts > 最佳实践 > LLM大语言模型训练推理 > 主流开源大模型基于Lite Server适配PyTorch NPU推理指导（6.3.908）
demo.sh方式启动（历史版本） - AI开发平台ModelArts

FlashAttention融合算子，具体约束详见NPU_Flash_Attn融合算子约束是，配置以下参数。 flash_attn: sdpa 否，配置以下参数关闭。 flash_attn: disabled 是否使用固定句长。是，配置以下参数 packing: true 否，默认使用动态句长，注释掉packing参数。

帮助中心 > AI开发平台ModelArts > 最佳实践 > LLM大语言模型训练推理 > 主流开源大模型基于Lite Server适配LlamaFactory PyTorch NPU训练指导（6.3.912） > 执行训练任务
在Notebook调试环境中部署推理服务 - AI开发平台ModelArts

Step3 启动推理服务配置需要使用的NPU卡编号。例如：实际使用的是第1张卡，此处填写“0”。 export ASCEND_RT_VISIBLE_DEVICES=0 如果启动服务需要使用多张卡，例如：实际使用的是第1张和第2张卡，此处填写为“0,1”，以此类推。 export A

帮助中心 > AI开发平台ModelArts > 最佳实践 > LLM大语言模型训练推理 > 主流开源大模型基于Standard适配PyTorch NPU推理指导（6.3.906）
套餐包 - AI开发平台ModelArts
套餐包 - AI开发平台ModelArts

域，且只能用于公共资源池，专属资源池不可用。当前只有部分区域可选，具体以控制台为准。已购买套餐包不支持退订，购买前请确认。已购买套餐包是按需套餐包，其资源为公共资源。套餐包不支持跨地域（跨region）使用。不同的地域之间资源包不互通，每个地域需分别购买，请根据您的实际需求慎重选择。

帮助中心 > AI开发平台ModelArts > 计费说明 > 计费模式
开发用于自定义镜像训练的代码 - AI开发平台ModelArts

对于启动命令，当存在输入管道、输出管道、或是超参的情况下，请保证启动命令的最后一条命令是运行训练脚本。原因：系统会将输入管道、输出管道、以及超参添加到启动命令的末尾，如果最后一条命令不是运行训练脚本则会报错。例如：启动命令的最后一条是python train.py，且存在--data_url超参，系统正常运行会执行python

帮助中心 > AI开发平台ModelArts > ModelArts用户指南（Standard） > 使用ModelArts Standard训练模型 > 准备模型训练代码
非分离部署推理服务 - AI开发平台ModelArts

image_path 是 str 传给模型的图片路径 payload 是 json 单图单轮对话的post请求json，可参考表2.请求服务json参数说明 docker_ip 是 str 启动多模态openAI服务的主机ip served_port 是 str 启动多模态openAI服务的端口号

 帮助中心 > AI开发平台ModelArts > 最佳实践 > LLM大语言模型训练推理 > 主流开源大模型基于Lite Server适配PyTorch NPU推理指导（6.3.910） > 部署推理服务
非分离部署推理服务 - AI开发平台ModelArts

image_path 是 str 传给模型的图片路径 payload 是 json 单图单轮对话的post请求json，可参考表2.请求服务json参数说明 docker_ip 是 str 启动多模态openAI服务的主机ip served_port 是 str 启动多模态openAI服务的端口号

 帮助中心 > AI开发平台ModelArts > 最佳实践 > LLM大语言模型训练推理 > 主流开源大模型基于Lite Server适配PyTorch NPU推理指导（6.3.911） > 部署推理服务
部署推理服务 - AI开发平台ModelArts

Step6 启动推理服务配置需要使用的NPU卡编号。例如：实际使用的是第1张卡，此处填写“0”。 export ASCEND_RT_VISIBLE_DEVICES=0 如果启动服务需要使用多张卡，例如：实际使用的是第1张和第2张卡，此处填写为“0,1”，以此类推。 export A

帮助中心 > AI开发平台ModelArts > 最佳实践 > LLM大语言模型训练推理 > 主流开源大模型基于LIte Server适配PyTorch NPU推理指导（6.3.905）
非分离部署推理服务 - AI开发平台ModelArts

否有对应运行的进程如出现错误，可能是机器上的NPU设备没有正常安装，或者NPU镜像被其他容器挂载。请先正常安装固件和驱动，或释放被挂载的NPU。驱动版本要求是23.0.6。如果不符合要求请参考安装固件和驱动章节升级驱动。启动后容器默认端口是8080。配置需要使用的NPU卡为

 帮助中心 > AI开发平台ModelArts > 最佳实践 > LLM大语言模型训练推理 > 主流开源大模型基于Lite Server适配PyTorch NPU推理指导（6.3.908） > 部署推理服务
创建导出任务 - AI开发平台ModelArts

ia-test/data/output/export-test/") 参数说明表1 请求参数参数是否必选参数类型描述 path 是 String 数据导出的OBS路径。父主题：导出任务管理

 帮助中心 > AI开发平台ModelArts > SDK参考 > 数据管理 > 导出任务管理
Lite Server资源开通 - AI开发平台ModelArts

购买界面存在新版和旧版2个版本，以下参数配置表中展示的参数顺序遵循的是新版购买页面，旧版购买页面的参数顺序和新版页面有差异，但具体的参数解释不变。图7 购买弹性节点Server时的基础配置表2 基础配置参数说明参数名称说明资源类型裸金属服务器是一款兼具弹性云服务器和物理机性能的计算类服务器

 帮助中心 > AI开发平台ModelArts > ModelArts用户指南（Lite Server）
准备权重 - AI开发平台ModelArts
准备权重 - AI开发平台ModelArts

Version中下载文件。文件会直接下载用户本地，需要再上传至SFS Turbo中。方法二：huggingface-cli：huggingface-cli是Hugging Face官方提供的命令行工具，自带完善的下载功能。具体步骤可参考：HF-Mirror中的使用教程。完成依赖安装和环境变量配置后，以Llama2-70B为例：

帮助中心 > AI开发平台ModelArts > 最佳实践 > LLM大语言模型训练推理 > 主流开源大模型基于Standard+OBS+SFS适配ModelLink PyTorch NPU训练指导（6.3.909） > 准备工作
准备权重 - AI开发平台ModelArts
准备权重 - AI开发平台ModelArts

Version中下载文件。文件会直接下载用户本地，需要再上传至SFS Turbo中。方法二：huggingface-cli：huggingface-cli是Hugging Face官方提供的命令行工具，自带完善的下载功能。具体步骤可参考：HF-Mirror中的使用教程。完成依赖安装和环境变量配置后，以Llama2-70B为例：

帮助中心 > AI开发平台ModelArts > 最佳实践 > LLM大语言模型训练推理 > 主流开源大模型基于Standard+OBS+SFS适配ModelLink PyTorch NPU训练指导（6.3.908） > 准备工作
创建工作流定时调度 - AI开发平台ModelArts

/schedules 表1 路径参数参数是否必选参数类型描述 project_id 是 String 用户项目ID。获取方法请参见获取项目ID和名称。 workflow_id 是 String 工作流的ID。请求参数表2 请求Body参数参数是否必选参数类型描述

 帮助中心 > AI开发平台ModelArts > API参考 > Workflow工作流管理
分布式训练功能介绍 - AI开发平台ModelArts

约束限制总览页面打开的CodeLab不支持此项功能，但是如果用户在AI Hub中打开了可用的案例，会自动跳转到CodeLab中，此时是可以使用这项功能的。如果切换了Notebook的规格，那么只能在Notebook进行单机调测，不能进行分布式调测，也不能提交远程训练作业。

帮助中心 > AI开发平台ModelArts > ModelArts用户指南（Standard） > 使用ModelArts Standard训练模型 > 分布式模型训练
准备权重 - AI开发平台ModelArts
准备权重 - AI开发平台ModelArts

Version中下载文件。文件会直接下载用户本地，需要再上传至SFS Turbo中。方法二：huggingface-cli：huggingface-cli是Hugging Face官方提供的命令行工具，自带完善的下载功能。具体步骤可参考：HF-Mirror中的使用教程。完成依赖安装和环境变量配置后，以Llama2-70B为例：

帮助中心 > AI开发平台ModelArts > 最佳实践 > LLM大语言模型训练推理 > 主流开源大模型基于Standard+OBS+SFS适配ModelLink PyTorch NPU训练指导（6.3.912） > 准备工作
训练的数据集预处理说明 - AI开发平台ModelArts

--seq-length：要处理的最大seq length。 --workers：设置数据处理使用执行卡数量 / 启动的工作进程数。 --log-interval：是一个用于设置日志输出间隔的参数，表示输出日志的频率。在训练大规模模型时，可以通过设置这个参数来控制日志的输出。输出数据预处理结果路径：训练完成后，以

 帮助中心 > AI开发平台ModelArts > 最佳实践 > LLM大语言模型训练推理 > 主流开源大模型基于Lite Server适配PyTorch NPU训练指导（6.3.905） > 训练脚本说明
SFT微调数据处理 - AI开发平台ModelArts

tokenizer-name-or-path：tokenizer的存放路径。 - handler-name：生成数据集的用途，这里是生成的指令数据集，用于微调。 - seq-length：是一个用于计算序列长度的函数。它接收一个序列作为输入，并返回序列的长度，需和训练时参数保持一致。 - workers：数据处理线程数。

帮助中心 > AI开发平台ModelArts > 最佳实践 > LLM大语言模型训练推理 > Qwen系列模型基于Lite Server适配PyTorch NPU训练指导（6.3.904） > SFT微调训练
创建工作空间 - AI开发平台ModelArts

路径参数参数是否必选参数类型描述 project_id 是 String 用户项目ID。获取方法请参见获取项目ID和名称。请求参数表2 请求Header参数参数是否必选参数类型描述 X-Auth-Token 是 String 用户Token。通过调用IAM服务获取用

 帮助中心 > AI开发平台ModelArts > API参考 > 工作空间管理
查询事件列表 - AI开发平台ModelArts

描述 project_id 是 String 用户项目ID。获取方法请参见获取项目ID和名称。表2 Query参数参数是否必选参数类型描述 resource 是 String 事件所属资源类型。可选值为pools，表示资源池。 name 是 String 事件所属资源名称。

帮助中心 > AI开发平台ModelArts > API参考 > 资源管理

总条数： 1539

上一页
1
...
56
57
58
...
77
下一页
跳转

点击加载更多

您搜索到想要的结果了吗？

是的没搜到

意见反馈

/200

提交反馈取消

推理性能测试 - AI开发平台ModelArts

demo.sh方式启动（历史版本） - AI开发平台ModelArts

在Notebook调试环境中部署推理服务 - AI开发平台ModelArts

套餐包 - AI开发平台ModelArts

开发用于自定义镜像训练的代码 - AI开发平台ModelArts

非分离部署推理服务 - AI开发平台ModelArts

非分离部署推理服务 - AI开发平台ModelArts

部署推理服务 - AI开发平台ModelArts

非分离部署推理服务 - AI开发平台ModelArts

创建导出任务 - AI开发平台ModelArts

Lite Server资源开通 - AI开发平台ModelArts

准备权重 - AI开发平台ModelArts

准备权重 - AI开发平台ModelArts

创建工作流定时调度 - AI开发平台ModelArts

分布式训练功能介绍 - AI开发平台ModelArts

准备权重 - AI开发平台ModelArts

训练的数据集预处理说明 - AI开发平台ModelArts

SFT微调数据处理 - AI开发平台ModelArts

创建工作空间 - AI开发平台ModelArts

查询事件列表 - AI开发平台ModelArts

意见反馈

7*24

备案

专业服务

退订

建议反馈

售前咨询热线