检测到您已登录华为云国际站账号,为了您更好的体验,建议您访问国际站服务网站 https://www.huaweicloud.com/intl/zh-cn
不再显示此消息
检查是否存在训练数据过少的情况,建议每个标签的样本数不少于100个,如果低于这个量级建议扩充。 检查不同标签的样本数是否均衡,建议不同标签的样本数量级相同,并尽量接近,如果有的类别数据量很高,有的类别数据量较低,会影响模型整体的识别效果。 选择适当的学习率和训练轮次。 通过详细评估中的错误识别示例,有针对性地扩充训练数据。
基于已设计好的分类标签准备文本数据。每个分类标签需要准备5个及以上数据,为了训练出效果较好的模型,建议每个分类标签准备100个以上的数据。 针对未标注数据,将待标注的内容放在一个文本文件内,通用文本分类工作流仅支持中文文本内容的分类,其他语种的文本分类请使用多语种文本分类工作流。 针
评估和考察。一次性很难获得一个满意的模型,需要反复的调整算法参数、数据,不断评估训练生成的模型。 一些常用的指标,如精准率、召回率、F1值等,能帮助您有效的评估,最终获得一个满意的模型。 前提条件 已在自然语言处理套件控制台选择“通用文本分类工作流”新建应用,并训练模型,详情请见训练模型。
“公共资源池”:提供公共的大规模计算集群,资源按作业隔离。您可以按需选择不同的资源类型。 “专属资源池”:提供独享的计算资源,不与其他用户共享,更加高效。使用专属资源池需要在ModelArts创建专属资源池。 计算节点规格 请根据界面提示选择需要使用的规格。 计算节点个数 设置当前版本模型的实例个
文本数据至少包含2个及以上的标签。每个分类标签需要准备5个及以上数据,为了训练出效果较好的模型,建议每个分类标签准备100个以上的数据。 多语种文本分类工作流仅支持对单语种的文本分类,当前支持文本分类的语种包括英语、法语、德语、西班牙语、葡萄牙语、阿拉伯语等。暂不支持对同一文本中含多语种的文本进行分类训练。
用于快速准确的返回第二相面积含量。 详细介绍请见产品介绍>视觉套件。 使用预置工作流开发应用流程 视觉套件提供了预置工作流,您可以通过预置的工作流,自主上传训练数据,构建和升级高精度识别模型。 图1 使用预置工作流开发应用 表1 使用预置工作流开发应用流程 流程 说明 详细指导
检查是否存在训练数据过少的情况,建议每个标签的样本数不少于100个,如果低于这个量级建议扩充。 检查不同标签的样本数是否均衡,建议不同标签的样本数量级相同,并尽量接近,如果有的类别数据量很高,有的类别数据量较低,会影响模型整体的识别效果。 选择适当的学习率和训练轮次。 通过详细评估中的错误识别示例,有针对性地扩充训练数据。
考察。往往不能一次性获得一个满意的模型,需要反复的调整算法参数、数据,不断评估训练生成的模型。 一些常用的指标,如精准率、召回率、F1值等,能帮助您有效的评估,最终获得一个满意的模型。 前提条件 已在自然语言处理套件控制台选择“多语种文本分类工作流”新建应用,并训练模型,详情请见训练模型。
热轧钢板表面缺陷检测工作流 云状识别工作流 刹车盘识别工作流 无监督车牌检测工作流 晶粒度定级工作流 第二相面积含量测定工作流 零售商品识别工作流 超市、零售商店等场景下,商品种类更新速度快,商品识别技术会提升商品优化和运营效率。ModelArts Pro提供零售商品识别工作流,为您提供高精度
GiB”,适合纯CPU类型的负载运行的模型。 如果资源池选择专属资源池,勾选自己在ModelArts创建的专属资源池。 计算节点个数 设置当前版本模型的实例个数。如果节点个数设置为1,表示后台的计算模式是单机模式;如果节点个数设置大于1,表示后台的计算模式为分布式的。请根据实际编码情况选择计算模式。
在ModelArts Pro控制台界面,单击“自然语言处理”套件卡片的“进入套件”。 进入自然语言处理套件控制台。 在左侧导航栏选择“应用开发>工作台”。 默认进入“我的应用”页签。 在“我的应用”页签下,选择已创建的应用,单击操作列的“查看”。 进入应用详情页,默认进入“应用开发”页签。
工作流指在具体行业场景下固定开发流程所构建的开发流水线,无需深究AI知识,按照工作流指引即可开发AI应用,解决特定场景问题。 开发应用 开发应用指通过工作流指引完成自主定制AI应用的开发,使所开发的应用在特定场景下能够解决具体问题。 资源池 用于数据处理、模型训练、服务部署的资源池和资源类型,分为“公共资源池”和“专属资源池”。
见产品介绍。用户基于自身行业、场景的需求,快速自定制需求,选择合适的套件以及工作流,然后根据工作流指引进行应用开发。 用户使用ModelArts Pro开发应用的流程如图1所示,首次使用ModelArts Pro的操作指引请见表1。 图1 使用ModelArts Pro 表1 首次使用ModelArts
针对场景领域提供预训练模型,分类准确率高。 提供完善的文本处理能力,支持多种数据格式内容,适配不同场景的业务数据。 可根据使用过程中的反馈持续优化模型。 多语种文本分类工作流 功能介绍 支持自主上传多语种文本数据,构建高精度文本分类预测模型,此工作流支持文本分类的语种包括英语、法语、德语、西班牙语
应用开发面向企业和行业用户开放,提供特定行业场景的预置行业工作流,用户基于自身行业、场景的需求,快速自定制需求,根据工作流指引进行应用开发。当前ModelArts Pro开放的预置套件有文字识别套件、自然语言处理套件、视觉套件和HiLens套件,后续还会开放更多行业套件,敬请期待。 工作流开发 工作流开发面向AI开发者。用户运用ModelArts
文字识别套件当前提供了单模板工作流和多模板工作流,开发应用时需要上传模板图片,明确以哪张图片作为模板训练文字识别模型。 上传图片的要求如表1所示。 表1 文字识别套件数据集要求 工作流 数据集要求 单模板工作流 保证图片质量:不能有损坏的图片;目前支持的格式包括JPG、JPEG、PNG、BMP。
文字识别套件提供预置工作流供您选择,全流程可视化完成AI应用开发以及持续迭代。 选择预置工作流 单模板工作流 通过工作流指引构建文字识别模板,识别单个板式图片中的文字,快速实现文档、票证等场景的文字识别。详情请见使用单模板工作流开发应用。 多模板工作流 通过工作流指引支持自定义多个
在“应用总览”页签,在开发版本列表选择工作流版本,单击“操作”列的“查看”,进入应用开发页面,您可以查看应用开发过程中各个步骤的配置信息,包括“数据选择”、“模型训练”、“模型评估”、“服务部署”。 图2 应用开发 您也可以在“应用总览”页签的“开发版本列表”右侧,单击“开发新版本”,进入新版本工作流的开发页面,详情请见更新应用版本。
Kit设备,对未戴安全帽的人进行告警。 首先,请仔细阅读准备工作罗列的要求,提前完成准备工作。使用安全帽检测工作流开发技能的步骤如下所示: 步骤1:上传数据至OBS 步骤2:新建可训练技能 步骤3:选择数据 步骤4:训练模型 步骤5:评估模型 步骤6:部署服务 步骤7:运行技能 准备工作 注册华为帐号,开通华为云
ModelArts Pro的应用场景和用户群体 ModelArts Pro基于华为云的先进算法和快速训练能力,提供预置工作流和模型。用户可以使用ModelArts Pro套件中特定行业场景的预置行业工作流,满足快速定制的需求,快速进行应用开发。 当前ModelArts Pro开放的预置套件有文