检测到您已登录华为云国际站账号,为了您更好的体验,建议您访问国际站服务网站 https://www.huaweicloud.com/intl/zh-cn
不再显示此消息
使用ModelArts Pro服务请根据如何使用ModelArts Pro罗列的要求,提前完成准备工作。 使用预置工作流开发应用流程 HiLens套件当前提供了HiLens安全帽检测工作流,自主上传数据训练模型,提高模型精度,并快速创建技能,一键部署至设备。 图1 HiLens安全帽检测工作流流程
准备数据 在使用通用实体抽取工作流开发应用之前,您需要提前准备用于模型训练的数据,上传至OBS服务中。 设计实体标签 首先需要确定好文本实体的标签,即希望抽取出文本的一种结果。例如“时间”、“地点”、“人物”等。 数据集要求 文件格式要求为txt或者csv,且编码格式为“UTF-8”格式,文件大小不能超过8MB。
提升企业AI应用的开发效率,降低开发难度。文字识别套件基于丰富的文字识别算法和行业知识积累,帮助客户快速构建满足不同业务场景需求的文字识别服务,实现多种版式图像的文字信息结构化提取。 文字识别套件提供预置工作流供您选择,全流程可视化完成AI应用开发以及持续迭代。 选择预置工作流 单模板工作流
具体问题。 资源池 用于数据处理、模型训练、服务部署的资源池和资源类型,分为“公共资源池”和“专属资源池”。 “公共资源池”:提供公共的大规模计算集群,资源按作业隔离。 “专属资源池”:提供独享的计算资源,可用于数据处理、模型训练、服务部署。专属资源池不与其他用户共享,更加高效。
“提取”:“\d+年\d+月\d+日” “后处理”:“年”/“.”、“月”/“.”、 “日”/“” 在识别字段类型为出生日期的文字“2020年1月1日出生”时,首先不做预过滤,然后提取关键字符“2020年1月1日”,最后做后处理,最终提取内容为“2020.1.1”。 提取 对经过“预处理”的文字进行关键字符提取。
取值范围0-1之间。 bndbox:必选字段,标注框的类型,可选值请参见表5。 表5 标注框类型描述 type 形状 标注信息 point 点 点的坐标。 <x>100<x> <y>100<y> line 线 各点坐标。 <x1>100<x1> <y1>100<y1> <x2>200<x2>
“提取”:“\d+年\d+月\d+日” “后处理”:“年”/“.”、“月”/“.”、 “日”/“” 在识别字段类型为出生日期的文字“2020年1月1日出生”时,首先不做预过滤,然后提取关键字符“2020年1月1日”,最后做后处理,最终提取内容为“2020.1.1”。 提取 对经过“预处理”的文字进行关键字符提取。
“提取”:“\d+年\d+月\d+日” “后处理”:“年”/“.”、“月”/“.”、 “日”/“” 在识别字段类型为出生日期的文字“2020年1月1日出生”时,首先不做预过滤,然后提取关键字符“2020年1月1日”,最后做后处理,最终提取内容为“2020.1.1”。 提取 对经过“预处理”的文字进行关键字符提取。
“提取”:“\d+年\d+月\d+日” “后处理”:“年”/“.”、“月”/“.”、 “日”/“” 在识别字段类型为出生日期的文字“2020年1月1日出生”时,首先不做预过滤,然后提取关键字符“2020年1月1日”,最后做后处理,最终提取内容为“2020.1.1”。 提取 对经过“预处理”的文字进行关键字符提取。
单击“应用资产”,在“应用资产”页签下,选择数据集,单击“管理”。 进入“数据集管理”页面。 图1 数据集管理 在数据集管理页面右上角单击“发布”。 在“发布新版本”弹出框中,填写发布数据集的相关参数,然后单击“确定”。 表1 发布数据集的参数说明 参数 描述 “版本名称” 默认按V001、V002递
登录“ModelArts Pro>文字识别套件”控制台,默认进入“应用开发>工作台”页面。选择应用并单击“操作”列的查看,进入“应用资产”页面。 图1 进入评估页面 在“应用资产”页面,单击已有模板操作列的“评估”,进入“应用开发>评估”页面。 在“应用资产”页面,单击已有模板操作列的“编
看”。 进入应用详情页,默认进入“应用资产”页面,查看应用资产。 您也可以单击“应用开发”,切换至“应用开发”页面,查看应用开发配置。 图1 进入应用详情 查看应用资产 在“应用资产”页面下,可以查看当前应用的资产信息。 使用预置工作流开发应用,“应用资产”可查看“模板列表”和“自定义字段类型”。
片,详情请见上传模板图片。 定义预处理 在“应用开发>定义预处理”页面上方或者“选择模板”下拉框中选择模板,对每个模板图片进行预处理。 图1 多模板定义预处理 在右侧“选择预处理逻辑”区域勾选对应操作,当前仅支持“自动旋转”操作,系统自动旋转文字方向不正确的图片,保持图片中的文字方向正确。
步骤。 前提条件 已在文字识别套件控制台选择“多模板分类工作流”新建应用,并对上传的模板图片进行预处理,详情请见定义预处理。 操作步骤 图1 多模板框选参照字段 在“应用开发>框选参照字段”页面上方或者“选择模板”下拉框中选择模板,对每个模板图片进行预处理。 单击左上方操作图标,调整当前模板图片到合适大小和位置。
进入数据标注页面 在“数据选择”页面,新建数据集后,单击操作列的“标注”,进入数据概览页,单击右上角的“开始标注”,进入“数据标注”页面。 图1 数据标注 标注文本 数据集详情页中,展示了此数据集中“未标注”和“已标注”的文本,默认显示“未标注”的文本列表。 在“未标注”页签文本列表