检测到您已登录华为云国际站账号,为了您更好的体验,建议您访问国际站服务网站 https://www.huaweicloud.com/intl/zh-cn
不再显示此消息
自然语言处理套件 行业套件介绍 新建应用 通用文本分类工作流 多语种文本分类工作流 通用实体抽取工作流 更新应用版本 查看应用详情 监控应用 删除应用
使用预置工作流开发应用 表1 使用预置工作流开发应用流程 流程 说明 详细指导 选择自然语言处理套件 根据您的实际使用需求选择自然语言处理套件。您也可以通过查看工作流定位所需使用的套件。 在ModelArts Pro控制台界面,单击“自然语言处理”套件卡片的“进入套件”,进入自然语言处理套件控制台。
Pro>视觉套件”控制台。 默认进入“应用开发>工作台”页面。 选择已新建的应用名称,单击“操作”列的“查看”。 进入“应用总览”页面。 图1 进入应用总览 在开发版本列表中单击“操作”列的“查看”。 进入“应用开发”页面。 图2 进入应用开发 新建训练数据集 在“数据选择”页面,单击“新
Pro会自动标注数据,自动标注完成后,可对每个数据的标注结果进行核对和确认。 自动标注数据 训练模型 选择训练数据后,无需用户配置任何参数即可开始训练商品识别模型,并查看训练的模型准确率和误差的变化。 训练模型 评估模型 训练得到模型之后,整个开发过程还不算结束,需要对模型进行评估和考察。 评估结果包括一些
热轧钢板表面缺陷检测工作流 云状识别工作流 刹车盘识别工作流 无监督车牌检测工作流 第二相面积含量测定工作流 通用图像分类工作流 更新应用版本 查看应用详情 监控应用 管理设备 删除应用
Pro>视觉套件”控制台。 默认进入“应用开发>工作台”页面。 选择已新建的应用名称,单击“操作”列的“查看”。 进入“应用总览”页面。 图1 进入应用总览 在开发版本列表中单击“操作”列的“查看”。 进入“应用开发”页面。 图2 进入应用开发 新建训练数据集 在“数据选择”页面,单击“新
Pro>视觉套件”控制台。 默认进入“应用开发>工作台”页面。 选择已新建的应用名称,单击“操作”列的“查看”。 进入“应用总览”页面。 图1 进入应用总览 在开发版本列表中单击“操作”列的“查看”。 进入“应用开发”页面。 图2 进入应用开发 新建训练数据集 在“数据选择”页面,单击“新
框选识别区 在图片模板中框选识别区,确定模板图片中需要识别的文字位置。 框选识别区 评估应用 通过上传与模板图片同一板式的测试图片,评估图片识别结果是否正确。 评估应用 部署服务 模板图片评估后,可以部署模板至文字识别开发套件中,开发属于自己的文字识别应用,此应用用于识别自己所上传的模板样式的图片。
进入自然语言处理套件控制台。 在左侧导航栏选择“应用开发>工作台”。 默认进入“我的应用”页签。 在“我的应用”页签下,选择已创建的应用,单击操作列的“查看”。 进入应用详情页,默认进入“应用开发”页签。 单击“应用资产”,在“应用资产”页签下,选择数据集,单击“管理”。 进入“数据集管理”页面。
用,收费规则请参见OBS价格详情。 基于可训练技能模板新建技能,训练模型和部署技能会占用ModelArts训练资源,需要收取一定费用,收费规格请参见ModelArts价格详情。 操作步骤 在ModelArts Pro控制台界面,单击“HiLens套件”卡片的“进入套件”。 默认进入“全部模板”页面。
标签”页中,添加标签名称,选择标签颜色,单击“确定”完成标签的新增。 图4 添加标签(2) 图5 新增标签 查看已标注文本 在数据集详情页,单击“已标注”页签,您可以查看已完成标注的文本列表。您也可以在右侧的“全部标签”中了解当前数据集支持的所有标签信息。 修改标注 当数据完成标
登录“ModelArts Pro>文字识别套件”控制台。 默认进入“应用开发>工作台”页面。 在“我的应用”页签下,选择应用并单击“操作”列的“查看”。 进入“应用资产”页面。 图1 进入应用资产 单击“自定义字段类型”,进入“自定义字段类型”页签。 图2 自定义字段类型 单击“创建字段类型”。
登录“ModelArts Pro>文字识别套件”控制台。 默认进入“应用开发>工作台”页面。 在“我的应用”页签下,选择应用并单击“操作”列的“查看”。 进入“应用资产”页面。 图1 进入应用资产 单击“自定义字段类型”,进入“自定义字段类型”页签。 图2 自定义字段类型 单击“创建字段类型”。
训练分类器 确定模板图片的参照字段和识别区后,多模板分类工作流在模板数量较多,或版式相似度较高的情况下,建议针对不同的模板上传对应的训练集数据,用于训练模板分类模型,使服务能够精准地分类多个模板图片,然后对多个模板图片进行文字识别和结构化提取。 前提条件 已在文字识别套件控制台选
工作流介绍 工作流简介 功能介绍 支持用户自定义多个文字识别模板,通过模型训练,自动识别图片所需使用的模板,从而支持从大量不同板式图像中提取结构化信息。 适用场景 用户认证识别 识别证件中关键信息,节省人工录入,提升效率,降低用户实名认证成本,准确快速便捷。 快递单自动填写 识别
使用多模板工作流开发应用 ModelArts Pro的文字识别套件提供了多模板工作流,通过工作流指引支持自定义多个文字识别模板,通过模型训练,自动识别图片所属模板,从而支持从大量不同板式图像中提取结构化信息。 本章节提供一个票证类型的样例,帮助您快速熟悉使用文字识别套件中的多模板
多模板分类工作流 工作流介绍 上传模板图片 定义预处理 框选参照字段 框选识别区 训练分类器 评估应用 部署服务 编辑应用 自定义字段类型 删除应用 父主题: 文字识别套件
“2020年1月1日”,最后做后处理,最终提取内容为“2020.1.1”。 提取 对经过“预处理”的文字进行关键字符提取。 在输入框中填写查找关键字符的正则表达式。 不填写时,默认提取全部字段。 如果需要多个提取规则,单击新增提取规则。提取时按从上到下优先级规则提取,选择第一个非空的提取内容作为提取后的内容。
“2020年1月1日”,最后做后处理,最终提取内容为“2020.1.1”。 提取 对经过“预处理”的文字进行关键字符提取。 在输入框中填写查找关键字符的正则表达式。 不填写时,默认提取全部字段。 如果需要多个提取规则,单击新增提取规则。提取时按从上到下优先级规则提取,选择第一个非空的提取内容作为提取后的内容。