检测到您已登录华为云国际站账号,为了您更好的体验,建议您访问国际站服务网站 https://www.huaweicloud.com/intl/zh-cn
不再显示此消息
自然语言处理套件(使用文本分类工作流开发应用) ModelArts Pro的自然语言处理套件提供了通用文本分类工作流和多语种文本分类工作流,通过工作流指引支持自主上传文本数据,构建高精度文本分类预测模型,适配不同行业场景的业务数据,快速获得定制服务。
图1 模型训练 模型如何提升效果 检查图片标注是否准确,第二相区域标注工作量较大,建议基于自动标注的结果进一步优化标注精度。 可根据损失函数选择适当的训练轮次。 通过详细评估中的错误识别示例,有针对性地扩充训练数据。
视觉套件提供无监督车牌检测工作流,基于高精度的无监督车牌检测算法,无需用户标注数据,大大降低标注成本和提高车牌检测场景上线效率。
预训练模型 当前服务提供预置预训练模型“高精版”、“均衡版”、“基础版”,在“预训练模型”列表中可查看“模型精度”、“推理速度”、“训练速度”和模型“简介”。 参数配置 在“参数配置”填写“学习率”、“训练轮次”和“语种”。 “学习率”用来控制模型的学习速度,范围为(0,1]。
预训练模型 当前服务提供预置预训练模型“高精版”、“均衡版”、“基础版”,在“预训练模型”列表中可查看“模型精度”、“推理速度”、“训练速度”和模型“简介”。 参数配置 在“参数配置”填写“学习率”和“训练轮次”。 “学习率”用来控制模型的学习速度,范围为(0,1]。
优势 模型精度高,识别速度快;更新模型简便。 工作流流程 在“ModelArts Pro>视觉套件”控制台选择“我的工作流>刹车盘识别工作流”新建应用,详细操作请见新建应用。您可以开发刹车盘识别模型,自主上传数据训练模型,实现刹车盘类型识别功能。
优势 模型精度高,识别速度快;更新模型简便。 工作流流程 在“工业视觉平台”控制台页面选择“工业AI开发>工业AI开发工作流”新建应用,详细操作请见新建应用。您可以开发通用图像分类模型,自主上传数据训练模型,实现图像分类功能。
优势 模型精度高,识别速度快;更新模型简便。 工作流流程 在“ModelArts Pro>视觉套件”控制台选择“我的工作流>第二相面积含量测定工作流”新建应用,详细操作请见新建应用。您可以构建第二相面积含量测定模型,能快速准确反馈测定结果。
一键式部署,快速输出高精度结构化数据。 解决单据复杂、单据板式多、语种多问题,支持自定义多个图像板式,快速适配新板式,快速接入业务。 支持从多个不同板式图像中提取结构化信息。
高精度:大部分模型的准确率高于90%。 少数据:训练所需的数据量更少。 智能标注:提升标注效率。 极致性能 依托ModelArts 基础平台,深度软硬件协同。 资源秒级调度,按需使用。 训练任务性能提升30%。
参考字段尽量框选独立文本块,避免框选某一个文本块的一部分,有利于识别精度提升。 本样例框选的参照字段如图8所示。 图8 框选参照字段 单击右下角的“下一步”。 进入“应用开发>框选识别区”页面。
参考字段尽量框选独立文本块,避免框选某一个文本块的一部分,有利于识别精度提升。 本样例框选的参照字段如图10所示。 图10 框选参照字段 页面上方通过调整成第二个模板,弹出“保存操作”对话框,单击“确认”。 对第二个模板框选参照字段。 本样例框选的参照字段如图11所示。
选择数据 在使用多语种文本分类工作流开发应用时,您需要选择训练数据集,后续训练模型操作是基于您选择的训练数据集。 训练数据集可以选择创建一个新的数据集,也可以选择导入在自然语言处理套件其他应用中已创建的文本数据集。 新建数据集 导入数据集 前提条件 已在自然语言处理套件控制台选择“
准备数据 在使用通用实体抽取工作流开发应用之前,您需要提前准备用于模型训练的数据,上传至OBS服务中。 设计实体标签 首先需要确定好文本实体的标签,即希望抽取出文本的一种结果。例如“时间”、“地点”、“人物”等。 数据集要求 文件格式要求为txt或者csv,且编码格式为“UTF-8
准备数据 在使用安全帽检测技能模板开发技能之前,您需要提前准备用于模型训练的数据,上传至OBS服务中。 数据集要求 文件名规范,不能有中文,不能有+、空格、制表符。 保证图片质量:不能有损坏的图片;目前支持的格式包括jpg、jpeg、bmp、png。 为了保证模型的预测准确度,训练样本跟真实使用场景尽量相似
准备数据 在使用热轧钢板表面缺陷检测工作流开发应用之前,您需要提前准备用于模型训练的数据,上传至OBS服务中。 设计钢板标签 首先需要考虑好热轧钢板表面缺陷的类型标签,即能识别出热轧钢板表面的缺陷类型。例如以“scratch”、“scar”、“pit”等作为热轧钢板表面缺陷的类型。
准备数据 在使用无监督车牌检测工作流开发应用之前,您需要提前准备用于模型训练的数据,上传至OBS服务中。 设计车牌标签 首先需要考虑好车牌的标签类型,即希望识别出图片中车牌的一种结果。例如“plate”。 数据集要求 文件名规范,不能有中文,不能有+、空格、制表符。 保证图片质量:
准备数据 在使用第二相面积含量测定工作流开发应用之前,您需要提前准备用于模型训练的数据,上传至OBS服务中。 数据标签 标注基于ModelArts的图像分割标注基础能力,由于第二相边界多为不规则形状,目前采用多边形标注第二相,标签为“second_phase”。 数据集要求 文件名规范
部署服务 评估模型后,就可以部署服务,开发属于自己的零售商品分类应用,此应用用于识别自己所上传的商品图片,也可以直接调用对应的API和SDK识别。 前提条件 已在视觉套件控制台选择“零售商品识别工作流”新建应用,并评估模型,详情请见评估模型。 由于部署服务涉及ModelArts功能
部署服务 评估模型后,就可以部署服务,开发检测热轧钢板表面缺陷的专属应用,此应用用于识别热轧钢板表面图片中的缺陷类型,也可以直接调用对应的API和SDK识别。 前提条件 已在视觉套件控制台选择“热轧钢板表面缺陷检测工作流”新建应用,并评估模型,详情请见评估模型。 由于部署服务涉及ModelArts