检测到您已登录华为云国际站账号,为了您更好的体验,建议您访问国际站服务网站 https://www.huaweicloud.com/intl/zh-cn
不再显示此消息
数据传入方式 使用OCR API或SDK时,数据主要通过以下两种方法传入。 image 传入图片的base64编码。 您可以通过在线转码工具,浏览器,使用Python中的base64.b64encode函数等方法,获取图片的base64编码。 url 传入图片的url路径。 使用公网http/https
使用OCR服务需要的权限 使用OCR服务时,如果您需要使用华为云对象存储服务(OBS)中的数据,请开通对象存储服务OBS授权,可在控制台进行开通。 OCR服务支持IAM细粒度划分策略。可以为子用户设置OCR服务的使用权限。 父主题: 权限类
OCR服务支持批量识别吗 OCR服务只支持调用一次接口识别一张图片,批量识别需要进行二次开发,编码循环调用API,实现批量调用服务识别图片。 父主题: API使用类
置。 框选识别区 模板总览 检查所有模板是否已正确配置。 模板总览 评估 通过上传测试图片,在线评估模板分类情况和模板的文字识别情况,保证能在多个模板情况下正确分类测试图片的模板,并且能正确识别测试图片中的识别区文字。 评估 父主题: 多模板分类工作流
准备工作 开通文字识别服务 登录文字识别控制台。 在控制台左上角选择区域为“北京四”,并开通“增值税发票识别”、“发票验真”。 开通后,默认为按需计费。 图1 开通管理 完成文字识别对OBS服务授权。 在文字识别控制台,选择“服务授权”,单击开通授权。 图2 服务授权 创建 rf_amdin_trust
newBuilder() 网络代理(可选) // 使用代理服务器(可选) client.withProxyAgent("http://username:password@proxy.huaweicloud.com:8080") SSL配置(可选) // 配置跳过服务端证书验证(可选) process.env
在使用之前,需要您完成服务申请和认证鉴权,具体操作流程请参见开通服务和认证鉴权章节。 用户首次使用需要先申请开通。服务只需要开通一次即可,后面使用时无需再次申请。如未开通服务,调用服务时会提示ModelArts.4204报错,请在调用服务前先进入控制台开通服务,并注意开通服务区域与调用服务的区域保持一致。
“评估”:单击“评估”,继续上传测试图片评估模板。 “继续编辑”:单击“继续编辑”,返回“应用开发>框选参照字段”页面,继续编辑模板。 “返回列表”:单击“返回列表”,返回至应用详情页。 “调用API”:下方调用指南区域,可直接调用API或SDK轻松调用当前模板服务,详情请见调用API。 父主题:
“评估”:单击“评估”,继续上传测试图片评估模板。 “继续编辑”:单击“继续编辑”,返回“应用开发>框选参照字段”页面,重新编辑模板。 “返回列表”:单击“返回列表”,返回至应用详情页。 “调用API”:下方调用指南区域,提供了调用当前模板服务的请求样例,详情请见调用API。 父主题:
API获取推理结果,帮助用户提升业务效率。 文字识别服务软件开发工具包(OCR SDK,Optical Character Recognition Service Software Development Kit)是对OCR服务提供的REST API进行的封装,以简化用户的开发工作。用户直接调用OCR
参照字段,且参照字段差异尽量明显,相似的参照字段容易导致分类错误。 模板数量可穷举,建议不超过20种模板,过多的模板会降低分类效果(以实际测试为准,模板差异较大时允许支持更多模板)。 父主题: 常见问题
一键式部署,快速输出高精度结构化数据。 工作流流程 在“文字识别控制台>自定义OCR”页面选择“通用单模板工作流”创建应用,详细操作请见6.2 新建应用。您可以创建单模板服务,通过模板配置文字识别模型,实现单模板图像的文字信息结构化提取。 图1 创建单模板流程 表1 创建单模板流程说明 流程 说明 详细指导 上传模板图片
【下线公告】OCR自定义模板下线公告 下线公告 华为云计划于2025/12/31 00:00(北京时间)正式下线文字识别服务北京四、上海一、北京一的自定义模版识别。 下线范围 华北-北京四、上海一、北京一 下线影响 正式下线后您将无法新建、修改、应用通用单模板和多模版分类工作流,
【停售公告】OCR自定义模板停售公告 停售公告 华为云计划于2024/07/05 00:00(北京时间)正式停售OCR文字识别服务北京四、上海一、北京一的自定义模版。 停售范围 华北-北京四、上海一、北京一 停售影响 正式停售后新用户无法购买及使用北京四、上海一自定义模板,已购买
按API调用次数计费,计费价格请参见价格计算器。 只有调用成功才会计算调用次数,其中返回的2xx状态码表示调用成功,调用失败不计费。 购买文字识别服务请参考如何选购合适的API。 如需了解实际场景下的计费样例以及各计费项在不同计费模式下的费用计算过程,请参见计费样例。
约束与限制 受技术与成本多种因素制约,文字识别服务存在一些约束限制。其中系统级约束限制,是所有子服务的约束。除系统级约束限制外,各子服务还有独立的约束条件。 智能文档解析 支持中英文及部分中文繁体字。 只支持识别PNG、JPG、JPEG、BMP、GIF、TIFF、WEBP、PCX
是为当前账号开通服务,所以当前界面的开通状态不会变。 解决措施 需要用户登录IAM账号(用户2)进入控制台界面,已开通服务的“开通状态”才会显示已开通。 图3 开通状态 如果主账号或被授予所有权限(OCR FullAccess)的IAM子账号需要为自己开通某个服务,可以在开通管理
需任何预付款或长期承诺的用户。本文将介绍按需计费OCR资源的计费规则。 适用场景 按需计费适用于具有不能中断的短期、突增或不可预测的应用或服务。 适用计费项 按API调用次数计费,计费价格请参见价格计算器。 只有调用成功才会计算调用次数,其中返回的2xx状态码表示调用成功,调用失败不计费。
测量对象 调用服务成功次数 该指标用于统计用户请求服务成功次数,以“次每分钟”为单位。 ≥0次每分钟 文字识别 调用服务失败次数 该指标用于统计用户请求服务失败次数,以“次每分钟”为单位。 ≥0次每分钟 文字识别 每个子服务都有调用成功次数和失败次数两个指标。 对象存储服务 对象存储服务(Object
审计 云审计服务(Cloud Trace Service,CTS),是华为云安全解决方案中专业的日志审计服务,提供对各种云资源操作记录的收集、存储和查询功能,可用于支撑安全分析、合规审计、资源跟踪和问题定位等常见应用场景。 用户开通云审计服务并创建和配置追踪器后,CTS可记录OCR的管理事件和数据事件用于审计。