检测到您已登录华为云国际站账号,为了您更好的体验,建议您访问国际站服务网站 https://www.huaweicloud.com/intl/zh-cn
不再显示此消息
配置过期时间实现新闻的过期下架 在新闻推荐等对物料的时效性要求较高的场景,可配置物料的过期时间expireTime,设置每一条新闻的有效期,使新闻在有效期内实现可推送,超过有效期,不会被推送。 表1 物品数据中expireTime字段描述 字段名 类型 描述 是否必选 expireTime
灵活配置物品状态和过期时间,保障有效性和实效性 配置物品status状态,完成物品的上下架 配置过期时间实现新闻的过期下架
在“创建数据质量”页面,单击“添加数据质量算子”选择“数据质量检测算子”。 填写基本信息并选择计算引擎。您可以根据实际情况填写“名称”、“场景”和“描述”信息。其中“场景”信息可选择您在全局配置页面创建的场景。 填写参数配置,参数说明请参见表1。 图1 创建数据质量检测作业 表1 数据质量检测算子参数说明 参数名称 说明
传至OBS。 只有在数据源数据结构特征抽取人工复核确认之前才允许修改数据源。 注意事项 修改编辑之后的离线数据源需要重新进行数据结构抽取和检测、探索等操作。 操作步骤 登录RES管理控制台,在左侧菜单栏中选择“数据源”,进入数据源列表页面。 在数据源列表单击目标数据源名称,进入数据源详情页面。
产品功能 数据源 数据源功能可以在用户上传数据后,将离线数据源经过数据特征抽取,生成推荐系统内部通用的数据格式。经过数据质量检测来确保数据的合法性。提供数据源智能检测,输出数据分布和数据质量信息等,智能完成特征工程。 智能场景 根据业务场景选择对应的智能推荐场景,快速搭建专属推荐系统。
离线数据和近线实时数据如何配合使用? 在推荐系统初始化阶段,需要用户提供批量的离线数据源并按照推荐系统要求的数据格式上传至OBS,完成数据的检测和导入。 近线实时数据源推荐使用RES SDK上传,此操作所有的数据更新都是实时生效的。 父主题: 数据源
Map[String, String]]] 查询到的效果指标,外层map的key表示服务名称,中间层表示流程名称,里层map的key表示时间戳,value表示对应的指标的值。 error_msg String 请求失败时的错误信息,请求成功时无此字段。 error_code String
查询数据源任务结果 功能介绍 查询指定数据源下离线任务的结果。其中包括数据格式,数据检测、数据探索及效果评估的内容。 调试 您可以在API Explorer中调试该接口。 URI GET /v2.0/{project_id}/workspaces/{workspace_id}/d
选集。 用户通过数据质量作业对离线数据进行质量检测,然后将检测合格的数据通过特征工程处理为可用于召回策略、过滤规则、排序策略、近线作业的数据。通过上述离线作业训练出可用于在线服务的推荐候选集。当在线服务运行完成,您可以通过效果评估检测推荐结果。 离线作业功能说明 表1 功能说明 离线作业
为数据的用户画像更新生成,热度越大排序越靠前。 时间排序:根据时间对候选集进行排序。时间排序需要指定特征名称和推荐天数。 特征名称:值为时间戳(10位)的特征的名称,任务会根据此特征对候选集进行排序。 推荐天数:推荐数据的时间段,该时间段从当前开始往前推N天,默认15天。 默认热度排序。
产品价格详情 03 使用 推荐系统对离线数据进行质量检测,然后将检测合格的数据通过特征工程处理为可用于召回策略、过滤规则、排序策略、近线策略的数据。通过上述作业训练出可用于在线服务的推荐候选集。当在线作业运行完成,您可以通过效果评估检测推荐结果。 使用推荐系统 推荐系统操作流程 准备工作
对第一个节点进行查询作业详情的配置。查询作业详情参数请参见查询作业详情API。 对第二节点进行重新执行作业的配置。重新执行作业详情参数请参见重新执行作业的API。 当检测到近线任务(实时流任务)失败时,才会进行第二个节点的作业。 单击“保存”后,进行“测试运行”。确保功能正常。 在页面右侧,单击“调度配置”
当数据源创建完成,您可以进入数据源详情页面进行数据质量管理操作。数据质量管理操作可以将离线数据源经过数据特征抽取,生成推荐系统内部通用的数据格式。经过数据质量检测来确保数据的合法性。 数据结构介绍 数据结构步骤的主要目的是读取用户上传的离线数据,解析用户特征和物品特征中每一个属性的数据格式、统计所有行为,然后保存解析生成的数据格式。
List 请参见表3,需要统计的指标列表及其对应的参数。 start_time 是 Long 被统计数据的起始时间戳。 end_time 是 Long 被统计数据的终止时间戳。 interval 是 Double 统计间隔,以天为单位,每隔interval天计算一次指标,大于0。 result_path
txt中的每条数据的expireTime字段的值修改成大于当前时间的值,避免数据因为过期被过滤掉。 查询当前时间戳,网址https://tool.lu/timestamp。 图1 查询当前时间戳 将behavior.txt中的每条数据的actionTime字段的值修改到当前时间附近。 图2 修改behavior
txt中的每条数据的expireTime字段的值修改成大于当前时间的值,避免数据因为过期被过滤掉。 查询当前时间戳,网址https://tool.lu/timestamp。 图1 查询当前时间戳 将behavior.txt中的每条数据的actionTime字段的值修改到当前时间附近。 图2 修改behavior
RES根据实时发送到DIS上的日志,进行数据计算和处理,更新用户的相关数据。 实时日志 运行推荐策略 创建离线作业 创建离线作业包括进行数据质量检测、创建组合作业、特征工程、召回策略、排序策略、过滤规则等作业。 运行推荐作业 创建在线服务 - 创建在线服务用于部署上线服务、更新模型。配
配置物品status状态,完成物品的上下架 在推荐系统中,有一种常见的场景,最终推荐列表是否展示无库存或者已下架商品。针对此场景,RES系统在物品表中提供status字段来实现物品的上下架。 参考准备离线数据源中的物品表字段介绍,status置为0,代表该物品可被推荐。statu
各标签体系下,兴趣标签的最大长度。 表14 canidate 参数说明 参数名称 是否必选 参数类型 说明 time_feature 否 String 特征值为10位时间戳的特征名称。 max_size 是 Int 维护的候选集的最大长度。 retain_days 否 Int 保留时间为最近N天的候选集。 表15
参数名称 是否必选 参数类型 说明 start_time 否 Long 训练数据开始时间,以毫秒为单位的时间戳。 end_time 否 Long 训练数据结束时间,以毫秒为单位的时间戳。 strategy 是 List 请参见表11,策略集合。 表11 strategy参数说明 参数名称