检测到您已登录华为云国际站账号,为了您更好的体验,建议您访问国际站服务网站 https://www.huaweicloud.com/intl/zh-cn
不再显示此消息
角单击“调试”,在“调用详情 > 调用链”中查看插件输出的错误信息。 解决方法:若为Token错误问题,可参考创建多语言文本翻译插件,重新获取Token并进行试运行。 父主题: 低代码构建多语言文本翻译工作流
表高度、有效波高等指标。不同模型的指标以页面展示为准。 深海变量 用于描述海洋深层的物理和化学特性,这些参数在海洋模型中用于模拟海洋内部的动态和状态。包括海温、海盐、海流径向速率、海流纬向速率等。 输出设置 用于选择是否输出图片结果。 海洋类预测场景的参数配置示例如下: 图3 调测科学计算大模型示例(海洋类预测)
预训练时,默认值为:0.00001,范围为[0, 0.001]。 学习率调整策略 用于选择学习率调度器的类型。学习率调度器可以在训练过程中动态地调整学习率,以改善模型的训练效果。目前支持CosineDecayLR调度器。 变量权重 2米温度 海表面2m温度 (℃)的权重设置。训练
和应用。 数据工程工具链 数据是大模型训练的基础,为大模型提供了必要的知识和信息。数据工程工具链作为盘古大模型服务的重要组成部分,具备数据获取、清洗、数据合成、数据标注、数据评估、数据配比、数据发布和管理等功能。 该工具链能够高效收集和处理各种格式的数据,满足不同训练和评测任务的
关性,而负值则表示反向相关。 RQE 衡量预测值与真实值之间差距的指标。它是所有单个观测的相对误差的平方和。该值越小,代表模型性能越好。 获取训练日志 单击训练任务名称,可以在“日志”页面查看训练过程中产生的日志。对于训练异常或失败的任务也可以通过训练日志定位训练失败的原因。典型
应用百宝箱 数据工程工具链 数据是大模型训练的基础,为大模型提供了必要的知识和信息。数据工程工具链作为盘古大模型服务的重要组成部分,具备数据获取、清洗、数据合成、数据标注、数据评估、数据配比、数据流通和管理等功能。 该工具链能够高效收集和处理各种格式的数据,满足不同训练和评测任务的
按标签:该场景适用于通过数据打标类加工算子进行加工的文本类数据集,具体标签名称与标签值可在完成加工文本类数据集操作后,进入数据集详情页面获取。 填写示例如图1所示。 图1 “按标签”配比方式填写示例 页面将返回至“配比任务”页面,配比任务运行成功后,状态将显示为“运行成功”。
数据工程常见报错与解决方案 数据工程常见报错及解决方案请详见表1。 表1 数据工程常见报错与解决方案 功能模块 常见报错 解决方案 数据获取 File format mismatch, require [{0}]. 请检查创建数据集时使用的数据,与平台要求的文件内容格式是否一致。
人工评估标准”模块 评估作业员 拥有权限如下: “数据工程 > 数据管理 > 数据评估 > 人工评估”模块 数据导入员 拥有权限如下: “数据工程 > 数据获取 > 导入任务”模块 “数据工程 > 数据管理 > 数据集”模块 数据加工员 拥有权限如下: “数据工程 > 数据加工 > 加工任务”模块
径无关的内容删除。 电子书内容提取 从电子书中提取出所有文本内容。 数据转换 个人数据脱敏 对文本中的手机号码、身份证件、邮箱地址、url链接、国内车牌号、IP地址、MAC地址、IMEI、护照、车架号等个人敏感信息进行数据脱敏,或直接删除敏感信息。 中文简繁转换 将中文简体和中文繁体进行转换。
科技行业公司的平均利润和市值是多少? 识别原始问题中的槽位: 科技行业公司的[metric]利润和市值是多少? 采用简单的逻辑规则进行替换,获取更多数据。此处将[metric]替换为“最大”、“最小”、“中位”、“总”等,示例如下: 科技行业公司的最大利润和市值是多少? 科技行业公司的最小利润和市值是多少?
在节点的“配置信息”输入请求参数的值以及Token值,单击“开始运行”。 其中,X-Auth-Token为文本翻译插件的鉴权参数,Token值由创建多语言文本翻译插件获取。 图16 单节点调试-2 单节点调试成功后,将在该节点显示“运行成功”字样及其运行时间。 图17 单节点调试成功示例 步骤3:试运行多语言文本翻译工作流
使用规则构建的优点是快速且成本低,缺点是数据多样性较低。 基于大模型的数据泛化:您可以通过调用大模型(比如盘古提供的任意一个规格的基础功能模型)来获取有监督场景。一个比较常见的方法是,将无监督的文本按照章节、段落、字符数进行切片,让模型基于这个片段生成问答对,再将段落、问题和答案三者组装
如果状态为“订阅失败”,表示该资产未成功从AI Gallery订阅,可单击“重新订阅”重新从AI Gallery订阅数据资产。 订阅成功后的数据资产,将在“数据工程 > 数据获取 > 原始数据集”中显示,可执行后续的数据加工及发布操作。 管理数据资产 登录ModelArts Studio大模型开发平台,在“我的空间”模块,单击进入所需空间。
的准确性。大规模预训练模型则是指模型参数达到千亿、万亿级别的预训练模型。此类大模型因具备更强的泛化能力,能够沉淀行业经验,并更高效、准确地获取信息。 大模型的计量单位token指的是什么 令牌(Token)是指模型处理和生成文本的基本单位。token可以是词或者字符的片段。模型的
在线问答公开数据、政务百科等。 来源二:特定的私域数据,针对于具体场景和项目需求,收集相关的文本数据。比如通过与当地政府的政数局进行合作,获取政府部门提供的内部脱敏数据等。相关的数据格式包括但不限于:在线网页、离线word文档、离线txt文件、离线excel表格、离线PDF文件、
在“提示词”模块,需要在输入框中填写Prompt提示词。 可依据模板填写Prompt,单击“”,输入框中将自动填入角色指令模板。单击“”,可使用获取提示词模板中的提示词模板。 图1 提示词 提示词填写完成后可通过大模型进行优化,单击“”,可在 “Prompt优化”窗口中复制优化后的提示词,单击“确定”。
专业大模型等服务,便捷地构建自己的模型和应用。 数据工程工具链:数据是大模型训练的核心基础。数据工程工具链作为平台的重要组成部分,具备数据获取、数据加工和数据发布等功能,确保数据的高质量与一致性。工具链能够高效收集并处理各种格式的数据,满足不同训练任务的需求,并提供强大的数据存储
审计 云审计服务(Cloud Trace Service,CTS)是华为云安全解决方案中专业的日志审计服务,提供对各种云资源操作记录的收集、存储和查询功能,可用于支撑安全分析、合规审计、资源跟踪和问题定位等常见应用场景。 用户开通云审计服务并创建、配置追踪器后,CTS可记录用户使用盘古的管理事件和数据事件用于审计。
意图识别节点配置说明 配置该节点来分析用户输入,识别其意图,以便后续处理。 提问器节点配置说明 配置一个提问器节点,用于向用户或系统提出问题,获取所需信息。 插件节点配置说明 将外部API等集成到工作流中,以扩展功能或调用外部接口。 判断节点配置说明 设置条件判断逻辑,根据不同情况分支到不同的流程路径。