检测到您已登录华为云国际站账号,为了您更好的体验,建议您访问国际站服务网站 https://www.huaweicloud.com/intl/zh-cn
不再显示此消息
toolPrinciple = "请在有用户ID、用户单据、用户最大报销比例的情况下查询用户最大报销额度时调用此工具。需要先分别调用query_receipt工具查询用户单据和query_reimbursement_ratio工具查询最大报销比例。", inputDesc = "用户ID、用户单据、用户报销最大比例"
评估盘古大模型 创建模型评估数据集 创建模型评估任务 查看评估任务详情
批量评估提示词效果 创建提示词评估数据集 创建提示词评估任务 查看提示词评估结果 父主题: 提示词工程
典型训练问题和优化策略 什么情况下需要微调 什么情况下不建议微调 数据量很少,可以微调吗 数据量足够,但质量较差,可以微调吗 无监督的领域知识数据,量级无法支持增量预训练,如何让模型学习 如何调整训练参数,使模型效果最优 如何判断训练状态是否正常 如何评估微调后的模型是否正常 如何调整推理参数,使模型效果最优
选择基模型/基础功能模型 盘古-NLP-N2-基础功能模型 准备训练数据 本场景不涉及自监督训练,无需准备自监督数据。 微调数据来源: 来源一:真实业务场景数据。 来源二:基于大模型的数据泛化。基于目标场任务的分析,通过人工标注部分数据样例,然后利用大模型(如盘古提供的任意规格的基础功能模型
默认值 范围 说明 数据批量大小 8 >=1 数据集进行分批读取训练,设定每个批次数据的大小。 一般来说,批大小越大,训练速度越快,但会占用更多的内存资源,且可能导致收敛困难或过拟合。批大小越小,训练速度越慢,但会减少内存消耗,且可能提高泛化能力。因此,批大小需要根据数据集的规模和特点
购买平台的用户默认为系统管理员,具有所有操作的权限。 运营人员 具备总览、平台管理(资产管理、权限管理)功能的权限。 模型开发人员 具备总览、服务管理、能力调测、数据工程(数据管理、数据清洗)、模型开发(模型管理、模型训练、模型评估、模型压缩、模型部署)、平台管理(资产管理、权限管理)功能的使用权限。 推理服务API调用人员
异常的Loss曲线:平缓且保持高位 Loss曲线异常抖动:Loss曲线异常抖动的原因可能是由于训练数据质量差,比如数据存在噪声或者分布不均衡,导致训练过程不稳定。你可以尝试提升数据质量的方式来解决。 图5 异常的Loss曲线:异常抖动 父主题: 典型训练问题和优化策略
= "capital", toolDesc = "资产注册查询", toolPrinciple = "请在需要查询各个公司的资产注册情况时调用此工具", inputDesc = "需要查询的公司名称,一次只支持查询一家公司", outPutDesc = "公司的资产注册规模")
版本: 0.1 - 语言: 中文 - 描述: 我是一个旅行规划助理,能够帮助用户查询天气、预订车票,以及查询旅游地的风景人文。 ## 技能 ### 技能-1 1. 通过调用{tool_id}工具,查询目的地的天气信息。 ### 技能-2 1. 能够根据用户需求和偏好,帮助用户规划旅行路线。
模型规格:不同规格的模型支持的长度不同,若目标任务本身需要生成的长度已经超过模型上限,建议您替换可支持更长长度的模型。 数据质量:请检查训练数据中是否存在包含异常截断的数据,可以通过规则进行清洗。 父主题: 典型训练问题和优化策略
out.println(JSONObject.toJSONString(resp.getResult())); 向量库 向量库用于向量数据存储,并提供向量数据检索能力。 初始化,以使用华为CSS示例。 import com.huaweicloud.pangu.dev.sdk.api.embedings
for doc in doc_list: print(doc.page_content) 向量库 向量库用于向量数据存储,提供向量数据检索能力。 初始化,以使用华为CSS示例。 from pangukitsappdev.api.memory.vector.factory
策略,并让Agent结合记忆模块中相关的信息以获取最优化任务解决策略。 任务执行:能通过工具与外界发生联系并产生影响,工具可以自定义,包括查询信息、调用服务、网络搜索、文件管理、调用云服务等,通过Agent构建一个让LLM按照特定的规则迭代运行的Prompt,直到任务完成或者达到终止条件(如设置迭代次数)。
- √ 应用百宝箱 - - - √ √ 服务管理 √ √ - √ √ 能力调测 √ √ - √ √ 数据工程-数据管理 - √ - - √ 数据工程-数据清洗 - √ - - √ 数据工程-提示用例管理 - - - √ √ 模型开发-模型管理 - √ - - √ 模型开发-模型训练
策略,并让Agent结合记忆模块中相关的信息以获取最优化任务解决策略。 任务执行:能通过工具与外界发生联系并产生影响,工具可以自定义,包括查询信息、调用服务、网络搜索、文件管理、调用云服务等,通过Agent构建一个让LLM按照特定的规则迭代运行的Prompt,直到任务完成或者达到终止条件(如设置迭代次数)。
通过一站式流程,完成从数据集准备、模型训练、压缩、部署到调用和迁移,全面掌握盘古大模型的开发过程。同时,结合应用开发的提示词工程、Agent开发以及盘古应用开发SDK,您将能够高效构建智能应用,充分释放盘古大模型的潜力,为业务创新提供强大支持。 数据工程 使用数据工程准备与处理数据集 模型开发
addTools(toolList); 工具添加后,会存储在向量库的索引中,并将指定的字段向量化。 从ToolRetriever中查找工具: // 查找工具 List<Tool> result = cssToolRetriever.search("预订会议室", 2); 返回的re
安全 责任共担 身份认证与访问控制 数据保护技术 审计 监控安全风险
模型会更倾向于使用不常见的词汇。 历史对话保留轮数 选择要包含在每个新API请求中的过去消息数。这有助于为新用户查询提供模型上下文。参数设置为10,表示包括5个用户查询和5个系统响应。该参数只涉及多轮对话功能。 体验预置模型文本补全能力 进入“文本补全”页签,选择模型与示例,参数