检测到您已登录华为云国际站账号,为了您更好的体验,建议您访问国际站服务网站 https://www.huaweicloud.com/intl/zh-cn
不再显示此消息
科大讯飞星火交互认知大模型”智能交互对话项目时,需要使用这里的应用信息,包括:应用名称、APPID、APPKEY和APISECRET。 (可选)开启闲聊功能:闲聊功能可以丰富数字人问答内容,如:天气、旅游、假期等日常闲聊信息。 需要在应用中,依次完成下述配置 开启讯飞闲聊功能,即开启“兜底设置”及其下的“讯飞闲聊”。
使用限制 在使用数字内容生产线服务前,您需要了解本服务的使用限制信息。 区域限制 预置模特使用限制 API使用限制 形象制作限制 声音制作限制 视频制作限制 视频直播限制 Flexus分身数字人限制 照片数字人限制 智能交互限制 资产管理说明 SP用户限制
视频中使用的素材未上传成功,需重新上传后使用。 视频中的素材已被删除,多数情况下为PPT素材。需要在“我的创作 > 回收站”界面,找到素材并恢复。 视频中的素材可能涉及敏感内容,在“我的创作 > 资源 > 已冻结”界面,查看已冻结的资产。如需解冻,需要提交工单申请人工复审。 声音账户余额不足,请充值后重新合成视频
部分浏览器提交H265训练视频失败如何处理? 声音和形象模型支持在其他平台使用吗? 声音和形象模型和音视频内容的关系? Flexus数字人在走动录制时需要注意什么?
定制声音时,从平台下载的授权书中有明确说明,定制音色需授权给公司使用。 操作前准备 用户创建声音制作任务前,需要参考操作步骤准备完成如下内容: “语料上传”方式制作声音时,需要参考声音制作页面的“录音指导”录制音频。 签署声音授权文件,如授权书所示。 购买小语种克隆套餐包并激活使用,操作请参考购买出门问问声音套餐。
为了保证数字人训练的效果,请按照我们提供的流程进行录制,请根据实际需求评估录制流程: 不需要交互:15~20秒静默 + 4~5分钟自然表达 需要交互:15~20秒静默 + 无语义动作 + 4~5分钟自然表达,详见交互数字人拍摄要求。 需要动作编排:15~20秒静默 + 4~5分钟自然表达 + 单独拍摄动
新增商品中新增的商品会自动展示在“商品”页签中,可直接使用。 直播画面创作完成后,需要制作剧本。 服务有预置文本,可以直接使用,如图8所示。用户也可以根据实际场景自定义文本内容,并单击图标,新增段落。 图8 文本驱动 如果还需要制作多场景,可以单击直播画面预览窗口右侧“场景1”小窗口下方的“+”
资产存储计费说明 资产存储 计费说明 免费存储空间 MetaStudio服务免费赠送每个租户5GB资产存储空间,用于上传各类音视频、图片等素材。如果租户需要更多的存储空间,请购买单独的资产管理包月产品。 定制形象模型存储 基于MetaStudio服务定制生成的形象模型,其所包含的音色模型所占存储空间,暂不计入租户资产存储计费中。
输入问答机器人ID。可在CBS控制台“智能问题机器人”页面查看,详见图2。 CBS委托站点 从下拉框中选择站点,即用户购买CBS问答机器人所在Region。 授权 需要授权MetaStudio访问CBS。首次授权的站点,需开启授权开关。 执行开启授权操作,界面会弹出获取访问权限对话框,如图2所示。单击“同
示方式。 下述智能交互客户端SDK的两个方法的配置字段enableCaption,默认值均为False,即用户自定义富媒体的展示效果。如果需要使用SDK提供的默认展示效果,需修改参数enableCaption的值为true。 修改create方法中param参数的config配置
et链接。 须知: 参数返回的地址默认无wss://前缀,实际使用时,需要补齐前缀。示例:如果返回字段内容为metastudio-api.cn-north-4.myhuaweicloud.com:443,则需要拼接为wss://metastudio-api.cn-north-4.myhuaweicloud
文本驱动:通过输入文本,选择声音的方式,生成播报内容。不能超过2000字。 单击声音图标,会弹出声音对话框,可以选择需要使用的声音。 无标注的系统声音,均为免费声音,可直接选用。 标注有“第三方”的声音,需要购买激活后才能使用,操作请参考购买出门问问声音套餐。 请填写名片信息 姓名 必填项,数字人姓名。
SDK静态JS文件,则通过以下方式访问: import { HwICSUiSdk } from './sdk/HwICSUiSdk' 除以上JS文件引入之外,还需要引入CSS样式文件,可以直接通过link标签引入或者直接在项目中import: <link rel="stylesheet" href="
技能配置要求,如表4所示。技能创建完成后,需要导入MetaStudio服务导出的技能文件。 表4 创建技能 参数 说明 技能名称 输入技能名称,必须与MetaStudio服务创建的技能一一对应,如4所示。 为方便识别和记忆,两边的技能名称可以设置一致。 技能标识 需要与MetaStudio服务新能技能的“技能标识”一致,如4所示。
在左侧导航栏中,选择“资产归属分配”,进入“资产归属分配”页面。 可以看到所有资产的名称/ID、类型、归属账号名称/ID和更新时间。 找到需要修改归属的资产名称,单击“操作”列的“修改归属”,弹出“修改归属”对话框,如图1所示。 图1 修改资产归属 从下拉框中选择资产归属用户名称,单击“确认归属”。
单击“定制数字人”,可以定制自己需要的数字人形象。 用户自定义的Flexus分身数字人,也会展示在这里。Flexus分身数字人左上角会有标识。 背景:背景图片列表,可本地导入图片。支持透明背景、纯色背景或导入图片。 PPT:PPT文件列表,需要用户从本地导入后使用。 贴图:各类
输入问答机器人ID。可在CBS控制台“智能问题机器人”页面查看,详见图2。 CBS委托站点 从下拉框中选择站点,即用户购买CBS问答机器人所在Region。 授权 需要授权MetaStudio访问CBS。首次授权的站点,需开启授权开关。 执行开启授权操作,界面会弹出获取访问权限对话框,如图2所示。单击“同
strings 音频上传的地址。 说明: 通过该obs地址上传时需要设置content-type为audio/wav txt_uploading_url Array of strings 文本上传的地址。 说明: 通过该obs地址上传时需要设置content-type为text/plain 表4
et链接。 须知: 参数返回的地址默认无wss://前缀,实际使用时,需要补齐前缀。示例:如果返回字段内容为metastudio-api.cn-north-4.myhuaweicloud.com:443,则需要拼接为wss://metastudio-api.cn-north-4.myhuaweicloud
文本驱动方式的要求如下所示: 文本输入长度不超过2000字。 通过文本合成的音频时长不能超过5分钟。 在照片数字人制作页面,选择“文本驱动”方式驱动照片说话时,需要输入文本并选择音色,再单击“试听”预估音频时长。如果超过5分钟,会导致照片数字人制作失败。 父主题: 使用限制