检测到您已登录华为云国际站账号,为了您更好的体验,建议您访问国际站服务网站 https://www.huaweicloud.com/intl/zh-cn
不再显示此消息
系MetaStudio服务支持,技术人员会根据唤醒词定制唤醒模型。唤醒模型的定制周期在5个工作日左右,定制唤醒词的上限为8个。 唤醒词的反馈格式,如下所示: 唤醒:你好云笙、云笙你好 打断:稍等一下 退出:谢谢再见 更新唤醒模型 客户获取到MetaStudio定制的唤醒模型后,需
创建角色:在奇妙问创建问答角色。 查看角色信息:查看奇妙问创建角色的RoleId和AppSecret,即MetaStudio平台API调用所需的角色ID和角色密钥。 支持在奇妙问平台查看角色的所有会话记录。 父主题: 创建智能交互数字人(奇妙问)
20次/秒 10次/秒 10次/秒 获取语音文件上传地址 20次/秒 10次/秒 10次/秒 获取语音训练任务审核结果 20次/秒 10次/秒 10次/秒 设置任务批次 10次/秒 3次/秒 3次/秒 确认在线录音结果 10次/秒 3次/秒 3次/秒 获取在线录音确认结果 20次/秒 10次/秒
视频制作界面如图1所示。各区域详细说明,如表1所示。 用户使用数字人形象创作的视频,都会自动保存在MetaStudio控制台首页“最近项目”区域的“视频项目”页签中。用户可以根据实际情况,进行二次创作。 图1 视频制作界面 表1 界面说明 序号 区域名称 说明 1 视频素材区域 设置视频的场景,包括如下内容。视频素材的操作详情,请参考视频制作公共配置。
手机录制音频 请根据手机类型,执行相应操作: 苹果手机操作 安卓手机 苹果手机操作 苹果手机推荐下载软件“简易录音机(Easy Voice Recorder)”进行录音,如图1所示。 图1 简易录音机 音频录制说明,如表1所示。 表1 音频录制说明 音频录制 说明 采样率 推荐使用48kHz采样率录制音频。
地生成SDK安装包的SHA256值。 其中,“D:\HwICSUiSdk-1.0.0.zip”为SDK安装包的本地存放路径及安装包名称,请根据实际情况修改。 certutil -hashfile D:\HwICSUiSdk-1.0.0.zip SHA256 命令执行结果示例,如下所示:
完成实名认证:单击进入实名认证。 账户充值:为确保正常使用MetaStudio,您需要进行账户充值。 开通MetaStudio服务:单击进入MetaStudio控制台,根据开通引导完成服务开通。 IAM权限管理 如果华为云账号无法满足用户的使用诉求,可参考创建用户并授权使用MetaStudio,创建IAM用户,进行精细化的权限管理。
提示模板不可用怎么办? 请根据实际情况判断处理: 如果是自己创建的模板不可用,请检查模板中的资产是否正常,即资产处于激活状态时正常,如果资产取消激活或已删除会导致模板不可用。 如果是分享给我的模板不可用,可能是分享者取消了模板分享,或者模板中的资产状态不正常,即资产已取消激活或被删除。
资产 支持管理资产,详细操作如表1所示。 图2 资产详情 表1 资产管理 操作 说明 查询资产 界面右上角的筛选框中,支持输入资产名称或资产ID,查询资产信息。 重命名资产 单击资产卡片区域的图标,从下拉框中单击“重命名”,对资产进行重命名。 取消激活 单击资产卡片区域的“取消激活
对话项目”页签,如图1所示。 图1 对话项目 找到需要修改的对话项目,单击右侧的“编辑”,进入对话编辑界面,如图2所示。 图中标识“1”处为语言修改配置。请根据实际情况切换语言,目前仅支持中文和英文。 图中标识“2”处为声音切换入口。单击图标,弹出如图3所示的对话框,选择需要切换的声音。 请注意,
由于Chrome等浏览器只支持硬解码H265(HEVC)视频,当您的PC硬件不支持解码H265(HEVC)视频时,Chrome等浏览器将无法播放H265(HEVC)视频,并获取不到视频分辨率等参数。 在Chrome浏览器中输入“chrome://gpu”后,搜索“coding”。可以检查当前PC的浏览器是否支持H265(HEVC)视频解码。
如果包含,直接执行4。 如果不包含,请参考下述操作,购买问答机器人。 单击界面右上方的“购买问答机器人”,进入“购买问答机器人”页面。 请根据实际情况,输入问答机器人名称,选择计费模式、规格、路数和机器人有效期。 单击“立即购买”,进入“订单确认”页面。 单击“去支付”。按照界面提示支付完成。
支持从本地上传模型、PPT、动画、素材、视频、场景、图片和音乐资产。 图2 上传资产 单击“图片”,进入“图片上传”页面,如图3所示。 请根据实际情况,配置下述信息: 资产标题:图片的标题。 图片简介:图片的基本介绍,方便了解和使用。 风格:关键词标签,方便用户搜索此类型的资产。
单击webm2mov,将视频格式转换小工具webm2mov_20240814.rar下载至本地。 下载过程大约耗时3~5分钟,请耐心等待。 如果用户需要自定义工具,可以获取其源码。 本地解压工具包,得到ffmpeg目录和运行文件webm2mov.exe。 双击webm2mov.exe,弹出如图1所示的界面。 图1
分身数字人智能交互 支持购买多路,每路按时长计费。 须知: 智能交互中数字人分身的动作是根据数字分身拍摄形象训练生成的,唇形和文字声音匹配,数字分身和背景融合自然,清晰度1080P。 智能交互根据客户需要,后台提供多种知识库配置,支持配置中英双语。 智能交互基于已有训练生成的数字分
标签关系 可以包含文本,不可以包含其他标签。 示例 1 今天<phoneme ph="tian1 qi4">天气</phoneme>很好 根据汉字获取拼音JS库,操作请参考pinyin-pro。 say-as标签 描述 <say-as></say-as>:将文本指定为特定类型的内容,或者控制英文单词逐个字符拼写。
生成声音,需要在云商店购买出门问问小语种克隆套餐包。 获取第三方声音使用凭证:查看已购套餐包的“用户账号”和“登录密码”,作为MetaStudio控制台第三方声音使用凭证。 出门问问小语种克隆套餐包购买后,也需要参考这里获取凭证。 激活第三方声音使用凭证:在MetaStudio控
3D数字人语音驱动 创建语音驱动任务 获取语音驱动任务列表 创建语音驱动表情动画任务 获取语音驱动表情数据 获取语音驱动数据 父主题: 3D数字人
查询语音训练任务列表 提交语音训练任务 查询语音训练任务详情 删除语音训练任务 查询任务操作日志 获取语音文件上传地址 获取语音训练任务审核结果 设置任务批次 确认在线录音结果 获取在线录音确认结果
语音合成管理 创建TTS试听任务 获取TTS试听文件 创建TTS异步任务 获取TTS异步任务 设置TTS租户级自定义读法配置 获取TTS租户级自定义读法配置 删除TTS租户级自定义读法配置 修改TTS租户级自定义读法配置 语音同步合成WebSocket接口