检测到您已登录华为云国际站账号,为了您更好的体验,建议您访问国际站服务网站 https://www.huaweicloud.com/intl/zh-cn
不再显示此消息
操作步骤 登录MetaStudio控制台。 在左侧导航栏中,单击“我的创作”。 选择“分身名片”页签,如图1所示。 在“分身名片”页面,可以看到已生成的名片列表,以卡片形式排列展示。 支持对名片进行如下操作: 单击,查看分身数字人的语音表达形态。 单击“下载”,将名片下载至本地查看。下载后的文件为mp4格式。
用户使用视频直播或智能交互接口调用音色时,需要先确认能否在MetaStudio控制台的视频直播间编辑界面或智能交互对话设置页面,选到当前音色。 如果界面正常展示且可以选择此音色使用,说明接口可以正常调用此音色,否则接口无法调用。 API流控 数字内容生产线服务对服务端API设置了调用次数限制,避免出现短时间内重复调用API,服务中断的情况。
用户提问结束后,大模型搜索答案进行回复,可能会有延迟。为避免不好的体验,可以配置安抚话术,及时安抚用户情绪,耐心等待回复。 开启安抚话术后,可以看到“通用安抚话术”。系统预置30个话术,需要单击“添加话术”,一一添加系统预置话术,也可以修改为自己的描述。 还需配置下述参数: 触发时长:设置通用
创建声音制作任务(自研模型) MetaStudio已经预置了各种类型的声音,可以在视频制作界面或视频直播界面查看。如果预置声音仍无法满足用户需求,可使用自研模型自定义生成声音。 操作限制 MetaStudio不支持个人用户定制声音,仅支持企业用户。 定制声音时,从平台下载的授权书
s/releases。 ffmpeg解压后,将其下bin目录加入系统环境变量。 输入命令行ffmpeg后可以显示版本号,说明安装成功。 解决方法 通过剪映或者ffmpeg可以将H265(HEVC)视频的格式转码为H264,再上传至MetaStudio控制台,进行形象制作。 以ffmpeg为例,输入命令行:ffmpeg
页签中,可直接使用。 直播画面创作完成后,需要制作剧本。 服务有预置文本,可以直接使用,如图8所示。用户也可以根据实际场景自定义文本内容,并单击图标,新增段落。 图8 文本驱动 如果还需要制作多场景,可以单击直播画面预览窗口右侧“场景1”小窗口下方的“+”图标,新增场景,并参考前
单击“管理技能配置”,在弹出的“配置应用需要的技能”对话框中,设置需要的系统预置技能,如图7所示。 示例:可以开启“生活”分类中的“天气”技能,这样用户就可以提问天气相关的问题。启用这类预置技能,可以支持用户进行闲聊。 图7 系统预置技能 全部设置完成后,单击对话框右上角的“保存配置”。 开启讯飞的闲聊功能。
互动管理 分身视频直播首页面的“互动管理”页签,支持新增互动库,及其相应的互动规则。互动库可以直接在直播间中导入使用。 操作步骤 登录MetaStudio控制台。 在“工作台”界面,单击“分身视频直播”下方的“开始创建”,进入分身数字人直播首页面。 单击“互动管理”,进入如图1所示的页面。
如需收回当前租户的资源,可单击租户右侧的“查看详情”,进入“租户详情”页面,如图5所示。 在下方的“资源列表”中,可以找到已分配的“分身数字人形象制作”资源。 图5 租户详情 单击资源右侧的“回收”,弹出“回收资源”对话框,如图6所示。 可以看到资源名称、可回收量、分配时间和到期时间。 图6 回收资源 根据实际情况,
单击“管理技能配置”,在弹出的“配置应用需要的技能”对话框中,设置需要的系统预置技能,如图13所示。 示例:可以开启“生活”分类中的“天气”技能,这样用户就可以提问天气相关的问题。启用这类预置技能,可以支持用户进行闲聊。 图13 系统预置技能 全部设置完成后,单击对话框右上角的“保存配置”。 开启讯飞的闲聊功能。
过64个字符。 一个技能可以最多添加40个问答对。 单击界面右上方的“保存”,界面左侧的“问答列表”中新增一个问答项,示例如图5所示。 图5 添加问答 请参考7~8,依次录入所有问答。 单击界面右上方的“导出”,将技能文件下载至本地,待后续使用。 也可以使用下述方式,导出技能文件。
购买资源 用户可以使用SP账号购买资源包。对SP账号开放购买的资源包,普通用户不可见。 所有资源的购买操作均相同,下面以“分身数字人形象制作”为例,进行操作演示。 前提条件 当前用户已拥有SP账号。 操作步骤 使用SP用户登录华为云控制台,单击界面左上角的图标,在弹出的服务列表界面中,搜索并单击“数字内容生产线
单击webm2mov,将视频格式转换小工具webm2mov_20240814.rar下载至本地。 下载过程大约耗时3~5分钟,请耐心等待。 如果用户需要自定义工具,可以获取其源码。 本地解压工具包,得到ffmpeg目录和运行文件webm2mov.exe。 双击webm2mov.exe,弹出如图1所示的界面。
“饭了么”,需要将两条通知的text值拼接在一起才是完整的内容。 文本问答的用法 智能交互默认是语音问答,如需使用文本问答,需要切换模式。可以通过下述2种方式处理: 在开始对话时设置。使用startChat接口开启对话时,设置成文本问答模式,如下所示: const { result
(可选)创建对话,操作请参考对话。 单击界面右上角的“发布”,发布数字人智能交互对话。 发布成功后,自动跳转至与数字人智能互动页面,可以体验与数字人互动的效果。也可以复制数字人互动页面的网址,分享给其他用户使用。 获取数字人互动页面URL的方式还有:进入“我的创作 > 智能交互 > 对话项
您设备的相应权限。您可以在客户应用或浏览器的设置功能中查看权限状态,并可自行选择开启或关闭部分或全部权限。 客户在集成、使用相应开放能力时,将自行决定权限的调用范围,因此客户应对权限的调用及用途向您进行说明。您根据客户应用的请求开启任一权限即代表授权我们可以处理相关个人信息来为您
对话框中,单击“确认”。 界面提示“资产已激活”,说明资产已激活成功。用户可以在“已激活”页签中查看已激活的分身模型资产。 图4 激活资产 完成上述操作后,声音和分身模型资产已经在当前账号下生效,用户可以使用已激活的资产进行视频制作或视频直播。 父主题: 资产管理
使用照片人像合成视频名称。 02 录入播报内容 选择一种方式,生成播报内容 提供下述种方式,生成照片数字人播报内容。 播报内容生成后,单击右侧的“试听”,可以试听播报效果。 语音上传:本地录制音频后上传。音频格式需要为WAV或MP3格式,音频大小不超过20MB,时长不超过5分钟。 在线录音:在线
进入问答机器人“数据总览”页面,如图3所示 图3 问答机器人 在左侧导航栏中,选择“知识库 > 问答管理”,进入“问答管理”页面,如图4所示。 图4 问答管理页面 用户可以选择下述一种方式,逐个新建问题分类及其语料,或者批量导入问题类别及其语料。 方式一:逐个新建问题分类及其语料。 单击图标,弹出“新建问题类别”对话框。
对话框中,单击“确认”。 界面提示“资产已激活”,说明资产已激活成功。用户可以在“已激活”页签中查看已激活的分身模型资产。 图4 激活资产 完成上述操作后,声音和分身模型资产已经在当前账号下生效,用户可以使用已激活的资产进行视频制作或视频直播。 父主题: 资产管理