检测到您已登录华为云国际站账号,为了您更好的体验,建议您访问国际站服务网站 https://www.huaweicloud.com/intl/zh-cn
不再显示此消息
Array of strings 音频上传的地址。 说明: 通过该obs地址上传时需要设置content-type为audio/wav txt_uploading_url Array of strings 文本上传的地址。 说明: 通过该obs地址上传时需要设置content-type为text/plain
PPT文件解析失败,无法上传怎么办? 需要排查是否是下述原因导致: PPT大小超过100M。 PPT内部包含很多媒体文件,导致PPT的压缩比过大。 PPT动画等内容过于复杂。 建议排查修改后,重新上传大小内容均合理的PPT。 父主题: 视频制作
如何自定义域名方式访问智能交互页面? 用户与数字人进行智能交互的URL页面,默认为IP地址形式。如果用户希望通过域名访问,目前MetaStudio服务提供了A记录的域名,但是这些A记录域名不能在浏览器直接访问,需要用户自己申请备案一个域名,并通过CNAME方式解析到如下域名上。 华东-上海一:metastudio-client
视频制作 上传图片时提示像素超标怎么办? 贴图支持动态图片吗? PPT如何转为PDF文件? 如何呈现PPT的动画效果? PPT文件解析失败,无法上传怎么办? 上传的PPT支持编辑吗? 视频合成失败如何处理? 如何将WEBM视频转成MOV格式? 合成的视频可以下载至本地吗? 合成视频二次剪辑后,数字人口型效果变差?
智能交互SDK从哪里下载? 下载地址,详见下载SDK安装包。 父主题: API和SDK使用
None 特性讲解 数字内容生产线 MetaStudio产品介绍 17:43 详细了解MetaStudio服务 服务访问路径 数字内容生产线 访问MetaStudio服务 00:50 访问MetaStudio服务 声音制作和形象制作 声音制作 操作指导 00:50 分身数字人声音制作操作指导
提供下述2种方式开播: 从直播平台获取推流地址。获取方式各平台入口不一,建议咨询对应的直播平台。在MetaStudio服务这里仅需输入推流地址,即可直推平台。 推流即RTMP直推,华为云服务器直接把画面传到直播平台服务器,不需要用户一直打开控制台。 如果直播平台无法提供推流地址,可通过窗口捕获方式开播。
确认在线录音结果 功能介绍 确认在线录音结果。 调用方法 请参见如何调用API。 URI POST /v1/{project_id}/voice-training-manage/user/training-segment 表1 路径参数 参数 是否必选 参数类型 描述 project_id
提供下述2种方式开播: 从直播平台获取推流地址。获取方式各平台入口不一,建议咨询对应的直播平台。在MetaStudio服务这里仅需输入推流地址,即可直推平台。 推流即RTMP直推,华为云服务器直接把画面传到直播平台服务器,不需要用户一直打开控制台。 如果直播平台无法提供推流地址,可通过窗口捕获方式开播。
视频制作 环境准备 已安装SDK。 场景说明 该场景通过示例代码,介绍了如何使用MetaStudio Java SDK来实现数字人视频制作功能。 建模示例 详情请参考数字人视频制作。
视频制作 MetaStudio服务支持制作数字人视频。 操作步骤 登录MetaStudio控制台。 在“工作台”界面,单击“分身视频制作”下方的“开始创建”。 进入视频制作界面,界面详情如图1所示。 图1 视频制作界面 在画布区域,设置角色、背景、贴图、视频等内容。 详细操作请参见视频制作素材操作详情。
视频制作 用户可以使用MetaStudio控制台首页的“分身视频制作”功能,制作数字人视频。 操作前准备 如果系统预置形象不满足要求,请参考形象制作,提前定制符合要求的分身数字人形象。 操作限制 MetaStudio控制台预置形象的有效使用期为3年,在2027年的年中前可放心使用
成。 支持新增、复制场景,并为每个场景设置对应的数字人形象、背景、声音等内容。 支持新增、复制段落,或使用txt格式文本导入剧本,平台自动解析输入内容。 直播剧本包含下述设置: 剧本驱动 支持下述三种方式任选其一: 文本驱动:输入文本,通过文本驱动数字人说话。 音频驱动:上传音频,通过音频驱动数字人说话。
OutputInfo 参数 参数类型 描述 face_addr String 面部表情输入地址。 body_addr String 身体动作输入地址。 audio_addr String 音频输入地址。 session_id Integer 会话ID。 取值范围: 0-4294967295
参数 是否必选 参数类型 描述 face_addr 否 String 面部表情输入地址。 body_addr 否 String 身体动作输入地址。 audio_addr 否 String 音频输入地址。 session_id 否 Integer 会话ID。 取值范围: 0-4294967295
OutputInfo 参数 参数类型 描述 face_addr String 面部表情输入地址。 body_addr String 身体动作输入地址。 audio_addr String 音频输入地址。 session_id Integer 会话ID。 取值范围: 0-4294967295
audio_uploading_url Array of strings 音频上传的地址。 通过该obs地址上传时,需设置content-type为audio/wav txt_uploading_url Array of strings 文本上传的地址。 通过该obs地址上传时需设置content-type为text/plain
文件上传地址,有效期为24小时)的值,待后续步骤使用。 图2 接口页面 参考OBS的PUT上传接口,上传资产文件至2中返回的upload_url(文件上传地址,有效期为24小时)中,如图3所示。 详细操作说明,如下所示: 在Postman工具中,将upload_url地址作为请求地址,使用PUT方式上传。
400 MSS.47010131 第三方语言模型地址为空 第三方语言模型地址为空 请携带正确的第三方语言模型地址字段 400 MSS.47010134 第三方语言模型地址非法 第三方语言模型地址非法 请配置正确的第三方语言模型地址 400 MSS.47010135 尾静音时长不合法
稿四:春江花月夜 《春江花月夜》是唐代诗人张若虚的代表作之一,以下是《春江花月夜》的原文以及解析。 原文: 春江潮水连海平,海上明月共潮生。 滟滟随波千万里,何处春江无月明! 江流宛转绕芳甸,月照花林皆似霰; 空里流霜不觉飞,汀上白沙看不见。 江天一色无纤尘,皎皎空中孤月轮。 江畔何人初见月?江月何年初照人?