检测到您已登录华为云国际站账号,为了您更好的体验,建议您访问国际站服务网站 https://www.huaweicloud.com/intl/zh-cn
不再显示此消息
String 音频文件是否已生成完成。该标记为PROCESSING时,应该每隔3秒再次调用本接口获取音频文件(WAITING 等待中,PROCESSING 处理中,SUCCEED 成功,FAILED 失败) audio_file_url String 音频文件下载链接,有效期为1个小时。
asset_state String 资产状态。 CREATING:资产创建中,主文件尚未上传 FAILED:主文件上传失败 UNACTIVED:主文件上传成功,资产未激活,资产不可用于其他业务(用户可更新状态) ACTIVED:主文件上传成功,资产激活,资产可用于其他业务(用户可更新状态) DEL
总体流程 调用创建资产接口创建资产ID。 调用创建文件并获取上传URL接口创建文件ID,并生成文件上传的URL地址。 使用Postman工具,参考OBS的PUT上传接口,将资产文件上传至URL地址中。 调用确认文件已上传接口,确认文件已上传成功。 操作步骤 单击创建资产,进入MetaStudio服务的API
形象声音授权 上传形象授权书。 操作如下所示: 单击“授权书模板”,将授权书模板下载本地。 打印授权书,由身份证本人完成签署操作。 扫描文件生成pdf文件,或拍摄文件生成jpg、jpeg、png格式的图片。 单击“上传授权书”,从本地选择pdf、jpg、jpeg或png格式的授权书上传。 授权书内容,可参考授权书。
附录 授权书 手机录制音频 客户声音制作案例 第三方平台开播指南 FAQ
、png、bmp、gif,主文件大小不超过50M 背景音乐资产:资产类型为MUSIC,主文件格式(忽略大小写)为wav,mp3,m4a,主文件大小不超过100M 音频资产:资产类型为AUDIO,主文件格式(忽略大小写)为wav,mp3,m4a,主文件大小不超过100M 幻灯片资产
照片建模任务创建失败是什么原因? 照片建模任务出现异常问题怎么办? 风格化照片建模的照片有什么要求? 风格化照片建模生成的模型文件是什么格式? 表情驱动数据格式如何定义? 肢体驱动数据格式如何定义?
分身数字人Flexus版针对中小企业客户,提供1080P的实景数字人、1分钟语料声音克隆能力和120分钟1080P视频制作能力,帮助客户通过手机拍摄即可轻松制作数字人。Flexus分身数字人不仅简化制作流程,还显著降低技术门槛,且购买简单,为中小企业提供超简单、超高性价比数字人。 使用限制
形象拍摄指导文档下载 如需查看拍摄真人视频的PDF文件,请单击形象拍摄指导下载文件。 父主题: 形象制作
声音录制指导文档下载 如需查看真人声音录制的的PDF文件,请单击声音制作录制指导下载文件。 父主题: 声音制作
分身形象和声音制作的处理方式相同,均需根据实际情况进行处理。下面以形象制作为例,进行说明。 如果当前分身形象制作的素材质量不佳,管理员会通过用户提交训练任务时输入的手机号联系用户。用户可以在管理员驳回任务后重新提交训练视频,进行数字人形象训练。形象制作任务制作完成前,形象制作资源一直处于占用状态,并未真正扣除。
创建语音驱动任务 功能介绍 该接口用于创建驱动数字人表情、动作及语音的任务。 调用方法 请参见如何调用API。 URI POST /v1/{project_id}/ttsa-jobs 表1 路径参数 参数 是否必选 参数类型 描述 project_id 是 String 项目ID,获取方法请参考获取项目ID。
资产创建失败说明 如下创建资产时的异常场景,会导致资产被自动置为失败状态。 超过24小时未上传资产主文件。 资产标题、描述和主文件内容审核失败。 服务校验资产主文件与用户创建的文件信息不匹配。 资产冻结说明 资产冻结说明,如表2所示。 表2 资产冻结说明 场景 操作说明 服务冻结租户资产
形象的数字人驱动模型。 推理阶段输入一段音频。 音频输入至数字人驱动模型后,经过模型推理生成数字人形象播报视频。 数字人视频通过审核后返回给用户。 算法应用场景 分身数字人驱动算法可以应用于真人视频自动生成,包括新闻播报、课件制作等场景,以取代真人视频拍摄,提升视频内容生产效率。
DED:确认训练视频所有分片文件已上传 GET_ACTION_VIDEO_MULTIPART_UPLOADED:获取动作编排视频分片上传地址 CONFIRM_ACTION_VIDEO_MULTIPART_UPLOADED:确认动作编排视频所有分片文件已上传 说明: CONFIRM
服务,已经广泛地应用到了千行百业,通过AI数字人辅助,让每个人都能成为专业的主播。以下是几个行业案例: 信息无障碍研究会致力于推动中国无障碍发展,华为云联合信息无障碍研究会,为听障人士打造分身数字人,让声音重现焕发新生,助力让每个人都能通过科技平等享受现代文明。聋哑画家史晓慧,通
SmartVideoLayerConfig 参数 是否必选 参数类型 描述 video_url 是 String 视频文件的URL。 video_cover_url 否 String 视频封面文件的URL。 display_duration 否 Integer 参数解释: 图片显示时长,单位s。
查询语音训练任务列表 功能介绍 查询语音训练任务列表 调用方法 请参见如何调用API。 URI GET /v1/{project_id}/voice-training-manage/user/jobs 表1 路径参数 参数 是否必选 参数类型 描述 project_id 是 String
errors objects 错误列表。 表4 errors 参数 参数类型 描述 audio_name String 音频文件名。 text_name String 文本文件名。 error_code String 异常错误码。 error_message String 异常错误信息。 表5
第三方用户ID。不允许输入中文。 表3 FormData参数 参数 是否必选 参数类型 描述 file 是 File 照片文件。 说明: 只能上传jpg/jpeg/png格式文件, 最大分辨率为3840*2160 style_id 是 String 数字人风格ID。 system_male_001:男性风格01