检测到您已登录华为云国际站账号,为了您更好的体验,建议您访问国际站服务网站 https://www.huaweicloud.com/intl/zh-cn
不再显示此消息
界面提供录音指导,需要按照指导录制1分钟的长音频WAV或MP3文件。WAV或MP3文件支持直接上传,无需压缩,无需携带文案txt文件。 如果未使用服务预置文案,声音标签仅作为标签,来区分声音使用场景。 请选择声音性别 声音的性别,用于匹配声音模型的精准度。 如下所示: 男生 女生 请选择原始输入语言
可以被称之为虚拟形象、数字虚拟人、虚拟数字人等。数字人的核心技术主要包括计算机视觉、计算机图形学、动作捕捉和驱动、图像渲染和人工智能等。 服务型数字人:利用深度神经网络进行图像合成、高度拟真的虚拟人。 具备如下特点: 2D模型,通过拍摄真人视频训练生成 无表情&骨骼数据 只能由AI驱动
参数类型 描述 X-Auth-Token 否 String 用户Token。使用Token鉴权方式时必选。 通过调用IAM服务获取用户Token接口获取。 响应消息头中X-Subject-Token的值。 Authorization 否 String 使用AK/SK方式认证时必选,携带的鉴权信息。
训练。形象制作任务制作完成前,形象制作资源一直处于占用状态,并未真正扣除。 已经制作完成的形象制作任务,对应的形象制作资源已扣除。原则上非服务问题,不支持重新训练。如有软件问题,可以提交工单处理,并提供形象制作任务ID和重训练原因。产品会对实际情况进行核实,并对满足条件的进行处理。
参数类型 描述 X-Auth-Token 否 String 用户Token。使用Token鉴权方式时必选。 通过调用IAM服务获取用户Token接口获取。 响应消息头中X-Subject-Token的值。 Authorization 否 String 使用AK/SK方式认证时必选,携带的鉴权信息。
参数类型 描述 X-Auth-Token 否 String 用户Token。使用Token鉴权方式时必选。 通过调用IAM服务获取用户Token接口获取。 响应消息头中X-Subject-Token的值。 Authorization 否 String 使用AK/SK方式认证时必选,携带的鉴权信息。
参数类型 描述 X-Auth-Token 否 String 用户Token。使用Token鉴权方式时必选。 通过调用IAM服务获取用户Token接口获取。 响应消息头中X-Subject-Token的值。 Authorization 否 String 使用AK/SK方式认证时必选,携带的鉴权信息。
bleLocalWakeup参数来开启Web语音唤醒能力。 定制唤醒能力 如果客户希望使用体现企业文化的唤醒词,需联系MetaStudio服务支持,技术人员会根据唤醒词定制唤醒模型。唤醒模型的定制周期在5个工作日左右,定制唤醒词的上限为8个。 唤醒词的反馈格式,如下所示: 唤醒:你好云笙、云笙你好
新闻播报风格文案 大家好,欢迎收听今天的新闻播报。我是主持人小A。现在为您带来最新的国内外要闻。 首先是国内新闻。 我们先来关注一下生活类新闻, 近年来,随着健康意识的提升,全国范围内的健身热潮愈发火爆。 从早晨的广场舞到晚上的健身房,人们纷纷加入到各种形式的健身运动中。 专家表
式文件,每句之间有2~3秒的停顿。WAV或MP3格式文件可直接上传MetaStudio控制台,无需压缩,无需提供语料txt文件。 推荐使用服务预置语料,也可自定义语料。系统会自动根据停顿做切割,自动识别文本内容。 音频文件命名无要求,可自定义,命名示例:Voice.wav。 进阶版
CreateOnceCode接口需要在后台调用,不能在浏览器直接调用,否则有跨域问题。 serverAddress 是 - string 智能交互服务端地址。 不同Region的取值如下所示: 华北-北京四:metastudio-api.cn-north-4.myhuaweicloud.com
Explorer的代码示例页签,可生成自动对应的SDK代码示例。 状态码 状态码 描述 202 处理成功返回。 400 请求传参异常,包含错误码及对应描述。 500 内部服务错误。 错误码 请参见错误码。 父主题: 3D数字人语音驱动