检测到您已登录华为云国际站账号,为了您更好的体验,建议您访问国际站服务网站 https://www.huaweicloud.com/intl/zh-cn
不再显示此消息
手机录制音频 请根据手机类型,执行相应操作: 苹果手机操作 安卓手机 苹果手机操作 苹果手机推荐下载软件“简易录音机(Easy Voice Recorder)”进行录音,如图1所示。 图1 简易录音机 音频录制说明,如表1所示。 表1 音频录制说明 音频录制 说明 采样率 推荐使用48kHz采样率录制音频。
更新商品 功能介绍 Update product 调用方法 请参见如何调用API。 URI PUT /v1/{project_id}/products/{product_id} 表1 路径参数 参数 是否必选 参数类型 描述 project_id 是 String 项目ID,获取方法请参考获取项目ID。
更新分身数字人模型训练任务 功能介绍 该接口用于更新分身数字人模型训练任务。用于在自动审核或者人工审核不通过情况下,更新训练视频、身份证照片等。 该接口只能在AUTO_VERIFY_FAILED或者MANUAL_VERIFY_FAILED状态下调用 调用方法 请参见如何调用API。
更新数字人名片制作 功能介绍 该接口用于更新数字人名片制作任务。 调用方法 请参见如何调用API。 URI PUT /v1/{project_id}/digital-human-business-cards/{job_id} 表1 路径参数 参数 是否必选 参数类型 描述 project_id
更新第三方直播平台信息 功能介绍 该接口用于更新第三方直播平台信息。 调用方法 请参见如何调用API。 URI PUT /v1/{project_id}/live-platforms/platforms/{platform_id} 表1 路径参数 参数 是否必选 参数类型 描述 project_id
男 TTS V9 - 英文 更新 Emma 女 TTS V9 - 英文 更新 2024年12月 表2 声音更新记录 发音人名称 性别 TTS版本 风格 语言 变更方式 对话女生 女 TTS V7 - 中文 更新 广告男声 男 TTS V7 - 中文 更新 教育女声 女 TTS V7
更新智能直播间互动规则库 功能介绍 该接口用于更新智能直播间互动规则库。 调用方法 请参见如何调用API。 URI PUT /v1/{project_id}/smart-live-interaction-rule-groups/{group_id} 表1 路径参数 参数 是否必选
更新视频制作剧本 功能介绍 该接口用于更新视频制作剧本。 调用方法 请参见如何调用API。 URI PUT /v1/{project_id}/digital-human-video-scripts/{script_id} 表1 路径参数 参数 是否必选 参数类型 描述 project_id
更新智能直播间信息 功能介绍 该接口用于智能直播间信息。 调用方法 请参见如何调用API。 URI PUT /v1/{project_id}/smart-live-rooms/{room_id} 表1 路径参数 参数 是否必选 参数类型 描述 project_id 是 String
MOBILE: 手机端 HUB: 大屏 room_id String 对话ID。 create_time String 智能交互对话创建时间,格式遵循:RFC 3339 如“2021-01-10T08:43:17Z”。 update_time String 智能交互对话更新时间,格式遵循:RFC
device_names 否 Array of strings 参数解释: 已执行编译任务设备类型列表。 约束限制: 支持走动的数字人,当前仅用于视频制作,不能用于直播和智能交互 取值范围: 设备名称列表最多16个。 设备名称字符长度1-64位。 默认取值: false is_with_action_library
分身形象和声音制作的处理方式相同,均需根据实际情况进行处理。下面以形象制作为例,进行说明。 如果当前分身形象制作的素材质量不佳,管理员会通过用户提交训练任务时输入的手机号联系用户。用户可以在管理员驳回任务后重新提交训练视频,进行数字人形象训练。形象制作任务制作完成前,形象制作资源一直处于占用状态,并未真正扣除。
Web语音唤醒 产品预置了唤醒能力,详见预制唤醒能力,如果用户需要更新唤醒词,需要参考定制唤醒能力处理。唤醒模型定制完成后,产品会提供给用户,用户需要参考更新唤醒模型,将模型更新至本地模型路径中。 使用要求 WebSDK版本为3.0.1及以上。 仅支持数字人平台配置或内置ASR(
例所示。 录音准备 表1 录音准备 声音类型 录制设备和软件 录音环境 录音文案 基础版 优先使用专业录音设备录制音频,推荐使用Adobe Audition软件进行录音。 如果不具备专业录音设备,可使用手机录制音频,详情请参见手机录制音频。 录音环境安静,无回音、混响、噪声,避免出现汽车鸣笛、他人说话、走动等杂声。
由于浏览器的安全策略限制,仅支持通过“https://域名”方式访问,否则无法正常加载运行智能交互WebSDK。 表2 浏览器适配详情 操作系统类型 浏览器类型 浏览器版本 Windows Chrome浏览器 91+ Edge浏览器 80+ Android 移动版Chrome浏览器 91+ iOS 移动版Safari浏览器
演讲过程中不限制说话的内容,出现失误可直接略过或从错误位置继续说话,无需打断拍摄。 背景尽量维持静态,不能出现规律性或大幅度的背景变化。 画面保持稳定,建议使用手机支架或手机稳定器。 在光线充足的地方拍摄,避免出现脸部光照不均匀或“阴阳脸”。 父主题: Flexus分身数字人
智能交互限制 智能交互对硬件设备的最低配置要求,如表1所示。 表1 硬件设备要求 硬盘配置 最低配置 CPU i5及以上版本。 内存 8G以上。 硬盘 128G及以上。 操作系统 Windows或Android系统。 麦克风 需要有麦克风,且要保障1米以内的拾音效果。 扬声器 需要有扬声器。
附录 授权书 手机录制音频 客户声音制作案例 第三方平台开播指南 FAQ
女声 基础版媒体1.wav 基础版媒体2.wav 支持手机录制20条语料音频(5分钟),1-3天制作,快速获得类真人音色,mos分3.8。 短视频制作 进阶版声音制作 女声 进阶版媒体1.wav 进阶版媒体2.wav 支持手机录制100条语料音频(15分钟),1-3天制作,获得高还原度音色,mos分4
分身数字人Flexus版针对中小企业客户,提供1080P的实景数字人、1分钟语料声音克隆能力和120分钟1080P视频制作能力,帮助客户通过手机拍摄即可轻松制作数字人。Flexus分身数字人不仅简化制作流程,还显著降低技术门槛,且购买简单,为中小企业提供超简单、超高性价比数字人。 使用限制