检测到您已登录华为云国际站账号,为了您更好的体验,建议您访问国际站服务网站 https://www.huaweicloud.com/intl/zh-cn
不再显示此消息
定制数字人形象 上传分身数字人训练数据。 界面操作详情,如表1所示。 表1 界面操作说明 区域 参数 说明 分身数字人训练数据上传 角色名称 输入分身数字人的角色名称。 示例:云笙。 训练视频 从本地上传已录制好,且符合拍摄要求的真人人像视频,训练生成数字人形象。 录制的视频要求4K,时长建
本地打开OBS视频采集工具。 在界面上方的导航栏中,选择“文件 > 设置”,弹出“设置”对话框。 在左侧导航栏中,选择“视频”,检查基础分辨率和输出分辨率的取值是否一致。 如果不一致,需要修改为相同的取值。 图1 视频设置 父主题: 视频直播
使用接口查询自研音色ID 支持使用查询资产列表接口,查询音色ID。需要设置如下参数: offset=0:从第一个音色开始查询,可以根据实际情况设置。 limit=60:一次可以查询的声音数据,可以根据实际情况设置。 asset_type=VOICE_MODEL:资产类型为音色模型。
说明,详见计费说明。 关联租户:仅SP用户有此入口。单击“关联租户”,进入“关联租户”信息配置界面。输入租户所在区域的项目ID和租户名称,租户名称支持自定义。单击“创建”,租户新增完成。 我的资源(租户) 租户在“我的资源”区域,可以看到资源剩余量详情,如表1所示。 也可以单击左
支持文本问答。 startChat新增入参,参考表15,用来设置交互模式(语音问答/文本问答)。 新增接口activeInteractionMode、interactionModeSwitch、sendTextQuestion,用来获取和设置当前交互模式(语音问答或文本问答),以及发送问题文本。
理: 在开始对话时设置。使用startChat接口开启对话时,设置成文本问答模式,如下所示: const { result } = await HwICSUiSdk.startChat({ interactionMode: 'TEXT' }); 在对话过程中设置。如果已经调用st
支持流式文本消息。seq为流式文本序号,从1开始计数;is_last用于判断流式文本的最后一包数据。如果不使用流式文本消息,seq设置为“1”,is_last设置为“true”。 建议每个分包数据长度大于6个字,否则可能会导致数字人说话卡顿。 详细交互流程如下所示: 用户发送文本驱动消息。
为保证名片的效果展示,请保持合理的输入长度。 LOGO(选填) 可选。支持上传png、jpg、jpeg格式的logo图片。 logo图片的设置方式与头像相同。 单击“生成名片”,名片开始生成。 界面会显示名片生成进度,如图3所示。 单击图中第一个链接“任务中心-分身名片”,可进入“任务中心
和智能交互,主要是生成画面内容。也可以直接通过静态的人脸照片生成视频,对应功能为照片数字人。 功能详情,如表1所示。 表1 功能特性 功能名称 功能描述 形象制作 拍摄真人视频,建模生成数字人形象。 数字人形象可用于生成音视频内容,应用于视频制作、视频直播和智能交互。 须知: 制
视频直播 视频直播界面说明 视频直播 互动管理 商品管理 直播任务管理 智能交互设置 视频直播公共配置
选择“基础版声音制作”,音频格式为WAV或MP3文件。需整段录制,每句之间有2~3秒的停顿。音频时长3~10分钟,建议5分钟。 请完善声音信息 输入声音名称,示例:欢快女声。 请制作声音 使用“语料上传”的方式,直接上传一个已录制好的长音频WAV或MP3文件,无需压缩,无需携带文案txt文件。
查询语音训练任务列表 提交语音训练任务 查询语音训练任务详情 删除语音训练任务 查询任务操作日志 获取语音文件上传地址 获取语音训练任务审核结果 设置任务批次 确认在线录音结果 获取在线录音确认结果
低的延迟, 为物联网、智能城市和工业自动化等应用打下了基础。 区块链技术正在改变金融、供应链和数字资产交易等领域, 许多国家和企业都在探索如何应用区块链技术来提高效率和安全性。 全球对可再生能源的需求增加,太阳能和风能等清洁能源的使用呈现快速增长, 可持续发展目标推动了绿色科技和环境保护的创新。
S_FAILED、JOB_SUCCESS、WAIT_USER_CONFIRM、JOB_REJECT、JOB_FINISH 调用方法 请参见如何调用API。 URI DELETE /v1/{project_id}/digital-human-training-manage/user/jobs/{job_id}
录制过程中,每句之间有2~3秒的停顿。 其中,进阶版和高品质声音制作需要更多语料,训练时长更长,声音效果更佳。 请完善声音信息 输入声音名称。 示例:欢快女声。 请制作声音 制作声音的方式为“语料上传”。界面提供录音指导,需要按照指导,录制生成一个符合时长要求的基础版、进阶版或
操作前提 注册操作 注册华为账号:单击进入注册页面。 完成实名认证:单击进入实名认证。 账户充值:为确保正常使用MetaStudio,您需要进行账户充值。 开通MetaStudio服务:单击进入MetaStudio控制台,根据开通引导完成服务开通。 IAM权限管理 如果华为云账号
需计费。 如需使用第三方声音进行语音合成,请购买出门问问声音套餐,操作请参考《用户指南》的“购买出门问问声音套餐”章节。 调用方法 请参见如何调用API。 URI POST /v1/{project_id}/ttsc/async-jobs 表1 路径参数 参数 是否必选 参数类型
在“照片数字人”页面,可以查看全部生成的视频,包括生成中、生成成功和生成失败的任务。 在下方的视频列表中,可以查看视频详情,包括视频封面、名称、任务ID、生成时间、状态。 支持对视频进行如下操作: 单击“查看”,进入“我的创作 > 视频”页面,可以查看视频详情,如查看视频所示。
选择“分身名片”页签,如图1所示。 在“分身名片”页面,可以查看全部任务,包括生成中、生成成功和生成失败的任务。 在下方的名片列表中,可以查看名片详情,包括名片封面、名称、任务ID、提交时间、生成时间、状态等信息。 支持对名片进行如下操作: 单击“查看”,进入“我的创作 > 分身名片”页面,可以查看名片详情,如查看名片所示。
command取值为START时,为必填项。 job_id 否 String body 请求标识ID,用于跟踪请求。 建议每次合成请求时,设置不同的值。 config 否 Conifg body 配置参数。 command取值为START时,为必填项。 表2 Config结构体 参数