检测到您已登录华为云国际站账号,为了您更好的体验,建议您访问国际站服务网站 https://www.huaweicloud.com/intl/zh-cn
不再显示此消息
重音位置要合理,避免错误的重音。 阅读发音 按顺序读,确保音字一致。避免漏字多字、发音错误、阅读不流畅等问题。如有这些问题,需重新录制。 内容要求 不能使用短音频复制拼接成长音频,会影响训练效果,无法通过审核。 录制提交 表3 录音内容提交规范 声音类型 音频说明 音频命名 基础版
Acceptable 服务器无法根据客户端请求的内容特性完成请求。 407 Proxy Authentication Required 请求要求代理的身份认证,与401类似,但请求者应当使用代理进行授权。 408 Request Timeout 服务器等候请求时发生超时。 客户端可
服务管理员会根据用户反馈的问题,重新优化数字人形象。 数字人定制任务,会重新进行模型训练。等待模型训练完成后,用户可以二次审验,继续4的操作,直至生成符合要求的分身数字人形象。 此时,在“我的创作 > 分身形象”页面,可以看到新增的数字人形象卡片,如图3所示。也可以在MetaStudio控制台首
刻自己的真人形象和声音,全程手机录制无需专业相机和专业绿幕环境。 高性价比 不到千元即可完成形象、声音定制,性价比超越业界。 应用场景 华为云Flexus版数字人为中小企业提供了一种高效、经济的解决方案,覆盖了教育、医疗、广电传媒和电商等多个行业场景。中小企业对换背景诉求较低,F
要更新唤醒词,需要参考定制唤醒能力处理。唤醒模型定制完成后,产品会提供给用户,用户需要参考更新唤醒模型,将模型更新至本地模型路径中。 使用要求 WebSDK版本为3.0.1及以上。 仅支持数字人平台配置或内置ASR(语音转文本)能力的方案。不支持WebSocket接口驱动数字人方案,即文本驱动方案。
声音授权签署文件。 操作步骤 登录MetaStudio控制台。 单击“声音制作”下方的“开始创建”,进入声音制作页面。 图1 定制声音 在“华为模型”页签,配置声音制作参数。 界面操作详情,如表1所示。 表1 界面操作说明 区域 说明 声音制作方式 选择“基础版声音制作”,音频格式
支持上传自己产品图、企业logo等等。 感兴趣的小伙伴,可以点击直播下方的购物车抢购。 我看见又有很多新的小伙伴进来咱们的直播间了,今天我们这里是万兴播爆“AI用得好,职场没烦恼”万兴播爆+万兴喵影专属直播间,欢迎刚进来的小伙伴。 如果你觉得今天的直播内容有趣或者有用,别忘了把直
{URI-scheme}://{Endpoint}/{resource-path}?{query-string} 尽管请求URI包含在请求消息头中,但大多数语言或框架都要求您从请求消息中单独传递它,所以在此单独强调。 表1 URI中的参数说明 参数 描述 URI-scheme 表示用于传输请求的协议,当前所有API均采用HTTPS协议。
查看界面右侧的“互动问答”页签,如图1所示。 参数配置说明如表1或表2所示。 图1 创建应用 表1 创建应用 参数 说明 第三方应用 从下拉框中选择“华为云CBS”。 需已完成配置对话机器人服务CBS。 应用名称 用户根据实际情况自定义即可。 问答机器人ID 输入问答机器人ID。可在CBS控制
name 是 String 应用名称。 app_type 是 Integer 对接第三方应用厂商类型。 说明: 0:科大讯飞AIUI;1:华为云CBS;2:科大讯飞星火交互认知大模型;5:第三方驱动;6:第三方语言模型;8:奇妙问 取值范围: 0-32 room_id 否 String
对接第三方应用厂商类型。 说明: 0:科大讯飞AIUI;1:华为云CBS;2:科大讯飞星火交互认知大模型;6:第三方语言模型;8:奇妙问 取值范围: 0-32 huawei_ei_cbs 否 HuaweiEiCbs object 华为云CBS应用配置 iflytek_aiui_config
name 否 String 应用名称。 app_type 否 Integer 对接第三方应用厂商类型。 说明: 0:科大讯飞AIUI;1:华为云CBS;2:科大讯飞星火交互认知大模型;5:第三方驱动;6:第三方语言模型;8:奇妙问 取值范围: 0-32 room_id 否 String
ack font_size 否 Integer 参数解释: 字体大小。接口的取值范围为0-120,实际业务使用的取值范围要求为24-120,请以业务实际使用要求为准。 约束限制: 不涉及。 取值范围: 0-120 默认取值: 54 h 否 Integer 参数解释: 字幕框高度。
图2 制作名片 表1 参数说明 区域 参数 说明 请填写数字人信息 上传头像 需提前准备一张正面清晰且无遮挡的数字人形象照片,并满足如下要求: 图片格式:png、jpg、jpeg、webp。 单击“查看示范”,查看正确示范和错误示范。 界面操作如下所示: 单击“头像区域”,从本地选择分身数字人头像图片。
随着互联网和电子商务的发展,农村电商在带动农产品销售方面发挥了积极作用。 越来越多的农民通过电商平台直接销售自己的农产品,打破了传统销售渠道的限制,提高了农产品的附加值和竞争力。 同时,消费者也能够更加方便地购买到优质的农产品,促进了城乡间的农产品流通。 随着疫情逐步控制,我国旅游业迎来了复苏的曙光。
ack font_size 否 Integer 参数解释: 字体大小。接口的取值范围为0-120,实际业务使用的取值范围要求为24-120,请以业务实际使用要求为准。 约束限制: 不涉及。 取值范围: 0-120 默认取值: 54 h 否 Integer 参数解释: 字幕框高度。
HarmonyOS_Sans_SC_Black font_size Integer 参数解释: 字体大小。接口的取值范围为0-120,实际业务使用的取值范围要求为24-120,请以业务实际使用要求为准。 约束限制: 不涉及。 取值范围: 0-120 默认取值: 54 h Integer 参数解释: 字幕框高度。 约束限制:
面,如图2所示。 界面操作详情,如表1所示。 图2 形象制作页面 表1 界面操作说明 参数 说明 训练视频 从本地上传已录制好,且符合拍摄要求的真人实景视频,训练生成Flexus数字人形象和Flexus声音。 录制的视频时长1~5分钟,建议2分钟,分辨率需≥1080P(4K最佳)
触发时长:设置通用安抚话术的触发时间,在这时间之前如果答案未生成,则播报此安抚话术。 高级设置:根据意图自定义安抚话术。默认不开放,如需使用,请提交工单申请开通,并提供需要使用的第三方应用名称。 单击“添加意图及话术”,新增“意图1”配置框。 需配置下述参数: 意图1:从下拉框中选择意图,这里
HarmonyOS_Sans_SC_Black font_size Integer 参数解释: 字体大小。接口的取值范围为0-120,实际业务使用的取值范围要求为24-120,请以业务实际使用要求为准。 约束限制: 不涉及。 取值范围: 0-120 默认取值: 54 h Integer 参数解释: 字幕框高度。 约束限制: