内容选择
全部
内容选择
内容分类
  • 学堂
  • 博客
  • 论坛
  • 开发服务
  • 开发工具
  • 直播
  • 视频
  • 用户
时间
  • 一周
  • 一个月
  • 三个月
  • 语音合成

    语音合成 支持“华北-北京一”、“华北-北京四”、“华东-上海一”区域。 仅支持中文,文本不长于500个中文字。 支持合成采样率8kHz、16kHz。 父主题: 使用限制

  • 数字人语音驱动

    数字人语音驱动 该场景示例代码以数字人语音驱动为例,介绍如何使用MetaStudio Java SDK将输入的文本数据转换为驱动数字的表情基系数和肢体动作数据。

  • 语音转换测试

    作者: yd_210684270
    327
    0
  • 离线语音识别与在线语音识别的区别

    原因很简单,因为你所测试的是科大讯飞在线语音识别模块,而我们的是离线的语音识别模块。

    作者: aiot_bigbear
    发表时间: 2022-09-24 16:33:34
    190
    0
  • 语音采集】基于matlab语音采集及处理【含Matlab源码 1737期】

    4 设计原理及步骤 4.1 语音信号的采集 语音信号是一种模拟信号,首先须经过采样将其转换为数字信号,实质是把连续信号变为脉冲或数字序列。 我们可以用录音软件先录一段wav格式的音频。然后用matlab的audioread函数采集,记住采样频率和采样点。

    作者: 海神之光
    发表时间: 2022-05-28 15:14:43
    336
    0
  • post/speechDetect/index 在线语音识别 - API

    该API属于APIHub22579服务,描述: 通过上传的语音识别,识别语音内容。支持上传完整的录音文件,录音文件时长不超过60秒。

  • RunAudioAssessment 语音评测 - API

    该API属于SIS服务,描述: 口语评测接口,基于一小段朗读语音和预期文本,评价朗读者发音质量。当前仅支持华北-北京四。接口URL: "/v1/{project_id}/assessment/audio"

  • 语音分析】基于matlab语音短时频域分析【含Matlab源码 558期】

    因为语音波是一个非平稳过程,因此适用于周期、瞬变或平稳随机信号的标准傅里叶变换不能用来直接表示语音信号,而应该用短时傅里叶变换对语音信号的频谱进行分析,相应的频谱称为“短时谱”。

    作者: 海神之光
    发表时间: 2022-05-28 18:56:58
    265
    0
  • 启动语音合成

    启动语音合成 您可以根据自己的业务逻辑进行优化、修改rtts.xml前端界面和RttsActivity.class代码,执行RttsActivity.class代码效果如下。 父主题: Android端调用语音交互服务

  • 实时语音识别

    实时语音识别 支持“华北-北京一”、“华北-北京四”、“华东-上海一”区域。 音频采样率8KHz或者16KHz,采样位数8bit或者16bit。 支持中文普通话、方言的语音识别,其中方言包括:四川话、粤语和上海话。

  • 实时语音转换SDK

    请问一下实时语音转换的demo程序怎么重写on_response函数呢?

    作者: 千年之案
    3266
    1
  • 语音识别-声学模型

    DNN应用到语音识别领域后取得了非常明显的效果,DNN技术的成功,鼓舞着业内人员不断将新的深度学习工具应用到语音识别上,从CNN到RNN再到RNN与CTC的结合等等,伴随着这个过程,语音识别的性能也在持续提升,未来我们可以期望将可以和机器进行无障碍的对话。

    作者: 可爱又积极
    发表时间: 2021-09-07 06:46:06
    1977
    0
  • 实时语音转换SDK

    请问一下实时语音转换的demo程序怎么重写on_response函数呢?

    作者: 千年之案
    965
    1
  • 使用Python实现深度学习模型:语音合成与语音转换

    这个系统可以将文本转换语音,并进行语音转换,广泛应用于语音助手、语音导航和语音翻译等领域。希望这篇教程对你有所帮助!

    作者: Echo_Wish
    发表时间: 2024-07-19 08:21:13
    101
    0
  • 什么是语音识别的语音助手?

    语音识别 语音识别是语音助手的核心功能,它可以将用户的语音输入转换为文本。语音识别的精度直接影响语音助手的使用体验。 语音合成 语音合成是指将文本转换语音信号的技术。语音合成可以使语音助手更加自然,更具人性化。 自然语言处理 自然语言处理是指对人类语言进行理解和处理的技术。

    作者: wljslmz
    发表时间: 2023-05-11 23:04:47
    24
    0
  • 什么是语音识别的语音搜索?

    解码 解码是指将经过模型训练的模型应用于新的语音信号,以便将语音信号转换为文本。常用的解码方法包括维特比算法和贪心搜索等。 语音搜索的基本原理 语音搜索是指通过语音输入的方式,进行搜索操作。语音搜索的基本原理是将用户的语音输入转换为文本,并且使用搜索引擎进行搜索。

    作者: wljslmz
    发表时间: 2023-05-11 23:05:36
    25
    0
  • 语音语音识别介绍

    语音语音识别介绍 注意事项 本案例推荐使用AI引擎:TensorFlow-1.8 本案例最低硬件规格要求:2 vCPU + 4 GiB 切换硬件规格方法:如需切换硬件规格,您可以在本页面右边的工作区进行切换 运行代码方法:点击本页面顶部菜单栏的三角形运行按钮或按

    作者: HWCloudAI
    发表时间: 2022-12-12 07:46:32
    373
    0
  • 语音识别与语音控制

    语音控制 SSH连接OriginBot成功后,配置智能语音模块: #从TogetheROS的安装路径中拷贝出运行示例需要的配置文件。 cp -r /opt/tros/lib/hobot_audio/config/ .

    作者: 梦笔生花
    发表时间: 2024-10-16 22:01:04
    111
    0
  • 调用实时语音识别

    private String path = ""; // 本地音频路径,如D:/test.wav, 也可将音频文件、音频流转换为byte数组后进行传送。

  • DeleteDemoInfo 删除语音作业 - API

    该API属于VCM服务,描述: 删除语音作业接口URL: "/v2/{project_id}/services/audio-moderation/tasks/{task_id}"