AI开发平台MODELARTS-创建ModelArts数据集:数据集的类型

时间:2024-11-21 19:45:59

数据集的类型

当前ModelArts支持如下格式的数据集。

  • 图片:对图像类数据进行处理,支持 .jpg、.png、.jpeg、.bmp四种图像格式,支持用户进行图像分类、物体检测、图像分割类型的标注。
  • 音频:对音频类数据进行处理,支持.wav格式,支持用户进行声音分类、语音内容、语音分割三种类型的标注。
  • 文本:对文本类数据进行处理,支持.txt、.csv格式,支持用户进行文本分类、命名实体、文本三元组三种类型的标注。
  • 视频:对视频类数据进行处理,支持.mp4格式,支持用户进行视频标注。
  • 自由格式:管理的数据可以为任意格式,目前不支持标注,适用于无需标注或开发者自行定义标注的场景。如果您的数据集需存在多种格式数据,或者您的数据格式不符合其他类型数据集时,可选择自由格式的数据集。
  • 表格

    表格:适合表格等结构化数据处理。数据格式支持csv。不支持标注,支持对部分表格数据进行预览,但是最多支持100条数据预览。

support.huaweicloud.com/usermanual-standard-modelarts/dataprepare-modelarts-0004.html