数聚天成 DeepSData
公开数据资料 · 机器学习与语料

Common Voice 语料库 1 Common Voice Corpus 1

Mozilla Common Voice 多语言开源语音识别语料,包含多种语言的口语录音与文本对齐数据,可用于训练语音识别模型。

获取获取方式:请查看来源页面
许可许可原文仍在核对

← 返回公开数据集资料库

机器学习与语料获取方式:请查看来源页面

关键信息

时间2024-06-29

内容与字段

该数据集包含多种语言的口语录音及其对应的文本转录,用于训练语音识别系统。具体字段包括音频文件、文本标注等,但元数据未提供详细字段列表。

适用研究

适用于多语言语音识别、声学模型训练、语音文本对齐等研究。

信息来自公开来源,具体内容和使用条件请以来源页面为准。

关键词

语音识别多语言开源语料Common VoiceMozilla

获取与许可

许可:许可原文仍在核对 | 获取方式:请查看来源页面

自行获取的难点

该数据集通过 Zenodo 分发,下载需注意文件格式与清洗成本,且版本更新频繁,需确认使用版本。

相关数据集

同领域 · 机器学习与语料

需要确认该数据是否满足你的任务?

请向小聚说明用途与必须满足的条件。先按这些条件查找和比对;需要继续核对文件、字段或许可,再交给团队处理。

本站资料可免费查阅;第三方数据能否下载、商用或再分发,以原发布方许可为准。

帮我取数