机器学习与语料获取方式:请查看来源页面
关键信息
内容与字段
该数据集包含开发与测试用的语音、音频和图像数据,以及答案键、注册和试验文件。数据来自LDC收集的WeCanTalk语料库,包含约355小时CTS音频(8kHz A-law sphere格式)、53小时AfV片段(16kHz FLAC压缩MS-WAV格式)、39小时视频片段(mp4格式)和202张自拍图像(JPG格式)。来源页未公开字段级说明。
适用研究
适用于文本无关的说话人识别技术研究、评测系统开发及性能基准测试。
信息来自公开来源,具体内容和使用条件请以来源页面为准。
关键词
自行获取的难点
获取受限,需申请访问权限,且许可条款不明确。
