机器学习与语料免费访问
关键信息
内容与字段
来源页未公开字段级说明。
适用研究
可用于机器学习基准测试,特别是与胫骨相关的混合数据研究。
本卡由来源页信息起草,机构/覆盖/时间/规模/字段与许可以官方为准(待人工核验)。
关键词
自行获取的难点
获取胫骨相关混合数据集用于基准测试时,常缺乏结构化元数据。
由Dr Robin Rohlen和Dimitrios Halatsis为MUniverse Benchmark策划的混合胫骨数据集,包含5个文件,采用CC BY 4.0许可。
来源页未公开字段级说明。
可用于机器学习基准测试,特别是与胫骨相关的混合数据研究。
本卡由来源页信息起草,机构/覆盖/时间/规模/字段与许可以官方为准(待人工核验)。
获取胫骨相关混合数据集用于基准测试时,常缺乏结构化元数据。
全球计算机视觉研究的奠基性基准,逾千万张人工标注图像、两万余类目,自 2009 年起被学界与产业引为通用评测标尺。…
规模最大的开放多语平行语料集合,逾千种语言、上千组语言对,是机器翻译与多语 NLP 的基础库。…
覆盖全球公开网页、按月持续更新的 PB 级标准化 Web 归档语料,是大模型预训练与大规模文本研究的基础语料源。…
完全开放的全球学术元数据库,收录数亿篇论文及其作者、机构、期刊、引用与主题关联,CC0 免费,是文献计量与科研知识图谱的开放替代。…