数聚天成 DeepSData
公开数据资料 · 机器学习与语料

海因里希·冯·克莱斯特散文文本语料库分析(LancsBox X) Heinrich von Kleist's prose texts corpus analysis using LancsBox X

该语料库包含海因里希·冯·克莱斯特的八部中短篇小说、两篇散文及政治写作等散文作品,文本源自Project Gutenberg,使用LancsBox X进行词频和聚类分析。

获取免费访问
许可许可原文仍在核对
发布方Harvard Dataverse

← 返回公开数据集资料库

机器学习与语料免费访问

关键信息

机构Harvard Dataverse
覆盖海因里希·冯·克莱斯特的散文作品(中短篇小说、散文、政治写作等)
时间以官方为准
规模2个文件
许可许可原文仍在核对
获取Harvard Dataverse

内容与字段

该语料库包含克莱斯特散文作品的词频和聚类数据,涵盖单词到十词单元(最小频率为2),以及相对频率、平均降低频率、出现范围、范围百分比、变异系数、Juilland's D值和比例偏差。另有一个文件记录了“Recht”一词的所有派生词及其在聚类中的出现次数。来源页未公开完整的字段级说明。

适用研究

适用于克莱斯特写作风格的语言学分析、文学研究以及哲学与政治思想关联的探索。

信息来自公开来源,具体内容和使用条件请以来源页面为准。

关键词

克莱斯特语料库LancsBox X词频聚类分析德语文学

获取与许可

许可:许可原文仍在核对 | 免费访问

自行获取的难点

获取克莱斯特散文语料库的详细词频和聚类数据,但字段级说明缺失。

相关数据集

同领域 · 机器学习与语料

想确认这个数据能不能满足你的任务?

告诉小聚你的用途和不能少的条件。先按这些条件查找和比对;需要继续核对文件、字段或许可,再交给团队处理。

本站资料可免费查阅;第三方数据能否下载、商用或再分发,以原发布方许可为准。

帮我取数