数聚天成 DeepSData
公开数据集说明库 · 结构化说明卡

先看清数据,再决定能不能用

每张说明卡集中说明来源机构、字段与变量、时间范围、地区覆盖、文件格式、许可、获取条件、适用场景和已知限制。说明卡免费查阅;第三方数据是否免费、是否需要注册或申请、能否商用及能否再分发,以原始发布方许可为准。自有与定制成果请到定制数据成果页查看。

没找到要的数据?让检索助手按必须项真实检索说清研究需要的数据与必须满足的条件,先评估可得性,再真实检索;候选、来源、判断依据和缺口都会如实说明,确实没有也直接告诉你。
说说你要找的数据
经济与社会科学

经济 · 社科 · 全球发展

经济与社会科学免费访问

宾大世界表 PWT · Penn World Table

跨国经济比较绕不开的黄金标准:把各国 GDP、产出、资本与生产率拉到同一可比口径,是国际顶刊宏观与增长研究的标配底数。

机构格罗宁根大学 GGDC
覆盖185 个经济体
时间1950–2023
规模数十个变量面板
许可许可待核验
获取免费免注册
查看字段与详情

内容与字段

以购买力平价(PPP)为核心、可跨国跨期比较的国民经济核算库:支出侧实际 GDP(CGDPe/RGDPe)、产出侧实际 GDP(CGDPo/RGDPo)、按国民核算口径的实际 GDP(RGDPNA)、人口与就业、人力资本指数、资本存量、全要素生产率(TFP)、价格水平与 PPP 等。

适用研究

跨国增长、生产率、收敛与发展研究的公认底数。

版本PWT 11.0(2025-10) · 格式Excel / Stata / 在线工具 · 标识DOI:10.34894/FABVLR

元数据以官方为准(2026-06 核验)。

自行获取的难点

不同版本的 PPP 基准、链式与当期口径、产出侧与支出侧 GDP 极易混用错配,自行比对常耗数日仍难自洽。版本梳理与口径校准交给我们,取来即用。

经济与社会科学免费访问

世界不平等数据库 WID · World Inequality Database

全球收入与财富分布的长历史数据库,融合国民账户、住户调查与税收数据,校正传统调查对顶端的低估。

机构世界不平等实验室
覆盖约 216 国家和地区
时间现代 1980 起,部分回溯更早
规模多维分布序列
许可许可待核验
获取免费访问 · Stata/R 工具
查看字段与详情

内容与字段

收入分布(税前/税后,按百分位、十分位的份额与人均水平)、财富分布与顶端财富份额、国民收入与国民账户宏观变量;近年新增对外收入、对外财富、公共收入与公共支出等。每条序列含地区代码、年份、指标代码、人口/百分位区间、币种与单位等维度。

适用研究

分布结构、再分配、宏观与发展经济学的分布份额统计。

更新滚动更新(含 2024 更新) · 格式网页导出 / Stata 包 / R 工具

许可类型以官方条款为准(待核验);元数据 2026-06 核验。

自行获取的难点

指标代码、币种单位、税前税后口径与百分位区间繁多,年度更新还会新增序列,自行对照官方字典逐条对齐、跨年跨地区拉通极易错配。交给我们整理成统一可检索的规范序列。

经济与社会科学免费访问

BACI 全球双边贸易数据库 CEPII BACI

经清洗调和的产品级双边贸易长表,HS 6 位、覆盖全球主要经济体,是贸易实证研究公认的标准口径。

机构法国 CEPII
覆盖主要经济体 · 约 5000 产品
时间年度,至 2024
规模多年度双边产品流
许可Etalab Open Licence 2.0
获取免费免注册
查看字段与详情

内容与字段

字段含义
t年份
k产品类别(HS 6 位,保留前导零)
i / j出口方 / 进口方(ISO 数字代码)
v贸易额(千美元,现价)
q数量(公吨)

方法学:对 UN Comtrade 原始申报做 CIF/FOB 口径统一、按报告方可靠性对镜像数据加权对账。

版本202601(2026-01,每年 1 月更新) · 格式CSV(ZIP 分发)

分析单位以 ISO 数字代码表示;元数据 2026-06 核验。

自行获取的难点

镜像数据打架、CIF/FOB 口径不一、HS 编码前导零被当数值丢失、跨年版本对不齐——这些拖垮研究者的脏活,我们已处理为可直接入模的一致长表。

经济与社会科学免费访问

CEPII 引力数据库 CEPII Gravity

引力方程估计要用的双边变量这里成套齐备:贸易流、距离、协定、共同语言与宏观指标,是国际贸易实证研究的标准基础数据。

机构法国 CEPII
覆盖方阵双边 · 约 252 经济体
时间1948–2020
规模双边配对面板
许可许可待核验
获取免费免注册
查看字段与详情

内容与字段

① 双边贸易流(IMF DOTS / UN Comtrade / BACI 三源);② 地理距离测度(多种加权距离、是否接壤、内陆、岛屿、经纬度);③ 制度与贸易便利化变量(GATT/WTO 成员、区域/双边贸易协定);④ 历史与制度联系的代理变量(共同语言、宗教、法律体系起源、历史关联等);⑤ 宏观指标(GDP、人口)。

适用研究

引力模型、双边贸易、全球价值链实证。

版本202211(2022-11) · 格式CSV / R / Stata · 引用Conte, Cotterlaz & Mayer (2022)

地区划分沿用数据源国际统计分类口径,仅为统计惯例,以中国官方标准为准;元数据 2026-06 核验。

自行获取的难点

三套贸易流来源口径不一、距离与制度变量年份各异、报告方编码还要逐年对齐,自行拼出一套可直接跑回归的双边面板往往要耗上数周。这里交付的是已统一口径、对齐配对的成套数据。

经济与社会科学免费访问

麦迪森历史 GDP 数据库 Maddison Project · MPD

把世界经济拉到两千年尺度的权威基准:自公元 1 年起跨国可比的人均 GDP 与人口估计。

机构格罗宁根大学 GGDC
覆盖169 国家和地区
时间公元 1 年 – 2022
规模长期时间序列
许可许可待核验
获取免费免注册
查看字段与详情

内容与字段

字段含义
countrycode / year地区代码 / 年份
cgdppc水平比较口径人均 GDP(2011 国际美元)
rgdpnapc实际人均 GDP(跨时增长比较)
pop人口(千人)
i_cig / i_bm估计来源 / 基准估计标识

适用研究

历史经济学、比较发展、长期增长与收入水平差异。

版本MPD 2023 · 格式Excel / Stata · 标识DOI:10.34894/INZBF2

字段命名与归类以官方 Codebook 为准;元数据 2026-06 核验。

自行获取的难点

不同年份发布的口径屡有修订、现价与实际两套人均 GDP 各有适用场景、基准估计与插值外推的标识需要逐字段甄别。这里直接交付经过梳理对齐、口径标注清晰的可用数据。

经济与社会科学免费访问

Barro-Lee 教育年限数据库 Barro-Lee Educational Attainment

衡量人力资本存量的权威参照系:分性别、分年龄的跨国受教育程度估计,被世界银行与大量增长研究长期引用。

机构Barro(哈佛)+ Lee(高丽大)
覆盖146 个经济体
时间1950–2015(5 年间隔)
规模分性别/年龄交叉表
许可许可待核验
获取免费免注册
查看字段与详情

内容与字段

分性别(总/男/女)、分年龄组的受教育程度:各教育层级(无教育/初等/中等/高等,含未完成与完成)的人口占比、平均受教育年限(yr_sch 及分初/中/高),以及用于估算的入学率、辍学率、人口结构等;含 Lee-Lee 长期历史数据与教育质量等扩展模块。

适用研究

教育经济学、人力资本与经济增长实证。

版本2021-09(BLv3) · 格式Excel / CSV / Stata

许可存在双重表述(GitHub MIT / 官网保留权利),商用前建议核验作者授权;元数据 2026-06 核验。

自行获取的难点

不同发布批次的口径调整、教育层级划分与历史回溯序列的衔接,往往让自行整理者反复对齐、难以确认用哪一版。我们已完成版本梳理与变量校准。

经济与社会科学免费访问

世界发展指标 WDI · World Development Indicators

世界银行的全球发展统计总集,覆盖经济、人口、教育、健康与环境上千项指标,是跨国发展研究最常用的权威底数。

机构世界银行
覆盖约 217 个经济体
时间1960 起
规模1400+ 指标
许可许可待核验
获取免费免注册 · API/批量
查看字段与详情

内容与字段

可跨国跨期比较的年度指标:GDP 与人均收入、人口与城镇化、贫困与不平等、教育入学率、预期寿命、能源与碳排放、基础设施与数字经济等,按经济体、指标代码、年份组织。

适用研究

发展经济学、跨国比较、政策评估与可持续发展目标(SDG)监测。

更新滚动更新 · 格式CSV / Excel / API(含 SDMX) · 平台World Bank Open Data / Data360

元数据以世界银行官方为准(2026-06 核验)。

自行获取的难点

指标代码繁多、口径与基年时有调整,跨指标跨年合并极易错配;交给我们按研究口径抽取、对齐与整合,取来即用。

经济与社会科学免费访问

世界经济展望数据库 IMF WEO · World Economic Outlook

国际货币基金组织的宏观经济数据库,含各国增长、通胀、失业、财政与国际收支,并提供未来五年预测,是宏观与政策研究的标准参照。

机构国际货币基金组织 IMF
覆盖约 190 个经济体
时间1980 起 + 未来5年预测
规模国民账户/物价/财政/国际收支
许可IMF Data Terms of Use
获取免费访问 · IMF 官方数据门户
查看字段与详情

内容与字段

实际/名义 GDP 与增速、人均 GDP、CPI 通胀、失业率、政府收支与债务、经常账户、商品价格等,年度数据并含未来五年预测。

适用研究

宏观经济、国别比较、财政与外部平衡、预测对比与情景分析。

更新每年 4 月、10 月两次 · 格式Excel / SDMX · 平台IMF DataMapper / data.imf.org

部分国别或年份数据可能不全;以 IMF 官方为准(2026-06 核验)。

自行获取的难点

不同版本(4月/10月)与历次预测口径不同、国别分组与聚合易混;我们按版本与口径校准后取数。

经济与社会科学免费访问

OECD 统计数据 OECD Data Explorer

经合组织的官方统计仓库,覆盖成员国与伙伴经济体的经济、就业、教育、健康、环境与社会指标,口径规范、可比性强。

机构经合组织 OECD
覆盖OECD 成员 + 伙伴经济体
时间多为 1960/1970 起
规模数百个数据集
许可许可待核验
获取免费 · Data Explorer/API
查看字段与详情

内容与字段

国民账户、就业与工时、价格、生产率、教育与技能、健康支出、环境与能源、社会保障等,按主题数据集组织,多含 SDMX 维度。

适用研究

发达经济体比较、产业与生产率、社会政策、可持续发展。

格式CSV / Excel / SDMX-API · 平台OECD Data Explorer · 2024 起数据免费开放

以 OECD 官方条款与元数据为准(2026-06 核验)。

自行获取的难点

数据集与维度代码繁杂、跨主题口径不一;我们按研究主题抽取并对齐维度。

经济与社会科学免费访问

联合国商品贸易统计数据库 UN Comtrade

联合国官方的国际货物贸易统计库,按 HS/SITC 产品与贸易伙伴提供各国进出口长序列,是官方口径贸易研究的权威来源。

机构联合国统计司 UNSD
覆盖约 200 个国家/地区
时间1962 起
规模产品级双边年度/月度
许可许可待核验
获取免费 · API;批量为付费高级版
查看字段与详情

内容与字段

按报告国、伙伴国、HS 6 位或 SITC 的进口/出口/再出口/再进口贸易额与数量,年度与月度。

适用研究

国际贸易、产业链与竞争力、贸易政策、引力模型。

格式CSV / JSON-API · 平台Comtrade Plus · 基础免费、批量下载为高级订阅

数据由各国上报,存在镜像差异;以 UNSD 官方为准(2026-06 核验)。

自行获取的难点

报告国与镜像数据对不齐、HS 版本切换、缺报年份多;我们做镜像校准与口径统一。

经济与社会科学免费访问

欧盟统计局数据 Eurostat

欧盟官方统计机构,提供成员国口径统一、可比的经济、人口、产业、能源与社会指标,是欧洲实证研究的标准数据源。

机构欧盟统计局 Eurostat
覆盖欧盟成员 + EFTA/候选国
时间多为 1990/2000 起
规模数千个数据表
许可许可待核验
获取免费 · API/批量
查看字段与详情

内容与字段

国民账户与 GDP、就业与失业、人口与移民、物价 HICP、产业与能源、研发与数字经济、收入与生活条件等,按数据表与维度组织。

适用研究

欧洲经济社会比较、区域 NUTS 分析、政策评估。

格式TSV / CSV / SDMX-API · 平台Eurostat Data Browser

以 Eurostat 官方为准(2026-06 核验)。

自行获取的难点

数据表代码与 NUTS 区划层级多、口径更新频繁;我们按区域层级与口径抽取整合。

经济与社会科学免费访问

Our World in Data OWID · Our World in Data

牛津与 Global Change Data Lab 维护的长期全球问题数据与图表库,把权威来源整理成可比、可下载的长序列,覆盖发展、健康、能源与环境。

机构Global Change Data Lab · 牛津大学
覆盖全球多国
时间长历史序列
规模数千个指标与图表
许可许可待核验
获取免费 · 下载/API
查看字段与详情

内容与字段

人口与人口结构、健康与疾病、能源与排放、贫困与不平等、教育、食物与农业等主题的可下载序列,含来源标注与处理说明。

适用研究

全球趋势、跨国比较、科普与教学、政策沟通。

格式CSV / 图表 / API · 标注"由 OWID 整理/处理" 区分自产与第三方

自产数据为 CC BY;第三方数据须依原始来源许可,使用前核对(2026-06 核验)。

自行获取的难点

自产与第三方数据许可不同、来源链路需逐条核对;我们厘清来源与许可再交付。

经济与社会科学访问条件待核验

非洲世界银行全球金融发展数据集 electricsheepafrica/africa-worldbank-global-financial-development

该数据集汇集了世界银行全球金融发展数据库中54个非洲国家1960–2021年的108项金融指标,涵盖金融深度、可及性与稳定性,是研究非洲金融结构与经济发展的刚需资源。

机构World Bank Group (Electric Sheep Africa 重新打包)
覆盖54个非洲国家
时间1960–2021
规模67,909条观测
许可许可待核验
获取HuggingFace 数据集页面
查看字段与详情

内容与字段

数据集包含108项全球金融发展指标,覆盖金融深度、可及性、稳定性等维度,共67,909条观测,时间跨度为1960年至2021年,涉及54个非洲国家。数据以Parquet格式存储,分为训练集和测试集两个文件。

适用研究

适用于非洲国家金融发展水平比较、金融包容性分析、金融稳定性评估以及金融与经济增长关系等实证研究。

元数据以来源页为准(2026-07 工厂起草 · 待人工核验)。

自行获取的难点

该数据集为世界银行官方数据的重新打包版本,但来源为HuggingFace镜像,非官方直接发布;研究者需注意版本一致性,并自行验证指标定义与官方最新版是否匹配。

经济与社会科学访问条件待核验

USPTO专利与引用数据 USPTO Patent and Citation Data

该数据集收录1975年至2010年美国专利商标局授权的专利首页信息,包括专利号、授权日、申请日、发明人国籍、第一受让人、分类号、权利要求数及前引次数,是研究专利引用网络与创新趋势的刚需资源。

机构Harvard Dataverse
覆盖1975-01-01至2010-12-31
时间2011-08-06更新
规模4个文件
获取https://doi.org/10.7910/DVN/SJPHLG
查看字段与详情

内容与字段

数据包含1975年1月1日至2010年12月31日期间授权的美国专利首页信息,字段包括专利号、授权日期、申请日期、申请号、第一发明人原籍国、第一受让人、所有权分配类别、每项专利的主分类及子分类、权利要求数量、前向引用次数(即后续专利对该专利的引用次数)。

适用研究

适用于专利引用网络分析、技术创新趋势研究、发明人及受让人合作网络分析、专利分类与技术创新关联研究等。

元数据以来源页为准(2026-07 工厂起草 · 待人工核验)。

自行获取的难点

数据仅覆盖至2010年,且为哈佛Dataverse镜像副本,需自行对接USPTO PatentsView官方API获取最新数据;原始数据为CSV格式,需进行清洗与字段对齐。

经济与社会科学免费访问

英国犯罪调查数据集 British Crime Survey datasets

英国犯罪调查(BCS)的估计数据表,按人口统计特征细分,可用于计算不同犯罪类型的比率和数量,以及BCS涵盖的某些感知指标。

机构Home Office(至2012年3月);Office for National Statistics (ONS)(2012年4月起)
覆盖英格兰和威尔士
时间以官方为准
规模9个文件
许可许可待核验
获取data.gov.uk
查看字段与详情

内容与字段

该数据集包含来自英国犯罪调查(BCS)的估计数据表,按人口统计特征细分。资源包括:Household crime incidence (CSV)、Household crime prevalence (CSV)、Personal crime incidence (CSV)、Personal crime prevalence (CSV)、Perceptions Criminal Justice System (CSV)、Perceptions Other (CSV)、Demographic characteristics (CSV)、Measurements (CSV) 以及一份用户指南 (PDF)。来源页未公开字段级说明。

适用研究

可用于犯罪率分析、犯罪类型分布研究、公众对刑事司法系统感知的研究,以及人口统计特征与犯罪关联分析。

本卡由来源页信息起草,机构/覆盖/时间/规模/字段与许可以官方为准(待人工核验)。

自行获取的难点

用户需要快速了解BCS数据集的构成、字段含义及获取方式,但官方页面缺乏详细的变量说明,导致数据使用前需额外查阅用户指南。

经济与社会科学免费访问

法治指数 - 治理估计值(约-2.5至+2.5) Rule of Law - Governance estimate (approx. -2.5 to +2.5)

世界银行发布的全球治理指标之一,衡量社会成员对规则遵守程度的感知,覆盖约200个经济体,时间跨度为1996年至2024年。

机构世界银行集团(World Bank Group)
覆盖全球所有国家和地区(All Countries and Economies)
时间1996年至2024年(年度数据)
规模以官方为准
许可许可待核验
获取以官方为准
查看字段与详情

内容与字段

该数据集为世界银行全球治理指标(WGI)中的法治(Rule of Law)维度,提供各国治理估计值。数据以标准化正态分布单位表示,范围约-2.5至2.5,数值越大表示治理越好。来源页未公开字段级说明。

适用研究

适用于跨国治理比较、制度质量与经济发展关系研究、法治对投资环境影响的实证分析等。

本卡由来源页信息起草,机构/覆盖/时间/规模/字段与许可以官方为准(待人工核验)。

自行获取的难点

获取全球法治指标时,常需处理不同来源的治理数据口径不一致问题。

经济与社会科学免费访问

MPS犯罪统计2022/23财年 MPS Crime Statistics Financial Year 2022/23

伦敦警察厅发布的2022/23财年犯罪统计数据,包含可通知犯罪和其他犯罪数据,按财年、基本指挥单元和行政区划分。

机构伦敦警察厅(Metropolitan Police Service)
覆盖伦敦警察厅辖区(大伦敦地区)
时间2022/23财年
规模2个文件(TNO Crime.xlsx和Other Crime.xlsx)
许可许可待核验
获取data.gov.uk
查看字段与详情

内容与字段

该数据集包含两个Excel文件:MPS Crime Statistics TNO Crime.xlsx(可通知犯罪)和MPS Crime Statistics Other Crime.xlsx(其他犯罪)。数据遵循英国内政部犯罪计数规则,指标包括犯罪数量、制裁侦破数和制裁侦破率。数据可按财年、基本指挥单元(BCU)和行政区筛选。来源页未公开字段级说明。

适用研究

可用于分析伦敦地区犯罪趋势、警务绩效评估、犯罪类型分布及区域差异研究。

本卡由来源页信息起草,机构/覆盖/时间/规模/字段与许可以官方为准(待人工核验)。

自行获取的难点

获取伦敦警察厅官方犯罪统计数据时,常需区分不同犯罪类型和区域,且数据更新频率和字段定义需参考官方文档。

经济与社会科学免费访问

房价数据 House Prices

林肯郡及各区平均月房价(英镑),按房屋类型细分,基于土地注册局方法,每月更新滚动12个月。

机构Lincolnshire County Council
覆盖Lincolnshire and Districts
时间滚动12个月,每月更新
规模4个文件
许可许可待核验
获取data.gov.uk
查看字段与详情

内容与字段

该数据集包含林肯郡及各区平均月房价(英镑),按房屋类型细分,包括所有房屋、独栋、半独栋、联排和公寓/复式公寓。数据基于土地注册局方法,每月更新,覆盖滚动12个月。历史数据可能修订。来源:土地注册局英国房价指数统计。数据集包含4个文件:房价CSV、元数据CSV、土地注册局HTML指南、ONS住房统计HTML。

  • All Houses——所有房屋类型的平均价格
  • Detached——独栋房屋平均价格
  • Semi-detached——半独栋房屋平均价格
  • Terraced——联排房屋平均价格
  • Flat/maisonette——公寓/复式公寓平均价格

适用研究

可用于区域房价趋势分析、住房市场监测、经济指标研究等。

本卡由来源页信息起草,机构/覆盖/时间/规模/字段与许可以官方为准(待人工核验)。

自行获取的难点

获取区域房价数据时,常需按房屋类型细分且更新及时,但官方数据分散,本数据集整合了林肯郡的月度房价。

经济与社会科学免费访问

全球粮食生产环境压力的双边贸易流综合数据集 Development of a comprehensive bilateral trade-flow dataset of the environmental pressures of global food production

该数据集提供了全球粮食生产从生产国到消费国的双边贸易流环境压力数据,涵盖温室气体排放、水资源使用、氮磷污染及土地/水域占用等指标。

机构以官方为准
覆盖全球
时间以官方为准
规模4个文件
许可许可待核验
获取Zenodo
查看字段与详情

内容与字段

该数据集包含4个文件,提供全球粮食生产从生产国到消费国的双边贸易流环境压力数据。数据涵盖温室气体排放、水资源使用、氮磷污染以及土地/水域占用等环境压力指标,涉及作物和动物产品来自陆地、淡水和海洋系统。来源页未公开字段级说明。

适用研究

可用于可持续全球粮食消费研究、环境退化驱动因素分析、供应链环境影响评估等方向。

本卡由来源页信息起草,机构/覆盖/时间/规模/字段与许可以官方为准(待人工核验)。

自行获取的难点

缺乏将粮食生产的环境压力与消费端关联的双边贸易流数据,难以追溯消费驱动的环境足迹。

经济与社会科学免费访问

釜山、大邱、大田、光州聚合特征价格数据集 Aggregated hedonic datasets for Busan, Daegu, Daejeon, and Gwangju

该数据集包含韩国四个广域市(釜山、大邱、大田、光州)的特征价格变量及实际交易房价,可用于房价影响因素、住房不平等及估价模型研究。

机构以官方为准
覆盖韩国釜山、大邱、大田、光州四个广域市
时间以官方为准
规模4个文件
许可许可待核验
获取Zenodo
查看字段与详情

内容与字段

该数据集包含四个韩国广域市(釜山、大邱、大田、光州)的特征价格变量及实际交易房价。每个特征价格变量分为四类:住房特征、本地便利设施、本地人口统计和季节性虚拟变量。来源页未公开字段级说明。

适用研究

可用于研究特征价格变量对房价的经济影响、住房不平等以及房价评估模型的开发。

本卡由来源页信息起草,机构/覆盖/时间/规模/字段与许可以官方为准(待人工核验)。

自行获取的难点

获取韩国城市级房价与特征变量数据时,常面临字段不统一、来源分散的问题。

经济与社会科学免费访问

管道运输事故数据(1979年1月起) Pipeline transportation occurrence data from January 1979

加拿大运输安全委员会发布的管道事故与事件数据,涵盖1979年1月至今的报告性事故与事件,用于促进运输安全。

机构Transportation Safety Board of Canada
覆盖加拿大
时间1979年1月至发布前一个月
规模6个文件
许可许可待核验
获取Open Canada
查看字段与详情

内容与字段

该数据集包含管道事故与事件记录,以及相关伤害信息,并附有数据字典。来源页未公开字段级说明。

适用研究

可用于管道运输安全分析、事故趋势研究、风险评估及政策制定。

本卡由来源页信息起草,机构/覆盖/时间/规模/字段与许可以官方为准(待人工核验)。

自行获取的难点

管道事故数据常缺乏统一字段说明,需结合数据字典理解变量含义。

经济与社会科学免费访问

全球(过度)旅游指数复制数据 Replication Data for: Global (over)Tourism Index

哈佛Dataverse上发布的全球(过度)旅游指数复制数据,用于衡量旅游对社区福祉的多维风险。

机构以官方为准
覆盖全球
时间以官方为准
规模11个文件
许可许可待核验
获取哈佛Dataverse
查看字段与详情

内容与字段

该数据集包含11个文件,用于复制《Global (over)Tourism Index》论文中的分析。来源页未公开字段级说明。

适用研究

可用于旅游经济学、社区可持续发展、风险评估等领域的研究,支持构建和验证旅游风险指数。

本卡由来源页信息起草,机构/覆盖/时间/规模/字段与许可以官方为准(待人工核验)。

自行获取的难点

研究旅游过度开发时缺乏标准化的多维风险指数数据

经济与社会科学免费访问

电力供应监测倡议分钟级电压数据集 Minute-wise voltage data collected in Electricity Supply Monitoring Initiative

该数据集由印度非营利组织Prayas(能源组)通过电力供应监测倡议(ESMI)收集,包含印度60多个地区自2014年以来的分钟级电压数据,用于评估供电质量。

机构Prayas (Energy Group)
覆盖印度60多个地区
时间2014年11月至2018年12月(会不定期更新)
规模14个文件
许可许可待核验
获取Harvard Dataverse
查看字段与详情

内容与字段

数据集包含位置信息文件和多个电压数据文件。位置信息文件提供每个监测点的名称、数据起止日期、所在地区、邦、类别(农村/城镇/大城市)及连接类型(家庭/非家庭/农业)。电压数据文件按分钟记录每个监测点的电压值,缺失数据表示不可用而非中断,电压为0表示停电。

  • Location name——监测点名称
  • From date——数据起始日期
  • To date——数据截止日期
  • District——监测点所在地区
  • State——监测点所在邦
  • Category——地点类别(农村/城镇/大城市)
  • Connection type——连接类型(家庭/非家庭/农业)
  • Date——电压记录日期
  • Hour——小时(0-23)
  • Min 0——第0分钟电压值
  • Min 1——第1分钟电压值
  • Min 59——第59分钟电压值

适用研究

可用于印度地区供电质量分析、电压稳定性研究、停电模式识别、城乡供电差异比较,以及基于时间序列的电力负荷预测等方向。

本卡由来源页信息起草,机构/覆盖/时间/规模/字段与许可以官方为准(待人工核验)。

自行获取的难点

获取印度地区长时间序列的分钟级电压数据,用于供电质量分析,但数据可能存在不连续和缺失,需注意处理。

经济与社会科学免费访问

解释印度改善电力服务的定价改革支付意愿 Explaining Willingness to Pay for Pricing Reforms that Improve Electricity Service in India

该数据集包含一篇关于印度居民对改善电力服务定价改革支付意愿的研究的复制包,由哈佛Dataverse发布。

机构Harvard Dataverse
覆盖印度
时间2019
规模5个文件
许可许可待核验
获取Harvard Dataverse
查看字段与详情

内容与字段

该数据集是研究文章的复制包,包含数据文件、代码和文档,用于分析印度居民对改善电力服务定价改革的支付意愿。来源页未公开字段级说明。

适用研究

可用于能源经济学、公共政策、发展经济学等领域,研究电力服务改革、支付意愿及定价机制。

本卡由来源页信息起草,机构/覆盖/时间/规模/字段与许可以官方为准(待人工核验)。

自行获取的难点

获取印度电力服务改革支付意愿的原始调查数据和复制代码,便于验证和扩展研究。

经济与社会科学免费访问

全球城市数据 Global City Data

该数据集包含来自纽约市全球城市数据库的多个城市指标,由大伦敦管理局发布,涵盖地理、人口、经济、交通、教育、旅游、健康、文化、环境等领域。

机构Greater London Authority
覆盖全球多个城市(来自纽约市全球城市数据库)
时间以官方为准
规模1个文件(global-city-indicators.xlsx)
许可许可待核验
获取data.gov.uk
查看字段与详情

内容与字段

该数据集包含多个城市指标,涵盖地理、人口、经济、交通、教育、旅游、健康、文化、环境等领域。具体字段如下:

  • Geography City Area (km2)——城市面积(平方公里)
  • Metro Area (km2)——大都市区面积(平方公里)
  • City Population (millions)——城市人口(百万)
  • Metro Population (millions)——大都市区人口(百万)
  • Foreign Born——外国出生人口
  • Annual Population Growth——年人口增长
  • GDP Per Capita (thousands $, PPP rates, per resident)——人均GDP(千美元,购买力平价)
  • Primary Industry——第一产业
  • Secondary Industry——第二产业
  • Share of Global 500 Companies (%)——全球500强公司占比(%)
  • Unemployment Rate——失业率
  • Poverty Rate——贫困率

适用研究

可用于全球城市比较研究、城市发展指标分析、城市经济与社会政策评估等。

本卡由来源页信息起草,机构/覆盖/时间/规模/字段与许可以官方为准(待人工核验)。

自行获取的难点

全球城市数据分散,难以获取统一、可比的指标集,该数据集提供了多维度城市指标,便于横向比较。

经济与社会科学免费访问

中国地方公共数据授权运营报告 中国地方公共数据授权运营报告

复旦大学数字与移动治理实验室发布的关于中国地方公共数据授权运营的年度报告,评估各地授权运营实践。

机构复旦大学数字与移动治理实验室(复旦DMG)
覆盖中国地方
时间2025年度
规模以官方为准
许可许可待核验
获取http://ifopendata.fudan.edu.cn/report
查看字段与详情

内容与字段

该报告为PDF格式的研究报告,内容涵盖中国地方公共数据授权运营的评估指标、排名与分析。来源页未公开字段级说明。

适用研究

可用于研究中国地方政府数据开放政策、授权运营模式、数据治理绩效评估等方向。

本卡由来源页信息起草,机构/覆盖/时间/规模/字段与许可以官方为准(待人工核验)。

自行获取的难点

获取完整报告需联系发布方,在线预览或下载链接不明确。

经济与社会科学免费访问

中国金融科技专利申请与授权数据 中国金融科技专利申请与授权数据 - CnOpenData

CnOpenData提供的中国金融科技领域专利数据库,覆盖发明、实用新型、外观设计专利,时间跨度为1985-2024年。

机构CnOpenData
覆盖中国境内金融科技领域
时间1985-2024年
规模以官方为准
许可许可待核验
获取CnOpenData平台
查看字段与详情

内容与字段

该数据集包含中国金融科技领域的专利数据,分为发明公布、发明授权、实用新型、外观设计四种类型,并提供专利事务表。数据字段包括专利申请号、公开号、授权号、优先权号、法律状态、专利类型、权利要求数、引用文献等。来源页未公开完整的字段列表,但提及了以下字段:

  • 专利申请号——专利的申请标识号
  • 公开号——专利公开的标识号
  • 授权号——专利授权的标识号
  • 优先权号——优先权申请的标识号
  • 法律状态——专利的法律状态信息
  • 专利类型——发明、实用新型或外观设计
  • 权利要求数——专利权利要求项数
  • 引用文献——专利引用的文献信息

适用研究

适用于金融科技领域的专利分析、技术趋势追踪、创新网络研究、产学研协同创新分析、专利价值评估等学术与商业研究。

本卡由来源页信息起草,机构/覆盖/时间/规模/字段与许可以官方为准(待人工核验)。

自行获取的难点

金融科技专利数据分散,缺乏统一分类和清洗,难以直接用于分析。

经济与社会科学免费访问

班夫国家公园野生动物死亡率数据 Wildlife Mortality - Banff

班夫国家公园2005-2017年间由铁路、车辆导致的野生动物死亡及野生动物管理扑杀记录,每条记录包含日期、地点、数量、年龄、性别和死因。

机构Parks Canada
覆盖Banff National Park
时间2005-2017
规模以官方为准
许可许可待核验
获取Open Government Portal (Canada)
查看字段与详情

内容与字段

该数据集包含两个CSV文件:主数据文件(banff_np_wildlife_mortality_2005-2017_data.csv)和数据字典文件(banff_np_wildlife_mortality_2005-2017_data_dictionary.csv)。每条记录记录一次野生动物死亡事件,字段包括日期、地点、数量、年龄、性别和死因。

  • date——死亡事件发生的日期
  • location——死亡事件发生的地点
  • count——死亡个体数量
  • age——死亡个体的年龄
  • gender——死亡个体的性别
  • cause——死亡原因(如铁路、车辆、管理扑杀)

适用研究

可用于分析交通基础设施对野生动物的影响、野生动物种群动态、以及管理扑杀对物种的影响。也可用于评估缓解措施的有效性。

本卡由来源页信息起草,机构/覆盖/时间/规模/字段与许可以官方为准(待人工核验)。

自行获取的难点

研究交通对野生动物的影响时,常缺乏长期、系统的死亡记录,该数据集提供了班夫国家公园13年的详细记录。

经济与社会科学免费访问

卫生厅2023-24年度报告采购(含ICT与广告)数据集 DH Annual Report 2023-24 Procurement (including ICT and advertising)

该数据集是澳大利亚维多利亚州卫生厅2023-24年度报告中采购数据的机器可读版本,包含咨询、审查、紧急采购、ICT及政府广告支出等表格。

机构Department of Health, Victoria Government
覆盖Victoria
时间2023-24财政年度
规模1个XLSX文件
许可许可待核验
获取以官方为准
查看字段与详情

内容与字段

该数据集包含一个XLSX文件,内含以下表格:咨询支出(价值$10,000及以上的咨询详情)、审查与研究支出、紧急采购、信息与通信技术支出、政府广告支出。来源页未公开各表格的具体字段列表。

适用研究

可用于分析维多利亚州卫生厅的采购模式、咨询与ICT支出趋势、政府广告投放情况,以及年度报告数据的机器可读化研究。

本卡由来源页信息起草,机构/覆盖/时间/规模/字段与许可以官方为准(待人工核验)。

自行获取的难点

获取政府年度报告中的采购数据时,常面临非机器可读格式(如PDF)或字段不完整的问题,该数据集提供了结构化的XLSX文件,便于直接分析。

经济与社会科学免费访问

终身学习政策相关调查研究——关于与相关机构合作的家庭教育支援举措及地区家庭教育支援实施状况的报告(平成27年度) 「生涯学習施策に関する調査研究~関係機関と連携した家庭教育支援の取組及び地域における家庭教育支援の実施状況について~」報告書(平成27年度)

日本文部科学省发布的平成27年度调查报告,收集分析学校、企业等机构合作的家庭教育支援优秀案例,并调查地方自治体实施状况以评估第2期教育振兴基本计划达成情况。

机构文部科学省(总合教育政策局地域学习推进课)
覆盖日本全国地方自治体
时间平成27年度(2015年度)
规模1个PDF文件
许可许可待核验
获取e-Gov数据门户(直接下载PDF)
查看字段与详情

内容与字段

该数据集为一份PDF格式的调查报告,内容涉及与学校、企业等机构合作的家庭教育支援优秀案例的收集与分析,以及对地方自治体实施状况的调查。来源页未公开字段级说明。

适用研究

可用于日本家庭教育支援政策评估、终身学习政策研究、地方教育行政实施状况分析等。

本卡由来源页信息起草,机构/覆盖/时间/规模/字段与许可以官方为准(待人工核验)。

自行获取的难点

获取日本家庭教育支援政策调查的原始报告,但PDF内容未结构化,难以直接进行定量分析。

经济与社会科学免费访问

全球GDP、食品价格、食品不安全与健康支出数据集(1960–2024) Global Dataset on GDP, Food Prices, Food Insecurity, and Health Expenditure (1960–2024)

该数据集汇集了1960至2024年的全球年度指标,包括GDP(名义和购买力平价调整)、食品不安全指数、健康支出、收入不平等(基尼系数)以及详细的食品价格指数,支持多因果计量经济建模。

机构以官方为准
覆盖全球
时间1960–2024
规模1个文件
许可许可待核验
获取Zenodo
查看字段与详情

内容与字段

该数据集包含1960年至2024年的全球年度指标,涵盖GDP(名义和购买力平价调整)、食品不安全指数、健康支出、收入不平等(基尼系数)以及详细的食品价格指数(总体、肉类、乳制品、谷物、植物油和糖)。数据集结构支持多因果计量经济建模,包括VAR和中介分析。

  • GDP (nominal)——名义GDP
  • GDP (PPP-adjusted)——购买力平价调整后的GDP
  • Food insecurity index——食品不安全指数
  • Health expenditure——健康支出
  • Income inequality (GINI)——收入不平等(基尼系数)
  • Food price index (overall)——总体食品价格指数
  • Food price index (meat)——肉类食品价格指数
  • Food price index (dairy)——乳制品食品价格指数
  • Food price index (cereals)——谷物食品价格指数
  • Food price index (vegetable oils)——植物油食品价格指数
  • Food price index (sugar)——糖类食品价格指数

适用研究

适用于研究收入、食品价格、食品不安全与健康支出之间相互关系的多因果计量经济建模,如VAR和中介分析。

本卡由来源页信息起草,机构/覆盖/时间/规模/字段与许可以官方为准(待人工核验)。

自行获取的难点

研究收入、食品价格、食品不安全与健康支出之间复杂因果关系时,常缺乏整合多维度年度指标的统一数据集。

经济与社会科学免费访问

AEA RCT注册库登记数据(2013年4月至2020年4月) Registrations in the AEA RCT Registry (2013-04 to 2020-04)

该数据集包含美国经济学会RCT注册库中截至2020年4月6日的公开登记数据。

机构以官方为准
覆盖美国经济学会RCT注册库中的登记项目
时间2013年4月至2020年4月6日
规模1个文件
许可许可待核验
获取Harvard Dataverse
查看字段与详情

内容与字段

该数据集包含美国经济学会RCT注册库中截至2020年4月6日的公开登记数据。来源页未公开字段级说明。

适用研究

可用于分析RCT注册趋势、研究设计特征等经济学相关研究。

本卡由来源页信息起草,机构/覆盖/时间/规模/字段与许可以官方为准(待人工核验)。

自行获取的难点

获取AEA RCT注册库的完整登记数据时,常需手动整理,此数据集提供了结构化版本。

经济与社会科学免费访问

二氧化碳排放与轨迹 Carbon Dioxide Emissions and Trajectory

Calderdale Metropolitan Borough Council发布的Calderdale地区2005-2014年二氧化碳排放数据,按工业商业、住宅和交通分类,包含人均排放和减排目标轨迹。

机构Calderdale Metropolitan Borough Council
覆盖Calderdale地区
时间2005-2014
规模1个文件
许可许可待核验
获取data.gov.uk
查看字段与详情

内容与字段

该数据集包含Calderdale地区2005年至2014年每年的二氧化碳排放数据,按工业商业、住宅(包括废弃物、住房和供暖)和交通部门分类,并包含总排放量、人均排放量以及实现减排目标的轨迹列。来源页未公开字段级说明。

适用研究

可用于地方碳排放趋势分析、减排政策评估、气候变化研究及可持续发展规划。

本卡由来源页信息起草,机构/覆盖/时间/规模/字段与许可以官方为准(待人工核验)。

自行获取的难点

地方碳排放数据常分散且时间跨度短,难以获取统一、按部门分类的长时间序列数据。

经济与社会科学免费访问

每周生成式AI市场脉搏调查 Weekly Generative AI Market Pulse Survey

一项针对韩国18-65岁居民的全国性每周在线追踪调查,监测生成式AI服务的消费者采用动态,匿名微观数据每周通过Harvard Dataverse和KOSSDA发布。

机构ConsumerSight
覆盖韩国18-65岁居民(全国)
时间2026年2月起每周
规模以官方为准
许可许可待核验
获取Harvard Dataverse和KOSSDA
查看字段与详情

内容与字段

该数据集包含每周调查的匿名微观数据、问卷和代码簿。调查模块涵盖:认知与体验、近期使用行为、目的与任务、付费情况、品牌表现、技术DNA与用户画像、社会影响。来源页未公开具体字段名列表。

适用研究

适用于生成式AI市场采用动态、品牌竞争格局、用户行为与付费转化、技术人格与社会影响等研究。

本卡由来源页信息起草,机构/覆盖/时间/规模/字段与许可以官方为准(待人工核验)。

自行获取的难点

获取韩国生成式AI消费者采用的高频追踪微观数据,但字段级说明缺失,需结合问卷和代码簿自行解析。

经济与社会科学免费访问

法院年度报告——10年比较 Courts - Annual Report - 10 Yr Comparison

由不列颠哥伦比亚省政府法院服务处发布的10年法院活动报告,按法院层级、分部和类别统计庭审时长、排期、新收及结案案件数。

机构Government of British Columbia (Court Services Branch)
覆盖不列颠哥伦比亚省法院
时间2015-16 至 2024-25 财年
规模4个文件(XLSX, CSV, HTML仪表盘, 元数据链接)
许可许可待核验
获取Open Canada 门户直接下载 XLSX 和 CSV
查看字段与详情

内容与字段

该数据集包含2015-16至2024-25财年不列颠哥伦比亚省法院活动的年度统计数据,按法院层级、分部和类别汇总。主要指标包括庭审时长(Session Hours)、排期出庭次数(Scheduled Court Appearances)、新收案件数(New Court Cases)和结案数(Concluded Cases)。数据以XLSX和CSV格式提供,另附Power BI仪表盘链接。

  • Session Hours——案件在法庭审理的时间量
  • Scheduled Court Appearances——案件排期出庭的次数(如首次出庭、案件会议、审判、量刑)
  • New Court Cases——法院收到的新立案数量,包括从其他登记处转移的案件
  • Concluded Cases——省级法院刑事案件中所有指控均有最终处置记录的案件数

适用研究

可用于分析法院工作量趋势、案件处理效率、司法资源配置及长期变化模式,支持司法行政与公共政策研究。

本卡由来源页信息起草,机构/覆盖/时间/规模/字段与许可以官方为准(待人工核验)。

自行获取的难点

获取法院多年活动数据时,常需跨财年比较,但字段定义和统计口径可能变化,需仔细核对元数据。

经济与社会科学免费访问

1800年以来地点、人口、降水与战争数据集 Place, Population, Precipitation, War since 1800

该数据集提供自1800年以来全球地点、人口、降水和战争的关联样本数据,包含四个可直接组合的工作表。

机构以官方为准
覆盖全球
时间1800年至今
规模1个文件
许可许可待核验
获取Harvard Dataverse
查看字段与详情

内容与字段

该数据集包含四个工作表,分别涉及地点、人口、降水和战争信息,用户可自行组合。来源页未公开字段级说明。

适用研究

适用于历史地理、人口学、气候与冲突关联研究等方向。

本卡由来源页信息起草,机构/覆盖/时间/规模/字段与许可以官方为准(待人工核验)。

自行获取的难点

获取历史时期多源数据(地点、人口、降水、战争)的关联样本,但字段细节不明确。

经济与社会科学免费访问

纽约商会鸦片出口数据(1870-1912) Opium export data for New York Chamber of Commerce 1870-1912

该数据集包含1870至1912年纽约商会记录的鸦片出口数据,涵盖纽约港及美国其他港口年度出口总量,由World-Historical Dataverse发布。

机构World-Historical Dataverse
覆盖美国(纽约港及其他港口)
时间1870-1912
规模2个文件
许可许可待核验
获取Harvard Dataverse
查看字段与详情

内容与字段

该数据集包含2个文件,提供1870-1912年纽约商会记录的鸦片出口数据,包括纽约港出口量及美国其他港口年度出口总量。来源页未公开字段级说明。

适用研究

适用于19世纪末至20世纪初国际贸易史、鸦片贸易史、美国港口经济史等研究。

本卡由来源页信息起草,机构/覆盖/时间/规模/字段与许可以官方为准(待人工核验)。

自行获取的难点

历史贸易数据常分散于不同档案,该数据集整合了纽约商会记录的鸦片出口数据,便于研究19世纪末至20世纪初的鸦片贸易格局。

经济与社会科学免费访问

2022年猫只圈养调查 2022 Cat Containment Survey

2022年南澳大利亚猫只管理情绪调查报告,由南澳大利亚政府环境与水资源部发布,覆盖南澳大利亚州。

机构南澳大利亚政府环境与水资源部
覆盖南澳大利亚州
时间2022年
规模1个PDF文件
许可许可待核验
获取通过Data.gov.au下载PDF
查看字段与详情

内容与字段

该数据集包含一份PDF格式的调查报告,内容涉及2022年南澳大利亚猫只圈养管理情绪调查。来源页未公开字段级说明。

适用研究

可用于宠物管理政策、动物福利、社区态度等研究。

本卡由来源页信息起草,机构/覆盖/时间/规模/字段与许可以官方为准(待人工核验)。

自行获取的难点

获取猫只圈养管理情绪调查数据时,常缺乏结构化字段说明。

经济与社会科学免费访问

WGEA数据集 WGEA Dataset

澳大利亚工作场所性别平等机构(WGEA)发布的年度数据集,涵盖超过12,000家澳大利亚非公共部门雇主的性别构成、政策与策略、带薪育儿假及灵活工作安排等信息。

机构Workplace Gender Equality Agency (WGEA)
覆盖澳大利亚
时间2014年4月1日至2025年3月31日
规模49个文件
许可许可待核验
获取Data.gov.au
查看字段与详情

内容与字段

该数据集包含多个年度文件,涵盖2013-14至2024-25财年。数据文件包括公共数据文件、按ANZSIC行业分类的汇总数据、性别构成数据、数据规范、报告问卷等。字段涉及劳动力性别构成、治理机构/董事会性别构成、拥有性别平等政策/策略的组织百分比、带薪育儿假和灵活工作安排等信息。来源页未公开完整的字段级说明。

适用研究

适用于工作场所性别平等、劳动力多样性、性别薪酬差距、组织政策对性别平等的影响等研究。

本卡由来源页信息起草,机构/覆盖/时间/规模/字段与许可以官方为准(待人工核验)。

自行获取的难点

获取澳大利亚工作场所性别平等数据时,常需整合多年份文件并理解行业分类与指标定义。

经济与社会科学免费访问

国际体系数据集(ISD)2.0版 The International System(s) Dataset (ISD): Version 2.0

国际体系数据集(ISD)2.0版,由Butcher和Griffiths创建,涵盖1816年以来国家及其国际关系的数据。

机构Butcher, C. R. & Griffiths, R. D.
覆盖以官方为准
时间1816年至今
规模2个文件
许可许可待核验
获取Harvard Dataverse
查看字段与详情

内容与字段

该数据集包含2个文件,具体字段信息未在来源页公开。

适用研究

适用于国际关系、政治学、历史学等领域中关于国家体系演变、国家间关系的研究。

本卡由来源页信息起草,机构/覆盖/时间/规模/字段与许可以官方为准(待人工核验)。

自行获取的难点

获取国际关系历史数据时,常需整合多个来源,该数据集提供了标准化的国家体系数据。

经济与社会科学免费访问

自动车牌识别(ANPR)项目 Automatic number plate recognition (ANPR) project

由利兹市议会发布的车辆类型与计数数据集,基于ANPR摄像头在利兹多个地点采集,用于比较本地排放与国家预测。

机构Leeds City Council
覆盖英国利兹市多个地点,包括内环公路及市内7个站点
时间2016年4月(内环公路)和2016年6月(市内7个站点)
规模以官方为准
许可许可待核验
获取data.gov.uk 及 datamillnorth.org 直接下载
查看字段与详情

内容与字段

数据集包含三个文件夹:原始数据(Raw Data)、处理后数据(Processed Data)和输出(Outputs)。原始数据包含ANPR匹配的车辆类型列表(如IRR ANPR matched to DFT vehicle type list.csv),处理后数据包含查找表和样本数据,输出为按站点和时间汇总的Excel电子表格。字段包括伪注册号(UniqueID)、车辆描述、Eurostandard等级、车辆类别(VehicleClass)、EU等级、修改后的总重(GVM_Mod)、发动机排量(EngineCC_mod)、乘客座位数(PassSeats)、整备质量(KerbWt)等。

  • UniqueID——匿名化的车辆唯一标识
  • VehicleClass——车辆类别(如轿车、货车)
  • EU class——欧盟排放标准等级
  • GVM_Mod——修改后的总重
  • EngineCC_mod——修改后的发动机排量
  • PassSeats——乘客座位数
  • KerbWt——整备质量
  • Eurostandard——欧标排放等级
  • Journey date/time——行程日期/时间
  • Site——监测站点

适用研究

可用于城市交通排放建模、车辆类型分布分析、交通流量与排放关系研究,以及ANPR数据在环境政策评估中的应用。

本卡由来源页信息起草,机构/覆盖/时间/规模/字段与许可以官方为准(待人工核验)。

自行获取的难点

获取ANPR数据时,常需处理大量原始记录并匹配车辆排放标准,字段说明和数据处理流程不透明。

经济与社会科学免费访问

加拿大植物性状(TOPIC)开放获取数据集 Traits of Plants in Canada (TOPIC) - Open Access Dataset

由加拿大自然资源部发布的植物功能性状数据库,整合文献综述与实地观测数据,支持加拿大植物与森林生态研究。

机构Natural Resources Canada (加拿大自然资源部)
覆盖加拿大
时间以官方为准
规模4个文件
许可许可待核验
获取Open Government Portal (加拿大开放政府门户)
查看字段与详情

内容与字段

该数据集包含两个模块:文献综述模块(Literature review module)整合科学文献中的植物性状数据;实证测量模块(Empirical measurements module)汇集野外、实验室或温室观测数据集。来源页未公开字段级说明。

适用研究

适用于植物功能生态学、群落生态学、森林可持续性、森林管理、累积效应评估、生态系统恢复等研究。

本卡由来源页信息起草,机构/覆盖/时间/规模/字段与许可以官方为准(待人工核验)。

自行获取的难点

植物性状数据分散于不同来源,难以整合统一使用。

经济与社会科学免费访问

加拿大反欺诈中心欺诈报告系统数据集 Canadian Anti-Fraud Centre Fraud Reporting System Dataset

加拿大皇家骑警(RCMP)发布的欺诈与身份犯罪报告数据集,数据来源于公众向加拿大反欺诈中心提交的报告,经分析师审核。

机构Royal Canadian Mounted Police (加拿大皇家骑警)
覆盖加拿大
时间2021-01-01 至 2025-09-30
规模3个文件(1个CSV数据文件,2个PDF说明文件)
许可许可待核验
获取Open Canada 开放政府门户
查看字段与详情

内容与字段

该数据集包含一个CSV文件(2021-01-01至2025-09-30的欺诈报告数据)以及两个PDF文件(英文和法文的统计描述与定义)。来源页未公开CSV的具体字段列表。

适用研究

可用于分析加拿大欺诈与身份犯罪趋势、类型分布、地理特征及时间变化,支持公共安全与消费者保护研究。

本卡由来源页信息起草,机构/覆盖/时间/规模/字段与许可以官方为准(待人工核验)。

自行获取的难点

获取加拿大官方欺诈报告数据时,常因字段说明不完整或更新延迟而难以直接使用。

经济与社会科学免费访问

美国俄勒冈州南福克麦肯齐河野火事件前后的大型无脊椎动物数据(2019-2021) Macroinvertebrate data from the South Fork McKenzie River in Oregon, USA before and after a wildfire event, 2019 to 2021

该数据集包含美国俄勒冈州南福克麦肯齐河在2019年秋季、2020年秋季和2021年冬季(2020年秋季Holiday Farm野火前后)采集的大型无脊椎动物计数数据、性状和分类信息、生物量及样点观测数据。

机构University of Nottingham(研究实施方);数据由美国林务局、波特兰州立大学、华盛顿州立大学和科罗拉多州立大学合作采集
覆盖美国俄勒冈州南福克麦肯齐河
时间2019年秋季、2020年秋季、2021年冬季
规模2个文件(ZIP格式)
许可许可待核验
获取通过data.gov.uk直接下载ZIP文件
查看字段与详情

内容与字段

数据包含大型无脊椎动物计数数据(鉴定到物种级别)、性状和分类信息、生物量以及样点观测数据(如冠层覆盖、栖息地类型等)。来源页未公开字段级说明。

适用研究

可用于研究野火对河流底栖大型无脊椎动物群落的影响、河流恢复措施的效果评估,以及生态监测与生物多样性分析。

本卡由来源页信息起草,机构/覆盖/时间/规模/字段与许可以官方为准(待人工核验)。

自行获取的难点

获取野火前后大型无脊椎动物数据时,常需整合多个时间点和恢复状态的数据,但字段细节和许可信息不明确。

经济与社会科学免费访问

NI 090 - 14-19岁学习文凭的接受率 NI 090 - Take up of 14-19 Learning Diplomas

该数据集记录了英国14-19岁学生注册学习文凭的人数,基于Minerva系统和ONS人口估计,涵盖14个行业领域。

机构Ministry of Housing, Communities and Local Government
覆盖英国
时间2008-2010(首次教学年份)
规模1个文件(XLS格式)
许可许可待核验
获取data.gov.uk
查看字段与详情

内容与字段

该数据集包含一个XLS文件,记录了14-19岁学生注册学习文凭的人数。数据基于Minerva系统,并参照英国国家统计局(ONS)的人口估计。来源页未公开字段级说明。

适用研究

可用于分析英国14-19岁教育文凭的接受情况,评估不同行业领域文凭的普及程度,以及随时间变化的趋势。

本卡由来源页信息起草,机构/覆盖/时间/规模/字段与许可以官方为准(待人工核验)。

自行获取的难点

获取英国14-19岁学习文凭注册人数的官方统计数据,但字段说明不明确。

经济与社会科学免费访问

美国专利分类系统的长期动态 Long-run dynamics of the US patent classification system

该数据集包含François Lafond和Daniel Kim论文中使用的多个文件,涵盖1836-2015年美国专利分类系统类别数量的演变,以及1976-2015年授权专利的原始和当前分类数据。

机构François Lafond and Daniel Kim
覆盖美国专利分类系统
时间以官方为准
规模7个文件
许可许可待核验
获取Harvard Dataverse
查看字段与详情

内容与字段

该数据集包含7个文件,用于支持论文分析。文件包括:美国专利分类系统类别数量演变数据(1836-2015),以及1976-2015年授权专利在授权时和2015年的原始与当前主分类数据(类别级别)。来源页未公开字段级说明。

适用研究

适用于专利分类体系演变、技术变迁、创新经济学等研究领域。

本卡由来源页信息起草,机构/覆盖/时间/规模/字段与许可以官方为准(待人工核验)。

自行获取的难点

获取专利分类系统长期演变的结构化数据时,常需从论文补充材料中提取,字段说明不完整。

经济与社会科学免费访问

北极与亚北极海豹物种生活史特征与适应策略比较分析数据集 A comparative analysis of life-history features and adaptive strategies of Arctic and subarctic seal species - who will win the climate change challenge?

该数据集包含加拿大北极地区四种海豹(环斑海豹、髯海豹、竖琴海豹、斑海豹)的生活史特征数据,由加拿大渔业与海洋部发布,数据来自因纽特人自给性捕猎。

机构Fisheries and Oceans Canada
覆盖加拿大北极地区
时间以官方为准
规模4个文件
许可许可待核验
获取Open Canada
查看字段与详情

内容与字段

该数据集包含2024年发表在《Canadian Journal of Zoology》上的研究数据,包括物种、地点、捕捞日期、性别、年龄、标准体长、周长、脂肪厚度、睾丸大小、产次状态、怀孕状态、黄体数、白体数、卵泡数等字段。数据为原始、未过滤、未处理的历史数据,由捕捞者提供,未进行异常值筛选。

  • species——海豹物种
  • location——采样地点
  • harvest date——捕捞日期
  • sex——性别
  • age——年龄
  • standard length——标准体长
  • girth——周长
  • fat depth——脂肪厚度
  • teste size——睾丸大小
  • parity status——产次状态
  • pregnancy status——怀孕状态
  • corpora lutea (n)——黄体数

适用研究

适用于气候变化背景下北极与亚北极海豹物种的分布变迁、生活史策略比较、适应性进化等生态与保护生物学研究。

本卡由来源页信息起草,机构/覆盖/时间/规模/字段与许可以官方为准(待人工核验)。

自行获取的难点

获取北极海豹生活史原始观测数据时,常面临数据分散、字段说明不完整、需自行筛选异常值等问题。

经济与社会科学免费访问

冰岛地热与常温环境野生及实验室饲养三刺鱼形态数据 Morphological data from wild and lab-reared threespine sticklebacks from Icelandic geothermal and ambient sites

该数据集包含冰岛地热与常温环境野生及实验室饲养三刺鱼的形态测量数据,由NERC EDS环境信息数据中心发布。

机构NERC EDS Environmental Information Data Centre
覆盖冰岛地热与常温环境
时间2023-09-29(出版日期)
规模2个文件
许可许可待核验
获取以官方为准
查看字段与详情

内容与字段

数据包含野生、F1和F2实验室饲养三刺鱼的形态测量数据,文件为tps格式,包含种群、饲养温度和缩放因子信息。还提供CSV格式的种群代码键,以及F2杂交鱼的对应照片。来源页未公开字段级说明。

适用研究

可用于研究环境温度对鱼类形态的影响、几何形态测量学方法应用、以及地热环境与常温环境下的种群差异。

本卡由来源页信息起草,机构/覆盖/时间/规模/字段与许可以官方为准(待人工核验)。

自行获取的难点

获取冰岛三刺鱼形态数据时,常需同时下载tps文件和CSV键文件,且需注意数据许可条款。

经济与社会科学免费访问

澳大利亚职业教育与培训统计 Australian Vocational Education and Training (VET) statistics

澳大利亚职业教育与培训统计数据集,由NCVER提供,涵盖学生注册、资格、学徒及毕业生调查数据,每年约200万学生注册。

机构National Centre for Vocational Education Research (NCVER)
覆盖澳大利亚
时间以官方为准
规模7个文件
许可许可待核验
获取NCVER网站
查看字段与详情

内容与字段

该数据集包含多个子集:学生与课程、学徒与受训者、学生成果调查等。涵盖学生注册、资格获得、人口统计信息、培训地点、课程分类(按预期职业和学科领域)、毕业生就业结果、薪资等。具体字段包括:

  • 学生注册——每年约200万学生注册信息
  • 毕业生——每年约40万毕业生数据
  • 学徒与受训者——约40万在训人员
  • 学生人口统计——学生人口统计信息
  • 培训资格——所培训的资格信息
  • 培训地点——培训发生地点
  • 课程分类——按完成后的预期职业分类
  • 学科领域——学习领域
  • 毕业生调查——培训质量、培训前后职业、薪资、继续教育

适用研究

适用于职业教育与培训政策分析、劳动力市场研究、教育成果评估、行业技能需求分析等。

本卡由来源页信息起草,机构/覆盖/时间/规模/字段与许可以官方为准(待人工核验)。

自行获取的难点

获取澳大利亚VET统计数据时,常需区分多个子集并理解字段定义,且数据需通过NCVER网站注册获取。

经济与社会科学免费访问

房价指数 House Price Index

英国住房、社区与地方政府部发布的英格兰房价指数数据集,提供房价表格数据。

机构Ministry of Housing, Communities and Local Government
覆盖英格兰
时间以官方为准
规模1个文件
许可许可待核验
获取data.gov.uk
查看字段与详情

内容与字段

该数据集包含英格兰房价指数表格,来源页未公开字段级说明。

适用研究

可用于分析英格兰房价趋势、住房市场研究及政策评估。

本卡由来源页信息起草,机构/覆盖/时间/规模/字段与许可以官方为准(待人工核验)。

自行获取的难点

获取英格兰房价指数时,常需明确时间范围和字段定义。

经济与社会科学免费访问

小区域房价——销售年份 House Prices by Small Area - Sale Year

墨尔本市按CLUE小区域划分的住宅/联排别墅和公寓销售年份中位价数据。

机构City of Melbourne
覆盖墨尔本市(City of Melbourne)
时间以官方为准
规模4个文件(CSV, JSON, KML, XLS)
许可许可待核验
获取Data.gov.au
查看字段与详情

内容与字段

该数据集包含墨尔本市按CLUE小区域划分的住宅/联排别墅和公寓销售年份中位价。来源页未公开字段级说明。

适用研究

可用于分析墨尔本不同小区域住宅价格的时间变化趋势,支持城市经济学、住房政策研究。

本卡由来源页信息起草,机构/覆盖/时间/规模/字段与许可以官方为准(待人工核验)。

自行获取的难点

获取墨尔本小区域房价中位价数据时,常因字段说明不完整而难以直接使用。

经济与社会科学访问条件待核验

自动驾驶:自闭症及其他残疾人士的车内体验与焦点小组随访 CAIT-UTC-REG 21: Autonomous Vehicles: Capturing In-Vehicle Experience and Focus Group Follow-up with Persons with Autism and Other Disabilit

本研究通过四次自动驾驶班车体验和焦点小组,收集残疾人士对自动驾驶车辆的直接体验和反馈,旨在为包容性设计提供依据。

机构以官方为准
覆盖残疾人士(包括自闭症及其他残疾)
时间2019年
规模1个文件
许可许可待核验
获取Harvard Dataverse
查看字段与详情

内容与字段

该数据集包含一份文件,记录了残疾人士在自动驾驶车辆中的体验和焦点小组讨论结果。来源页未公开字段级说明。

适用研究

可用于自动驾驶包容性设计、残疾人士出行需求、人机交互体验等研究。

本卡由来源页信息起草,机构/覆盖/时间/规模/字段与许可以官方为准(待人工核验)。

自行获取的难点

获取残疾人士对自动驾驶的真实体验数据困难,本数据集提供了直接体验后的反馈。

经济与社会科学访问条件待核验

澳大利亚人口普查纵向数据集微数据,2006-2011 Microdata: Australian Census Longitudinal Dataset, 2006-2011

该数据集由澳大利亚统计局发布,将2006年与2011年人口普查5%样本链接,形成纵向研究工具,用于探索澳大利亚社会随时间的变化。

机构Australian Bureau of Statistics
覆盖澳大利亚
时间2006-2011
规模以官方为准
许可许可待核验
获取通过ABS TableBuilder或ABS Data Laboratory获取
查看字段与详情

内容与字段

该数据集包含2006年和2011年澳大利亚人口普查5%样本的链接记录,提供个体层面的纵向数据。字段包括年龄、性别、出生地、婚姻状况、语言、宗教、学历、职业、配偶信息等。来源页未公开完整的字段列表,但标签中提及以下字段:

  • age——年龄
  • sex——性别
  • birthplace——出生地
  • marital status——婚姻状况
  • language——语言
  • religion——宗教
  • qualification——学历
  • occupation——职业
  • spouse——配偶
  • year of arrival——抵达年份
  • Indigenous status——原住民身份
  • SA1, SA2, SA4——地理区域编码

适用研究

适用于纵向社会人口学研究,如人口流动、就业变迁、家庭结构变化、教育与社会经济地位的关系等。

本卡由来源页信息起草,机构/覆盖/时间/规模/字段与许可以官方为准(待人工核验)。

自行获取的难点

获取纵向人口普查微数据时,常需通过特定工具(如TableBuilder)访问,且字段细节不透明。

经济与社会科学免费访问

生活在收入中位数50%以下的人口比例(%) Proportion of people living below 50 percent of median income (%)

生活在收入中位数50%以下的人口比例(%)由世界银行(World Bank)发布或维护。本说明从原发布方材料中确认其覆盖范围为所有国家和地区,当前共有 23 项事实通过逐字引用核验;来源未说明的内容保持为空,不由模型推断。

机构世界银行(World Bank)
覆盖所有国家和地区
时间各国家最近年份数据,具体年份因国家而异
规模来源未披露
许可Creative Commons Attribution 4.0 International (CC BY 4.0)
获取通过世界银行数据网站公开访问,可在线查看和下载
查看字段与详情

数据内容与结构

  • 覆盖对象或范围:所有国家和地区
  • 字段、变量或文件结构:指标代码SI.DST.50MD,包含国家、年份、数值
  • 时间覆盖:各国家最近年份数据,具体年份因国家而异
  • 观测粒度:国家-年份
  • 变量或列定义:国家(国家)、最近年份(Most Recent Year)、最近值(Most Recent Value)

适用范围与限制

  • 适用与不适用场景:适用于研究相对贫困、收入不平等、社会福利分析;不适用于绝对贫困测量或跨时期严格比较(因调查方法和收入定义可能不同)
  • 已知限制或未实测边界:数据基于家庭调查,不同国家调查方法和收入定义可能存在差异;高收入经济体数据主要来自卢森堡收入研究数据库,可能与其他来源不可比

来源与核验边界

仍未闭合的事项:

  • 数据规模:来源尚未形成可确认事实
  • 缺失值情况:来源尚未形成可确认事实
  • 平衡性与缺失口径:来源尚未形成可确认事实
  • 修订与跨期版本规则:来源尚未形成可确认事实

本卡只呈现能够回到原发布方材料的事实;公开可访问、开放许可、免费获取、商用和再分发分别判断。

适用范围与使用边界

适用方向:适用于研究相对贫困、收入不平等、社会福利分析;不适用于绝对贫困测量或跨时期严格比较(因调查方法和收入定义可能不同)。已知限制:数据基于家庭调查,不同国家调查方法和收入定义可能存在差异;高收入经济体数据主要来自卢森堡收入研究数据库,可能与其他来源不可比。

经济与社会科学免费访问

基尼系数 Gini index

基尼系数由世界银行贫困与不平等平台(世界银行(World Bank), Poverty and Inequality Platform)发布或维护。本说明从原发布方材料中确认其覆盖范围为所有国家和经济体,当前共有 19 项事实通过逐字引用核验;来源未说明的内容保持为空,不由模型推断。

机构世界银行贫困与不平等平台(世界银行(World Bank), Poverty and Inequality Platform)
覆盖所有国家和经济体
时间各国以最近可得年份为准;页面提供历史数据,但未完整说明全部时间范围。
规模页面未说明
许可CC BY-4.0
获取可通过交互式图表页面查看和下载数据,也可通过世界银行 API(世界银行(World Bank) API)获取
查看字段与详情

数据内容与结构

  • 覆盖对象或范围:所有国家和经济体
  • 数据规模:页面未说明
  • 字段、变量或文件结构:国家、最近年份、最近数值
  • 时间覆盖:各国以最近可得年份为准;页面提供历史数据,但未完整说明全部时间范围。

适用范围与限制

  • 适用与不适用场景:适合开展跨国收入不平等比较;不适合直接用于次国家级分析或高频时间序列研究。
  • 已知限制或未实测边界:数据基于住户调查,各国调查方法可能不同;并非所有国家均覆盖全部年份,页面默认只显示最近一期数值。

来源与核验边界

当前必需事实已闭合,仍需保留版本与使用条件复核。

本卡只呈现能够回到原发布方材料的事实;公开可访问、开放许可、免费获取、商用和再分发分别判断。

适用范围与使用边界

适用方向:适合开展跨国收入不平等比较;不适合直接用于次国家级分析或高频时间序列研究。。已知限制:数据基于住户调查,各国调查方法可能不同;并非所有国家均覆盖全部年份,页面默认只显示最近一期数值。。

经济与社会科学免费访问

人口中最贫困的40%的人均实际调查平均消费或收入的年化平均增长率 Annualized average growth rate in per capita real survey mean consumption or income, bottom 40% of population (%)

人口中最贫困的40%的人均实际调查平均消费或收入的年化平均增长率由世界银行(World Bank)发布或维护。本说明从原发布方材料中确认其覆盖范围为覆盖全球所有国家和经济体;其中高收入经济体的数据主要来自卢森堡收入研究数据库(Luxembourg Income Study),当前共有 23 项事实通过逐字引用核验;来源未说明的内容保持为空,不由模型推断。

机构世界银行(World Bank)
覆盖覆盖全球所有国家和经济体;其中高收入经济体的数据主要来自卢森堡收入研究数据库(Luxembourg Income Study)
时间采用各国最近可得年份,具体年份因国家而异。
规模来源未披露
许可Creative Commons Attribution 4.0 International (CC BY 4.0)
获取可通过世界银行数据网站公开访问,并可在网页界面查看和下载数据。
查看字段与详情

数据内容与结构

  • 覆盖对象或范围:覆盖全球所有国家和经济体;其中高收入经济体的数据主要来自卢森堡收入研究数据库(Luxembourg Income Study)
  • 字段、变量或文件结构:指标代码 SI.SPR.PC40.ZG、国家、最近年份、最近数值
  • 时间覆盖:采用各国最近可得年份,具体年份因国家而异。
  • 观测粒度:国家—年份
  • 变量或列定义:国家(地理实体)、最近年份(观测年份)、最近数值(以百分比表示的年化平均增长率)

适用范围与限制

  • 适用与不适用场景:适合分析共享繁荣以及收入最低 40% 人口的增长情况;在没有补充数据时,不适合个体层面分析或次国家级比较。
  • 已知限制或未实测边界:数据基于原始住户调查;该页面未完整说明方法细节,高收入经济体的数据主要来自卢森堡收入研究数据库(Luxembourg Income Study)。

来源与核验边界

仍未闭合的事项:

  • 数据规模:来源尚未形成可确认事实
  • 缺失值情况:来源尚未形成可确认事实
  • 平衡性与缺失口径:来源尚未形成可确认事实
  • 修订与跨期版本规则:来源尚未形成可确认事实

本卡只呈现能够回到原发布方材料的事实;公开可访问、开放许可、免费获取、商用和再分发分别判断。

适用范围与使用边界

适用方向:适合分析共享繁荣以及收入最低 40% 人口的增长情况;在没有补充数据时,不适合个体层面分析或次国家级比较。。已知限制:数据基于原始住户调查;该页面未完整说明方法细节,高收入经济体的数据主要来自卢森堡收入研究数据库(Luxembourg Income Study)。。

经济与社会科学免费访问

CPIA 商业监管环境评级(1=低 至 6=高) CPIA business regulatory environment rating (1=low to 6=high)

CPIA 商业监管环境评级(1=低 至 6=高)由世界银行集团(世界银行集团(世界银行(World Bank) Group),WBG)发布或维护。本说明从原发布方材料中确认其覆盖范围为所有国家和经济体,当前共有 17 项事实通过逐字引用核验;来源未说明的内容保持为空,不由模型推断。

机构世界银行集团(世界银行集团(世界银行(World Bank) Group),WBG)
覆盖所有国家和经济体
时间Most Recent Year (逐年更新)
规模来源未披露
许可CC BY-4.0
获取公开网页浏览,可通过 世界银行(World Bank) Data Catalog 下载
查看字段与详情

数据内容与结构

  • 覆盖对象或范围:所有国家和经济体
  • 字段、变量或文件结构:指标代码 IQ.CPA.BREG.XQ、国家、最近年份、最近数值
  • 时间覆盖:Most Recent Year (逐年更新)

适用范围与限制

  • 适用与不适用场景:适用于跨国商业监管环境比较分析、学术研究、政策制定;不适用于微观企业层面分析
  • 已知限制或未实测边界:数据为年度国家层面评级,不提供子国家或企业级数据;评级主观性较强,基于专家评估

来源与核验边界

仍未闭合的事项:

  • 数据规模:来源尚未形成可确认事实
  • 版本或发布日期:来源尚未形成可确认事实

本卡只呈现能够回到原发布方材料的事实;公开可访问、开放许可、免费获取、商用和再分发分别判断。

适用范围与使用边界

适用方向:适用于跨国商业监管环境比较分析、学术研究、政策制定;不适用于微观企业层面分析。已知限制:数据为年度国家层面评级,不提供子国家或企业级数据;评级主观性较强,基于专家评估。

经济与社会科学免费访问

CPIA债务政策评级(1=低至6=高) CPIA debt policy rating (1=low to 6=high)

CPIA债务政策评级(1=低至6=高)由世界银行集团(世界银行集团(世界银行(World Bank) Group),WBG)发布或维护。本说明从原发布方材料中确认其覆盖范围为所有国家和经济体,当前共有 18 项事实通过逐字引用核验;来源未说明的内容保持为空,不由模型推断。

机构世界银行集团(世界银行集团(世界银行(World Bank) Group),WBG)
覆盖所有国家和经济体
时间仅提供每个国家的最新年份数据,未提供完整时间范围
规模来源未披露
许可CC BY-4.0
获取公开网页浏览,可通过世界银行数据目录在线访问
查看字段与详情

数据内容与结构

  • 覆盖对象或范围:所有国家和经济体
  • 字段、变量或文件结构:国家、最近年份、最近数值
  • 时间覆盖:仅提供每个国家的最新年份数据,未提供完整时间范围

适用范围与限制

  • 适用与不适用场景:适用于研究、分析、政策制定等场景,需遵守知识共享署名许可(CC BY-4.0)署名要求
  • 已知限制或未实测边界:仅包含国家、最近年份和最近值三个字段,未提供完整时间序列或详细元数据

来源与核验边界

仍未闭合的事项:

  • 数据规模:来源尚未形成可确认事实

本卡只呈现能够回到原发布方材料的事实;公开可访问、开放许可、免费获取、商用和再分发分别判断。

适用范围与使用边界

适用方向:适用于研究、分析、政策制定等场景,需遵守CC BY-4.0署名要求。已知限制:仅包含国家、最近年份和最近值三个字段,未提供完整时间序列或详细元数据。

经济与社会科学免费访问

外国直接投资净流出(国际收支,现价美元) Foreign direct investment, net outflows (BoP, current US$)

外国直接投资净流出(国际收支,现价美元)由世界银行集团(世界银行(World Bank) Group)发布或维护。本说明从原发布方材料中确认其覆盖范围为所有国家和经济体,当前共有 22 项事实通过逐字引用核验;来源未说明的内容保持为空,不由模型推断。

机构世界银行集团(世界银行(World Bank) Group)
覆盖所有国家和经济体
时间最近年份(具体年份因国家而异)
规模来源未披露
许可Creative Commons Attribution 4.0 International (CC BY 4.0)
获取公开网页浏览,可通过 世界银行(World Bank) API 获取
查看字段与详情

数据内容与结构

  • 覆盖对象或范围:所有国家和经济体
  • 字段、变量或文件结构:国家、最近年份、最近数值(百万)
  • 时间覆盖:最近年份(具体年份因国家而异)
  • 序列长度或观测时长:每个国家一个最近年份数据点
  • 量纲和单位:百万美元(现价)

适用范围与限制

  • 适用与不适用场景:适用于国际经济学研究、跨国投资分析、政策制定参考;不适用于微观企业层面分析或实时交易决策
  • 已知限制或未实测边界:数据来源于 IMF 国际收支数据库,并补充自 UNCTAD 和官方国家来源,可能存在统计口径差异和修订;仅提供最近年份数据,未提供完整时间序列

来源与核验边界

仍未闭合的事项:

  • 数据规模:来源尚未形成可确认事实

本卡只呈现能够回到原发布方材料的事实;公开可访问、开放许可、免费获取、商用和再分发分别判断。

适用范围与使用边界

适用方向:适用于国际经济学研究、跨国投资分析、政策制定参考;不适用于微观企业层面分析或实时交易决策。已知限制:数据来源于 IMF 国际收支数据库,并补充自 UNCTAD 和官方国家来源,可能存在统计口径差异和修订;仅提供最近年份数据,未提供完整时间序列。

经济与社会科学免费访问

外国直接投资 Foreign Direct Investment

外国直接投资由英国国家统计局(Office for National Statistics)发布或维护。本说明从原发布方材料中确认其覆盖范围为覆盖英国(UK)外国直接投资的流量、头寸(存量)和收益,包括流入与流出,并按国家、组成部分和行业划分。,当前共有 23 项事实通过逐字引用核验;来源未说明的内容保持为空,不由模型推断。

机构英国国家统计局(Office for National Statistics)
覆盖覆盖英国(UK)外国直接投资的流量、头寸(存量)和收益,包括流入与流出,并按国家、组成部分和行业划分。
时间数据集页面未说明
规模未说明
许可UK Open Government Licence (OGL)
获取通过数据集页面中的 HTML 链接访问;资源包括“UK foreign direct investment, trends and analysis”等 HTML 页面。
查看字段与详情

数据内容与结构

  • 覆盖对象或范围:覆盖英国(UK)外国直接投资的流量、头寸(存量)和收益,包括流入与流出,并按国家、组成部分和行业划分。
  • 时间覆盖:数据集页面未说明
  • 观测粒度:数据集页面未说明
  • 字段、变量或文件结构:数据集页面未提供
  • 变量或列定义:数据集页面未提供
  • 数据规模:未说明

适用范围与限制

  • 适用与不适用场景:适合经济分析、政策研究和有关英国(UK)外国直接投资趋势及模式的学术研究。
  • 已知限制或未实测边界:数据集页面未提供详细数据字典或字段结构;页面仅链接 HTML 报告,无法直接取得实际数据文件;时间覆盖和数据粒度也未说明。

来源与核验边界

当前必需事实已闭合,仍需保留版本与使用条件复核。

本卡只呈现能够回到原发布方材料的事实;公开可访问、开放许可、免费获取、商用和再分发分别判断。

适用范围与使用边界

适用方向:适合经济分析、政策研究和有关英国(UK)外国直接投资趋势及模式的学术研究。。已知限制:数据集页面未提供详细数据字典或字段结构;页面仅链接 HTML 报告,无法直接取得实际数据文件;时间覆盖和数据粒度也未说明。。

经济与社会科学免费访问

森林面积(平方公里) Forest area (sq. km)

森林面积(平方公里)由联合国粮食及农业组织(FAO)发布或维护。本说明从原发布方材料中确认其覆盖范围为所有国家和经济体,当前共有 30 项事实通过逐字引用核验;来源未说明的内容保持为空,不由模型推断。

机构联合国粮食及农业组织(FAO)
覆盖所有国家和经济体
时间采用各国最近可得年份,具体年份因国家而异。
规模来源未披露
许可CC BY-4.0
获取网页提供交互式表格和下载选项。
查看字段与详情

数据内容与结构

  • 覆盖对象或范围:所有国家和经济体
  • 字段、变量或文件结构:国家、最近年份、最近数值
  • 时间覆盖:采用各国最近可得年份,具体年份因国家而异。
  • 观测粒度:国家—年份
  • 变量或列定义:国家(文本)、最近年份(整数)、最近数值(数值型,sq. km)
  • 序列长度或观测时长:观测时长因国家而异,页面仅显示最近可得年份。
  • 量纲和单位:平方公里(sq. km)

适用范围与限制

  • 适用与不适用场景:适合比较各国森林面积随时间的变化;不适合直接用于次国家级分析或高时间分辨率研究。
  • 已知限制或未实测边界:数据按国家层面汇总,各国最近可得年份不同;原始来源为 FAOSTAT,需同时遵循其方法和后续修订。

来源与核验边界

仍未闭合的事项:

  • 数据规模:来源尚未形成可确认事实
  • 版本或发布日期:来源尚未形成可确认事实

本卡只呈现能够回到原发布方材料的事实;公开可访问、开放许可、免费获取、商用和再分发分别判断。

适用范围与使用边界

适用方向:适合比较各国森林面积随时间的变化;不适合直接用于次国家级分析或高时间分辨率研究。。已知限制:数据按国家层面汇总,各国最近可得年份不同;原始来源为 FAOSTAT,需同时遵循其方法和后续修订。。

公共卫生与医学

人口 · 健康 · 流行病

公共卫生与医学免费访问

人类死亡率数据库 HMD · Human Mortality Database

国际人口学界公认的死亡率与生命表权威源,统一计算方法,可直接用于精算、寿险定价与人口研究。

机构UC 伯克利 & 马普人口所
覆盖约 41 国家和地区
时间最早 1751 起(逐年)
规模约 48 个人口序列
许可许可待核验
获取免费需注册
查看字段与详情

内容与字段

分年龄/性别的死亡率、生命表、死亡数、出生数与暴露风险人口;含时期与队列两套数据,以及生命表所用原始输入数据。附属子序列:短期每周死亡数序列(STMF,用于死亡波动监测)。

适用研究

人口学、老龄化、精算与公共卫生。

更新各国滚动更新 · 格式CSV/TXT / Excel / R 接口

输入数据受各国统计机构原许可约束;元数据 2026-06 核验。

自行获取的难点

各国原始口径不一、生命表构建方法繁琐、版本更新与暴露风险人口对齐易出错,还要先注册接受协议。交由我们交付口径统一、可追溯的标准化成品。

公共卫生与医学免费访问

人类生育数据库 HFD · Human Fertility Database

发达国家高质量生育数据的国际权威源,按母亲年龄与孩次细分至生育表层级,是低生育率对标研究的可比基准。

机构马普人口所 & 维也纳人口所
覆盖约 37 国家和地区
时间各国最长序列,近期至 2024
规模时期 + 队列生育数据
许可许可待核验
获取免费需注册(另有免注册 lite)
查看字段与详情

内容与字段

四大数据块:① 汇总指标(出生数、粗出生率、总和生育率 TFR、节奏调整 TFR、平均生育年龄、队列累计生育率等);② 按年龄/孩次明细;③ 时期表与队列生育表(含 PATFR);④ 原始输入数据。统一标准化方法(Lexis 格式、人口分母、生育表计算)。

适用研究

人口学、生育与家庭动态、公共政策对标。

更新滚动更新 · 格式制表符文本 / Excel(lite)

输入数据受各国统计机构原许可约束;元数据 2026-06 核验。

自行获取的难点

各国出生与人口原始记录口径不一、年龄孩次维度参差,要自行对齐 Lexis 格式、统一分母并复算时期/队列生育表既耗时又易错。这里直接交付已标准化、可横向比较的成套数据。

公共卫生与医学免费访问

人口与健康调查 DHS Program · Demographic and Health Surveys

覆盖发展中国家的全国代表性入户调查微观数据,统一问卷口径,是全球健康与发展研究难以替代的一手来源。

机构ICF 执行(盖茨基金过渡资助)
覆盖90+ 国家 · 400+ 次调查
时间1984 年至今
规模全国代表性入户微观数据
许可许可待核验
获取免费需申请(24–48h 审核)
查看字段与详情

内容与字段

生育与总和生育率、计划生育与避孕、孕产妇与儿童健康(免疫、患病与存活)、营养、HIV 与疟疾、生物标志物等模块;按记录文件组织(妇女/儿童/家户/男性/HIV 等)。调查类型含标准 DHS、疟疾指标调查、艾滋指标调查、服务提供评估等。

适用研究

全球健康、人口与发展经济学。

格式Stata / SPSS / SAS / ASCII;汇总指标 STATcompiler / API · 更新国家+轮次滚动

微观数据需按项目说明申请、限定用途;元数据 2026-06 核验。

自行获取的难点

多轮调查、多种调查类型与按记录文件拆分的字段结构,往往需要逐版本核对口径、对齐编码并跨文件关联才能用于分析。我们已完成版本梳理与字段对齐整理。

公共卫生与医学免费访问

全球疾病负担研究 GBD 2021 · Global Burden of Disease

全球疾病负担测算的公认权威基准,371 种疾病与伤害、88 种危险因素,是流行病学与卫生政策研究的高频数据源。

机构华盛顿大学 IHME
覆盖204 国家和地区 + 次国家级
时间1990–2021
规模371 病种 · 88 危险因素
许可许可待核验
获取免费需注册
查看字段与详情

内容与字段

维度取值
度量指标死亡数、DALYs、YLLs、YLDs、患病率、发病率、HALE
分层维度地点、年份、年龄、性别、病因、危险因素
单位数值 / 率 / 百分比

适用研究

疾病负担、流行病学、卫生政策评估。

版本GBD 2021 · 格式网页表 / 可视化 / CSV(GBD Results 工具)

地理粒度按国家/地区/次国家级层级描述,地名口径以中国官方为准;元数据 2026-06 核验。

自行获取的难点

病因分类、危险因素归因与多年份口径的对齐校准本就繁复,跨版本指标定义与单位换算稍有出入便会影响结论。我们已完成版本梳理与口径对照。

公共卫生与医学免费访问

全球卫生观察站 WHO GHO · Global Health Observatory

世卫组织的全球健康统计门户,覆盖 194 个成员国上千项健康指标,是国别健康比较与公共卫生研究的权威来源。

机构世界卫生组织 WHO
覆盖194 个成员国
时间多为 2000 起
规模1000+ 指标
许可许可待核验
获取免费 · API/下载
查看字段与详情

内容与字段

死亡率与预期寿命、传染病与免疫接种、非传染性疾病、卫生系统与资源、危险因素、SDG 健康指标等,按指标、国家、年份与维度组织。

适用研究

全球健康、卫生政策、流行病学、SDG 监测。

格式CSV / JSON-API · 平台GHO 数据仓库 / Athena API

CC BY-NC-SA 3.0 IGO 为非商业许可,商用须另核;以 WHO 官方为准(2026-06 核验)。

自行获取的难点

非商业许可需留意、指标维度与口径多;我们按合规口径抽取并标注许可。

公共卫生与医学访问条件待核验

全球慢性肾脏病疾病负担核心指标(YLD、YLL、DALY) Core global metrics of years lived with disability (YLDs), years of life lost (YLLs), and disability-adjusted life years (DALYs) due to impa

该数据集提供全球慢性肾脏病(CKD)的YLD、YLL和DALY核心指标,源自GBD研究,是分析CKD疾病负担时间趋势和跨国比较的刚需数据。

获取Zenodo 直接下载
许可许可待核验
时间2023-09-03 更新
规模1 个文件
查看字段与详情

内容与字段

该数据集包含一个PDF文件(inforgaphics ikf dalys.pdf),内容为慢性肾脏病(CKD)的YLD、YLL和DALY核心指标信息图,数据源自GBD研究。

适用研究

适用于全球疾病负担研究,特别是CKD的流行病学分析、跨国比较和时间趋势研究。

元数据以来源页为准(2026-07 工厂起草 · 待人工核验)。

自行获取的难点

数据以PDF信息图形式提供,需手动提取结构化数值,清洗成本较高;且仅包含CKD单一病因,非全病因数据集。

公共卫生与医学访问条件待核验

DHS项目最常见指标 The_DHS_Program_Most_Common_Indicators

该数据集提供来自人口与健康调查(DHS)项目的最常见指标的国家以下层面数值,涵盖家庭特征、生育、计划生育等主题,对发展中国家健康与营养研究是刚需。

机构The Demographic and Health Surveys (DHS) Program
覆盖发展中国家
时间最近一次调查
获取ArcGIS Open Data
查看字段与详情

内容与字段

该图层包含DHS项目最常见指标的国家以下层面数值,指标主题包括家庭特征、生育、计划生育、其他生育近端决定因素、生育偏好、早期等。数据来自最近一次调查且指标数量最多。

适用研究

适用于发展中国家家庭健康、营养、生育行为等领域的空间分析、趋势研究和政策评估。

元数据以来源页为准(2026-07 工厂起草 · 待人工核验)。

自行获取的难点

该数据为ArcGIS图层格式,需通过ArcGIS平台或API获取,可能需处理空间数据格式转换;且仅包含最近一次调查的指标,无法获取历史趋势。

公共卫生与医学免费访问

TTSwing:乒乓球挥拍与球拍运动学分析数据集 TTSwing: Table Tennis Swing and racket kinematics analysis

TTSwing是一个用于分析乒乓球挥拍动作的数据集,由来自台湾的93名精英乒乓球运动员使用嵌入9轴运动传感器的定制球拍手柄采集,提供精确的运动学数据及匿名人口统计信息。

机构以官方为准
覆盖台湾
时间以官方为准
规模93名参与者
许可许可待核验
获取Zenodo
查看字段与详情

内容与字段

该数据集包含使用定制球拍手柄(嵌入9轴运动传感器)采集的乒乓球挥拍运动学数据,以及参与者的匿名人口统计信息。数据来自93名台湾精英乒乓球运动员。

适用研究

适用于乒乓球挥拍动作分析、运动生物力学研究、运动模式识别及相关机器学习模型开发。

本卡由来源页信息起草,机构/覆盖/时间/规模/字段与许可以官方为准(待人工核验)。

自行获取的难点

运动科学领域缺乏公开的乒乓球挥拍精细运动学数据集,尤其是来自精英运动员的高质量数据。

公共卫生与医学免费访问

烹饪风扇干预研究数据集 Cooking Fan Intervention Study Dataset

加拿大卫生部发布的烹饪风扇干预研究数据集,包含不同流量抽油烟机在烹饪期间及之后减少空气污染暴露的测试结果。

机构Health Canada
覆盖加拿大安大略省渥太华加拿大住房技术中心的双子研究房屋
时间以官方为准
规模6个文件(XLS、CSV、数据字典各含英法双语版本)
许可许可待核验
获取Open Government Portal(直接下载XLS、CSV、TXT格式)
查看字段与详情

内容与字段

该数据集包含在燃气灶上重复60次相同烹饪协议的结果,测试了三种抽油烟机在六种不同流量下的效果,连续测量超细颗粒物(UFP)、细颗粒物(PM2.5)、二氧化氮(NO2)和一氧化氮(NO)。数据包括烹饪测试后污染物的衰减率、峰值浓度、源排放率和综合暴露量。来源页提供了数据字典(TXT格式),但未公开具体字段列表。

适用研究

适用于室内空气质量、烹饪排放控制、抽油烟机效能评估、健康暴露风险评估等研究。

本卡由来源页信息起草,机构/覆盖/时间/规模/字段与许可以官方为准(待人工核验)。

自行获取的难点

室内空气质量研究中,烹饪排放暴露数据常缺乏系统性的抽油烟机干预对比实验数据,本数据集提供了标准化的多流量测试结果。

公共卫生与医学免费访问

本地居民访问的前三大非本地急症护理医院,2011/2012财年 Top 3 Non-Local Acute Care Hospitals Accessed by Local Residents, Fiscal Year 2011/2012

该数据集由阿尔伯塔省政府发布,提供2011/2012财年本地居民访问的前三大非本地急症护理医院的住院分离数据,覆盖阿尔伯塔省132个本地地理区域。

机构Government of Alberta
覆盖阿尔伯塔省132个本地地理区域及省级层面
时间2011/2012财年
规模以官方为准
许可许可待核验
获取Open Canada
查看字段与详情

内容与字段

该数据集包含一个XLSX文件,记录了本地居民访问的前三大非本地急症护理医院的住院分离次数。住院分离指患者因死亡、出院、违背医嘱离院或转院而离开医疗机构。数据按本地地理区域(如Lacombe、Red Deer、Calgary West Bow等)和阿尔伯塔省层面提供。来源页未公开字段级说明。

适用研究

可用于分析阿尔伯塔省居民跨区域就医模式、医院服务利用情况,以及评估非本地急症护理资源的可及性。

本卡由来源页信息起草,机构/覆盖/时间/规模/字段与许可以官方为准(待人工核验)。

自行获取的难点

研究阿尔伯塔省居民跨区域就医行为时,常需获取非本地医院利用数据,但此类数据分散且字段说明不足。

公共卫生与医学免费访问

国家饮食与营养调查:第5-9年 National Diet and Nutrition Survey: Years 5-9

英国食品标准局发布的连续横截面调查数据,评估英国私人住户中1.5岁及以上人群的饮食、营养摄入和营养状况。

机构Food Standards Agency
覆盖英国私人住户中1.5岁及以上人群
时间以官方为准
规模25个文件
许可许可待核验
获取data.gov.uk
查看字段与详情

内容与字段

该数据集包含25个PDF和XLSX文件,涵盖调查问卷、方法附录、时间趋势分析表格等。来源页未公开字段级说明。

适用研究

可用于英国人群饮食结构、营养摄入状况、营养状况的时间趋势分析,以及不同收入水平与饮食关系的比较研究。

本卡由来源页信息起草,机构/覆盖/时间/规模/字段与许可以官方为准(待人工核验)。

自行获取的难点

获取英国全国代表性饮食与营养调查的详细附录和方法文档,但字段级数据需另行申请。

公共卫生与医学免费访问

诊断影像数据集统计 Diagnostic Imaging Dataset Statistics

英国NHS患者在英格兰地区的诊断影像检查月度临时数据,包含全科医生直接访问胸部影像、非产科超声和MRI脑部扫描的估计值,这些是癌症关键诊断测试。

机构Department of Health and Social Care (原Department of Health)
覆盖英格兰地区NHS患者
时间以官方为准
规模5个HTML文件
许可许可待核验
获取data.gov.uk
查看字段与详情

内容与字段

该数据集包含5个HTML文件,分别对应2012年4月至7月、4月至8月、4月至9月、4月至10月、4月至11月的临时月度数据。数据涵盖NHS患者在英格兰地区的诊断影像检查,包括全科医生直接访问胸部影像、非产科超声和MRI脑部扫描的估计值。来源页未公开字段级说明。

适用研究

可用于分析英格兰地区诊断影像检查的使用趋势、全科医生转诊模式,以及癌症诊断测试的利用情况。

本卡由来源页信息起草,机构/覆盖/时间/规模/字段与许可以官方为准(待人工核验)。

自行获取的难点

获取英格兰地区诊断影像检查的月度临时数据,特别是全科医生直接访问胸部影像、非产科超声和MRI脑部扫描的估计值。

公共卫生与医学免费访问

AIHW - 土著眼健康指标 - 验光师人数及全职等效率(PHN)2015 AIHW - Indigenous Eye Health Measures - Number and Full-time Equivalent (FTE) Rate of Optometrists (PHN) 2015

该数据集呈现2015年澳大利亚验光师人数及每10万人口全职等效(FTE)率,按2015年卫生部初级健康网络(PHN)区域汇总,数据来源于国家卫生劳动力数据集(NHWD)。

机构Australian Institute of Health and Welfare (AIHW)
覆盖澳大利亚,按2015年卫生部初级健康网络(PHN)区域汇总
时间2015年
规模以官方为准
许可许可待核验
获取AURIN Download Manager (HTML)
查看字段与详情

内容与字段

该数据集包含2015年澳大利亚验光师人数及全职等效(FTE)率,按PHN区域汇总。数据来源于NHWD,经AURIN空间化处理。来源页未公开字段级说明。

适用研究

可用于分析澳大利亚土著眼健康服务可及性、验光师地理分布及劳动力规划研究。

本卡由来源页信息起草,机构/覆盖/时间/规模/字段与许可以官方为准(待人工核验)。

自行获取的难点

获取按PHN区域汇总的验光师人数及FTE率数据,用于土著眼健康服务可及性分析。

公共卫生与医学免费访问

HAALSI 第一轮干血斑C反应蛋白数据 HAALSI Wave 1 Dried Blood Spot for C-Reactive Protein

HAALSI第一轮调查中从干血斑检测的C反应蛋白(CRP)值,可关联至HAALSI调查数据。

机构Harvard Center for Population and Development Studies; MRC/Wits Rural Public Health and Health Transitions Research Unit of the University of the Witwatersrand
覆盖南非姆普马兰加省农村地区,Agincourt健康与社会人口监测系统(AHDSS)框架内
时间2014年11月至2015年11月(第一轮调查)
规模3个文件
许可许可待核验
获取Harvard Dataverse
查看字段与详情

内容与字段

该数据集包含HAALSI第一轮调查中从干血斑(DBS)检测的C反应蛋白(CRP)值。数据可通过唯一标识符(prim_key)与HAALSI调查数据合并。数据集包含3个文件,具体字段信息未公开。

适用研究

可用于研究南非农村中老年人群的炎症标志物与健康、认知功能、心血管疾病、HIV等关联的流行病学研究。

本卡由来源页信息起草,机构/覆盖/时间/规模/字段与许可以官方为准(待人工核验)。

自行获取的难点

获取特定生物标志物(CRP)数据时,常需从大型调查中提取并关联至主数据集。

公共卫生与医学免费访问

渥太华学校室内空气质量研究金属数据集 Ottawa School Indoor Air Quality Study Metals Dataset

Health Canada于2013年秋季在渥太华4所靠近主干道的学校开展室内空气质量研究,监测了PM2.5中33种元素成分的室内外浓度,本数据集呈现按干预状态和采样环境分层的描述性统计结果。

机构Health Canada
覆盖加拿大渥太华4所靠近主干道的学校
时间2013年秋季,连续32个上学日
规模2个CSV文件(英文和法文)
许可许可待核验
获取Open Canada平台直接下载CSV
查看字段与详情

内容与字段

该数据集包含PM2.5中33种元素成分的描述性统计结果,按干预状态(基线/干预)和采样环境(室内/室外)分层。来源页未公开字段级说明。

适用研究

可用于评估学校环境中PM2.5元素成分的暴露水平,支持室内空气质量干预效果评估及儿童健康风险研究。

本卡由来源页信息起草,机构/覆盖/时间/规模/字段与许可以官方为准(待人工核验)。

自行获取的难点

缺乏加拿大本地学校环境中PM2.5元素成分的暴露数据,难以评估干预措施对室内空气质量的影响。

公共卫生与医学免费访问

昆士兰州女性乳腺癌结局指标空间变异(SA2)2000-2019 AusUrbHI Spatial Variation in Indicators of Breast Cancer Outcomes for Women in Queensland (SA2) 2000-2019

该数据集由澳大利亚城市健康指标项目与昆士兰癌症委员会合作开发,提供2000-2019年昆士兰州女性乳腺癌结局的七个空间指标,基于贝叶斯统计建模,以SA2区域呈现。

机构Australian Urban Research Infrastructure Network (AURIN); Cancer Council Queensland
覆盖昆士兰州(Queensland, Australia),以SA2区域(2016 ASGS)为空间单元
时间2000-2019
规模以官方为准
许可许可待核验
获取通过AURIN下载管理器获取(https://adp-access.aurin.org.au/dataset/ausurbhi_breast_cancer_outcome_spatial_variation)
查看字段与详情

内容与字段

数据集包含七个乳腺癌结局指标,每个指标以标准化发病率比(SIR)形式呈现,附带95%可信区间和后验概率差(ppd)。数据以表格结构存储,每行对应一个SA2区域,列包含区域编码、名称、城市分类及各项指标值。字段定义如下:

  • sa2——2016 ASGS的五位数字SA2编码
  • sa2name——每个SA2区域的名称
  • urban——分类变量:1=布里斯班/黄金海岸,2=凯恩斯,3=昆士兰其他地区
  • sir_incidence——乳腺癌发病率的标准化发病率比(SIR)
  • low_cri_incidence——sir_incidence的95%可信区间下限
  • high_cri_incidence——sir_incidence的95%可信区间上限
  • ppd_incidence——sir_incidence的后验概率差,>0.6表示与昆士兰平均水平有显著差异
  • sir_localised——局限性乳腺癌诊断比例的SIR
  • sir_survive5yrs——诊断后至少存活5年的SIR
  • sir_hospitalization——住院率的SIR
  • sir_surgery——乳腺癌手术率的SIR
  • sir_screen——定期乳腺癌筛查率的SIR

适用研究

适用于乳腺癌结局的地理差异分析、空间流行病学研究、健康不平等评估、公共卫生规划及癌症监测研究。

本卡由来源页信息起草,机构/覆盖/时间/规模/字段与许可以官方为准(待人工核验)。

自行获取的难点

研究昆士兰州乳腺癌结局的空间变异时,缺乏整合了发病率、诊断分期、生存率、住院、手术、筛查及治疗体验等多维度指标的SA2层面数据。

公共卫生与医学免费访问

心理健康:常见心理健康问题患病率 Mental health: Prevalence of common mental health problems

该数据集提供英格兰地区常见心理健康问题(神经症障碍)的患病数量和比例,数据来源于英国卫生部国家精神病发病率调查,由东北公共卫生观察站心理健康观察站发布。

机构Mental Health Observatory: North East Public Health Observatory
覆盖英格兰
时间2006年
规模以官方为准
许可许可待核验
获取data.gov.uk
查看字段与详情

内容与字段

该数据集包含神经症障碍(包括恐惧症、抑郁发作、广泛性焦虑障碍、强迫症和惊恐障碍)的患病数量和比例。数据为模型数据,地理层级包括地方当局区、郡/单一当局、政府办公区、国家和初级保健信托。来源页未公开字段级说明。

适用研究

可用于英格兰地区常见心理健康问题的流行病学研究、区域健康差异分析及卫生政策评估。

本卡由来源页信息起草,机构/覆盖/时间/规模/字段与许可以官方为准(待人工核验)。

自行获取的难点

研究英格兰地区常见心理健康问题的患病率时,常需按地理层级和年份获取数据,但原始数据字段和下载方式可能不直接提供。

公共卫生与医学免费访问

WHO国际临床试验注册平台数据集(2015年4月) WHO International Clinical Trials Registry Platform (ICTRP), April 2015

该数据集由ClinicalTrials.gov从WHO ICTRP获取并公开,包含2015年4月从16个注册中心检索的临床试验记录。

机构ClinicalTrials.gov(代表WHO ICTRP)
覆盖全球16个临床试验注册中心
时间2015年4月
规模320,790个变体,285,177条唯一记录
许可许可待核验
获取Zenodo
查看字段与详情

内容与字段

数据集包含来自16个注册中心的临床试验记录,区分“记录”(在特定注册中心注册的试验)和“变体”(同一记录的不同版本)。仅欧盟临床试验注册中心(EUCTR)的记录有多个变体(每个成员国一个)。来源页未公开字段级说明。

适用研究

可用于临床试验注册情况分析、全球试验分布研究、注册中心比较等。

本卡由来源页信息起草,机构/覆盖/时间/规模/字段与许可以官方为准(待人工核验)。

自行获取的难点

获取完整的WHO ICTRP数据集通常受限,此版本由ClinicalTrials.gov特别获取并公开,便于研究全球临床试验注册情况。

公共卫生与医学免费访问

营养生物标志物,第1周期——加拿大健康措施调查——食品与营养监测——加拿大卫生部 Nutrition Biomarkers, Cycle 1 - Canadian Health Measures Survey - Food and Nutrition Surveillance - Health Canada

加拿大卫生部发布的营养生物标志物数据集,来自加拿大健康措施调查第1周期,用于评估人群营养状况。

机构Health Canada
覆盖加拿大
时间以官方为准
规模2个文件
许可许可待核验
获取Open Canada
查看字段与详情

内容与字段

该数据集包含营养生物标志物数据,来自加拿大健康措施调查(CHMS)第1周期。来源页未公开字段级说明。

适用研究

可用于评估加拿大人口营养状况、监测营养相关健康指标、支持公共卫生政策研究。

本卡由来源页信息起草,机构/覆盖/时间/规模/字段与许可以官方为准(待人工核验)。

自行获取的难点

获取加拿大人群营养生物标志物数据时,常面临字段说明不完整、数据获取路径分散的问题。

公共卫生与医学免费访问

Lwala家庭调查2018-2019:人口统计、抑郁和经济变量 Lwala household survey 2018-2019: Demographic, depression, and economic variables

该数据集是Lwala社区联盟在肯尼亚Migori县开展的大型家庭调查的子集,包含人口统计、经济和心理健康变量,用于分析贫困与抑郁的关系。

机构Lwala Community Alliance
覆盖肯尼亚Migori县
时间2018-2019
规模以官方为准
许可许可待核验
获取Zenodo
查看字段与详情

内容与字段

该数据集包含人口统计、经济和心理健康变量,每条记录对应一位受访者,所有受访者来自不同家庭。来源页未公开字段级说明。

适用研究

可用于分析贫困与抑郁的关系,以及肯尼亚农村地区健康指标的相关研究。

本卡由来源页信息起草,机构/覆盖/时间/规模/字段与许可以官方为准(待人工核验)。

自行获取的难点

获取肯尼亚农村家庭调查中贫困与抑郁关联的微观数据时,常因字段不完整或访问限制而受阻。

公共卫生与医学免费访问

常规季度心理健康最低数据集报告 Routine Quarterly Mental Health Minimum Dataset Reports

由NHS Digital发布的英国NHS资助成人二级心理健康服务提供者定期上报的数据集,已被月度报告取代。

机构NHS Digital
覆盖英国NHS资助的成人二级心理健康服务提供者
时间以官方为准
规模6个文件
许可许可待核验
获取data.gov.uk
查看字段与详情

内容与字段

该数据集包含来自NHS资助的成人二级心理健康服务提供者的常规数据返回,称为心理健康最低数据集(MHMDS)。数据资源包括元数据文件(XLS)和多个MHMDS摘要统计文件(CSV和XLS格式)。来源页未公开字段级说明。

适用研究

可用于分析英国成人二级心理健康服务的活动、趋势和结果,支持卫生服务研究、政策评估和流行病学研究。

本卡由来源页信息起草,机构/覆盖/时间/规模/字段与许可以官方为准(待人工核验)。

自行获取的难点

获取英国成人二级心理健康服务的结构化数据时,常因数据集已被取代而难以找到历史版本。

公共卫生与医学免费访问

心理健康与无家可归报告 Mental health and homelessness report

由新南威尔士州心理健康委员会与澳大利亚住房与城市研究所合作编写的报告,探讨心理健康与无家可归的关键问题,并提出改进建议。

机构Mental Health Commission of NSW
覆盖New South Wales
时间2021-09-09(参考期)
规模1个PDF文件
许可许可待核验
获取以官方为准
查看字段与详情

内容与字段

该数据集包含一份PDF格式的报告,内容涉及心理健康与无家可归的关键问题、当前实践及改进建议。来源页未公开字段级说明。

适用研究

可用于心理健康政策、无家可归干预措施、住房与健康交叉领域的研究。

本卡由来源页信息起草,机构/覆盖/时间/规模/字段与许可以官方为准(待人工核验)。

自行获取的难点

获取心理健康与无家可归主题的官方报告,但许可不明确,需确认使用条件。

公共卫生与医学免费访问

AIHW儿童与孕产妇健康指标——低出生体重活产百分比(PHN)2012-2016 AIHW - Child and Maternal Health Indicators - Low Birthweight Live Births (%) (PHN) 2012-2016

该数据集展示了2012-2016年每两年一次的低出生体重活产百分比,按2015年卫生部初级健康网络(PHN)区域汇总,数据来源于AIHW国家死亡率数据库、出生登记和国家围产期数据收集。

机构Australian Institute of Health and Welfare (AIHW)
覆盖澳大利亚,按2015年卫生部初级健康网络(PHN)区域,基于2011年澳大利亚统计地理标准(ASGS)
时间2012-2016年,每两年一次
规模以官方为准
许可许可待核验
获取通过AURIN下载管理器获取HTML格式数据
查看字段与详情

内容与字段

该数据集包含低出生体重活产百分比的空间化数据,按PHN区域汇总。来源页未公开字段级说明。

适用研究

可用于分析澳大利亚区域低出生体重发生率及其与孕产妇健康、医疗资源分布的关系。

本卡由来源页信息起草,机构/覆盖/时间/规模/字段与许可以官方为准(待人工核验)。

自行获取的难点

获取按区域汇总的低出生体重数据时,常需自行空间化处理,且许可不明确。

公共卫生与医学免费访问

助产士密度与分布及基本产科急救授权指标验证数据 Validation Data of Indicators Measuring: Density and Distribution of Midwives and Midwives are authorized to deliver basic emergency obstetr

该数据集用于验证三项与助产士密度、分布及基本产科急救(BEmONC)功能授权相关的指标,由Harvard Dataverse发布。

机构Harvard Dataverse
覆盖以官方为准
时间2022-07-29
规模8个文件
许可许可待核验
获取Harvard Dataverse
查看字段与详情

内容与字段

该数据集包含8个文件,用于验证三项指标:1)助产专业人员密度与分布(每千人口);2)按地区(出生数)计算的助产士密度;3)助产士是否被授权提供基本产科急救(BEmONC)服务。来源页未公开字段级说明。

适用研究

可用于助产士人力资源规划、孕产妇健康服务可及性评估、以及卫生政策对助产士授权影响的研究。

本卡由来源页信息起草,机构/覆盖/时间/规模/字段与许可以官方为准(待人工核验)。

自行获取的难点

验证助产士相关指标时,常缺乏可直接用于比较的验证数据集。

公共卫生与医学免费访问

加拿大罕见病药物监管方法:查找临床试验 Canada’s regulatory approach to drugs for rare diseases: find clinical trials

Health Canada授权的加拿大罕见病药物临床试验公开列表,提供试验相关信息。

机构Health Canada
覆盖加拿大
时间以官方为准
规模2个文件
许可许可待核验
获取Open Canada
查看字段与详情

内容与字段

该数据集为Health Canada授权的加拿大罕见病药物临床试验的公开列表,提供试验相关信息。来源页未公开字段级说明。

适用研究

可用于罕见病药物临床试验的查找、监管政策分析及患者招募研究。

本卡由来源页信息起草,机构/覆盖/时间/规模/字段与许可以官方为准(待人工核验)。

自行获取的难点

查找加拿大罕见病药物临床试验信息时,缺乏结构化字段说明。

公共卫生与医学免费访问

IntoValue 1+2 研究数据集:德国大学医学中心临床试验结果传播 Dataset for the IntoValue 1 + 2 studies on results dissemination from clinical trials conducted at German university medical centers complet

该数据集包含在德国35所大学医学中心进行、于2009-2017年间完成的临床试验注册信息及结果发表情况,用于分析结果传播的及时性和完整性。

机构QUEST-BIH
覆盖德国35所大学医学中心
时间2009-2017年(试验完成年份)
规模4个文件
许可许可待核验
获取Zenodo
查看字段与详情

内容与字段

该数据集包含临床试验注册记录,每条记录对应一个试验注册号。数据包括来自ClinicalTrials.gov和德国临床试验注册库(DRKS)的注册信息,以及通过人工检索找到的结果发表信息。数据字典文件(iv_data_dictionary.csv)提供了每个变量的类型、描述和水平。主要变量包括:

  • iv_version——数据版本(1或2)
  • lead_city——牵头方所在城市(用于关联大学医学中心)
  • facility_city——试验机构所在城市(仅版本1)
  • is_dupe——是否在两个版本中重复
  • identification_step——人工检索步骤描述
  • levels_drks——DRKS中的变量水平
  • levels_ctgov——ClinicalTrials.gov中的变量水平
  • completion_date——试验完成日期
  • primary_completion_date——主要完成日期
  • doi——结果发表的DOI
  • pmid——结果发表的PubMed ID
  • url——结果发表的URL

适用研究

适用于分析临床试验结果传播的及时性、完整性及影响因素,也可用于评估注册与发表之间的关联,以及不同注册库之间的数据一致性。

本卡由来源页信息起草,机构/覆盖/时间/规模/字段与许可以官方为准(待人工核验)。

自行获取的难点

获取德国大学医学中心临床试验结果传播的完整数据,用于评估发表延迟和不完整性问题。

公共卫生与医学免费访问

心理健康公报 Mental Health Bulletin

NHS Digital发布的关于英格兰NHS严重和持久心理健康问题服务统计的公报,基于心理健康最小数据集(MHMDS)年度回报。

机构NHS Digital
覆盖英格兰NHS服务的严重和持久心理健康问题患者
时间以官方为准
规模9个文件
许可许可待核验
获取data.gov.uk
查看字段与详情

内容与字段

该数据集包含9个文件,包括元数据文件(XLS格式)、最新报告(HTML格式)以及多个CSV格式的心理健康公报数据。来源页未公开字段级说明。

适用研究

可用于分析英格兰地区严重和持久心理健康问题的服务利用、趋势及结果,支持卫生政策评估和服务规划研究。

本卡由来源页信息起草,机构/覆盖/时间/规模/字段与许可以官方为准(待人工核验)。

自行获取的难点

获取英格兰NHS心理健康服务统计数据时,常需整合多个文件且字段说明不明确。

公共卫生与医学免费访问

死因:非传染性疾病(占总死亡百分比) Cause of death, by non-communicable diseases (% of total)

世界卫生组织(WHO)全球健康评估数据,反映非传染性疾病(如癌症、糖尿病、心血管疾病等)占总死亡的比例,覆盖2000-2021年各国数据。

机构世界卫生组织(WHO)
覆盖所有国家和地区
时间2000-2021年
规模以官方为准
许可许可待核验
获取World Bank Data API 及 DataBank
查看字段与详情

内容与字段

该数据集提供非传染性疾病导致的死亡占总死亡的比例(百分比),数据来源为WHO全球健康评估。来源页未公开字段级说明。

适用研究

可用于全球疾病负担分析、非传染性疾病趋势研究、公共卫生政策评估等。

本卡由来源页信息起草,机构/覆盖/时间/规模/字段与许可以官方为准(待人工核验)。

自行获取的难点

获取WHO非传染性疾病死亡比例数据时,常需跨国家、跨年份的标准化指标,但原始数据分散,需通过API或DataBank整合。

公共卫生与医学免费访问

北欧试验报告项目:来自欧盟临床试验注册库和ClinicalTrials.gov的原始数据 Nordic trial reporting project: Raw data from EU Clinical Trials Registry (EUCTR) and ClinicalTrials.gov

该数据集包含来自EUCTR和ClinicalTrials.gov的原始数据,用于评估北欧国家医学大学和大学医院的临床试验报告情况。

机构author team for the research project "Systematic evaluation of clinical trial reporting at medical universities and university hospitals in the Nordic countries"
覆盖北欧国家(丹麦、芬兰、冰岛、挪威、瑞典)的医学大学和大学医院
时间以官方为准
规模3个文件
许可许可待核验
获取Zenodo
查看字段与详情

内容与字段

该数据集包含来自EUCTR和ClinicalTrials.gov的原始数据,具体包括EUCTR试验的追踪数据集(来自EU Trials Tracker)以及通过自定义网络爬虫从EUCTR国家方案和结果部分提取的数据(变量见附录表2),以及从ClinicalTrials.gov下载的完整AACT数据集。数据集共3个文件。

  • EUCTR trials tracker dataset——来自EU Trials Tracker的EUCTR试验数据集
  • Custom web scraper data——从EUCTR国家方案和结果部分提取的数据(变量见附录表2)
  • AACT dataset——ClinicalTrials.gov的完整Aggregate Analysis数据集

适用研究

可用于评估北欧国家临床试验报告合规性、分析试验结果报告延迟等研究。

本卡由来源页信息起草,机构/覆盖/时间/规模/字段与许可以官方为准(待人工核验)。

自行获取的难点

获取北欧国家临床试验报告原始数据时,常需整合多个注册库,数据格式不统一。

公共卫生与医学免费访问

威胁场景心理意象诱发的行为、生理和神经影像反应复制数据 Replication Data for Behavioral, Physiological and Neuroimaging Responses Induced by Mental Imagery of Threatening Scenarios

该数据集包含一项关于心理意象威胁场景诱发行为、生理和fMRI反应的研究的复制数据,由Harvard Dataverse发布。

机构Harvard Dataverse
覆盖以官方为准
时间2015-09-28更新
规模34个文件
许可许可待核验
获取Harvard Dataverse
查看字段与详情

内容与字段

该数据集包含34个文件,用于复制一项研究,该研究测量了心理意象威胁场景下的主观和生理反应,并进行了fMRI实验。来源页未公开字段级说明。

适用研究

可用于神经科学、心理学中关于威胁感知、心理意象和情绪调节的研究。

本卡由来源页信息起草,机构/覆盖/时间/规模/字段与许可以官方为准(待人工核验)。

自行获取的难点

获取神经影像和行为数据时,常需寻找公开的复制数据集,但字段说明和实验细节可能不完整。

公共卫生与医学免费访问

非洲健康与老龄化:南非INDEPTH社区纵向研究基线调查 HAALSI Baseline Survey

HAALSI基线调查由哈佛大学人口与发展研究中心和威特沃特斯兰德大学MRC/Wits农村公共卫生与健康转型研究单位实施,在南非农村对5059名40岁及以上成年人进行健康、认知、社会网络、心血管代谢疾病、HIV及经济福祉等方面的调查。

机构Harvard Center for Population and Development Studies; MRC/Wits Rural Public Health and Health Transitions Research Unit of the University of the Witwatersrand
覆盖南非姆普马兰加省农村地区,Agincourt健康与社会人口监测系统(AHDSS)框架内
时间2014年11月至2015年11月
规模5059名受访者,4个文件
许可许可待核验
获取Harvard Dataverse
查看字段与详情

内容与字段

该数据集包含基线调查的问卷数据,涵盖认知与身体功能、社会网络、心血管代谢疾病及风险因素、HIV与HIV风险、经济福祉等主题,还包括人体测量指标和即时血液检测(血红蛋白、血糖、血脂)。未来将发布干血斑检测结果(HIV、HIV病毒载量、HbA1c、CRP)及亚样本的实验室随访数据。来源页未公开字段级说明。

适用研究

适用于非洲农村老龄化、健康转型、慢性病流行病学、HIV与社会经济因素等研究。

本卡由来源页信息起草,机构/覆盖/时间/规模/字段与许可以官方为准(待人工核验)。

自行获取的难点

获取非洲农村老年人健康与老龄化的纵向调查数据,但字段级说明和许可信息不明确。

公共卫生与医学免费访问

神经系统疾病对卫生支出和经济产出影响的OECD国家动态面板数据集 Dataset for "Effects of Neurological Disorders on Health Expenditure and Economic Output: Dynamic Panel Analysis for OECD Countries"

该数据集支持发表于Systems (2025, Vol. 13)的研究,包含OECD国家2000-2022年神经系统疾病患病率、卫生支出和经济产出的年度面板数据,用于动态面板数据建模。

机构以官方为准
覆盖OECD国家
时间2000-2022
规模1个文件
许可许可待核验
获取Zenodo
查看字段与详情

内容与字段

该数据集包含OECD国家2000-2022年的年度面板数据,变量涉及神经系统疾病患病率、卫生支出和经济产出。数据已匿名化处理,聚合在国家-年份层面,并经过协调处理以适用于动态面板数据建模(包括Arellano-Bond和Blundell-Bond估计量)。来源页未公开字段级说明。

适用研究

可用于复制和扩展神经系统疾病对卫生支出及宏观经济影响的研究,支持动态面板数据计量经济学分析。

本卡由来源页信息起草,机构/覆盖/时间/规模/字段与许可以官方为准(待人工核验)。

自行获取的难点

获取OECD国家神经系统疾病与卫生经济面板数据时,常需整合多个来源,该数据集提供统一协调的年度数据。

公共卫生与医学免费访问

人类阿尔茨海默病组织中Aβ斑块周围小胶质细胞空间分辨表达数据 Code and associated data directory for manuscript: Spatially Resolved Microglial Expression Around Aβ Plaques in Human Alzheimer's Disease T

该数据集包含与手稿相关的代码和预处理数据,使用NanoString GeoMx数字空间分析技术对人类阿尔茨海默病海马组织中小胶质细胞进行空间转录组分析。

机构University College London等
覆盖人类阿尔茨海默病海马组织
时间以官方为准
规模14个文件
许可许可待核验
获取Zenodo
查看字段与详情

内容与字段

该数据集包含代码和预处理后的数据目录。数据已经过FASTQ到DCC再到探针级质量控制的预处理步骤。原始FASTQ和DCC文件可从NCBI GEO获取。来源页未公开字段级说明。

适用研究

可用于阿尔茨海默病中小胶质细胞空间转录组学研究,特别是Aβ斑块相关基因表达分析。

本卡由来源页信息起草,机构/覆盖/时间/规模/字段与许可以官方为准(待人工核验)。

自行获取的难点

获取阿尔茨海默病空间转录组数据时,常需整合代码与预处理数据,但字段说明不完整。

公共卫生与医学免费访问

阿尔伯塔生物监测项目:阿尔伯塔孕妇和儿童血清中的化学物质 Alberta Biomonitoring Program: Chemicals in Serum of Pregnant Women and Children in Alberta

阿尔伯塔生物监测项目数据集,包含三项全省范围研究中孕妇、儿童及脐带血血清中环境化学物质(天然和合成)的浓度数据,由阿尔伯塔省政府发布。

机构Government of Alberta
覆盖阿尔伯塔省(北部、中部、南部)
时间以官方为准
规模6个文件
许可许可待核验
获取Open Canada
查看字段与详情

内容与字段

该数据集包含三项研究(Phase 1、Phase 2、Phase 3)的血清化学物质浓度数据。Phase 1和Phase 2中,每种化学物质的结果以单列呈现(全血清或脂质调整浓度),每行提供年龄+地区组中重复池的平均浓度和标准误,补充行包括检测限/定量限(LOD/LOQ)和备注。Phase 3中,每种化学物质的结果最多有8列(年龄加权和年龄-地理加权均值及其95%置信区间),每行提供平均浓度和95% CI,补充行包括LOD/LOQ、报告状态和备注。数据集包含6个XLSX文件:Phase 1和Phase 2列描述、Phase 3列描述、Phase 3妇女和脐带血数据、Phase 2儿童血清数据、Phase 1孕妇血清数据,以及原始元数据HTML文件。

  • Mean concentration——重复池的平均浓度
  • Standard error of measurement——重复池测量标准误(Phase 1和2)
  • 95% confidence intervals (CIs)——均值的95%置信区间(Phase 3)
  • Limit of Detection/Limit of Quantification (LOD/LOQ)——检测限/定量限
  • Report Status——报告状态(Yes: ≥25%池样本可检测;No: <25%)
  • Comments——备注

适用研究

该数据集可用于环境健康研究,评估阿尔伯塔省孕妇和儿童对环境化学物质的暴露水平,建立基线以追踪未来暴露趋势,支持健康风险评估和暴露源识别。

本卡由来源页信息起草,机构/覆盖/时间/规模/字段与许可以官方为准(待人工核验)。

自行获取的难点

获取环境化学物质在孕妇和儿童血清中的浓度数据,但字段说明分散在多个文件中,需整合理解。

公共卫生与医学免费访问

AIHW - 医疗保险患者支出 - 因费用障碍而延迟或未就诊专科医生、全科医生、影像或病理检查的人口比例(PHN)2016-2017 AIHW - Patients Spending on Medicare - People who experienced Cost Barriers to Specialist, GP, Imaging or Pathology (%) (PHN) 2016-2017

该数据集展示了2016-2017财年因费用原因延迟或未就诊专科医生、全科医生、影像或病理检查的人口百分比,按2015年卫生部初级健康网络(PHN)区域汇总。

机构Australian Institute of Health and Welfare (AIHW)
覆盖澳大利亚,按2015年卫生部初级健康网络(PHN)区域汇总,基于2011年澳大利亚统计地理标准(ASGS)
时间2016-2017财年(2016年7月1日至2017年6月30日)
规模以官方为准
许可许可待核验
获取通过AURIN下载管理器获取HTML格式数据
查看字段与详情

内容与字段

该数据集包含因费用原因延迟或未就诊专科医生、全科医生、影像或病理检查的人口百分比,按PHN区域汇总。数据来源于Medicare福利计划(MBS)索赔数据和ABS 2016-17患者体验调查。来源页未公开字段级说明。

适用研究

可用于分析澳大利亚不同地区因费用障碍导致的医疗服务可及性问题,支持卫生政策评估和区域健康差异研究。

本卡由来源页信息起草,机构/覆盖/时间/规模/字段与许可以官方为准(待人工核验)。

自行获取的难点

获取按区域细分的因费用障碍而延迟就医的百分比数据,但字段说明和许可信息不明确。

公共卫生与医学免费访问

通勤空气污染干预研究(CAPI)挥发性有机化合物(VOC)数据集 The commuter air pollution intervention study (CAPI) volatile organic compound (VOC) dataset

Health Canada于2014年在蒙特利尔开展的通勤空气污染干预研究(CAPI)中,测量车内外的VOC水平,提供通勤暴露的描述性统计数据。

机构Health Canada
覆盖加拿大蒙特利尔
时间2014年
规模4个文件(2个CSV,2个TXT)
许可许可待核验
获取Open Canada平台下载
查看字段与详情

内容与字段

该数据集包含通勤空气污染干预研究(CAPI)中挥发性有机化合物(VOC)的描述性统计结果,数据来自2014年秋季在蒙特利尔进行的实验,测量了高峰时段车内外的VOC水平。数据集提供英文和法文CSV文件各一个,以及对应的说明文件(TXT)。来源页未公开字段级说明。

适用研究

适用于通勤暴露评估、空气污染健康影响、交通相关污染物研究等方向。

本卡由来源页信息起草,机构/覆盖/时间/规模/字段与许可以官方为准(待人工核验)。

自行获取的难点

获取车内VOC暴露的实测数据,用于通勤暴露评估和健康影响研究。

公共卫生与医学访问条件待核验

英国医学影像人工智能研究文献数据集(2017-2025) Scopus United Kingdom AI in Medical Imaging (2017-2025)

该数据集包含Scopus数据库中2017-2025年英国医学影像人工智能研究的文献记录及清洗后数据,用于文献计量分析。

机构以官方为准
覆盖英国,医学影像人工智能研究
时间2017-2025
规模4个文件
许可许可待核验
获取Zenodo
查看字段与详情

内容与字段

该数据集包含Scopus文献记录及清洗后的数据,共4个文件。来源页未公开字段级说明。

适用研究

可用于文献计量分析、科研趋势研究、医学影像人工智能领域的发展评估等。

本卡由来源页信息起草,机构/覆盖/时间/规模/字段与许可以官方为准(待人工核验)。

自行获取的难点

获取特定领域、特定时间范围的文献计量数据时,常需自行检索和清洗,该数据集提供了预处理后的记录。

公共卫生与医学免费访问

组织病理学教育实习:学习资源 Educational Clerkship in histopathology: learning resources

该数据集包含组织病理学本科实习的完整学习资源,基于证据和理论设计,由哈佛Dataverse发布。

机构以官方为准
覆盖组织病理学本科实习学习资源
时间2021-03-08更新
规模2个文件
许可许可待核验
获取哈佛Dataverse
查看字段与详情

内容与字段

该数据集包含组织病理学本科实习的完整学习资源,具体文件构成未公开。来源页未公开字段级说明。

适用研究

可用于医学教育研究,特别是组织病理学实习课程的设计与评估。

本卡由来源页信息起草,机构/覆盖/时间/规模/字段与许可以官方为准(待人工核验)。

自行获取的难点

获取组织病理学实习教学资源时,常缺乏系统、公开的完整资源集。

地理遥感与城市

遥感 · 人口 · 土地

地理遥感与城市免费访问

VIIRS 夜间灯光(年度合成) VIIRS Nighttime Lights · VNL

以一束可量化的夜光还原经济活动、城市扩张与能源分布——衡量区域经济最常用的遥感代理。

机构科罗拉多矿院 EOG
覆盖全球(75°N–65°S)
分辨率约 500m(15 弧秒)
时间2012 至今
许可许可待核验
获取免费需注册(亦可 GEE)
查看字段与详情

内容与字段

波段含义
average / average_masked平均辐射 / 掩膜后平均辐射
median / maximum / minimum中值 / 最大 / 最小辐射
cf_cvg / cvg无云观测计数 / 总观测数

辐射单位 nW/cm²/sr,经去云、去月光、去火点处理。

适用研究

区域经济、GDP 代理、电力可及性与城市扩张。

版本年度 VNL V2.2 · 格式GeoTIFF

许可口径官方表述不一(公共领域或 CC BY,均可商用,建议署名 EOG);本站不渲染地图,元数据 2026-06 核验。

自行获取的难点

全球夜光散落在境外平台、注册门槛与多版本格式让人光是"拿到能用的那一份"就耗掉大半精力,年际传感器/算法一致性还需自行甄别。这部分繁琐交给我们处理到位。

地理遥感与城市免费访问

全球人居层 GHSL · Global Human Settlement Layer

把"哪里有人、有多少、城市化到什么程度"做成全球统一口径的栅格图层,城市与人口暴露研究难以替代的底层数据。

机构欧盟委员会 JRC
覆盖全球栅格
分辨率100m / 1km(部分 10m)
时间1975–2030(5 年)
许可许可待核验
获取免费免注册
查看字段与详情

内容与字段

产品含义
GHS-BUILT-S / V / H建成区面积 / 体积 / 建筑高度
GHS-POP人口分布格网(每格人数)
GHS-SMOD / DUC城市化程度 / 行政单元城市化分类

适用研究

城市化、人口分布、区域经济与灾害暴露。

版本R2023A · 格式GeoTIFF

行政单元划分沿用数据源原始口径,仅为技术处理结果,以中国官方标准地图为准;本站不渲染地图,元数据 2026-06 核验。

自行获取的难点

多版本年份交错、建成面积与人口格网口径各异、与普查及联合国数据的对齐繁琐,自行下载比对、统一坐标与分辨率往往耗时数日。交由我们完成版本甄别与口径对齐。

地理遥感与城市免费访问

ESA 全球土地覆盖(10m) ESA WorldCover

基于 Sentinel 卫星的 10 米全球土地覆盖图,独立验证总体精度约 76.7%,分类清晰、可直接用作研究底图。

机构欧洲空间局 ESA(VITO 牵头)
覆盖全球
分辨率10m
时间2020 / 2021 两版
许可许可待核验
获取免费(官网/AWS/GEE)
查看字段与详情

内容与字段

单波段(Map)记录 11 个土地覆盖类别:树木覆盖、灌木地、草地、耕地、建成区、裸地/稀疏植被、冰雪、永久水体、草本湿地、红树林、苔藓与地衣。附产品用户手册与验证报告。

适用研究

土地利用、农业、生态、城市扩张与环境研究。

版本v200(2021,2022-10 发布)· 格式Cloud-Optimized GeoTIFF

两版算法不同,做变化检测需谨慎;本站不渲染地图,元数据 2026-06 核验。

自行获取的难点

v100 与 v200 口径差异、类别定义对齐、精度报告比对与原始栅格的获取分发,自行梳理往往耗时易错。我们已完成版本甄别与说明整理,按需直取可用底图。

地理遥感与城市免费访问

WorldPop 全球人口分布 WorldPop

约 100 米分辨率的网格化人口估算,以官方普查为基底降尺度,空间人口学研究与区域规划的权威公开源。

机构南安普顿大学等
覆盖全球(逐国定制)
分辨率约 100m(另有 1km)
时间约 2000–2021(另有预测)
许可许可待核验
获取免费开放
查看字段与详情

内容与字段

人口计数(每网格估计居住人口)、人口密度、分年龄分性别人口结构、发展指标(贫困/出生率等)、人口流动等。方法学:以普查为基础,用随机森林 dasymetric 再分配结合地理协变量降尺度到约 100m 网格。

适用研究

空间人口学、城市研究、灾害评估、可达性与公共服务规划。

版本按 DOI 分版 · 格式GeoTIFF / REST API

为第三方机构基于模型估算的成果,行政区划与边界以中国官方标准为准;本站不渲染地图,元数据 2026-06 核验。

自行获取的难点

同一区域跨年份、跨版本的人口栅格口径与坐标系常需反复核对,年龄性别分层与协变量对齐也耗时。我们已完成版本梳理与字段统一,检索即用。

地理遥感与城市免费访问

WorldClim 全球气候数据 WorldClim

覆盖全球的高分辨率气候栅格基准,逐月气温降水到 19 个生物气候变量一应俱全,物种分布与气候影响评估的常用参照源。

机构Hijmans 等(UC Davis/Berkeley)
覆盖全球陆地
分辨率30 弧秒 – 10 弧分
时间基准 1970–2000
许可许可待核验
获取免费免注册直链
查看字段与详情

内容与字段

逐月最低/平均/最高气温(°C)、降水量(mm)、太阳辐射、风速、水汽压;19 个标准化生物气候变量(bio1–bio19,如年均温、温度季节性、年降水量等);附 SRTM 高程。由全球气象站记录经薄板样条插值生成。

适用研究

物种分布与生态位建模、气候变化影响、农业与城市气候分析。

版本2.1(2020-01)· 格式GeoTIFF(按要素/分辨率分组)

官方口径为非商业用途,未经许可不得再分发或商用;元数据 2026-06 核验。

自行获取的难点

不同版本口径、变量定义与坐标对齐的逐一比对往往耗费数日。我们已完成整理校核,可直接取用进入分析。

地理遥感与城市免费访问

哨兵二号光学影像 Copernicus Sentinel-2

欧盟哥白尼计划的高分辨率多光谱卫星影像,10 米分辨率、3–5 天重访,全球免费开放,是土地、农业与城市遥感的主力数据。

机构ESA · 欧盟哥白尼计划
覆盖全球陆地
时间2015 起
规模10/20/60m 多光谱
许可许可待核验
获取免费 · Data Space/云平台
查看字段与详情

内容与字段

13 个光谱波段、10–60 米分辨率的 L1C/L2A 反射率产品,可计算 NDVI 等植被与水体指数。

适用研究

土地覆盖与变化、农业与作物、城市扩张、灾害与环境监测。

格式GeoTIFF / SAFE / NetCDF · 平台Copernicus Data Space Ecosystem / GEE / AWS / Planetary Computer

免费开放、可商用;以哥白尼官方数据政策为准(2026-06 核验)。

自行获取的难点

影像分幅大、云遮挡与时序合成、坐标与投影处理门槛高;我们做检索、裁剪、去云与指数计算。

地理遥感与城市免费访问

MODIS 对地观测产品 NASA MODIS

NASA 中分辨率成像光谱仪的全球每日观测产品,提供植被指数、地表温度、火点、雪盖等分析就绪图层,是长时序地表监测的标配。

机构NASA(LP DAAC 等)
覆盖全球
时间2000 起
规模250m–1km 多产品
许可许可待核验
获取免费 · Earthdata 登录
查看字段与详情

内容与字段

植被指数 NDVI/EVI、地表温度 LST、土地覆盖类型、火点、雪盖、反照率等标准化合成产品,日 / 8 天 / 16 天 / 年度。

适用研究

生态与农业、气候与物候、火灾与环境、城市热岛。

格式HDF / GeoTIFF · 平台Earthdata Search / LP DAAC / AppEEARS / GEE

需免费 Earthdata 账号;以 NASA 官方为准(2026-06 核验)。

自行获取的难点

HDF 格式与正弦投影、产品众多、批量下载与子集化繁琐;我们做产品选型、提取与重投影。

地理遥感与城市免费访问

全球生物多样性信息库 GBIF

各国政府资助的全球生物多样性数据网络,汇聚数十亿条带坐标与时间的物种出现记录,是生态、地理与生物多样性研究的开放数据来源。

机构GBIF(国际网络)
覆盖全球
时间跨历史至今
规模数十亿条出现记录
许可许可待核验
获取免费 · 下载含 DOI
查看字段与详情

内容与字段

物种学名、经纬度、采集/观测时间、记录类型、数据集与发布机构等的物种出现记录(occurrence)。

适用研究

物种分布与生态位、生物多样性、入侵物种、气候与栖息地变化。

格式Darwin Core CSV · 平台GBIF.org · 每次下载含 DOI 便于引用

许可按各发布方为 CC0 / CC BY / CC BY-NC,商用前逐条核对(2026-06 核验)。

自行获取的难点

各发布方许可不一、坐标与鉴定质量参差、清洗去重门槛高;我们按许可筛选并做质量清洗。

地理遥感与城市访问条件待核验

ESA 世界覆盖 10 米 2021 v200 ESA WorldCover 10 m 2021 v200

ESA WorldCover 10 m 2021 v200 是欧空局基于 Sentinel-1/2 数据生产的全球 10 米分辨率土地覆盖栅格,包含 11 个与 FAO 分类系统对齐的类别,对全球变化与土地利用研究是刚需。

机构European Space Agency (ESA)
时间2021
规模18 个文件(全球分幅)
许可许可待核验
查看字段与详情

内容与字段

全球 10 米分辨率土地覆盖栅格,基于 Sentinel-1 和 Sentinel-2 数据生产,包含 11 个土地覆盖类别,与联合国粮农组织土地覆盖分类系统(UN-FAO LCCS)对齐。数据以 60 度分幅的 GeoTIFF 文件提供,如 ESA_WorldCover_10m_2021_v200_60deg_macrotile_N30E060.zip。

适用研究

适用于全球土地利用/覆盖变化监测、生态系统评估、气候变化研究、生物多样性保护规划等需要高分辨率土地覆盖信息的领域。

元数据以来源页为准(2026-07 工厂起草 · 待人工核验)。

自行获取的难点

数据以 60 度分幅的 GeoTIFF 压缩包提供,共 18 个文件,需自行下载并拼接处理,清洗成本较高。

地理遥感与城市访问条件待核验

ERA5 全球大气再分析数据集 nmasi/era5

ERA5 是 ECMWF 第五代全球大气再分析产品,提供逐小时气温、降水、风场等 26 个变量的格点数据,是气候与气象研究的基础资料。

机构ECMWF (European Centre for Medium-Range Weather Forecasts)
覆盖全球
时间逐小时,每6小时采样,按月组织
规模99147 个文件,约 102863 次下载
获取HuggingFace 数据集页面
查看字段与详情

内容与字段

ERA5 基于 Hersbach et al. 2020,通过 Copernicus C3S API 暴露数据。该子集包含 26 个变量(如 Bonev et al. 2023 表 3 所述),每个文件包含一个月内每 6 小时(起始 00:00:00)采样的全部 26 个变量。

适用研究

适用于气候分析、气象建模、可再生能源评估等需要长时间序列全球格点气象数据的研究。

元数据以来源页为准(2026-07 工厂起草 · 待人工核验)。

自行获取的难点

数据以 Zarr 格式存储,需熟悉该格式及 Python 生态;每月文件较大,需注意存储和计算资源;原始数据来自 Copernicus C3S API,本仓库为镜像,版本更新可能滞后。

地理遥感与城市访问条件待核验

全球道路清单数据集 GRIP 2018:道路密度 GRIP (Global Roads Inventory Dataset) -2018: Road Density

GRIP 2018 道路密度数据提供全球分等级道路的栅格密度图,是交通地理、环境模型及基础设施规划研究的刚需底图。

机构The World Bank
时间2018
获取来源平台:The World Bank
查看字段与详情

内容与字段

GRIP (Global Roads Inventory Dataset) -2018: Road Density 数据集,提供全球道路密度栅格数据,基于分等级道路矢量生成。

适用研究

适用于全球交通网络分析、环境暴露评估、土地利用变化建模等研究。

元数据以来源页为准(2026-07 工厂起草 · 待人工核验)。

自行获取的难点

该数据集为栅格格式,需具备 GIS 软件处理能力;元数据未提供详细分级说明,可能需结合原始 GRIP 矢量数据理解。

地理遥感与城市免费访问

SMART-Ship:面向靠港船舶分析的同步多模态对齐遥感目标数据集与基准 SMART-Ship: A Comprehensive Synchronized Multi-modal Aligned Remote Sensing Targets Dataset and Benchmark for Berthed Ships Analysis

SMART-Ship是由清华大学团队构建的多模态遥感船舶数据集,包含1092组时空对齐的五模态图像(可见光、SAR、全色、多光谱、近红外),覆盖38838艘船舶,提供精细多边形标注,支持检测、重识别、跨模态生成等任务。

机构清华大学电子工程系、清华大学深圳国际研究生院
覆盖全球港口靠港船舶
时间以官方为准
规模1092组多模态图像集,包含38838艘船舶
许可许可待核验
获取申请后用于学术用途
查看字段与详情

内容与字段

SMART-Ship数据集包含1092组多模态图像集,每组图像集在1周内获取并配准,确保时空一致性。图像涵盖五种模态:可见光(RGB)、合成孔径雷达(SAR)、全色(PAN)、多光谱(MS)和近红外(NIR)。每艘船舶实例标注了多边形位置信息、细粒度类别、实例级标识符和变化区域掩码,按层次组织以支持多种多模态遥感任务。来源页未公开字段级说明。

适用研究

该数据集适用于多模态遥感图像分析研究,包括目标检测、目标重识别、跨模态生成、全色锐化和变化检测等任务,尤其适合靠港船舶场景下的细粒度分析与多模态融合方法评估。

本卡由来源页信息起草,机构/覆盖/时间/规模/字段与许可以官方为准(待人工核验)。

自行获取的难点

多模态遥感船舶数据集稀缺,现有数据集多为单模态或粗粒度标注,难以支持细粒度分析与多任务联合研究。

地理遥感与城市免费访问

火山信息系统数据集:基于IMS次声探测的全球火山喷发活动记录 Volcanic Information System (VIS) Dataset: global volcanic eruptive activity records using IMS infrasound detections

该数据集包含2010-2019年间利用国际监测系统(IMS)16个次声阵列探测的火山喷发活动记录,由VIS算法生成,共419条记录。

机构University of Florence
覆盖全球,火山位于IMS阵列2000公里范围内
时间2010-2019
规模419条记录,1个文件
许可许可待核验
获取Zenodo
查看字段与详情

内容与字段

数据集包含一个.mat文件,每条记录对应一次火山喷发事件,包含以下字段:

  • t_start——喷发开始时间
  • t_end——喷发结束时间
  • Ps_mean——源处压力振幅
  • N_det——信号持续性
  • Range-corrected IP——事件的距离校正次声参数

适用研究

可用于火山喷发监测、次声信号分析、全球火山活动统计及次声探测算法验证等研究。

本卡由来源页信息起草,机构/覆盖/时间/规模/字段与许可以官方为准(待人工核验)。

自行获取的难点

火山喷发次声数据获取困难,该数据集提供了系统化的全球记录,便于研究。

地理遥感与城市免费访问

康威流域 - 南特布鲁恩流量数据集(2008-2011) Conwy Catchment - Nant Y Brwyn Discharge dataset (2008-2011)

该数据集包含北威尔士康威流域泥炭源头溪流南特布鲁恩2008年3月至2011年7月的流量和溪流温度数据,由英国生态与水文中心(UKCEH)制作,用于计算年径流和河流碳通量。

机构UK Centre for Ecology & Hydrology (UKCEH)
覆盖北威尔士康威流域南特布鲁恩溪流,位于斯诺登尼亚国家公园的Migneint泥炭沼泽
时间以官方为准
规模2个文件(ZIP压缩包),192次下载
许可许可待核验
获取通过NERC环境信息数据中心(EIDC)直接下载ZIP包
查看字段与详情

内容与字段

数据集包含南特布鲁恩溪流的流量(discharge)和溪流温度(in-stream temperature)数据,时间分辨率为15分钟(每5分钟测量,每15分钟平均记录)。数据以CSV格式存储,并附有支持文档。来源页未公开具体字段名列表。

适用研究

该数据集适用于泥炭地水文过程、年径流估算、河流碳通量研究,以及高时间分辨率流量与温度变化分析。

本卡由来源页信息起草,机构/覆盖/时间/规模/字段与许可以官方为准(待人工核验)。

自行获取的难点

泥炭地源头溪流的高时间分辨率流量和温度数据不易获取,该数据集提供了连续多年的15分钟间隔观测记录,但存在因设备故障或冰冻导致的数据缺失。

地理遥感与城市免费访问

火山喷发数据集 Volcanic Eruptions

Zenodo上发布的火山喷发数据集,包含全球火山喷发记录,时间跨度至1918年。

机构以官方为准
覆盖全球
时间至1918年
规模1个文件
许可许可待核验
获取Zenodo
查看字段与详情

内容与字段

来源页未公开字段级说明。

适用研究

可用于火山活动历史分析、灾害风险评估等研究。

本卡由来源页信息起草,机构/覆盖/时间/规模/字段与许可以官方为准(待人工核验)。

自行获取的难点

火山喷发数据分散,缺乏统一整理,该数据集提供集中记录。

地理遥感与城市免费访问

日本环境质量1992 Quality of the Environment in Japan 1992

日本环境厅发布的1992年环境白皮书,涵盖大气、水质、土壤、噪声、废弃物、自然植被、湖泊、河流、海岸等环境要素的状态与趋势。

机构环境計画課(环境计划课)
覆盖日本全国
时间1992年(数据涵盖至1991年)
规模253个HTML文件
许可许可待核验
获取日本e-Gov数据门户及环境省官网
查看字段与详情

内容与字段

该数据集为日本环境厅发布的1992年环境白皮书全文,以HTML格式提供,包含14个章节及多个子章节,覆盖大气、水质、土壤、噪声、振动、恶臭、生物残留、固体废物、发展中国家污染、东欧污染、海湾危机污染、自然植被、湖泊、河流、海岸、野生动物、温泉等环境要素。来源页未公开字段级说明。

适用研究

可用于日本环境史、环境政策、污染治理、生态保护、可持续发展等领域的文献分析与案例研究。

本卡由来源页信息起草,机构/覆盖/时间/规模/字段与许可以官方为准(待人工核验)。

自行获取的难点

日本环境白皮书数据分散,缺乏结构化字段说明,难以直接进行定量分析。

地理遥感与城市免费访问

NASA SRTMGL1 V003 全球1弧秒数字高程模型 NASA Shuttle Radar Topography Mission Global 1 arc second V003

NASA与NGA等机构合作,利用航天飞机雷达地形测绘任务(SRTM)获取的全球陆地约30米分辨率数字高程模型(DEM),覆盖北纬60°至南纬56°。

机构NASA Land Processes Distributed Active Archive Center (LP DAAC)
覆盖全球陆地,北纬60°至南纬56°
时间2000-02-11 至 2000-02-21
规模14297个文件/图幅
许可许可待核验
获取Earthdata Search 下载页
查看字段与详情

内容与字段

SRTMGL1 V003 数据以1°×1°图幅(tile)提供,每个图幅包含一个高程栅格,文件扩展名为.HGT。数据采用16位有符号整型(int16),单位为米。主要变量为DEM(高程)。来源页公开了以下字段:

  • DEM——高程,单位为米,数据类型int16,填充值-32768,有效范围-32767至32767。

适用研究

适用于地形分析、水文建模、地表过程研究、遥感影像正射校正、以及需要全球尺度30米分辨率DEM的各类地学与生态研究。

本卡由来源页信息起草,机构/覆盖/时间/规模/字段与许可以官方为准(待人工核验)。

自行获取的难点

获取全球30米DEM时,需注意数据格式为HGT而非GeoTIFF,且需通过Earthdata登录下载。

地理遥感与城市访问条件待核验

Nirex三维建模数据 Nirex 3-D Modelling Data.

英国地质调查局(BGS)维护的Nirex三维地质建模数据,涵盖Sellafield和Dounreay地区1989-1997年的地质调查结果。

机构British Geological Survey (BGS)
覆盖Sellafield和Dounreay地区
时间1989-1997(调查时间);2000年存档;2026年更新
规模1个文件
许可许可待核验
获取通过BGS Nirex地质档案页面获取
查看字段与详情

内容与字段

该数据集包含使用EarthVision和Vulcan软件创建的Sellafield场地地质结构三维模型,已导入英国地质调查局(BGS)计算机系统。数据资源链接指向Nirex地质档案页面,提供钻孔、深钻、地质、地球物理、地震仪、场地调查等主题的详细信息。来源页未公开字段级说明。

适用研究

适用于放射性废物处置场地选址的地质结构分析、三维地质建模方法研究、以及Sellafield和Dounreay地区的地质历史研究。

本卡由来源页信息起草,机构/覆盖/时间/规模/字段与许可以官方为准(待人工核验)。

自行获取的难点

获取Nirex三维地质模型时,常因档案分散、格式老旧而难以直接使用。

地理遥感与城市免费访问

3D网络地图——3D地球科学信息在线 3D Web Mapping - 3D Geoscience Information Online

Geoscience Australia发布的关于3D VRML模型用于在线展示3D地质结构的会议论文,覆盖澳大利亚。

机构Geoscience Australia
覆盖澳大利亚
时间以官方为准
规模2个文件
许可许可待核验
获取Data.gov.au
查看字段与详情

内容与字段

该数据集包含一份PDF格式的会议论文,内容涉及Geoscience Australia开发的3D VRML模型用于在线展示3D地质结构。来源页未公开字段级说明。

适用研究

可用于研究3D地质建模、VRML/X3D技术在科学可视化中的应用、地球科学数据在线共享方法。

本卡由来源页信息起草,机构/覆盖/时间/规模/字段与许可以官方为准(待人工核验)。

自行获取的难点

获取3D地质模型在线可视化技术资料时,常缺乏详细的字段说明和许可信息。

地理遥感与城市免费访问

垂直航空摄影 Vertical Aerial Photography

英国环境署自2006年起定期采集的垂直航空摄影影像,分辨率10-50cm,提供RGB、NIR及4波段ECW格式数据。

机构Environment Agency
覆盖英国(以英国国家网格OSGB 1936投影分幅)
时间2006年起,逐年更新
规模9个文件(含ZIP、GeoJSON、GPKG、SHP等格式)
许可许可待核验
获取data.gov.uk 及 Defra Data Services Platform 直接下载
查看字段与详情

内容与字段

该数据集包含英国环境署自2006年起采集的垂直航空摄影影像,以ECW格式提供真彩色(RGB)、近红外(NIR)或4波段(RGBN)栅格数据,空间分辨率10-50cm,经正射校正,采用英国国家网格OSGB 1936投影。数据按年份以5km下载ZIP文件组织,每个ZIP内包含与军械测量网格对齐的ECW文件。此外还提供GeoJSON、GPKG、SHP等矢量格式的元数据索引目录。来源页未公开字段级说明。

适用研究

适用于环境监测、洪水评估、土地利用分类、遥感影像分析及地理空间制图等研究。

本卡由来源页信息起草,机构/覆盖/时间/规模/字段与许可以官方为准(待人工核验)。

自行获取的难点

获取英国高分辨率航空影像时,常需了解其分辨率、波段、投影及分幅方式,本数据集提供清晰说明。

地理遥感与城市免费访问

中国北方GNSS气象观测业务站网积雪深度数据集 Snow Depth Dataset from GNSS Meteorological Observation Stations in Northern China

本数据集提供中国北方52个GNSS地基站点2013-2022年的历史积雪深度数据,基于中国气象局业务站网研制,以CSV格式存储。

机构北京大学
覆盖中国北方(25°~55°N, 70°~140°E)
时间2013-2022年
规模52个站点,CSV格式
许可许可待核验
获取北大开放研究数据平台
查看字段与详情

内容与字段

数据集包含52个GNSS站点的积雪深度观测数据,时间分辨率有24小时、12小时和2小时(个别站点),空间分辨率代表站点周围约1000m²。数据以CSV格式存储,同时包含测站清单(CSV/XLS)和数据集缩略图(PNG)。来源页未公开字段级说明。

适用研究

可用于积雪深度时空变化分析、气候与水文研究、GNSS遥感应用验证等。

本卡由来源页信息起草,机构/覆盖/时间/规模/字段与许可以官方为准(待人工核验)。

自行获取的难点

获取长时间序列、多站点的积雪深度观测数据时,常面临数据分散、格式不统一的问题。

地理遥感与城市免费访问

苏格兰土地覆盖(LCS)1988 Land Cover Scotland (LCS) 1988

苏格兰首次全国航空照片土地覆盖普查,由Macaulay土地利用研究所代表苏格兰政府制作,覆盖126种土地覆盖类型,用于监测乡村变化。

机构The Macaulay Land Use Research Institute (现James Hutton Institute) 代表苏格兰政府
覆盖苏格兰
时间1988年(基线数据)
规模4个文件(ZIP格式)
许可许可待核验
获取data.gov.uk 直接下载ZIP文件
查看字段与详情

内容与字段

该数据集包含苏格兰1988年土地覆盖的矢量数据,分类系统可识别126种土地覆盖类型(点、线、面要素),并包含超过1300个镶嵌类型。数据以ESRI Shapefile格式提供,可通过OGC视图服务、要素下载服务、ESRI REST服务及直接ZIP下载获取。

  • LandCoverScotland1988——主数据文件(Shapefile)
  • LC:LandCoverScotland1988——OGC要素下载服务图层
  • Land Cover Scotland 1988——ESRI REST服务图层
  • Land Cover Scotland 1988 ZIP——ESRI Shapefile下载包

适用研究

适用于苏格兰乡村土地覆盖变化监测、环境政策评估、生态与农业研究,可作为1988年基线用于后续土地覆盖变化分析。

本卡由来源页信息起草,机构/覆盖/时间/规模/字段与许可以官方为准(待人工核验)。

自行获取的难点

获取历史土地覆盖基线数据时,常需处理分类体系复杂、格式转换等问题。

地理遥感与城市免费访问

GNSS反射测量潮汐分析数据——南极和格陵兰沿海海平面感知 Output data for manuscript "Tidal analysis of GNSS reflectometry applied for coastal sea level sensing in Antarctica and Greenland"

该数据集包含通过GNSS反射测量(GNSS-R)从八个POLENET GNSS站点获取的南极和格陵兰沿海海平面数据,改进了相位约束和动态滤波方法。

机构以官方为准
覆盖南极和格陵兰沿海区域
时间4年(具体年份以官方为准)
规模7个文件
许可许可待核验
获取Zenodo
查看字段与详情

内容与字段

该数据集包含GNSS反射测量(GNSS-R)从八个POLENET GNSS站点获取的信噪比(SNR)观测数据,以及改进后的海平面反演结果。数据包括反射高度、潮汐成分等。来源页未公开字段级说明。

适用研究

适用于极地沿海海平面监测、潮汐分析、GNSS反射测量方法改进研究,以及南极和格陵兰地区海洋模型验证。

本卡由来源页信息起草,机构/覆盖/时间/规模/字段与许可以官方为准(待人工核验)。

自行获取的难点

极地GNSS反射测量海面高度数据获取困难,且潮汐成分易受冰层干扰,该数据集提供了改进后的高精度反演结果。

地理遥感与城市免费访问

特罗尔站地基TEC与闪烁接收机2018年3月18日和25日事件数据集 Dataset from the ground-based TEC and scintillation receiver in Troll station for events on March 18th and 25th, 2018

该数据集包含2018年3月18日和25日南极特罗尔站GNSS电离层闪烁与TEC监测仪(GISTM)接收机记录的GPS、GLONASS和Galileo卫星信号,提供每分钟扩展摘要消息,包括卫星方位角/仰角、C/N0、锁定时间、码减载波、幅度闪烁指数S4和相位闪烁指数σφ。

机构European Research Council (ERC)
覆盖南极毛德皇后地特罗尔站
时间以官方为准
规模6个文件
许可许可待核验
获取Zenodo
查看字段与详情

内容与字段

数据来自位于南极特罗尔站的NovAtel GPStation-6 GISTM接收机,记录GPS、GLONASS和Galileo卫星信号。每分钟提供扩展摘要消息,包含以下字段:

  • 卫星方位角/仰角——卫星的方位角和仰角
  • C/N0——载波噪声比
  • 锁定时间——信号锁定持续时间
  • 码减载波——码相位与载波相位之差
  • S4——幅度闪烁指数
  • σφ——相位闪烁指数

数据以表格形式存储于.txt文件中,每个文件包含数据和文件头。

适用研究

适用于电离层闪烁研究、GNSS信号传播特性分析、极区空间天气效应研究等。

本卡由来源页信息起草,机构/覆盖/时间/规模/字段与许可以官方为准(待人工核验)。

自行获取的难点

获取极区电离层闪烁高时间分辨率观测数据时,常面临数据格式不统一、字段说明缺失等问题。

地理遥感与城市免费访问

动态土地覆盖数据集 Dynamic Land Cover Dataset

澳大利亚首个全国一致、主题全面的土地覆盖参考数据集,由Geoscience Australia与澳大利亚农业资源经济科学局合作开发,基于MODIS EVI时序数据,覆盖2000-2008年,250米分辨率。

机构Geoscience Australia(与澳大利亚农业资源经济科学局合作)
覆盖澳大利亚全境
时间2000年4月至2008年4月
规模1个ZIP文件
许可许可待核验
获取Data.gov.au(直接下载ZIP)
查看字段与详情

内容与字段

该数据集包含澳大利亚2000-2008年每250米×250米像元的土地覆盖分类信息,分类方案符合ISO 19144-2标准,将土地覆盖分为34个ISO类别,反映植被结构特征(如耕地、牧场、封闭森林、稀疏开阔草地等)。数据基于MODIS增强型植被指数(EVI)时序数据(186期影像)生成。来源页未公开字段级说明。

适用研究

可用于土地覆盖变化监测、植被动态分析、生态环境评估、气候变化影响研究及自然资源管理。

本卡由来源页信息起草,机构/覆盖/时间/规模/字段与许可以官方为准(待人工核验)。

自行获取的难点

获取全国一致、长时间序列的土地覆盖分类数据时,常面临数据源分散、分类标准不统一的问题。

地理遥感与城市付费或受限访问

SPOT卫星影像数据集 Imagery-Satellite-SPOT

新南威尔士州SPOT卫星影像数据集,由NSW政府多个供应商提供,覆盖2005-2025年全州范围,分辨率1.5-2.5米。

机构NSW Department of Climate Change, Energy, the Environment and Water
覆盖新南威尔士州全境
时间2005-2025
规模以官方为准
许可许可待核验
获取仅限NSW政府机构申请
查看字段与详情

内容与字段

该数据集包含新南威尔士州全州的SPOT卫星影像产品,由SPOT 5或SPOT 6/7卫星获取,分辨率1.5-2.5米。产品类型包括:全州镶嵌影像、100k地图片、多光谱场景、全色锐化场景、全色场景、反射率场景、传感器辐射场景以及全州镶嵌的Shapefile切割线。来源页未公开字段级说明。

适用研究

适用于遥感、地理信息系统(GIS)应用,如植被健康监测、土地利用分类、环境监测等。

本卡由来源页信息起草,机构/覆盖/时间/规模/字段与许可以官方为准(待人工核验)。

自行获取的难点

获取NSW政府卫星影像数据时,常因许可限制和申请流程不透明而受阻。

地理遥感与城市免费访问

努萨河数字高程模型 Noosa River Digital Elevation Model

由Geoscience Australia发布的努萨河流域5米分辨率数字高程模型,基于ELVIS系统中5米及以上分辨率数据生成,覆盖2009-2015年。

机构Geoscience Australia
覆盖努萨河流域(Noosa River drainage basin),范围约152.72°E至153.19°E,26.51°S至25.42°S
时间2009-07-17 至 2015-08-18
规模3个文件,DEM ZIP文件约328 MB
许可许可待核验
获取直接下载ZIP文件
查看字段与详情

内容与字段

该数据集包含一个5米分辨率的数字高程模型(DEM),覆盖努萨河流域。数据来源于ELVIS系统中5米及以上分辨率的数据集,高于5米的数据被重采样至5米。数据集由2463个输入数据源生成。文件包括:一个PDF元数据声明(1.0 MB)、一个指向ELVIS的HTML链接、以及一个ZIP格式的DEM文件(328 MB)。来源页未公开字段级说明。

适用研究

适用于水文建模、洪水风险评估、流域管理、地形分析等地理空间研究。

本卡由来源页信息起草,机构/覆盖/时间/规模/字段与许可以官方为准(待人工核验)。

自行获取的难点

获取高分辨率DEM数据时,常需整合多源数据并处理重采样问题。

地理遥感与城市免费访问

芬兰赫尔辛基Mäkelänkatu空气质量监测站周边移动与固定空气污染测量数据集 Mobile and stationary air pollution measurements around an air quality monitoring site on Mäkelänkatu in Helsinki, Finland

该数据集包含芬兰赫尔辛基Mäkelänkatu空气质量监测站周边的移动与固定空气污染测量数据,用于评估PALM模型系统6.0的高分辨率空气质量模拟。

机构以官方为准
覆盖芬兰赫尔辛基Mäkelänkatu空气质量监测站周边
时间2017年夏季和冬季(部分数据)
规模1个文件
许可许可待核验
获取Zenodo
查看字段与详情

内容与字段

数据集包含多个子数据集:drone_data(无人机测量的肺沉积表面积垂直廓线,2017年夏季和冬季)、kumpula_airquality_data(SMEAR III站的基本空气质量观测和DMPS气溶胶粒径分布)、met_data(Kivenlahti桅杆观测和SMEAR III气象观测)、sniffer_data(移动实验室Sniffer测量的空气污染物水平分布)、supersite_data(Mäkelänkatu监测站的空气质量观测、DMPS气溶胶粒径分布、ACSM气溶胶化学成分测量)。

  • drone_data——无人机测量的肺沉积表面积(LDSA)垂直廓线
  • kumpula_airquality_data/airquality——SMEAR III站基本空气质量观测
  • kumpula_airquality_data/dmps——SMEAR III站DMPS气溶胶粒径分布
  • met_data/Kivenlahti_mast_DDMMYYYY.txt——Kivenlahti桅杆观测数据
  • met_data/Meteorology_YYMM_10.txt——SMEAR III气象观测
  • sniffer_data/long/[timeofday]YYYYMMDD.dat——移动实验室Sniffer测量的空气污染物水平分布
  • supersite_data/AQdata——Mäkelänkatu监测站空气质量观测
  • supersite_data/DMPS——Mäkelänkatu监测站DMPS气溶胶粒径分布
  • supersite_data/ACSM——Mäkelänkatu监测站ACSM气溶胶化学成分

适用研究

适用于城市空气污染监测、高分辨率空气质量模型验证、气溶胶垂直分布与水平扩散研究、移动与固定监测数据对比分析。

本卡由来源页信息起草,机构/覆盖/时间/规模/字段与许可以官方为准(待人工核验)。

自行获取的难点

获取城市尺度高时空分辨率空气污染监测数据以验证精细空气质量模型时,常面临移动与固定监测数据整合困难。

地理遥感与城市免费访问

布罗姆湖土地覆盖制图(基于Landsat-ETM和RADARSAT-1影像,2007年) Land cover mapping of lake Brome using Landsat-ETM and RADARSAT-1 imagery, 2007

基于Landsat-ETM和RADARSAT-1影像的布罗姆湖土地覆盖分类数据,由加拿大环境与气候变化部发布,采用面向对象分类方法。

机构Environment and Climate Change Canada
覆盖布罗姆湖(Lake Brome),加拿大魁北克
时间2007年(影像获取年份)
规模4个文件
许可许可待核验
获取直接下载SHP文件
查看字段与详情

内容与字段

该数据集包含一个SHP格式的矢量文件,为布罗姆湖地区的土地覆盖分类结果。分类基于多时相Landsat-ETM和RADARSAT-1影像,使用Definiens Earth软件进行面向对象分割,结合模糊逻辑分类。目标土地覆盖类别包括:农业用地(一年生和多年生)、道路系统(高速公路、道路、林道)、水系(永久性和非永久性水道、林下非永久性池塘)、湿地、城市区域和森林。来源页未公开字段级说明。

适用研究

适用于土地覆盖/土地利用变化监测、湿地遥感分类方法研究、面向对象分类技术验证,以及加拿大魁北克地区生态环境研究。

本卡由来源页信息起草,机构/覆盖/时间/规模/字段与许可以官方为准(待人工核验)。

自行获取的难点

获取加拿大特定湖泊区域的精细土地覆盖分类数据,尤其是结合光学与雷达影像的面向对象分类结果。

地理遥感与城市免费访问

加拿大北方驯鹿分布范围内的人为干扰足迹(基于2008-2010年Landsat卫星影像,更新至2012年范围边界) Anthropogenic disturbance footprint within boreal caribou ranges across Canada - As interpreted from 2008-2010 Landsat satellite imagery (Updated to 2012 range

加拿大环境与气候变化部制作的全国性地理空间数据集,基于2008-2010年Landsat影像,绘制57个北方驯鹿分布范围内的人为干扰足迹,更新至2012年范围边界。

机构Environment and Climate Change Canada
覆盖加拿大境内57个北方驯鹿分布范围
时间以官方为准
规模14个文件,主SHP文件146 MB
许可许可待核验
获取Open Government Portal (open.canada.ca)
查看字段与详情

内容与字段

该数据集包含矢量数据(SHP格式),表示加拿大北方驯鹿分布范围内的人为干扰足迹。干扰类型分为面状和线状要素,面状干扰包括:采伐区、矿山、水库、建成区、井场、农业用地、油气设施及未知特征;线状干扰包括:道路、铁路、电力线、地震勘探线、管道、水坝、简易机场及未知特征。数据还包含500米缓冲区(影响区)用于计算干扰水平。来源页提供了字段名称和描述文件(TXT格式),但未在正文中列出具体字段名。

适用研究

适用于北方驯鹿栖息地评估、资源选择函数建模、干扰水平分析、综合风险评估,以及人为干扰对野生动物种群影响的研究。

本卡由来源页信息起草,机构/覆盖/时间/规模/字段与许可以官方为准(待人工核验)。

自行获取的难点

获取全国一致、可重复的北方驯鹿分布范围内人为干扰空间数据,用于栖息地评估和种群影响分析。

地理遥感与城市访问条件待核验

卫星图像数据集——足球场与跑道 Satellite Imagery Dataset - Soccer Field and Runway

该数据集包含足球场和跑道的卫星图像,来源于Google,由Harvard Dataverse发布。

机构Harvard Dataverse
覆盖以官方为准
时间2024-10-07更新
规模2个文件
许可许可待核验
获取Harvard Dataverse
查看字段与详情

内容与字段

来源页未公开字段级说明。

适用研究

可用于目标检测、图像分类等计算机视觉研究,特别是针对足球场和跑道等特定地物。

本卡由来源页信息起草,机构/覆盖/时间/规模/字段与许可以官方为准(待人工核验)。

自行获取的难点

获取卫星图像数据集时,常缺乏具体字段说明和标注信息。

地理遥感与城市免费访问

湖泊水位查看器提取数据 Extracted Data From: Lake Level Viewer

该数据集包含NOAA数字海岸湖泊水位查看器背后的地理空间数据层,模拟美国五大湖沿岸湖泊水位上升和洪水影响。

机构NOAA Office for Coastal Management
覆盖美国五大湖沿岸(伊利湖、休伦湖、密歇根湖、安大略湖、圣克莱尔湖、苏必利尔湖)
时间以官方为准
规模7个文件
许可许可待核验
获取Harvard Dataverse
查看字段与详情

内容与字段

该数据集包含地理空间数据层,分为以下文件夹:DEMs(基于激光雷达的高分辨率数字高程模型,GeoTIFF格式)、Depth Rasters(湖泊水位上升淹没深度栅格,从LWD以下3英尺到以上10英尺,GeoTIFF格式)、Extent Rasters(湖泊水位上升淹没范围栅格,单值,GeoTIFF格式)、Lake Level Vectors(湖泊水位上升淹没范围多边形数据,GeoPackage格式)。此外还包含一个PDF文档说明工具和方法论。

  • DEMs——基于激光雷达的高分辨率数字高程模型,GeoTIFF格式
  • Depth Rasters——湖泊水位上升淹没深度栅格,从-3英尺到+10英尺(相对于LWD),GeoTIFF格式
  • Extent Rasters——湖泊水位上升淹没范围单值栅格,GeoTIFF格式
  • Lake Level Vectors——湖泊水位上升淹没范围多边形数据,GeoPackage格式

适用研究

适用于五大湖沿岸洪水风险评估、湖泊水位上升影响分析、沿海规划与管理决策的初步筛选工具。

本卡由来源页信息起草,机构/覆盖/时间/规模/字段与许可以官方为准(待人工核验)。

自行获取的难点

获取五大湖高分辨率淹没数据时,常需从多个来源整合,且原始数据分散在NOAA不同页面。

地理遥感与城市免费访问

加拿大数字高程模型 - Canada3D, 2001 Digital Elevation Model of Canada - Canada3D, 2001

加拿大自然资源部发布的数字高程模型(DEM),覆盖加拿大陆地,由加拿大林业局安大略区域生产,基于1:250,000比例尺的CDED数据,提供30弧秒和300弧秒两种分辨率。

机构Natural Resources Canada(加拿大自然资源部)
覆盖加拿大陆地
时间2001年(产品发布年份);2022-01-27(元数据更新)
规模4个文件(两个ASCII Grid数据文件及两个PDF产品标准文档)
许可许可待核验
获取通过FTP直接下载(https://ftp.maps.canada.ca/pub/nrcan_rncan/elevation/canada3d/)
查看字段与详情

内容与字段

该数据集包含两个数字高程模型(DEM)文件,分别以30弧秒和300弧秒的网格间距提供,格式为ASCII Grid。高程值以米为单位,参考平均海平面(MSL),基准为北美1983大地基准(NAD83)。此外还提供两份产品标准PDF文档(英文和法文)。

  • can3d30.zip——30弧秒分辨率的DEM ASCII Grid文件
  • can3d300.zip——300弧秒分辨率的DEM ASCII Grid文件
  • norme_canada3d_en.pdf——产品标准英文版PDF
  • norme_canada3d_fr.pdf——产品标准法文版PDF

适用研究

适用于加拿大全境的地形分析、水文建模、土地利用规划、气候变化影响评估等地理空间研究。由于是遗留产品,可能不满足当前政府标准,建议结合最新DEM数据使用。

本卡由来源页信息起草,机构/覆盖/时间/规模/字段与许可以官方为准(待人工核验)。

自行获取的难点

获取加拿大全境历史DEM数据时,常需区分不同分辨率并注意产品已停止维护。

地理遥感与城市免费访问

冲浪带数字高程模型(DEM)- 2米分辨率 SurfZone Digital Elevation Model (DEM) - 2m

英国环境署2019年生产的冲浪带数字高程模型,结合LIDAR与近岸多波束声纳测深数据,覆盖潮间带,2米分辨率,GeoTiff格式。

机构Environment Agency(英国环境署)
覆盖英格兰潮间带,包括锡利群岛
时间2019年生产
规模以官方为准
许可许可待核验
获取data.gov.uk 及 Defra Data 平台下载
查看字段与详情

内容与字段

该数据集为栅格DEM,GeoTiff格式,每块5km×5km,对齐英国国家网格。空间分辨率2米,高程单位为米,参考Newlyn基准(锡利群岛参考St Marys)。数据由LIDAR与多波束声纳测深数据融合生成,使用定制羽化技术平滑重叠区域,小间隙采用双线性插值。提供元数据索引目录,说明每个位置使用的源调查数据。

  • Elevation——高程值,单位为米
  • LIDAR——激光雷达源数据
  • Bathymetry——多波束声纳测深数据
  • Surface type——表面类型
  • Coastal monitoring region——海岸监测区域
  • Geoidal model——大地水准面模型
  • Transformation model——转换模型

适用研究

适用于海岸带地形分析、潮间带地貌研究、洪水淹没模拟、海岸侵蚀监测、海洋与陆地过渡带环境建模等。

本卡由来源页信息起草,机构/覆盖/时间/规模/字段与许可以官方为准(待人工核验)。

自行获取的难点

获取高分辨率潮间带DEM时,常需融合多源数据,本数据集提供现成融合产品,但许可限制需注意。

地理遥感与城市免费访问

世界边境口岸数据集(V 1.1) Border Crossings of the World (V 1.1)

该数据集记录了1993-2020年间全球国际公路边境口岸的信息,包括道路特征和检查基础设施,基于公开卫星影像目视检查收集。

机构Harvard Dataverse
覆盖全球
时间1993-2020
规模6个文件
许可许可待核验
获取Harvard Dataverse
查看字段与详情

内容与字段

该数据集包含6个文件,记录了全球国际公路边境口岸的信息。字段包括道路特征(如单车道、多车道等)以及检查基础设施(如官方建筑、大门、检查车道)的有无。数据基于公开卫星影像的目视检查收集。

  • road features——道路本身特征,如单车道、多车道等
  • filtering infrastructure——用于搜索和检查的基础设施,如官方建筑、大门、检查车道

适用研究

可用于边境管理、交通基础设施、国际关系、地理信息系统等相关研究。

本卡由来源页信息起草,机构/覆盖/时间/规模/字段与许可以官方为准(待人工核验)。

自行获取的难点

获取全球边境口岸的详细基础设施数据困难,该数据集提供了标准化、可比较的信息。

地理遥感与城市免费访问

卡尔古利-博尔德光伏潜力地图:澳大利亚建筑足迹(卡尔古利、博尔德、特拉法加) Kalgoorlie-Boulder Photo-Voltaic (PV) Potential Maps: Australian Footprints (Kalgoorlie, Boulder, Trafalgar)

该数据集提供卡尔古利-博尔德地区约16,000栋建筑的足迹几何和属性,整合微软Bing建筑足迹、ABS网格块边界、高程和2021年人口普查数据,支持屋顶太阳能分析。

机构Australian Urban Research Infrastructure Network (AURIN)
覆盖澳大利亚卡尔古利、博尔德、特拉法加地区
时间建筑足迹代表2013-2018年建筑存量;数据创建于2025年11月15日,更新于2026年1月10日
规模约16,000栋建筑,530个网格块
许可许可待核验
获取通过AURIN下载管理器获取
查看字段与详情

内容与字段

该数据集包含建筑足迹几何和属性,整合了微软Bing建筑足迹、澳大利亚统计局(ABS)网格块边界、来自Elvis – Elevation and Depth (Geoscience Australia)的高程数据以及2021年人口普查住房计数。每个足迹包括几何属性、统计地理编码(SA1-SA4、网格块)、地形分类、高程和人口背景。来源页未公开完整的字段列表,但提及以下字段:

  • SA1-SA4——统计地理编码,用于关联ABS数据
  • mesh block——网格块编码
  • topographic classification——地形分类
  • elevation——高程值
  • population context——人口背景信息

适用研究

该数据集适用于屋顶太阳能潜力分析、空间规划分析(识别高潜力区域用于太阳能激励计划)、公平性评估(评估不同社会经济区域的可再生能源获取)、基础设施规划(将分布式发电潜力与电网连接点关联),以及将太阳能数据与ABS人口普查统计、健康数据或其他空间参考数据集整合的GIS分析。

本卡由来源页信息起草,机构/覆盖/时间/规模/字段与许可以官方为准(待人工核验)。

自行获取的难点

获取建筑足迹数据时,常需整合多个来源(建筑足迹、行政边界、高程、人口数据),该数据集已预集成,节省预处理时间。

地理遥感与城市免费访问

数字大不列颠海岸线(DiGBcoast v1.0) Digital Great Britain coastlines (DiGBcoast v1.0): a dataset of the coastline position of Great Britain from 1984 to 2022 derived from publicly available optica

DiGBcoast v1.0 是由英国地质调查局(BGS)制作的大不列颠海岸线数据集,基于Landsat-5/8和Sentinel-2光学卫星影像,覆盖1984至2022年,包含瞬时水线和潮汐校正至平均海平面的岸线。

机构British Geological Survey (BGS) / NERC EDS National Geoscience Data Centre
覆盖大不列颠本土(英格兰、苏格兰、威尔士)及怀特岛和安格尔西岛
时间1984年4月12日至2022年12月15日
规模以官方为准
许可许可待核验
获取通过BGS NGDC访问页面获取(GeoPackage格式)
查看字段与详情

内容与字段

该数据集包含瞬时水线和瞬时潮汐校正至平均海平面的岸线,以GeoPackage(GPKG)格式提供,附带QGIS样式文件(QML)和文本文件(TXT)。来源页未公开字段级说明。

适用研究

适用于海岸线变化监测、海岸侵蚀评估、海岸管理及气候变化影响研究。

本卡由来源页信息起草,机构/覆盖/时间/规模/字段与许可以官方为准(待人工核验)。

自行获取的难点

获取大不列颠长时序海岸线数据时,常需整合多源卫星影像并处理潮汐校正,本数据集直接提供已校正的岸线,节省预处理时间。

地理遥感与城市免费访问

冲浪带数字高程模型2014 SurfZone Digital Elevation Model 2014

英国环境署2014年生产的冲浪带数字高程模型,覆盖潮间带,结合LIDAR和多波束声纳测深数据,分辨率2米。

机构Environment Agency
覆盖英格兰沿海潮间带
时间2014年生产
规模以官方为准
许可许可待核验
获取data.gov.uk 及环境数据门户
查看字段与详情

内容与字段

该数据集为GeoTiff格式的瓦片栅格数据集,每瓦片5km×5km,对齐英国国家网格,空间分辨率2米,高程以米为单位,参考Newlyn(锡利群岛参考St Marys)。数据还提供ESRI影像服务。元数据索引目录图层提供高程数据来源(LIDAR或测深)、表面类型、沿海监测区域、大地水准面模型和转换模型信息,目录可下载为shapefile、ESRI File Geodatabase和GeoJSON格式。

  • Elevation——高程值,单位米
  • Surface type——表面类型(DTM或DSM)
  • Source——数据来源(LIDAR或Bathymetry)
  • Coastal monitoring region——沿海监测区域
  • Geoidal model——大地水准面模型
  • Transformation model——转换模型

适用研究

适用于沿海地形变化分析、风暴影响评估、潮间带建模、海岸带管理及GIS相关研究。

本卡由来源页信息起草,机构/覆盖/时间/规模/字段与许可以官方为准(待人工核验)。

自行获取的难点

获取高分辨率沿海DEM数据时,常需了解数据来源、精度及许可限制。

地理遥感与城市免费访问

大涡模拟亚网格尺度参数化对真实飓风动力学与预报的影响 The Impacts of Sub-grid Scale Parameterization of Large-eddy Simulations on Real Hurricane Dynamics and Forecasts

该数据集包含针对飓风Sam(2021)的WRF v4.2.2大涡模拟输出文件,评估三种亚网格尺度参数化配置(ck=0.075, 0.15, 0.3),包括每小时LES结果、边界条件、初始条件及后处理脚本。

机构以官方为准
覆盖飓风Sam(2021)
时间2021年
规模37个文件
许可许可待核验
获取Harvard Dataverse
查看字段与详情

内容与字段

数据集包含WRF v4.2.2在LES模式下针对飓风Sam(2021)的输出文件。目录按SGS案例组织(ck_0.075/, ck_def/, ck_0.3/),每个目录包含每小时LES结果文件(wrfout_d03_*)、边界条件文件(wrfbdy_d01)、初始条件文件(wrfinput_d0*)及对应的namelist.input文件。还包括用于后处理10米风强度和最小海平面气压时间序列的Python脚本。

  • wrfout_d03_*——每小时LES结果文件
  • wrfbdy_d01——边界条件文件
  • wrfinput_d0*——初始条件文件
  • namelist.input——模型配置参数文件
  • Python脚本——后处理10米风强度和最小海平面气压时间序列

适用研究

可用于研究亚网格尺度参数化对飓风动力学和预报的影响,评估不同SGS配置在真实飓风模拟中的表现,以及验证和改进大涡模拟方案。

本卡由来源页信息起草,机构/覆盖/时间/规模/字段与许可以官方为准(待人工核验)。

自行获取的难点

获取真实飓风高分辨率大涡模拟输出数据,用于评估不同亚网格尺度参数化方案对飓风动力学和预报的影响。

地理遥感与城市免费访问

气候韧性文档 Climate resilience documents

该数据集由利兹市议会指导创建,包含与气候韧性相关的政策、战略和文档链接,覆盖广泛地理尺度,侧重利兹地区。

机构Leeds City Council
覆盖广泛地理尺度,侧重利兹地区
时间以官方为准
规模6个文件
许可许可待核验
获取data.gov.uk 直接下载
查看字段与详情

内容与字段

该数据集包含6个文件,提供气候韧性相关文档的链接,包括政策、战略和报告。文件格式包括XLS、CSV、ODT和PDF。具体文件有:2017年12月文档链接(XLS和CSV)、2018年10月更新文档链接(XLS和CSV)、2016年利兹气候变化适应更新报告(ODT)、英国气候预测项目概述(PDF)。来源页未公开字段级说明。

适用研究

可用于分析地方气候韧性政策、适应策略及文档汇编,支持城市气候规划、政策评估和跨区域比较研究。

本卡由来源页信息起草,机构/覆盖/时间/规模/字段与许可以官方为准(待人工核验)。

自行获取的难点

获取地方气候韧性政策文档时,常需从分散来源收集,该数据集集中提供链接,但可能不更新。

地理遥感与城市免费访问

ENACT增强海洋数据同化与气候预测海洋再分析数据集1962-2004 ENACT - ENhanced ocean data Assimilation and ClimaTe prediction - Ocean reanalysis dataset 1962-2004

ENACT是全球海洋再分析数据集,由欧洲委员会第五框架项目创建,通过将观测数据同化到HOPE-E海洋环流模型生成,提供1962-2004年网格化温度、盐度和流速信息。

机构CSIRO Marlin Data Catalogue
覆盖全球海洋
时间1962-2004
规模以官方为准
许可许可待核验
获取Data.gov.au 及 CSIRO Marlin
查看字段与详情

内容与字段

该数据集包含全球海洋再分析数据,由CSIRO版本将逐月变量拼接为单个NetCDF文件,空间分辨率1.0°×1.0°,33个深度层。数据包括势温、海水x方向流速、海水y方向流速,以及计算得到的距平、气候态和季节形式。

  • Potential temperature——势温
  • Seawater x-velocity——海水x方向流速
  • Seawater y-velocity——海水y方向流速

适用研究

适用于海洋环流研究、气候变化分析、海洋状态估计及数值模式验证。

本卡由来源页信息起草,机构/覆盖/时间/规模/字段与许可以官方为准(待人工核验)。

自行获取的难点

获取全球海洋再分析数据时,常遇到许可不明确、字段说明不足的问题。

地理遥感与城市免费访问

气候公正数据 'Climate Just' data

该数据集由大伦敦政府发布,包含英格兰社区尺度气候变化脆弱性地图工具相关指标,涵盖洪水、高温和燃料贫困等维度。

机构Greater London Authority
覆盖英格兰,Middle Super Output Area (MSOA) 层面
时间2011年(数据基准年),2026年7月16日更新
规模5个文件
许可许可待核验
获取data.gov.uk 及 data.london.gov.uk
查看字段与详情

内容与字段

该数据集包含5个Excel文件,提供英格兰MSOA层面的气候脆弱性与劣势指标。文件包括:洪水劣势指数、洪水灾害暴露、社会空间脆弱性指数(SSVI)及其指标、以及地方当局汇总。字段涵盖洪水风险、社会脆弱性、人口统计、经济状况、健康、住房、交通可达性等。

  • Fluvial flood disadvantage index——河流洪水劣势指数
  • Pluvial flood disadvantage index (1 in 30 years)——30年一遇暴雨洪水劣势指数
  • Percentage of area at moderate and significant risk of fluvial flooding——河流洪水中等及以上风险面积百分比
  • Sensitivity - flood and heat——对洪水和高温的敏感性
  • Ability to prepare - flood——洪水准备能力
  • Ability to respond - flood——洪水响应能力
  • Ability to recover - flood——洪水恢复能力
  • Socio-spatial vulnerability index - flood——社会空间脆弱性指数(洪水)
  • % children <5 years old——5岁以下儿童百分比
  • % people with long term ill-health/disability——长期患病/残疾人口百分比
  • Average weekly household net income estimate——家庭周净收入估计(英镑)
  • Travel time to nearest GP by walk/public transport——步行/公交至最近GP时间(分钟)

适用研究

可用于气候变化影响评估、社会脆弱性分析、城市规划、灾害风险管理、环境公平性研究等。

本卡由来源页信息起草,机构/覆盖/时间/规模/字段与许可以官方为准(待人工核验)。

自行获取的难点

获取英格兰社区尺度气候变化脆弱性指标时,常需整合多源数据,本数据集提供标准化MSOA层面指标。

地理遥感与城市免费访问

海平面上升查看器提取数据 Extracted Data From: Sea Level Rise Viewer

NOAA海平面上升查看器背后的地理空间数据层,模拟海平面上升和沿海洪水影响,覆盖30个州及领地,MHHW 0-10英尺增量。

机构NOAA Office for Coastal Management
覆盖30个州及美国领地(有海洋前沿海岸)
时间以官方为准
规模50个文件
许可许可待核验
获取Harvard Dataverse
查看字段与详情

内容与字段

数据集包含NOAA海平面上升查看器背后的地理空间数据层,模拟海平面上升和沿海洪水影响。数据按文件夹组织:Ancillary(支持数据文件,如合并的淹没多边形geodatabase和shapefile)、NOAA OCM SLR MergedPolys Shapefiles 0225(按区域合并的淹没多边形shapefile)、DEMs(基于激光雷达的高分辨率数字高程模型geotiff)、Depth Rasters(0-10英尺MHHW以上海洋连接海平面上升淹没栅格geotiff)、Extent Rasters(单值栅格geotiff)、High Tide Flooding(高潮洪水潜在淹没范围geotiff)、Marsh Migration(湿地影响和迁移产品geotiff)、Mapping Confidence(淹没置信度geotiff)、Sea Level Rise Vectors(淹没范围多边形geopackage)、Tidal Surfaces(MHHW潮汐表面geotiff)。还包括文档、方法和报告。

  • Ancillary——支持数据文件,包括按区域合并的淹没多边形
  • DEMs——基于激光雷达的高分辨率数字高程模型
  • Depth Rasters——0-10英尺MHHW以上海洋连接海平面上升淹没栅格
  • Extent Rasters——单值栅格,表示淹没范围
  • High Tide Flooding——高潮洪水潜在淹没范围
  • Marsh Migration——湿地影响和迁移产品
  • Mapping Confidence——淹没制图置信度
  • Sea Level Rise Vectors——淹没范围多边形(geopackage)
  • Tidal Surfaces——MHHW潮汐表面

适用研究

适用于海平面上升影响评估、沿海洪水风险分析、湿地变化研究、沿海规划与管理决策支持。

本卡由来源页信息起草,机构/覆盖/时间/规模/字段与许可以官方为准(待人工核验)。

自行获取的难点

获取NOAA海平面上升查看器原始地理空间数据层,用于本地化分析和建模。

地理遥感与城市免费访问

Geoscape 行政边界 Geoscape Administrative Boundaries

Geoscape Administrative Boundaries 是澳大利亚最全面的全国边界数据集,由 Geoscape Australia 使用权威政府数据构建和维护,涵盖政府、统计和选举边界。

机构Geoscape Australia
覆盖澳大利亚
时间季度更新;最新版本为 May 2026 发布
规模约 1.5 GB(解压后)
许可许可待核验
获取Data.gov.au 直接下载 ZIP 文件
查看字段与详情

内容与字段

该数据集包含七个产品:Localities、Local Government Areas (LGAs)、Wards、Australian Bureau of Statistics (ABS) Boundaries、Electoral Boundaries、State Boundaries 和 Town Points。数据以 ESRI Shapefile 和 MapInfo TAB 格式提供,坐标参考可选 GDA94 或 GDA2020。来源页未公开字段级说明。

适用研究

适用于行政区域分析、人口统计、选举研究、空间规划及地理信息系统相关研究。

本卡由来源页信息起草,机构/覆盖/时间/规模/字段与许可以官方为准(待人工核验)。

自行获取的难点

获取澳大利亚全国统一、权威且定期更新的行政边界数据,但需注意不同版本和坐标参考的选择。

地理遥感与城市免费访问

船舶密度网格2014 Vessel Density Grid 2014

英国海洋管理组织发布的2014年英国全境2km网格分辨率平均每周船舶密度数据,基于AIS采样计算。

机构Marine Management Organisation
覆盖英国全境
时间2014年
规模1个文件
许可许可待核验
获取以官方为准
查看字段与详情

内容与字段

该数据集包含2014年英国全境2km网格的平均每周船舶密度,基于AIS数据采样(每月前7天,共12周)计算每周平均值,再乘以52得到年估计值。属性表包含以下字段:

  • 0 - Unknown Vessels——未知类型船舶密度
  • 1 - Non-Port service craft——非港口服务船密度
  • 2 - Port service craft——港口服务船密度
  • 3 - Vessels engaged in dredging or underwater operations——疏浚或水下作业船密度
  • 4 - High Speed Craft——高速船密度
  • 5 - Military or Law enforcement——军事或执法船密度
  • 6 - Passenger——客船密度
  • 7 - Cargo——货船密度
  • 8 - Tankers——油轮密度
  • 9 - Fishing vessels——渔船密度
  • 10 - Recreational vessels——休闲船密度
  • Weekly_Ave——所有船舶的每周平均密度
  • Annual_Ave——所有船舶的估计年密度

适用研究

适用于海洋空间规划、航运交通分析、环境影响评估、渔业管理及海上安全研究。

本卡由来源页信息起草,机构/覆盖/时间/规模/字段与许可以官方为准(待人工核验)。

自行获取的难点

获取高分辨率船舶密度网格数据时,常需处理不同年份网格不一致的问题。

地理遥感与城市免费访问

东亚区域再分析6小时压力层数据(2010-2019) East Asia Regional Reanalysis 6 hourly data on pressure levels from 2010 to 2019

由韩国延世大学开发的东亚区域再分析数据集,时间跨度为2010-2019年,每6小时一次,包含风、温度、位势高度和比湿等变量。

机构Yonsei University (South Korea)
覆盖东亚区域
时间2010-2019
规模14608个文件
许可许可待核验
获取Harvard Dataverse
查看字段与详情

内容与字段

该数据集包含东亚区域再分析数据,时间分辨率为6小时(00, 06, 12, 18 UTC),覆盖2010-2019年。数据以netCDF格式存储,包含以下变量:

  • u-component of wind——风的u分量(东西向风速)
  • v-component of wind——风的v分量(南北向风速)
  • temperature——温度
  • geopotential height——位势高度
  • specific humidity——比湿

适用研究

适用于东亚区域的气候研究、气象分析、大气动力学研究以及相关环境模拟。

本卡由来源页信息起草,机构/覆盖/时间/规模/字段与许可以官方为准(待人工核验)。

自行获取的难点

获取东亚区域高时间分辨率再分析数据时,常需整合多个变量和长时间序列,本数据集提供标准化格式。

地理遥感与城市免费访问

降水观测数据 Precipitation Observations

该数据集由巴拉瑞特市提供,包含分布在巴拉瑞特的传感器实时采集的降水观测历史数据,通常每15分钟更新一次。

机构City of Ballarat
覆盖澳大利亚巴拉瑞特
时间以官方为准
规模1个文件(API)
许可许可待核验
获取通过巴拉瑞特数据交换平台API获取
查看字段与详情

内容与字段

该数据集包含由分布在巴拉瑞特的传感器实时采集的降水观测记录。数据通过API提供,来源页未公开字段级说明。

适用研究

适用于城市降水模式分析、历史降水趋势研究、以及公众降水信息查询等。

本卡由来源页信息起草,机构/覆盖/时间/规模/字段与许可以官方为准(待人工核验)。

自行获取的难点

获取实时降水观测数据时,常需明确数据更新频率和许可条款。

地理遥感与城市免费访问

地表水温档案(截至2007年) Surface Water Temperature Archive up to 2007

英国环境署创建的地表水温档案,包含英格兰和威尔士超过30,000个站点截至2007年的水温时间序列数据及站点元数据。

机构Environment Agency
覆盖英格兰和威尔士
时间截至2007年,多数站点记录始于1980年代
规模超过30,000个站点
许可许可待核验
获取通过Defra数据服务直接下载ZIP文件
查看字段与详情

内容与字段

该档案包含水温数据和站点元数据。水温数据分为两种类型:常规监测的瞬时样本(如每月)和高分辨率样本(如每15分钟)。数据库使用Microsoft Access 2003创建,具有基于查询的简单前端。约十分之一的站点进行了趋势分析,相关图表嵌入在档案中。站点信息包括水体类型(如河流、湖泊或运河)。

  • Site Operator——监测组织
  • Source Info——信息提供时间
  • 水体温数据——瞬时或高分辨率水温记录
  • 站点元数据——站点位置、水体类型等

适用研究

可用于气候变化指示研究、生态响应分析、水温趋势评估及水体监测网络规划。

本卡由来源页信息起草,机构/覆盖/时间/规模/字段与许可以官方为准(待人工核验)。

自行获取的难点

获取英国长时序、多站点地表水温数据时,常需整合分散来源,本档案提供统一汇编。

地理遥感与城市免费访问

德国网格化人口地图(基于人口普查数据分解与自下而上估算) Gridded population maps of Germany from disaggregated census data and bottom-up estimates

该数据集包含德国10米网格的三套人口分布数据,基于建筑密度、高度和类型,通过人口普查分解和自下而上估算生成。

机构Franz Schug, David Frantz, Sebastian van der Linden, Patrick Hostert
覆盖德国
时间建筑密度层基于2018年Sentinel-2和2017年Sentinel-1数据;建筑高度层代表约2015年;建筑类型层基于2018年Sentinel-2和2017年Sentinel-1数据;人口普查数据来自2018年
规模7.5 GB
许可许可待核验
获取Zenodo
查看字段与详情

内容与字段

该数据集包含三个10米网格的人口分布数据集(DE_POP_VOLADJ16、DE_POP_TDBP、DE_POP_BU),单位为每网格单元人数。数据以30x30公里瓦片形式提供,投影为EPSG:3035,格式为压缩GeoTiff(*.tif)和GDAL虚拟格式(*.vrt)。

  • DE_POP_VOLADJ16——基于加权分区密度法分解全国人口普查数据,使用建筑密度、高度和类型作为协变量,并对多户住宅体积进行调整
  • DE_POP_TDBP——基于分区密度法分解市政人口普查数据,使用相同三个协变量层,被视为最佳产品
  • DE_POP_BU——基于自下而上的网格化人口估算,利用建筑密度、高度和类型计算居住楼面面积,并结合联邦人均居住面积统计

适用研究

适用于人口分布建模、城市与区域规划、环境健康研究、灾害风险评估等需要高分辨率人口空间分布的研究。

本卡由来源页信息起草,机构/覆盖/时间/规模/字段与许可以官方为准(待人工核验)。

自行获取的难点

高分辨率人口空间数据获取困难,且不同来源数据一致性差,该数据集提供了统一方法生成的10米网格人口数据。

地理遥感与城市免费访问

UniMi/ISAC-CNR 观测数据集(地表气温)在再分析网格与海拔上 UniMi/ISAC-CNR Observational Dataset (t2m) on reanalysis grid and elevations

该数据集由米兰大学与CNR-ISAC合作提供,包含1991-2020年意大利境内日最低和最高地表气温的网格化观测值,插值到六种再分析产品的网格上,并考虑了海拔影响。

机构University of Milan & CNR-ISAC
覆盖意大利
时间以官方为准
规模6个再分析网格,每个网格30个年度压缩文件(共180个.7z文件)
许可许可待核验
获取Zenodo
查看字段与详情

内容与字段

该数据集包含1991-2020年意大利境内日最低和最高地表气温的网格化观测值,插值到六种再分析产品的网格上(ERA5、ERA5-Land、MERIDA、MERIDA HRES、CERRA、VHR-REA_IT)。每个再分析网格对应30个年度压缩文件(.7z格式),解压后为NetCDF格式,包含每日最低和最高温度场以及额外的标志变量,用于标识因数据不足而无法插值的极少数情况。

  • t2m_min——日最低地表气温
  • t2m_max——日最高地表气温
  • flag——标志变量,标识插值不可用的网格点

适用研究

该数据集适用于再分析产品的验证与评估、意大利地区气温变率与气候变化影响研究,以及高分辨率网格化观测与再分析输出的比较分析。

本卡由来源页信息起草,机构/覆盖/时间/规模/字段与许可以官方为准(待人工核验)。

自行获取的难点

获取与再分析网格和海拔一致的网格化观测气温数据,用于再分析产品验证。

地理遥感与城市免费访问

MODIS衍生海面温度数据集 MODIS derived Sea Surface Temperature (SST) datasets

由Geoscience Australia发布的基于MODIS Aqua影像衍生的澳大利亚海域海面温度数据集,覆盖澳大利亚专属经济区及周边水域,时间跨度为2002年至2012年。

机构Geoscience Australia
覆盖澳大利亚专属经济区及周边水域(包括南大洋)
时间2002年至2012年(126个月度图层)
规模37个文件(ZIP格式)
许可许可待核验
获取通过data.gov.au直接下载ZIP文件
查看字段与详情

内容与字段

该数据集包含126个月度海面温度(SST)图层,空间分辨率为0.01度,覆盖澳大利亚专属经济区及周边水域。数据由MODIS Aqua影像经NASA SeaDAS软件处理生成。来源页未公开字段级说明。

适用研究

适用于海洋温度变化监测、海洋气候研究、渔业资源管理及海洋生态系统分析等。

本卡由来源页信息起草,机构/覆盖/时间/规模/字段与许可以官方为准(待人工核验)。

自行获取的难点

获取海洋温度数据时,常遇到许可不明确、字段说明缺失等问题。

地理遥感与城市免费访问

面向自然灾害风险建模的合成未来城市暴露数据集(含10个城市的社会人口、建筑和土地利用数据) Exposure datasets representing a synthetic future urban context, including socio-demographic, building, and land-use data from 10 cities, for natural hazard ris

该数据集包含10个城市(伊斯坦布尔、纳布卢斯等)的合成未来城市暴露数据,涵盖建筑、道路、电力网络等物理要素及家庭、个人等社会要素,用于自然灾害风险建模。由NERC支持创建。

机构NERC(英国自然环境研究理事会)
覆盖10个城市:伊斯坦布尔、纳布卢斯、查图姆、科克斯巴扎尔、内罗毕、纳库鲁、基多、科卡纳、拉普提、达鲁萨兰
时间未来50年(未来城市情景)
规模2个文件(ZIP格式)
许可许可待核验
获取直接下载ZIP文件(https://data-package.ceh.ac.uk/sd/cdfea06f-d47c-4967-99d4-cc71bddea45d.zip)
查看字段与详情

内容与字段

该数据集包含9种数据类型,每种类型对应一个文件或图层,命名格式为“CitynameFutureExposureDataset/Cityname_CommunityCode_DataType”。具体字段如下:

  • landuse——土地利用规划数据,包括土地利用类型、面积(公顷)、最大人口密度和现有人口
  • building——建筑足迹数据,包括建筑标识号、结构类型、楼层数、足迹面积、占用类型和建筑规范等级
  • road nodes——道路节点数据,包括每个节点的标识号
  • road edges——道路路段数据,包括起点和终点节点的ID
  • power nodes——电力节点数据,包括每个节点的标识号
  • power edges——电力线路数据,包括起点和终点节点的ID
  • household——家庭社会属性数据,包括个体数量、收入水平和常用设施ID(如医院)
  • individual——个体属性数据,包括年龄、性别、学校ID(如相关)、工作场所ID(如相关)和最高教育水平
  • Distribution table——每个城市未来50年的人口社会变化和预期物理发展分布表

适用研究

该数据集适用于自然灾害风险建模、城市暴露评估、未来城市情景分析、社会人口与基础设施交互研究等。

本卡由来源页信息起草,机构/覆盖/时间/规模/字段与许可以官方为准(待人工核验)。

自行获取的难点

获取合成未来城市暴露数据时,常面临数据字段不明确、许可条件不清等问题。

地理遥感与城市访问条件待核验

ORA-S3 业务化海洋再分析系列3数据集 1959-2006 ORA-S3 - Operational Ocean Re-Analysis Series 3 dataset 1959-2006

由ECMWF创建、CSIRO处理的全球海洋再分析数据集,覆盖1959-2006年,包含温度、盐度等变量,提供月均、异常、气候态和季节平均数据。

机构European Centre for Medium-Range Weather Forecasts (ECMWF)(创建者);CSIRO(处理与发布)
覆盖全球海洋(经度-180°至180°,纬度-90°至90°)
时间1959年1月至2006年12月
规模40个NetCDF文件,总大小约36.4 GB(10个月均文件13.0 GB,10个异常文件13.0 GB,10个气候态文件557 MB,10个季节文件9.81 GB)
许可许可待核验
获取通过Data.gov.au页面提供的链接访问CSIRO Marlin数据目录
查看字段与详情

内容与字段

该数据集包含全球海洋再分析变量,由ECMWF的ORA-S3系统生成,CSIRO将逐月变量拼接为单个NetCDF文件。数据在256×195经纬度网格(29层)上提供,包括月均、异常、气候态和季节平均四种形式。来源页未公开字段级说明。

适用研究

适用于海洋环流研究、气候变率与变化分析、耦合模式初始条件生成、季节至年代际预测等。

本卡由来源页信息起草,机构/覆盖/时间/规模/字段与许可以官方为准(待人工核验)。

自行获取的难点

海洋再分析数据通常变量多、格式复杂,且许可不明确,难以直接用于研究或再分发。

地理遥感与城市免费访问

加拿大MODIS 10天合成地表反照率时间序列(修订版0) MODIS 10-daily composite surface albedo time series of Canada - Revision 0

由加拿大自然资源部遥感中心(CCRS)生产的MODIS 10天合成地表短波宽带反照率数据集,覆盖加拿大全境及美国北部、阿拉斯加和格陵兰,时间跨度2000-2016年,空间分辨率250米。

机构Canada Center for Remote Sensing (CCRS), Natural Resources Canada
覆盖加拿大全境、美国北部、阿拉斯加和格陵兰
时间2000-2016年
规模以官方为准
许可许可待核验
获取ESRI REST服务
查看字段与详情

内容与字段

该数据集包含2000-2016年加拿大及周边地区每10天合成的短波宽带地表反照率影像,共36幅/年。数据采用LCC投影,250米像素分辨率。同时提供每10天对应的像素状态数据集(如云/阴影、雪/冰、水、陆地等)。数据来源于MODIS TERRA卫星前7个波段(B1-B7,波长459-2155 nm),其中B1、B2原始分辨率250米,B3-B7经降尺度至250米。反照率反演采用结合陆地/雪BRDF模型的算法。

  • B1——波段1,波长620-670 nm,250米分辨率
  • B2——波段2,波长841-876 nm,250米分辨率
  • B3——波段3,波长459-479 nm,500米分辨率(降尺度至250米)
  • B4——波段4,波长545-565 nm,500米分辨率(降尺度至250米)
  • B5——波段5,波长1230-1250 nm,500米分辨率(降尺度至250米)
  • B6——波段6,波长1628-1652 nm,500米分辨率(降尺度至250米)
  • B7——波段7,波长2105-2155 nm,500米分辨率(降尺度至250米)
  • 短波宽带反照率——由7个光谱反照率经经验多项式转换得到的短波宽带地表反照率
  • 像素状态——每10天对应的像素分类(云/阴影、雪/冰、水、陆地等)

适用研究

适用于气候变化研究、地表能量平衡建模、水文模拟、植被动态监测、冰雪覆盖变化分析等需要长时间序列地表反照率数据的领域。

本卡由来源页信息起草,机构/覆盖/时间/规模/字段与许可以官方为准(待人工核验)。

自行获取的难点

获取长时间序列、高空间分辨率的地表反照率数据,且覆盖加拿大及周边高纬度地区,但数据需通过ESRI REST服务访问,可能需GIS工具处理。

地理遥感与城市访问条件待核验

V6时间序列县级点数据 V6 Time Series County Points

V6时间序列县级点数据,覆盖中国历史县级行政单元,时间跨度从公元前221年至公元1911年,由哈佛Dataverse发布。

机构以官方为准
覆盖中国历史县级行政单元
时间公元前221年至公元1911年
规模6个文件
许可许可待核验
获取哈佛Dataverse
查看字段与详情

内容与字段

该数据集包含中国历史县级行政单元的点数据,时间跨度从公元前221年至公元1911年。来源页未公开字段级说明。

适用研究

适用于历史地理、行政区划变迁、人口分布等研究。

本卡由来源页信息起草,机构/覆盖/时间/规模/字段与许可以官方为准(待人工核验)。

自行获取的难点

历史地理研究中,获取中国历代县级行政单元的空间点数据常因时间跨度大、空间覆盖不完整而困难。

地理遥感与城市免费访问

连通性专家小组建议水文建模2025–情景2–系统末端–透光性 Hydrologic Modelling of Connectivity Expert Panel Recommendations 2025–Scenario 2–End of System–Translucency

该数据集包含新南威尔士州连通性专家小组建议的水文建模结果,情景2模拟系统末端透光性规则,覆盖Gwydir、Namoi和Border Rivers等regulated valleys,时间跨度为1895-01-01至2023-06-30。

机构NSW Department of Climate Change, Energy, the Environment and Water
覆盖新南威尔士州regulated valleys(Gwydir, Namoi, Border Rivers),地理范围约141°E–154°E, 32°S–28°S
时间1895-01-01 至 2023-06-30
规模4个文件(含XLSX和PDF)
许可许可待核验
获取DataNSW平台直接下载
查看字段与详情

内容与字段

该数据集包含4个文件:一个XLSX数据文件(Northern Basin Connectivity - Modelling 2025 - Scenario 2 - EOSTargetTrans.xlsx)、一个PDF分析报告(Analysis of the Connectivity Expert Panel Recommendations Hydrologic modelling assessment.pdf)、一个数据质量声明PDF和一个元数据声明PDF。XLSX文件包含水文建模结果,具体字段未在页面中公开。

  • Northern Basin Connectivity - Modelling 2025 - Scenario 2 - EOSTargetTrans.xlsx——主要数据文件,包含情景2的建模输出
  • Analysis of the Connectivity Expert Panel Recommendations Hydrologic modelling assessment.pdf——分析报告,详细说明建模方法
  • Data Quality Statement——数据质量声明PDF
  • MetadataStatement_Questionnaire_Scenario 2-end of system–Translucency.pdf——元数据声明PDF

适用研究

该数据集适用于水文连通性建模、河流基流保护策略评估、水资源管理政策分析,以及气候变化情景下的水文响应研究。

本卡由来源页信息起草,机构/覆盖/时间/规模/字段与许可以官方为准(待人工核验)。

自行获取的难点

获取水文建模数据时,常因缺乏详细的字段说明和元数据而难以直接使用。

地理遥感与城市免费访问

EPSRC项目数据:DiSECCS——Sleipner地震分析数据集 EPSRC project data: DiSECCS - Seismic analysis datasets from Sleipner

该数据集包含Sleipner CO2封存操作的三维时移地震解释参数网格(时间厚度和构造深度厚度)以及一个CO2楔形体合成地震模型,由英国地质调查局发布。

机构British Geological Survey (BGS)
覆盖北海Sleipner CO2封存操作区域
时间1994年(基线)、1999、2001、2002、2004、2006、2008、2010年(时移地震);数据集创建于2020年2月26日,更新于2026年7月16日
规模1个文件(资源定位器)
许可许可待核验
获取通过data.gov.uk页面上的资源定位器获取
查看字段与详情

内容与字段

数据集包含两部分内容:1)从Sleipner CO2封存操作的三维时移地震数据中解释的参数网格(以电子表格形式提供),包括时间厚度和构造深度厚度;2)一个CO2楔形体的合成地震模型,用于研究楔形体真实厚度与时间厚度之间的关系。来源页未公开字段级说明。

适用研究

该数据集可用于CO2封存监测、时移地震解释方法研究、以及CO2层厚度与地震响应关系的建模分析。

本卡由来源页信息起草,机构/覆盖/时间/规模/字段与许可以官方为准(待人工核验)。

自行获取的难点

获取CO2封存时移地震解释数据时,常缺乏公开的网格化参数和合成地震模型。

地理遥感与城市免费访问

V6时间序列府级点数据 V6 Time Series Prefecture Points

CHGIS发布的V6版时间序列府级点数据,覆盖中国历代府级行政单位,时间跨度从公元前221年至1911年,其中1350-1911年空间覆盖较完整。

机构CHGIS
覆盖中国历代府级行政单位
时间公元前221年至1911年
规模5个文件
许可许可待核验
获取Harvard Dataverse
查看字段与详情

内容与字段

该数据集包含中国历代府级行政单位的点状地理坐标,时间跨度从公元前221年至1911年。来源页未公开字段级说明。

适用研究

适用于历史地理、行政区划变迁、空间分析等研究。

本卡由来源页信息起草,机构/覆盖/时间/规模/字段与许可以官方为准(待人工核验)。

自行获取的难点

历史地理研究中,获取历代府级行政单位精确空间位置数据常因时间跨度大、覆盖不完整而困难。

地理遥感与城市免费访问

2022年9月北海岸风暴后恢复调查激光雷达点云 September 2022 - North Coast Post-Storm Recovery Survey - LiDAR Point Cloud

该数据集包含2022年9月北爱尔兰北海岸风暴后恢复调查的激光雷达点云,由Fugro受委托采集,覆盖软沉积海岸线区域。

机构OpenDataNI
覆盖北爱尔兰北海岸软沉积区域,包括Curran Strand、Portrush East Strand、Portstewart Strand、Downhill Beach至Magilligan
时间2022年9月
规模2个文件
许可许可待核验
获取以官方为准
查看字段与详情

内容与字段

该数据集为激光雷达点云,由2022年9月北爱尔兰北海岸风暴后恢复调查生成。数据以0.5米分辨率采集,覆盖从潮间带至内陆10米的软沉积区域。点云数据可直接与2022年3月初始风暴后调查数据进行比较。来源页未公开字段级说明。

适用研究

适用于海岸线变化监测、风暴影响评估、沉积物动态研究及海岸恢复分析。

本卡由来源页信息起草,机构/覆盖/时间/规模/字段与许可以官方为准(待人工核验)。

自行获取的难点

获取高分辨率海岸激光雷达点云数据以分析风暴后海岸线恢复情况时,常面临数据格式和许可不明确的问题。

地理遥感与城市免费访问

英国环境变化网络(ECN)凯恩戈姆固定点重复摄影环境与物候数据(2002-2019) UK Environmental Change Network (ECN) Cairngorm environmental and phenological data derived from fixed-point repeat photography, 2002-2019

该数据集包含从英国环境变化网络(ECN)凯恩戈姆国家公园固定点重复相机系统拍摄的照片中提取的环境和物候事件日期/持续时间,涵盖2002-2019年。

机构UK Environmental Change Network (ECN)
覆盖英国苏格兰凯恩戈姆国家公园
时间2002-2019
规模2个文件(ZIP格式)
许可许可待核验
获取直接下载ZIP文件
查看字段与详情

内容与字段

该数据集包含从固定点重复相机系统拍摄的照片中提取的环境和物候事件日期/持续时间。数据涵盖2002-2019年北向和东向山坡的永久冬季降雪及春季融雪时间,以及2010-2019年无脊椎动物(沫蝉泡沫)和植物(石楠开花、欧洲赤松展叶)的物候事件。每天拍摄三张照片以最大化无云图像机会,使用最清晰的图像进行分析。事件检测主要通过人工评估完成,但石楠开花采用自动像素颜色计数方法确定盛花期。来源页未公开字段级说明。

适用研究

该数据可用于气候变化对高山环境物候影响的研究,以及雪盖动态、植物物候和昆虫活动周期的长期监测分析。

本卡由来源页信息起草,机构/覆盖/时间/规模/字段与许可以官方为准(待人工核验)。

自行获取的难点

获取长期高山环境物候观测数据时,常面临数据分散、时间跨度短、字段说明不完整等问题。

地理遥感与城市免费访问

年均降水量深度(毫米/年) Average precipitation in depth (mm per year)

世界银行指标,反映各国年均降水量深度(毫米/年),数据由联合国粮农组织(FAO)发布,采用CC BY-4.0许可。

机构Food and Agriculture Organization of the United Nations (FAO)
覆盖所有国家和地区
时间2022年(最新年份)
规模以官方为准
许可许可待核验
获取World Bank Data API / DataBank
查看字段与详情

内容与字段

该数据集提供各国年均降水量深度(毫米/年),为长期平均年降水量。来源页未公开字段级说明。

适用研究

可用于气候变化、水资源管理、农业规划等领域的跨国比较分析。

本卡由来源页信息起草,机构/覆盖/时间/规模/字段与许可以官方为准(待人工核验)。

自行获取的难点

获取各国年均降水量数据时,常需从多个来源整合,且许可条件不明确。

地理遥感与城市免费访问

Floreat-f2 点云 LAS - 2022年8月 Floreat-f2 - Point Cloud LAS - Aug 2022

该数据集为2022年8月24日通过无人机影像采集的Floreat Surf Life Saving Club北部沙丘稀疏三维点云,用于海岸沙丘侵蚀监测。

机构Cambridge Coastcare
覆盖以官方为准
时间2022年8月24日(单日采集)
规模1个LAS文件
许可许可待核验
获取通过DataWA免费下载LAS文件
查看字段与详情

内容与字段

该数据集为一个稀疏三维点云(LAS格式),存储每个点的X、Y、Z坐标和颜色信息。数据由超过500张无人机影像经Pix4D处理生成,属于Cambridge Coastcare海滩沙丘建模与监测项目的一部分。来源页未公开字段级说明。

适用研究

适用于海岸沙丘侵蚀监测、地形变化分析、三维建模及可视化研究。

本卡由来源页信息起草,机构/覆盖/时间/规模/字段与许可以官方为准(待人工核验)。

自行获取的难点

获取高精度海岸沙丘点云数据时,常需明确采集时间、空间范围和许可条件。

地理遥感与城市免费访问

BROKE-WEST调查中声纳浮标部署的海洋哺乳动物声学调查数据 Marine mammal acoustic survey data from sonobuoy deployments on the BROKE-WEST Survey

该数据集包含2006年1月至2月BROKE-WEST调查期间,在南大洋使用DIFAR 53D声纳浮标记录的海洋哺乳动物声学调查数据,由澳大利亚海洋数据网络发布。

机构Australian Ocean Data Network
覆盖南大洋,地理范围:经度29.98°E至103.71°E,纬度69.12°S至36.58°S
时间以官方为准
规模10个文件
许可许可待核验
获取通过澳大利亚海洋数据网络获取(HTML格式)
查看字段与详情

内容与字段

数据集描述存储在一个Excel工作簿中,包含一个摘要表和多个声纳浮标部署数据日志表。摘要表每行概括一次声纳浮标部署。数据日志表按部署开始日期分页。每个部署有初始条目,后续行为运行日志。字段包括:

  • Observer(real time/post-processing)——实时或后处理观察者
  • Summary of the sounds——样本内声音摘要(70分钟)
  • Total recording length (in minutes)——总录音时长(分钟)
  • Date——日期
  • UTC time of deployment——部署的UTC时间
  • Initial latitude (decimal degrees)——初始纬度(十进制度)
  • Initial Longitude (decimal degrees)——初始经度(十进制度)
  • Depth setting of sonobuoy hydrophone (90, 120, or 300m)——声纳浮标水听器深度设置
  • National Instruments sound card gain (0, 5, or 10 times)——NI声卡增益
  • Ship heading (true degrees)——船首向(真度)
  • Ship speed (knots)——船速(节)
  • Distance of deployment from CTD location (if applicable)——部署点距CTD位置的距离

适用研究

该数据可用于南大洋海洋哺乳动物声学监测、物种分布与行为研究,以及声纳浮标数据处理方法开发。

本卡由来源页信息起草,机构/覆盖/时间/规模/字段与许可以官方为准(待人工核验)。

自行获取的难点

海洋哺乳动物声学调查数据常因采集设备、处理流程和字段结构不统一而难以直接复用,本数据集提供了详细的采集与处理说明,但许可未明确,需进一步确认使用条件。

地理遥感与城市免费访问

工程气候数据集 Engineering Climate Datasets

由加拿大环境与气候变化部发布的工程气候数据集,包含IDF文件、CWEEDS和CWEC,覆盖加拿大563个地点,提供降雨强度-历时-频率统计、每小时气象条件及典型气象年数据。

机构Environment and Climate Change Canada
覆盖加拿大563个地点
时间1953年至2005年(CWEEDS);CWEC基于通常30年数据
规模以官方为准
许可许可待核验
获取Open Canada门户及加拿大气候网站
查看字段与详情

内容与字段

该数据集包含三个子集:IDF文件、CWEEDS和CWEC。IDF提供加拿大563个地点的短历时降雨统计(强度-历时-频率曲线)。CWEEDS包含特定地点的小时气象条件,包括1953-2005年的长期天气记录及每小时太阳辐射估算。CWEC由12个典型气象月组成,基于通常30年数据,选取标准包括日总辐射、干球温度、露点温度及风速的月均值比较。来源页未公开具体字段列表。

适用研究

适用于工程气候分析、建筑设计、城市规划、可再生能源评估及水文研究。

本卡由来源页信息起草,机构/覆盖/时间/规模/字段与许可以官方为准(待人工核验)。

自行获取的难点

工程气候数据分散,IDF、CWEEDS、CWEC三个子集需分别获取,且字段说明不明确。

地理遥感与城市免费访问

IMOS自主水下航行器——SIRIUS,巴特曼斯湾航次,2010年11月 IMOS - Autonomous Underwater Vehicles - SIRIUS, CAMPAIGN: BATEMANS BAY, NOVEMBER 2010

该数据集包含2010年11月IMOS SIRIUS自主水下航行器在澳大利亚新南威尔士州巴特曼斯湾的航次数据,包括立体图像、多波束、AUV轨迹、3D纹理网格和水文数据。

机构Australian Ocean Data Network
覆盖澳大利亚新南威尔士州巴特曼斯湾附近海域
时间2010年11月17日至22日
规模8个文件;数据集超过1TB
许可许可待核验
获取以官方为准
查看字段与详情

内容与字段

该数据集包含SIRIUS AUV在巴特曼斯湾航次中采集的多种数据类型,包括立体图像、多波束测深、AUV轨迹、3D纹理网格和水文数据(CDOM、盐度、温度)。数据集还包含每次潜水的报告(PDF格式)。来源页未公开完整的字段级说明,但标签中列出了部分变量。

  • altitude——高度
  • concentration_of_co...——浓度(未完整显示)
  • depth——深度
  • heading——航向
  • latitude——纬度
  • longitude——经度
  • mass_concentration_...——质量浓度(未完整显示)
  • optical_backscatter——光学后向散射
  • platform_pitch_angle——平台俯仰角
  • platform_roll_angle——平台横滚角
  • sea_water_salinity——海水盐度
  • sea_water_temperature——海水温度

适用研究

该数据集适用于海洋底栖栖息地测绘、水下自主航行器性能评估、海洋水文参数研究以及近岸海洋生态系统监测等研究领域。

本卡由来源页信息起草,机构/覆盖/时间/规模/字段与许可以官方为准(待人工核验)。

自行获取的难点

获取AUV航次详细数据时,常因数据分散、格式多样而难以整合,该数据集提供了集中访问的入口。

地理遥感与城市免费访问

2022年3月北海岸风暴后测量激光雷达点云 March 2022 - North Coast Post-Storm Survey - LiDAR Point Cloud

由Fugro受委托于2022年3月在北爱尔兰北海岸进行的风暴后激光雷达点云数据,覆盖Curran Strand等软沉积区域。

机构Fugro(受委托)
覆盖北爱尔兰北海岸的Curran Strand、Portrush East Strand、Portstewart Strand、Downhill Beach至Magilligan
时间2022年3月(测量时间);数据创建2025-07-28,更新2026-07-23
规模2个文件
许可许可待核验
获取以官方为准
查看字段与详情

内容与字段

该数据集包含2022年3月风暴后北爱尔兰北海岸软沉积区域的激光雷达点云数据,以点云格式提供。数据格式与2021年基线调查的 topographic LiDAR 数据相同,便于对比变化。来源页未公开字段级说明。

适用研究

可用于海岸侵蚀评估、风暴影响分析、海岸线变化监测及地貌演变研究。

本卡由来源页信息起草,机构/覆盖/时间/规模/字段与许可以官方为准(待人工核验)。

自行获取的难点

获取风暴后高精度海岸地形数据以评估侵蚀变化时,常面临数据格式不统一或缺乏基线对比数据的问题。

地理遥感与城市免费访问

加拿大ANUSPLIN网格化调整降水数据集 ANUSPLIN-gridded Adjusted Precipitation (ANUSPLIN-AdjP) datasets for Canada

由加拿大环境与气候变化部发布的网格化调整降水数据集,包含日、候、月三种时间尺度,覆盖加拿大陆地,空间分辨率0.083333°。

机构Environment and Climate Change Canada
覆盖加拿大陆地
时间日降水自1900年,候平均降水率自1950年,月降水自1872年
规模以官方为准
许可许可待核验
获取Open Canada 平台,直接下载 TXT 文件
查看字段与详情

内容与字段

该数据集包含三个子数据集:日降水(ANUSPLIN-AdjPdly,自1900年)、候平均降水率(ANUSPLIN-AdjP5d,自1950年)和月总降水(ANUSPLIN-AdjPmly,自1872年),均为0.083333°×0.083333°网格上的调整降水数据。数据基于ANUSPLIN曲面拟合,日数据来自调整后的日降雨和降雪数据集(AdjDlyRS)版本2016(含3346个手动观测站),月和候数据由相应日站数据导出。来源页未公开字段级说明。

适用研究

适用于加拿大区域降水气候学研究、水文模拟、农业气象分析等,但需注意数据未经均一化,用于趋势分析前需进行均一性检验。

本卡由来源页信息起草,机构/覆盖/时间/规模/字段与许可以官方为准(待人工核验)。

自行获取的难点

获取加拿大高分辨率网格化调整降水数据时,常需区分不同时间尺度(日/候/月)并注意早期北部数据缺失及未经均一化的限制。

地理遥感与城市免费访问

戴维斯机场项目(DAP)——声学系泊记录 Davis Aerodrome Project (DAP) - Acoustic Mooring recordings

该数据集包含澳大利亚南极局戴维斯机场项目在戴维斯站附近两个地点采集的长周期水下声学记录,用于环境评估。

机构Australian Antarctic Division
覆盖戴维斯站附近(约站西5公里及Long Fjord北部)
时间2021年7月22日至2022年2月8日
规模4个文件
许可许可待核验
获取Data.gov.au 直接下载
查看字段与详情

内容与字段

该数据集包含从戴维斯站西侧部署的仪器下载的长期水下声学记录。数据为24位WAV音频文件,按占空比记录:60秒512 kHz采样率,随后580秒32 kHz采样率,然后280秒关闭。文件名格式为AMAR序列号后跟UTC起始时间,例如AMAR897.20210722T061621Z.wav。数据包含校准声压测量。

  • WAV文件——24位音频文件,包含水下声学记录
  • 文件名——格式为AMAR序列号_UTC起始时间,例如AMAR897.20210722T061621Z.wav

适用研究

该数据可用于南极近岸海洋环境声学监测、海洋哺乳动物声学检测、人为噪声对海洋生态系统影响评估等研究。

本卡由来源页信息起草,机构/覆盖/时间/规模/字段与许可以官方为准(待人工核验)。

自行获取的难点

获取南极水下声学数据时,常面临数据许可不明确、字段说明不足的问题。

经济与社会科学免费访问

澳大利亚农业全要素生产率测量手册 A manual for measuring total factor productivity in Australian agriculture

澳大利亚农业全要素生产率测量手册由澳大利亚农业与资源经济科学局(ABARES)发布或维护。本说明从原发布方材料中确认其覆盖范围为覆盖澳大利亚农业的产出、投入和全要素生产率测量。,当前共有 23 项事实通过逐字引用核验;来源未说明的内容保持为空,不由模型推断。

机构澳大利亚农业与资源经济科学局(ABARES)
覆盖覆盖澳大利亚农业的产出、投入和全要素生产率测量。
时间1948-49 至 2013-14
规模来源未披露
许可Creative Commons Attribution 4.0 International
获取可从 data.gov.au 下载 PDF 和 Word 文件。
查看字段与详情

数据内容与结构

  • 覆盖对象或范围:覆盖澳大利亚农业的产出、投入和全要素生产率测量。
  • 时间覆盖:1948-49 至 2013-14
  • 空间覆盖:澳大利亚(点坐标:151.122622, -25.371968)
  • 坐标参考系:WGS 84(由 GeoJSON 点要素元数据推定)
  • 空间分辨率或比例尺:国家级(以代表整个国家的单个点表示)
  • 地理数据格式:GeoJSON(元数据中声明)
  • 字段、变量或文件结构:PDF 和 Word 文档;页面未说明结构化数据字段。

适用范围与限制

  • 适用与不适用场景:适合研究澳大利亚农业生产率趋势的研究人员、经济学者和政策分析人员;在没有补充数据时,不适合次国家级或农场层面分析。
  • 已知限制或未实测边界:该资源是说明方法和汇总结果的手册或报告,不包含原始微观数据;空间范围以澳大利亚单个点表示,时间覆盖截至 2013-14。

来源与核验边界

仍未闭合的事项:

  • 数据规模:来源尚未形成可确认事实

本卡只呈现能够回到原发布方材料的事实;公开可访问、开放许可、免费获取、商用和再分发分别判断。

适用范围与使用边界

适用方向:适合研究澳大利亚农业生产率趋势的研究人员、经济学者和政策分析人员;在没有补充数据时,不适合次国家级或农场层面分析。。已知限制:该资源是说明方法和汇总结果的手册或报告,不包含原始微观数据;空间范围以澳大利亚单个点表示,时间覆盖截至 2013-14。。

机器学习与语料

图像 · 文本 · 多语

机器学习与语料免费访问

ImageNet 大规模图像库 ImageNet

全球计算机视觉研究的奠基性基准,逾千万张人工标注图像、两万余类目,自 2009 年起被学界与产业引为通用评测标尺。

机构斯坦福视觉实验室 + 普林斯顿
覆盖约 1420 万张 · 21841 类
子集ILSVRC-1K 约 120 万训练
时间2009 起
许可许可待核验
获取免费需注册
查看字段与详情

内容与字段

来自网络采集的自然图像、每图类别标签(对应 WordNet 同义词集 synset)、WordNet 名词层级关系,部分子集含目标定位边界框(bounding box)。按 WordNet 名词树组织,目标为每个 synset 约 1000 张图。

适用研究

图像分类、目标定位、迁移学习与模型评测基准。

版本ImageNet-21K / 里程碑子集 ILSVRC2012 · 格式图像(JPEG)+ 标注

2019 年起官网关闭 21K 全量下载、仅保留 ILSVRC 子集;仅限非商业学术研究;元数据 2026-06 核验。

自行获取的难点

模型在自有样本上跑得不错,换到公认标准基准上却名次成谜——缺的不是算力,是一把行业共同认账的尺子。基准取用与子集对齐交给我们。

机器学习与语料免费访问

OPUS 开放平行语料库 OPUS · Open Parallel Corpus

规模最大的开放多语平行语料集合,逾千种语言、上千组语言对,是机器翻译与多语 NLP 的基础库。

机构赫尔辛基大学 Helsinki-NLP
覆盖约 1005 语言 · 1214 语料
规模约 1029 亿句对
时间各子语料滚动更新
许可许可待核验
获取免费免注册
查看字段与详情

内容与字段

双语/多语逐句对齐文本(bitext):源语言句、目标语言句、语言对标识、子语料来源标识、句对齐信息(XCES stand-off);部分经处理含分词、词形还原与词性标注。

适用研究

机器翻译、跨语言模型与多语 NLP。

格式XML+对齐 / TMX / Moses 纯文本 · 工具OpusTools / API

许可依各子语料各异,使用前须逐子语料核对;元数据 2026-06 核验。

自行获取的难点

语料来源分散、版本与对齐口径各异、子语料格式与授权各不相同,逐一甄别整合往往耗时费力。我们已完成梳理与统一交付,按语言对即取即用。

机器学习与语料免费访问

Common Crawl 网页语料 Common Crawl

覆盖全球公开网页、按月持续更新的 PB 级标准化 Web 归档语料,是大模型预训练与大规模文本研究的基础语料源。

机构Common Crawl Foundation
覆盖全球公开网页(逾 3000 亿页)
时间2008 起,月度更新
规模单月约 21 亿页 / PB 级累计
许可许可待核验
获取免费免注册(AWS S3/HTTPS/HF)
查看字段与详情

内容与字段

格式含义
WARC原始 HTTP 请求/响应(含 HTML)
WAT提取的元数据(链接、标题等 JSON)
WET仅抽取的纯文本正文

另含 URL 索引(CDXJ/列式)、超链接图谱。主要字段:URL、抓取时间戳、HTTP 状态、MIME 类型、内容与纯文本。

适用研究

大规模语料研究、自然语言处理与大模型预训练。

版本CC-MAIN-2026-21 · 格式WARC/WAT/WET(gzip)+ 列式索引

网页内容版权归原站;用户需自行做合规清洗与过滤,遵守来源许可与中国法律法规;元数据 2026-06 核验。

自行获取的难点

自行从全网抓取、去重、对齐格式并维护跨月份版本口径,往往耗费大量算力与工程时间且难以复现。我们已梳理好格式、字段与索引脉络,直接取用可研究的语料。

机器学习与语料免费访问

OpenAlex 学术图谱 OpenAlex

完全开放的全球学术元数据库,收录数亿篇论文及其作者、机构、期刊、引用与主题关联,CC0 免费,是文献计量与科研知识图谱的开放替代。

机构OurResearch(非营利)
覆盖全球学术
时间跨历史至今
规模4 亿+ 学术作品
许可许可待核验
获取免费 · API/月度快照
查看字段与详情

内容与字段

作品 works、作者 authors、机构 institutions、来源 sources、出版商、资助方、主题 topics 及其引用与关联关系,含摘要倒排索引等。

适用研究

文献计量、科研评价、知识图谱、NLP 语料与科研趋势。

格式JSON-API / 月度快照(S3、Zenodo) · 限额API 免密钥(约 10 万次/日)

CC0 公共领域,可自由使用;以 OpenAlex 官方为准(2026-06 核验)。

自行获取的难点

全量快照体量大、实体关联与去重复杂;我们做子集抽取、实体消歧与建库。

机器学习与语料访问条件待核验

Common Voice 语料库 1 Common Voice Corpus 1

Mozilla Common Voice 多语言开源语音识别语料,包含多种语言的口语录音与文本对齐数据,是训练语音识别模型的刚需资源。

获取https://zenodo.org/records/12588635
许可许可待核验
时间2024-06-29
查看字段与详情

内容与字段

该数据集包含多种语言的口语录音及其对应的文本转录,用于训练语音识别系统。具体字段包括音频文件、文本标注等,但元数据未提供详细字段列表。

适用研究

适用于多语言语音识别、声学模型训练、语音文本对齐等研究。

元数据以来源页为准(2026-07 工厂起草 · 待人工核验)。

自行获取的难点

该数据集通过 Zenodo 分发,下载需注意文件格式与清洗成本,且版本更新频繁,需确认使用版本。

机器学习与语料免费访问

基于多模态大语言模型与知识库的乒乓球教练系统官方代码与数据集 Official Code and Dataset of Table Tennis Coaching System Based on a Multimodal Large Language Model with Knowledge Base

该数据集包含乒乓球教练系统的官方代码与数据集,基于多模态大语言模型与知识库构建,由Zenodo发布。

机构以官方为准
覆盖以官方为准
时间2024-11-04
规模1个文件
许可许可待核验
获取Zenodo
查看字段与详情

内容与字段

该数据集包含乒乓球教练系统的官方代码与数据集,具体字段与文件结构以官方发布为准。

适用研究

可用于多模态大语言模型在体育教练系统中的应用研究,以及知识库构建与评估相关研究。

本卡由来源页信息起草,机构/覆盖/时间/规模/字段与许可以官方为准(待人工核验)。

自行获取的难点

多模态体育教练系统的代码与数据获取渠道有限,该数据集提供了官方资源。

机器学习与语料免费访问

BIKED++:140万自行车图像与参数化CAD设计多模态数据集 BIKED++: A Multimodal Dataset of 1.4 Million Bicycle Image and Parametric CAD Designs

包含140万程序生成的自行车设计,以参数化JSON文件和栅格图像表示,用于训练参数与图像间的跨模态预测模型。

机构以官方为准
覆盖自行车设计
时间以官方为准
规模140万设计,4个文件
许可许可待核验
获取Harvard Dataverse
查看字段与详情

内容与字段

该数据集包含140万程序生成的自行车设计,每个设计以参数化JSON文件和栅格图像两种形式表示。数据集通过渲染引擎利用BikeCAD软件从参数化设计生成矢量图形。来源页未公开字段级说明。

适用研究

可用于训练参数表示与图像表示之间的跨模态预测模型,例如从参数表示估计CLIP嵌入,建立参数化自行车设计与文本或参考图像之间的相似性关系。

本卡由来源页信息起草,机构/覆盖/时间/规模/字段与许可以官方为准(待人工核验)。

自行获取的难点

缺乏大规模参数化设计与图像配对的多模态数据集,难以训练跨模态预测模型。

机器学习与语料免费访问

板材表面缺陷高质量数据集 Sheet_material_defect_dataset

临沂科技职业学院发布的板材缺陷AI检测数据集,涵盖283G高质量图像,包含10类典型缺陷,用于模型训练与验证。

机构临沂科技职业学院
覆盖板材表面缺陷
时间以官方为准
规模283G
许可许可待核验
获取ModelScope
查看字段与详情

内容与字段

该数据集包含283G高质量板材缺陷图像,涵盖划痕、凹坑、脏污异物等10类典型缺陷。数据包括采集图像、xml文件和txt文件,科学划分训练集与验证集。来源页未公开字段级说明。

适用研究

适用于板材表面缺陷检测、工业质检、计算机视觉分类与目标检测等研究。

本卡由来源页信息起草,机构/覆盖/时间/规模/字段与许可以官方为准(待人工核验)。

自行获取的难点

工业质检领域缺乏高质量、标注完善的板材缺陷数据集,该数据集提供283G图像和10类缺陷,可直接用于模型训练。

机器学习与语料免费访问

工业设备多源异构数据融合与健康诊断高质量数据集 High_Quality_Dataset_for_Multi_Source_Heterogeneous_Data_Fusion_and_Health_Diagnosis_of_Industrial_Equipment

浙江德塔森特构建的工业设备多源异构数据融合与健康诊断高质量数据集,总规模6.7TB,含837.40亿条结构化时序记录,覆盖17大类600台工业设备,1955种故障-设备-工况组合样本。

机构浙江德塔森特
覆盖17大类、600台工业设备,1955种故障-设备-工况组合样本
时间以官方为准
规模6.7TB,837.40亿条结构化时序记录
许可许可待核验
获取ModelScope平台
查看字段与详情

内容与字段

数据集由自有机房原生采集数据、合规整合IEEE开源工业数据集、标准化融合标注成品三层数据构成,涵盖时序、图像、音频、视频、工程特征多模态数据,统一梳理26类标准化工业故障模式,覆盖负载波动、高低温、间断启停等极端复杂工况。全流程搭建标准化数据治理体系,经降噪清洗、时序对齐、双人双标三级复核,数据完整性96.5%、标注准确率98.5%。来源页未公开字段级说明。

适用研究

适用于工业设备故障诊断、多源异构数据融合、健康管理、预测性维护等方向的研究与模型开发。

本卡由来源页信息起草,机构/覆盖/时间/规模/字段与许可以官方为准(待人工核验)。

自行获取的难点

工业故障样本稀缺、多模态数据难以融合、数据无合规确权等行业痛点。

机器学习与语料免费访问

LiBforSecUse 数据发布——商用18650电池寿命测试阻抗谱 LiBforSecUse Data Release - Impedance spectra of life cycle tests of commercial 18650 cells

该数据集由EMPIR项目LiBforSecUse发布,包含商用18650(石墨/NMC)电池寿命测试的阻抗谱和容量测量数据,可用于验证残容量估算模型。

机构EMPIR project LiBforSecUse
覆盖商用18650(石墨/NMC)电池
时间2022-03-22(更新日期)
规模2个文件
许可许可待核验
获取Zenodo
查看字段与详情

内容与字段

该数据集包含商用18650(石墨/NMC)电池在寿命测试过程中定期测量的阻抗谱和容量数据。数据以文件形式提供,并附带一个PDF文件提供更详细的数据说明。来源页未公开字段级说明。

适用研究

可用于验证基于阻抗的电池残容量估算模型,支持锂离子电池二次利用相关研究。

本卡由来源页信息起草,机构/覆盖/时间/规模/字段与许可以官方为准(待人工核验)。

自行获取的难点

电池阻抗谱数据通常分散且缺乏标准化,该数据集提供了系统化的寿命测试数据,便于模型验证。

机器学习与语料免费访问

全球人工智能指标数据库(GAID)2.0版 Global Artificial Intelligence Indicator Database (GAID), 1998–2025 (Version 2)

全球人工智能指标数据库(GAID)2.0版是一个纵向面板数据集,整合了来自Epoch AI、UNESCO等8个权威来源的AI指标,覆盖1998-2025年227个国家和地区,包含24,453个独特指标和259,546条观测记录。

机构Harvard Dataverse
覆盖227个国家和地区
时间1998–2025
规模259,546条观测记录,24,453个指标,9个文件
许可许可待核验
获取Harvard Dataverse
查看字段与详情

内容与字段

该数据集包含来自8个权威来源的AI指标,涵盖技术趋势、基础设施、人才、伦理治理、创新等主题。数据以长格式(Tidy Data)提供,包含以下字段:

  • Country——国家或地区名称
  • ISO3——ISO3 alpha-3国家代码
  • Year——年份
  • Indicator——指标名称
  • Value——指标数值
  • Source_File——来源文件
  • Source_Type——来源类型
  • Source_Year——来源年份

适用研究

适用于全球AI发展比较、AI政策分析、技术趋势预测、人才流动研究、AI伦理与治理评估等。

本卡由来源页信息起草,机构/覆盖/时间/规模/字段与许可以官方为准(待人工核验)。

自行获取的难点

获取整合多源、长期、全球范围的AI指标数据时,常面临数据分散、标准不一、清洗困难等问题。

机器学习与语料免费访问

人工智能信任度数据集 Trust in AI

由CSIRO提供的标注数据集,用于从科学文献中提取关于AI信任的新概念,包含人工标注和远程标注数据。

机构CSIRO
覆盖澳大利亚
时间2000-01-01起
规模以官方为准
许可许可待核验
获取CSIRO DAP
查看字段与详情

内容与字段

该数据集包含7个文件,分为人工标注和远程标注两部分。人工标注部分包含dev.json、test.json、train.json三个JSON文件;远程标注部分包含string_based_results.pickle和vector_based_results.pickle两个pickle文件;另有一个README.md和一个CSV文件Trust_in_AI_paperlist.csv。来源页未公开字段级说明。

适用研究

适用于自然语言处理、信任度分析、科学文献挖掘等领域的研究,特别是从学术文献中自动提取与AI信任相关的新概念。

本卡由来源页信息起草,机构/覆盖/时间/规模/字段与许可以官方为准(待人工核验)。

自行获取的难点

从科学文献中提取AI信任相关新概念时,缺乏标注数据,该数据集提供了人工和远程标注的基准。

机器学习与语料免费访问

农业维基推理问答数据集_110K Agricultrue_Wiki_QA_110K

由用户chal1ce在魔搭社区发布的农业领域维基百科推理问答数据集,包含约11万条问答对,基于QwQ-Plus和Qwen32B蒸馏生成。

机构chal1ce(个人发布者)
覆盖农业类别维基百科内容
时间以官方为准
规模约110,000条问答对
许可许可待核验
获取魔搭社区数据集页面
查看字段与详情

内容与字段

该数据集包含农业领域的维基百科问答对,问题由R1蒸馏的Qwen32B根据维基百科相关内容生成,答案由QwQ-Plus蒸馏得到。来源页未公开字段级说明。

适用研究

适用于农业领域的问答系统、推理模型训练与评估,以及知识蒸馏方法研究。

本卡由来源页信息起草,机构/覆盖/时间/规模/字段与许可以官方为准(待人工核验)。

自行获取的难点

农业领域问答数据稀缺,且需要高质量推理型问答对。

机器学习与语料免费访问

网易云音乐情感数据集(emo163) emo163

网易云音乐情感分类数据集,由Genius-Society发布,包含约395,000条音乐情感标签数据,每条数据由歌曲ID、歌单ID和情感标签组成。

机构Genius-Society
覆盖网易云音乐平台歌曲
时间以官方为准
规模约395,000条
许可许可待核验
获取ModelScope
查看字段与详情

内容与字段

该数据集包含约395,000条音乐情感标签数据,每条数据由三个主要列组成:歌曲ID、歌单ID和情感标签。歌曲ID唯一标识每首歌曲,歌单ID表示歌曲所属歌单,情感标签为每首歌曲赋予情感分类。

  • 歌曲ID——唯一标识每首歌曲
  • 歌单ID——表示歌曲所属歌单
  • 情感标签——歌曲的情感分类标签

适用研究

适用于构建情感分析模型、进行数据挖掘,以及深入理解音乐与情感之间的关联。

本卡由来源页信息起草,机构/覆盖/时间/规模/字段与许可以官方为准(待人工核验)。

自行获取的难点

获取大规模、带情感标签的音乐数据用于情感分析模型训练

机器学习与语料免费访问

音乐流派数据集 music_genre

音乐流派分类数据集,包含1700首音频(mp3格式,每段约270-300秒),分为17个流派,提供三层标签体系(2分类、9分类、16分类),适用于音乐流派识别研究。

机构ccmusic-database
覆盖17个音乐流派,包括古典(交响乐、歌剧、独奏、室内乐)和非古典(流行、舞曲/浩室、独立、灵魂/R&B、摇滚)
时间以官方为准
规模至少1700首音频,每段时长约270-300秒
许可许可待核验
获取ModelScope Datasets
查看字段与详情

内容与字段

原始数据集包含至少1700首不同流派音乐的音频(.mp3格式),每段音频时长约270~300秒。数据库共分为17个流派,每个流派对应一个标注文件,标注信息为流派分类标签。经处理后的数据集由将所有音频转成的频谱切片组成,分为3层标签:第一层为2分类(古典与非古典);第二层为9分类(Symphony, Opera, Solo, Chamber, Pop, Dance_and_house, Indie, Soul_or_r_and_b, Rock);第三层为16分类(具体类别未完全列出)。

  • 第一层标签——2分类:古典与非古典
  • 第二层标签——9分类:3_Symphony, 4_Opera, 5_Solo, 6_Chamber, 7_Pop, 8_Dance_and_house, 9_Indie, 10_Soul_or_r_and_b, 11_Rock
  • 第三层标签——16分类:3_Symphony, 4_Opera, 5_Solo, 6_Chamber, ...(其余未列出)

适用研究

适用于音乐流派分类、音频信号处理、机器学习分类模型训练等研究。

本卡由来源页信息起草,机构/覆盖/时间/规模/字段与许可以官方为准(待人工核验)。

自行获取的难点

音乐流派分类任务中,缺乏标注清晰、层次分明的公开数据集,本数据集提供三层标签体系,便于多粒度分类研究。

机器学习与语料免费访问

MUSDB18活跃音轨数据集(CS229项目) cs229-audio-ml-project/musdb18-processed

该数据集是MUSDB18的加工版本,仅包含各音轨(鼓、贝斯、人声、伴奏及混合)的活跃片段,用于斯坦福CS229课程的音乐源分离项目。

机构CS229 Audio ML Project Team
覆盖MUSDB18数据集的活跃音轨片段(鼓、贝斯、人声、伴奏、混合)
时间2025年
规模99134个文件,总大小15 GB
许可许可待核验
获取Hugging Face Datasets
查看字段与详情

内容与字段

数据集包含从MUSDB18中提取的活跃音轨片段,结构为 extracted_stems/ 目录,下分 train/ 和 test/ 子目录,每个子目录包含 drums、bass、vocals、accompaniment、mixture 五个子文件夹,以及 metadata/ 目录存放JSON元数据文件。音频格式为22.05 kHz采样率、单声道。使用Hugging Face datasets库加载时,每个样本包含以下字段:

  • audio——音频数组及采样率
  • stem_type——音轨类型(如drums、bass等)
  • track_name——音轨名称

适用研究

适用于音乐源分离、深度学习模型训练与评估,特别是针对活跃/非活跃音频段的分析。

本卡由来源页信息起草,机构/覆盖/时间/规模/字段与许可以官方为准(待人工核验)。

自行获取的难点

需要处理MUSDB18数据集但希望聚焦于活跃音频段以提升训练效率时,缺乏现成的活跃片段提取版本。

机器学习与语料免费访问

MUSDB18音乐分离语料库 MUSDB18 - a corpus for music separation

MUSDB18包含150首完整歌曲的立体声混音和原始音源,分为训练集(100首)和测试集(50首),用于音乐源分离算法的设计与评估。

机构Zafar Rafii, Antoine Liutkus, Fabian-Robert Stöter, Stylianos Ioannis Mimilakis, Rachel Bittner
覆盖不同风格的音乐歌曲
时间2017-12-17(更新日期)
规模150首歌曲,1个文件(.mp4格式)
许可许可待核验
获取Zenodo
查看字段与详情

内容与字段

数据集包含150首完整歌曲的立体声混音和原始音源,以Native Instruments stems格式(.mp4)编码,每个文件包含5个立体声流:混音、鼓、贝斯、其他伴奏、人声。所有信号为立体声,采样率44.1kHz,AAC编码@256kbps。训练集100首,测试集50首。

  • 0 - The mixture——混音信号
  • 1 - The drums——鼓信号
  • 2 - The bass——贝斯信号
  • 3 - The rest of the accompaniment——其他伴奏信号
  • 4 - The vocals——人声信号

适用研究

适用于音乐源分离算法的设计与评估,如卡拉OK应用、信号处理研究,以及作为SiSEC 2018专业制作音乐录音任务的官方数据集。

本卡由来源页信息起草,机构/覆盖/时间/规模/字段与许可以官方为准(待人工核验)。

自行获取的难点

音乐源分离研究常需高质量的多轨数据集,但获取标注完整、许可清晰的音乐源数据困难。

机器学习与语料访问条件待核验

20846组菜谱图文描述数据 20846_Groups_Image_Caption_Data_of_Cookbook

该数据集包含20,846组菜谱图文描述,每组菜谱含4-18张图片及对应中英文文本描述,覆盖中餐、西餐、韩餐、日料等菜系,由DatatangBeijing发布。

机构DatatangBeijing
覆盖中餐、西餐、韩餐、日料等菜系
时间以官方为准
规模20,846组菜谱,每组4-18张图片
许可许可待核验
获取ModelScope平台
查看字段与详情

内容与字段

该数据集包含20,846组菜谱,每组菜谱包含4-18张图片以及每张图片对应的文本描述。描述语言为中文和英文,中文描述不少于15个字,英文描述不少于30个单词。菜系涵盖中餐、西餐、韩餐、日料等。来源页未公开字段级说明。

适用研究

可用于食谱推荐、烹饪教育、多模态图文理解、图像描述生成等方向的研究。

本卡由来源页信息起草,机构/覆盖/时间/规模/字段与许可以官方为准(待人工核验)。

自行获取的难点

获取大规模、多菜系、中英文双语标注的菜谱图文数据用于多模态模型训练时,常面临数据分散、标注不统一的问题。

机器学习与语料访问条件待核验

2021年NIST说话人识别评测开发与测试集 2021 NIST Speaker Recognition Evaluation Development and Test Set

由LDC和NIST开发的2021年说话人识别评测开发与测试集,包含约447小时粤语、普通话和英语电话会话语音、视频音频及图像数据,附答案键、注册和试验文件。

机构Linguistic Data Consortium (LDC) and NIST (National Institute of Standards and Technology)
覆盖粤语、普通话和英语电话会话语音(CTS)、视频音频(AfV)及图像数据
时间2026年7月13日发布
规模约447小时音频/视频,2个ZIP文件各41.6 GB
许可许可待核验
获取UC Berkeley Library Dataverse(需请求访问)
查看字段与详情

内容与字段

该数据集包含开发与测试用的语音、音频和图像数据,以及答案键、注册和试验文件。数据来自LDC收集的WeCanTalk语料库,包含约355小时CTS音频(8kHz A-law sphere格式)、53小时AfV片段(16kHz FLAC压缩MS-WAV格式)、39小时视频片段(mp4格式)和202张自拍图像(JPG格式)。来源页未公开字段级说明。

适用研究

适用于文本无关的说话人识别技术研究、评测系统开发及性能基准测试。

本卡由来源页信息起草,机构/覆盖/时间/规模/字段与许可以官方为准(待人工核验)。

自行获取的难点

获取受限,需申请访问权限,且许可条款不明确。

机器学习与语料免费访问

ORIN歌词数据集:面向NLP的多语言尼日利亚歌曲歌词综合语料库 ORIN Lyrics Dataset: A Comprehensive Corpus of Multilingua Nigerian Song Lyrics for NLP

ORIN Lyrics数据集包含862条尼日利亚歌曲歌词,涵盖约鲁巴语、英语、尼日利亚皮钦语及多语言组合,附有艺术家、标题、专辑、年份、流派等元数据,专为自然语言处理研究设计。

机构Olabisi Onabanjo University
覆盖尼日利亚歌曲歌词,语言包括约鲁巴语、英语、尼日利亚皮钦语及多语言组合
时间2025年发布
规模862条记录
许可许可待核验
获取以官方为准
查看字段与详情

内容与字段

数据集以结构化Excel (.xlsx)文件提供,包含原始歌词文本、预处理文本、元数据、主题建模结果及能耗日志。字段如下:

  • S/N——记录标识符
  • Artist——表演者或乐队名称
  • Lyrics——歌词全文
  • Title——歌曲标题
  • Album——专辑名称(如有)
  • Year——发行年份
  • Genre——主要音乐流派分类
  • Subgenre——更详细的流派分类
  • Source——原始歌词来源URL
  • Time——歌曲时长(HH:MM:SS格式)
  • Region——来源地区/国家
  • Language——语言或多语言组合
  • Group——更广泛的音乐类别或分组

适用研究

适用于自然语言处理(NLP)、情感分析、音乐信息检索(MIR)、计算民族音乐学、文化AI应用,特别是低资源语言、文化文本挖掘和跨语言NLP任务。

本卡由来源页信息起草,机构/覆盖/时间/规模/字段与许可以官方为准(待人工核验)。

自行获取的难点

获取高质量、多语言、带丰富元数据的尼日利亚歌词数据用于NLP研究,尤其是低资源语言处理。

机器学习与语料免费访问

Suno AI音乐数据集(多流派精选) Kukedlc/suno-ai-music-dataset

由Kukito策划的多流派AI音乐数据集,使用Suno V5.5 (chirp-fenix)生成,覆盖100+子子流派,包含MP3音频、封面图、生成提示词及32列元数据。

机构Kukito
覆盖100+子子流派,涵盖电子、嘻哈、拉丁、爵士、世界、摇滚、氛围、流行、雷鬼、古典等
时间以官方为准
规模约200-300首曲目(持续增长),总文件大小4.02 GB,1714个文件
许可许可待核验
获取Hugging Face
查看字段与详情

内容与字段

数据集包含MP3音频文件、JPG封面图,以及一个主CSV文件(biblioteca_master.csv),包含32列元数据。所有元数据以Suno的UUID为键。字段包括:

  • id——Suno分配的UUID,主键
  • title——曲目标题
  • hoja_id_pipeline——内部流水线标识符
  • major_model_version——Suno模型系列(如v5.5)
  • model_name——具体模型变体(如chirp-fenix)
  • status——Suno处理状态
  • duration——曲目时长(秒)
  • is_instrumental——是否纯器乐
  • tags——生成时使用的自由标签
  • tax_radio_destino——目标电台/听众上下文标签
  • tax_suno_capability——Suno能力分类
  • prompt——生成时使用的精确文本提示

适用研究

该数据集适用于细粒度音频分类、文本到音乐条件实验、音乐推荐与相似性研究、音乐标注与自动DJ系统基准测试、AI音乐生成器能力与失败模式研究,以及衍生音乐生成模型的训练(需遵守许可条款)。

本卡由来源页信息起草,机构/覆盖/时间/规模/字段与许可以官方为准(待人工核验)。

自行获取的难点

获取高质量、多流派、带详细元数据的AI生成音乐数据集,用于音频分类或文本到音乐研究。

机器学习与语料免费访问

音乐元数据与歌词数据集 Music_Metadata_and_Lyrics_Dataset

由MarKos29在Kaggle原始数据集基础上,通过Wikidata爬取丰富艺术家信息构建的超过20万首歌曲的元数据与歌词数据集。

机构MarKos29
覆盖全球音乐作品
时间20世纪中期至今
规模以官方为准
许可许可待核验
获取Hugging Face
查看字段与详情

内容与字段

数据集包含超过20万首歌曲的元数据,每首歌曲记录包括歌曲标识、标题、艺术家、发行年份、专辑、流派、标签、音乐特征、播放量、时长、语言检测结果,以及从Wikidata获取的艺术家出生年份、出生国家、性别、是否乐队、获奖信息等。数据以CSV格式提供。

  • id——歌曲唯一标识符
  • title——歌曲标题
  • artist——艺术家或乐队名称
  • year——发行年份
  • album——歌曲所属专辑
  • genre_song——主要音乐流派
  • tag——关联标签或关键词
  • features——音乐或技术特征
  • views——播放或观看次数
  • duration_s——歌曲时长(秒)
  • language_cld3——CLD3自动检测语言
  • language_ft——FastText检测语言

适用研究

适用于音乐信息检索、音乐推荐系统、艺术家画像分析、歌词语言识别、音乐趋势分析等研究领域。

本卡由来源页信息起草,机构/覆盖/时间/规模/字段与许可以官方为准(待人工核验)。

自行获取的难点

获取大规模、结构化的音乐元数据并附带艺术家背景信息,但需注意非商用许可限制。

机器学习与语料免费访问

热门歌曲预测数据集(百万歌曲数据集与音频特征) Hit Song Prediction (Million Song Dataset and Audio Features)

基于百万歌曲数据集,提取低层和高层音频特征,用于热门歌曲预测研究,包含Billboard Hot 100匹配与非匹配数据。

机构以官方为准
覆盖西方商业音乐,1922年至2011年
时间1922年至2011年
规模4个文件;515,576首歌曲有发行年份信息
许可许可待核验
获取Zenodo
查看字段与详情

内容与字段

数据集包含音频特征文件和Billboard数据文件。音频特征文件为压缩包msd_audio_features.tar.gz,内含每首曲目的低层和高层特征JSON文件,按曲目标识符首字母分文件夹组织。Billboard数据文件夹包含两个CSV文件:msd_bb_matches.csv(Billboard Hot 100匹配曲目)和msd_bb_non_matches.csv(非匹配曲目,作为负样本)。

  • msd_bb_matches.csv——包含MSD ID、Echo Nest ID、艺术家名、曲目标题、发行年份、Billboard最高排名、在榜周数
  • msd_bb_non_matches.csv——包含MSD ID、Echo Nest ID、艺术家名、曲目标题、发行年份
  • 高/低层特征JSON——每首曲目两个JSON文件,分别存储Essentia提取的高层和低层音频特征

适用研究

适用于音乐信息检索、热门歌曲预测、音频特征分析、流行音乐趋势研究等。

本卡由来源页信息起草,机构/覆盖/时间/规模/字段与许可以官方为准(待人工核验)。

自行获取的难点

获取带标签的音频特征和Billboard匹配数据用于热门歌曲预测模型训练时,常需整合多源数据,本数据集提供现成特征和标签。

机器学习与语料免费访问

AgriShelf:面向智能农业食品零售应用的多类别双源图像数据集 AgriShelf: A Multi-Class, Bi-Source Image Dataset for Smart Agri-Food Retailing Applications

AgriShelf是一个包含16,592张农业食品零售图像的多类别数据集,由智能手机和Intel RealSense深度相机采集,用于智能零售应用中的计算机视觉任务。

机构Qatar University College of Engineering
覆盖农业食品零售图像,涵盖杂货店和超市环境中的常见类别
时间2025年4月24日发布
规模以官方为准
许可许可待核验
获取Mendeley Data
查看字段与详情

内容与字段

该数据集包含16,592张农业食品零售图像,分为未标注和标注两个子集。未标注子集适用于分类、目标检测和产品识别;标注子集包含2,416个样本,带有详细的质心标注,适用于货架可用性估计、计数或多任务学习。图像由iPhone 14 Plus(1080p,30fps,HDR)和Intel RealSense Depth Camera D435i采集,涵盖不同货架倾斜度、光照水平和角度。

  • 图像——农业食品零售场景的RGB图像
  • 质心标注——标注子集中每个目标物体的中心点坐标

适用研究

适用于智能零售中的自动库存监控、产品识别、货架可用性估计、目标检测和实时零售分析等计算机视觉任务。

本卡由来源页信息起草,机构/覆盖/时间/规模/字段与许可以官方为准(待人工核验)。

自行获取的难点

获取高质量、多来源、真实场景的零售图像数据集用于计算机视觉模型训练和评估。

机器学习与语料免费访问

齿轮箱齿损伤振动与噪声信号分析数据集 Vibrational and Noise Signal Analysis to Detect the Gear Teeth Damage in A Gear Box with Austempered Ductile Iron as Gear Material

该数据集包含齿轮箱振动、声音和阶次分析数据,用于检测奥贝球墨铸铁齿轮的齿损伤,由DAQ采集,涵盖不同转速下的健康与故障齿轮信号。

机构以官方为准
覆盖齿轮箱振动、声音和阶次信号
时间2020-08-28
规模1个文件
许可许可待核验
获取Zenodo
查看字段与详情

内容与字段

该数据集包含齿轮箱在健康与故障状态下的振动、声音和阶次分析数据,通过DAQ采集,涵盖不同转速(RPM)下的时域、FFT和1/3倍频程分析结果。来源页未公开字段级说明。

适用研究

可用于齿轮箱故障诊断、振动信号分析、声音信号处理、阶次跟踪分析以及机械状态监测研究。

本卡由来源页信息起草,机构/覆盖/时间/规模/字段与许可以官方为准(待人工核验)。

自行获取的难点

齿轮箱故障诊断数据常缺乏公开的振动与声音同步信号,该数据集提供了多模态信号,但字段说明不完整。

机器学习与语料访问条件待核验

基于多传感器平台的齿轮退化评估 Assessment of gear degradation with multi sensor platform

该数据集包含通过多传感器平台(表面形貌、视觉系统、油液质量、振动监测等)在FZG齿轮试验台上进行的200小时耐久性测试数据,用于监测齿轮点蚀退化过程。

机构以官方为准
覆盖齿轮点蚀退化监测数据
时间2023-10-26(更新日期)
规模1个文件
许可许可待核验
获取Zenodo
查看字段与详情

内容与字段

来源页未公开字段级说明。

适用研究

可用于齿轮退化监测、多传感器融合、预测性维护等领域的研究。

本卡由来源页信息起草,机构/覆盖/时间/规模/字段与许可以官方为准(待人工核验)。

自行获取的难点

齿轮退化监测数据通常难以获取,且多传感器同步数据稀缺。

机器学习与语料免费访问

轮胎缺陷数据集 Tyre defect data set

该数据集包含1905张轮胎X射线图像及对应的缺陷标注,由上海大学网络控制中心提供,用于轮胎缺陷检测研究。

机构Shanghai University Network Control Centre
覆盖轮胎X射线图像
时间以官方为准
规模1905张图像(1142训练、382验证、381测试),每张480x480像素,JPG格式
许可许可待核验
获取Zenodo
查看字段与详情

内容与字段

该数据集包含1905张轮胎X射线图像,分为训练集(1142张)、验证集(382张)和测试集(381张)。每张图像分辨率为480x480像素,存储为JPG格式。每张图像附带一个TXT格式的标注文件,记录缺陷位置和类型。

  • open——一种缺陷类型
  • cord_defects——一种缺陷类型
  • impurity——一种缺陷类型
  • belt_cuobian——一种缺陷类型

适用研究

该数据集适用于轮胎缺陷检测研究,特别是针对包含细长特征的缺陷。由于数据集特性,可能不适用于其他类型的图像检测任务。

本卡由来源页信息起草,机构/覆盖/时间/规模/字段与许可以官方为准(待人工核验)。

自行获取的难点

轮胎缺陷检测研究中,缺乏公开的带标注X射线图像数据集,尤其是针对细长缺陷的样本。

机器学习与语料免费访问

电子学习推荐系统数据集 E-learning Recommender System Dataset

Mandarine Academy Recommender System (MARS) Dataset,来自哈佛Dataverse,包含真实MOOC平台的法语和英语版本显式与隐式评分数据。

机构Harvard Dataverse
覆盖Mandarine Academy MOOC平台(法语和英语版本)
时间以官方为准
规模8个文件
许可许可待核验
获取哈佛Dataverse
查看字段与详情

内容与字段

数据集包含用户、项目、显式评分和隐式评分四个CSV文件,分别对应法语和英语版本。用户ID和项目ID在文件间一致。字段包括:

  • user_id——用户唯一标识
  • job——用户职业(如有)
  • item_id——项目唯一标识
  • language——项目语言(法语或英语)
  • name——项目名称
  • nb_views——项目浏览次数
  • description——项目描述
  • created_at——评分或项目创建时间
  • Difficulty——项目难度
  • Job——项目相关职业
  • Software——项目相关软件
  • Theme——项目主题
  • duration——项目时长
  • type——项目类型
  • watch_percentage——观看百分比(显式评分)
  • rating——显式评分值

适用研究

适用于教育领域的推荐系统研究,特别是基于显式和隐式反馈的算法评估,以及多语言环境下的推荐效果比较。

本卡由来源页信息起草,机构/覆盖/时间/规模/字段与许可以官方为准(待人工核验)。

自行获取的难点

教育推荐系统数据集稀缺,且常缺乏真实多语言环境下的显隐式反馈数据。

机器学习与语料免费访问

FETS数据集:基础模型实现可扩展且通用的能源时间序列预测 FETS Dataset: Foundation Models Enable Scalable and Generalizable Energy Time Series Forecasting

FETS数据集包含欧洲及国际能源领域的多变量时间序列,用于评估零样本和协变量感知预测,涵盖9个领域类别,数据以Apache Parquet格式存储。

机构Obermeier, M. et al.
覆盖欧洲及国际能源领域
时间以官方为准
规模1个文件
许可许可待核验
获取Zenodo
查看字段与详情

内容与字段

该数据集包含来自欧洲和国际能源领域的多变量时间序列,用于评估零样本和协变量感知预测。数据涵盖9个领域类别:平衡服务、可调度发电、不可调度发电、负荷、市场数据、电网数据、热数据、移动性/电动汽车充电、住宅负荷。所有时间序列以Apache Parquet格式存储;协变量文件(天气预报历史数据、NWP运行数据、ERA5再分析数据以及假日日历)包含在每个目标序列的子文件夹中。所有时间戳采用协调世界时(UTC)。文件结构为:DataClass/DatasetName-TargetName/data_file.parquet(目标时间序列),covariates/cov_file.parquet(天气、日历等),以及zenodo_dataset_overview.csv(机器可读索引)和zenodo_description.html(本文件)。注意:部分数据集因许可限制未包含在内,需从原始来源单独下载。

  • DataClass——数据类别,如Balancing Services、Dispatchable Generation等
  • DatasetName——数据集名称,如Balancing Data Germany
  • TargetName——目标变量名称,如Area Control Error (NRV Saldo)
  • data_file.parquet——目标时间序列文件
  • cov_file.parquet——协变量文件,包括天气、日历等
  • zenodo_dataset_overview.csv——机器可读的数据集索引
  • zenodo_description.html——数据集描述文件

适用研究

该数据集适用于能源时间序列预测研究,特别是零样本预测和协变量感知预测,可用于评估基础模型在能源领域的泛化能力。

本卡由来源页信息起草,机构/覆盖/时间/规模/字段与许可以官方为准(待人工核验)。

自行获取的难点

获取能源时间序列数据时,常面临数据分散、格式不统一、许可限制等问题,该数据集提供了结构化的多变量时间序列和协变量,便于评估基础模型的预测性能。

机器学习与语料免费访问

PubMed期刊推荐系统数据集 Pubmed Journal Recommendation System dataset

该数据集基于PubMed开放获取文章,包含标题、摘要、关键词和期刊信息,用于期刊推荐系统研究。

机构以官方为准
覆盖PubMed开放获取文章
时间2018-01-01至2022-12-13
规模262,870篇文章,469种期刊,5个文件
许可许可待核验
获取Zenodo
查看字段与详情

内容与字段

该数据集包含5个文件:data_pubmed_all(全部文章)、data_pubmed(过滤后文章)、data_pubmed_train、data_pubmed_val、data_pubmed_test(按期刊随机60/20/20划分)。每个文章记录包含以下字段:

  • pubmed_id——PubMed唯一标识符
  • title——文章标题
  • keywords——关键词
  • journal——期刊名称
  • abstract——摘要
  • conclusions——结论
  • methods——方法
  • results——结果
  • copyrights——版权信息
  • doi——数字对象标识符
  • publication_date——出版日期
  • authors——作者

适用研究

适用于期刊推荐系统、学术文献分类、文本挖掘等自然语言处理与信息检索研究。

本卡由来源页信息起草,机构/覆盖/时间/规模/字段与许可以官方为准(待人工核验)。

自行获取的难点

获取结构化的PubMed文章数据用于期刊推荐模型训练时,常需处理字段不全或划分不明确的问题。

机器学习与语料免费访问

城市声音事件分类数据集AOB Dataset-AOB: urban sounds events classification

Dataset-AOB是用于城市声音事件分类的音频数据集,包含10类声音事件,由Ospina在硕士论文中创建。

机构Beuth University of Applied Sciences, Berlin
覆盖城市声音事件
时间2020
规模6个文件,包含5049个音频样本(开发集4831,评估集218)
许可许可待核验
获取以官方为准
查看字段与详情

内容与字段

数据集包含10类城市声音事件:alarm-siren, children playing, dog bark, engine, footsteps, glass breaking, gun shot, metro train, rain, screams。音频格式为.wav,时长小于4秒,采样率22KHz-44KHz。开发集4831个样本,评估集218个样本。附带元数据文件(.csv)和每类声源分布图(.png)。

  • alarm-siren——警报/汽笛声
  • children playing——儿童玩耍声
  • dog bark——狗叫声
  • engine——引擎声
  • footsteps——脚步声
  • glass breaking——玻璃破碎声
  • gun shot——枪声
  • metro train——地铁列车声
  • rain——雨声
  • screams——尖叫声

适用研究

适用于城市声音事件分类、深度学习音频识别、环境声音分析等研究。

本卡由来源页信息起草,机构/覆盖/时间/规模/字段与许可以官方为准(待人工核验)。

自行获取的难点

获取城市声音事件分类音频数据时,常需寻找标注完整、类别均衡且许可明确的数据集。

机器学习与语料免费访问

加拿大长期室外无人机数据集 CLOUD: Canadian Longterm Outdoor Unmanned Aerial Vehicule Dataset (UAV)

由加拿大国防研究与发展中心与多伦多大学合作收集的无人机视觉惯性飞行数据集,包含加拿大三个地点超过30公里的飞行数据。

机构Defence Research and Development Canada (DRDC), University of Toronto Institute for Aerospace Studies (UTIAS)
覆盖加拿大三个地点:Suffield, Montreal, 多伦多大学航空航天研究所 (UTIAS)
时间以官方为准
规模超过30公里视觉惯性飞行数据
许可许可待核验
获取Open Canada 平台直接下载 CSV 文件
查看字段与详情

内容与字段

该数据集包含超过30公里的视觉惯性飞行数据,由DJI M600无人机搭载云台相机采集。每个地点包含Teach和Repeat两次飞行(反向)。数据包括Google Earth图像、人类可读文本文件以及一组Python工具。来源页未公开字段级说明。

适用研究

适用于无人机视觉定位研究,包括视角变化、光照变化和季节变化的鲁棒性,以及卫星图像无人机导航、基于经验的定位和同步定位与地图构建。

本卡由来源页信息起草,机构/覆盖/时间/规模/字段与许可以官方为准(待人工核验)。

自行获取的难点

无人机视觉定位研究常需多环境、多条件的长时室外数据,但公开数据集往往场景单一或规模有限。

机器学习与语料免费访问

ADASIND:用于自动驾驶的多样化广角鱼眼相机数据集 ADASIND: A Diverse Wide Angle Fisheye Camera Dataset for Autonomous Driving

ADASIND是一个包含10,000张RGB图像的鱼眼相机数据集,由印度Silchar国家技术研究所采集,聚焦于半城市无分隔道路的驾驶场景,提供2D边界框、运动目标检测、相机标定等标注。

机构National Institute of Technology Silchar
覆盖印度Silchar市半城市道路
时间2023-04-21(更新日期)
规模10,000张RGB图像,4个文件
许可许可待核验
获取Zenodo
查看字段与详情

内容与字段

数据集包含10,000张RGB图像及其对应的标注文件,分为以下文件夹:

  • RGB images——从30fps视频中每秒提取一帧得到的RGB图像,共10,000张,按顺序索引。
  • 2d box annotations——每个图像的.txt文件,包含对象标签、x-y坐标、宽度和高度。
  • Motion instance annotations——运动目标实例的像素级掩码,用于遮挡运动物体。
  • Calibration——单个JSON文件,包含相机内参和外参。
  • Ground Truth——位于Motion instance annotations子文件夹中,以图像形式提供正确标签。

适用研究

适用于自动驾驶场景下的鱼眼相机目标检测、运动目标分割、深度估计、3D重建等计算机视觉任务,尤其适合研究非均匀道路环境下的模型适应。

本卡由来源页信息起草,机构/覆盖/时间/规模/字段与许可以官方为准(待人工核验)。

自行获取的难点

鱼眼相机自动驾驶数据集稀缺,且现有数据集多来自发达国家规范道路,缺乏印度半城市无分隔道路场景的标注数据。

机器学习与语料免费访问

地质命名实体识别与实体关系抽取模型微调标注数据 Labelled data for fine tuning a geological Named Entity Recognition and Entity Relation Extraction model

该数据集包含从BGS回忆录、DECC/OGA陆上油气井报告和矿产勘查计划报告中提取的标注句子,用于训练地质领域的命名实体识别和关系抽取模型。

机构British Geological Survey (BGS)
覆盖英国地质领域(岩石地层、地质年代、岩石类型、物理性质、地点)
时间2024年发布
规模3个文件
许可许可待核验
获取GitHub (BritishGeologicalSurvey/princeton-nlp-relation-extraction)
查看字段与详情

内容与字段

该数据集以JSONL格式提供,包含从BGS回忆录、DECC/OGA陆上油气井报告和矿产勘查计划报告中提取的句子,并进行了实体和关系标注。实体包括岩石地层、地质年代、岩石类型、物理性质和地点,关系包括overlies、observedIn等。数据来自doccano标注工具导出格式。

  • rock formations——岩石地层实体
  • geological ages——地质年代实体
  • rock types——岩石类型实体
  • physical properties——物理性质实体
  • locations——地点实体
  • overlies——实体间关系:上覆
  • observedIn——实体间关系:观测于

适用研究

可用于微调预训练语言模型,实现从非结构化地质文本中自动提取结构化信息,支持地质建模和地下表征等研究。

本卡由来源页信息起草,机构/覆盖/时间/规模/字段与许可以官方为准(待人工核验)。

自行获取的难点

地质领域缺乏高质量标注数据用于NLP模型微调,该数据集提供了概念验证级别的标注样本。

机器学习与语料免费访问

DeepScenario:面向自动驾驶系统测试的开放驾驶场景数据集 DeepScenario: An Open Driving Scenario Dataset for Autonomous Driving System Testing

DeepScenario是一个面向自动驾驶系统测试的开放驾驶场景数据集,包含超过30,000个可执行驾驶场景,由三种场景生成策略通过2880次测试执行收集而来。

机构Simula Research Laboratory
覆盖驾驶场景,包括碰撞场景(与其他车辆、行人、静态障碍物)
时间以官方为准
规模超过30,000个可执行驾驶场景,1个文件
许可许可待核验
获取Zenodo
查看字段与详情

内容与字段

数据集包含两个主要部分:deepscenario-dataset(驾驶场景数据)和deepscenario-toolset(工具集)。每个场景标注有六个表征测试结果的属性。来源页未公开字段级说明。

适用研究

适用于自动驾驶系统测试、场景生成策略评估、碰撞场景分析等研究。

本卡由来源页信息起草,机构/覆盖/时间/规模/字段与许可以官方为准(待人工核验)。

自行获取的难点

自动驾驶系统测试需要大量多样化场景,但现有数据集规模小、场景单一,难以覆盖边缘情况。

机器学习与语料免费访问

NexusStreets:结合人类与自动驾驶行为的数据集 NexusStreets: a dataset combining human and autonomous driving behaviours

NexusStreets 包含人类与自动驾驶场景,通过监控目标车辆(自动驾驶或人类驾驶)收集,数据为 JPEG 图像序列和车辆状态信息。

机构以官方为准
覆盖CARLA 模拟器中的五个默认地图(Town01-Town05)
时间2023-02-27(更新日期)
规模520 个场景(260 对镜像场景),每个场景 60 秒,共 1 个文件
许可许可待核验
获取Zenodo
查看字段与详情

内容与字段

数据集包含 520 个场景(260 对镜像场景),每个场景 60 秒,记录 120 帧视频和对应 CSV 行。文件夹按驾驶模式(Baidu Apollo 或手动驾驶)、地图(Town01-Town05)、试验编号组织。每个试验包含:

  • video——JPEG 图像序列
  • state_features.csv——目标车辆每帧的状态信息
  • detection_features.csv——预训练 YOLOv7 检测器输出的 2D 边界框检测结果

适用研究

可用于自动驾驶行为分析、人机驾驶对比、场景理解、目标检测等研究。

本卡由来源页信息起草,机构/覆盖/时间/规模/字段与许可以官方为准(待人工核验)。

自行获取的难点

获取同时包含人类与自动驾驶行为的模拟驾驶场景数据,用于行为对比和模型训练。

机器学习与语料访问条件待核验

供应链图神经网络数据集 SCG Dataset from Graph Neural Networks in Supply Chain Analytics and Optimization: Concepts, Perspectives, Dataset and Benchmarks

该数据集来自孟加拉国一家领先快消品公司的供应链规划场景,用于图神经网络基准测试,涵盖六项供应链分析任务。

机构以官方为准
覆盖孟加拉国一家领先快消品公司的供应链规划
时间2024-09-03(更新日期)
规模1个文件
许可许可待核验
获取Zenodo
查看字段与详情

内容与字段

来源页未公开字段级说明。

适用研究

可用于供应链管理中的图神经网络方法研究,包括回归、分类、检测和异常检测等任务。

本卡由来源页信息起草,机构/覆盖/时间/规模/字段与许可以官方为准(待人工核验)。

自行获取的难点

供应链图数据稀缺,缺乏真实世界基准数据集用于GNN研究。

机器学习与语料免费访问

孟加拉语手写字符与单词识别数据集 Bangla Hand Written Character and Word Recognition Dataset

该数据集由达芙妮国际大学50名学生手写采集,包含85个类别的手写字符和单词,用于机器学习与计算机视觉研究。

机构Daffodil International University
覆盖孟加拉语手写字符和单词
时间以官方为准
规模1个文件
许可许可待核验
获取Zenodo
查看字段与详情

内容与字段

该数据集包含85个类别的手写字符和单词样本,由50名学生采集,涵盖多种书写风格。来源页未公开字段级说明。

适用研究

适用于手写文本识别、字符分类、模式识别等机器学习与计算机视觉研究。

本卡由来源页信息起草,机构/覆盖/时间/规模/字段与许可以官方为准(待人工核验)。

自行获取的难点

手写识别数据集常缺乏多样性,该数据集通过多学生采集增加了书写风格变化。

机器学习与语料访问条件待核验

大哈伊格弗拉斯自治水下航行器图像调查——原始图像(2012) Greater Haig Fras autonomous underwater vehicle image survey - raw images (2012)

2012年在凯尔特海大哈伊格弗拉斯海洋保护区使用AUV Autosub6000采集的海底原始图像,由英国国家海洋学中心等机构提供。

机构National Oceanography Centre (NOC)
覆盖Greater Haig Fras Marine Conservation Zone (MCZ), central Celtic Sea
时间2012
规模1个文件(数据集)
许可许可待核验
获取通过BODC请求获取(DOI: 10.5285/090239b1-b7dd-1030-e063-6c86abc0e183)
查看字段与详情

内容与字段

该数据集包含2012年在凯尔特海大哈伊格弗拉斯海洋保护区使用AUV Autosub6000搭载的Grasshopper 2相机系统采集的海底原始图像。图像来自四条4.7公里长的测线,格式为Grasshopper 2相机系统特有的原始格式。来源页未公开字段级说明。

适用研究

可用于海底栖息地测绘、海洋保护区监测、AUV技术评估及底栖生物群落研究。

本卡由来源页信息起草,机构/覆盖/时间/规模/字段与许可以官方为准(待人工核验)。

自行获取的难点

获取原始海底图像数据时,常因格式特殊且需申请而难以直接使用。

机器学习与语料访问条件待核验

随机神经网络架构描述及高频精度与损失数据(图像数据集训练) Architecture Descriptions and High Frequency Accuracy and Loss Data of Random Neural Networks Trained on Image Datasets

该数据集提供随机生成的神经网络在图像数据集上训练40个epoch的高频精度与损失数据,支持神经架构搜索的早期预测方法研究。

机构以官方为准
覆盖随机神经网络在图像数据集上的训练
时间2021-12-08更新
规模4个文件
许可许可待核验
获取Harvard Dataverse
查看字段与详情

内容与字段

该数据集包含随机神经网络的架构描述以及训练过程中的高频精度和损失数据。每个网络训练40个epoch,每半个epoch记录一次训练损失、验证损失和验证精度,同时记录所有生成的参数值以便重建网络。数据以表格形式存储,每个网络对应一行记录。来源页未公开字段级说明。

适用研究

可用于神经架构搜索(NAS)的早期预测方法研究,分析损失和精度曲线,比较不同网络参数对性能的影响。

本卡由来源页信息起草,机构/覆盖/时间/规模/字段与许可以官方为准(待人工核验)。

自行获取的难点

神经架构搜索中早期预测方法缺乏高频训练数据支持

机器学习与语料免费访问

A4NN工作流在蛋白质衍射数据上的架构描述、模型检查点与训练历史 Architecture Descriptions, Model Checkpoints, and Training Histories for A4NN Workflow on Protein Diffraction Data

该数据集包含ICPP 2023论文中A4NN工作流在蛋白质衍射数据上的脚本、输入与输出数据,包括模拟的XFEL衍射图像及神经网络模型。

机构Harvard Dataverse
覆盖模拟蛋白质衍射图像(低、中、高束强度)及神经网络模型
时间以官方为准
规模44个文件;约72,900个模型相关文件
许可许可待核验
获取Harvard Dataverse
查看字段与详情

内容与字段

该数据集包含脚本、输入和输出数据,用于复现ICPP 2023论文中的结果。输入数据为模拟的X射线自由电子激光(XFEL)蛋白质衍射图像,分为低、中、高三种束强度,每种强度包含63,508张训练图像和15,876张测试图像(80/20分割)。输出数据包含使用A4NN工作流在不同GPU分布上生成的神经网络模型和元数据,每个实验包含100个NN模型,每个模型最多训练25个epoch,总计约72,900个模型相关文件。

  • README.txt——说明文件,包含数据集使用说明
  • 训练图像——模拟XFEL衍射图像,用于训练神经网络
  • 测试图像——模拟XFEL衍射图像,用于测试神经网络
  • NN模型——神经网络模型文件,每个实验100个
  • 元数据——训练历史等元数据文件

适用研究

该数据集适用于蛋白质分类、神经网络架构搜索、可重复计算工作流等方向的研究。

本卡由来源页信息起草,机构/覆盖/时间/规模/字段与许可以官方为准(待人工核验)。

自行获取的难点

获取蛋白质衍射数据及对应神经网络模型时,常面临数据格式不统一、模型文件数量庞大、元数据缺失等问题。

机器学习与语料免费访问

混合胫骨数据集 Hybrid Tibialis Dataset

由Dr Robin Rohlen和Dimitrios Halatsis为MUniverse Benchmark策划的混合胫骨数据集,包含5个文件,采用CC BY 4.0许可。

机构Dr Robin Rohlen and Dimitrios Halatsis
覆盖以官方为准
时间2025-05-15更新
规模5个文件
许可许可待核验
获取Harvard Dataverse
查看字段与详情

内容与字段

来源页未公开字段级说明。

适用研究

可用于机器学习基准测试,特别是与胫骨相关的混合数据研究。

本卡由来源页信息起草,机构/覆盖/时间/规模/字段与许可以官方为准(待人工核验)。

自行获取的难点

获取胫骨相关混合数据集用于基准测试时,常缺乏结构化元数据。

机器学习与语料免费访问

FCG-MFD:用于恶意软件家族检测的基准函数调用图数据集 FCG-MFD: Benchmark function call graph-based dataset for malware family detection

FCG-MFD 是一个包含函数调用图(FCG)和元数据的基准数据集,用于恶意软件家族检测,包含 100,000 个样本,来自多个恶意软件来源。

机构以官方为准
覆盖恶意软件家族检测
时间2025-04-02(更新日期)
规模100,000 个样本,1 个文件
许可许可待核验
获取Zenodo
查看字段与详情

内容与字段

该数据集包含两个子数据集:FCG(函数调用图)和元数据,共 100,000 个样本。来源页未公开字段级说明。

适用研究

适用于基于机器学习的恶意软件家族检测、函数调用图分析、图嵌入网络研究等。

本卡由来源页信息起草,机构/覆盖/时间/规模/字段与许可以官方为准(待人工核验)。

自行获取的难点

获取大规模、带标注的恶意软件函数调用图数据集困难,且现有数据集更新不及时。

机器学习与语料免费访问

StreamSpot数据集 StreamSpot Dataset

StreamSpot数据集由Emaad Manzoor等人创建,包含7个文件,用于流式异构图中的异常检测研究,许可为CC0 1.0。

机构Emaad Manzoor, Sadegh M. Milajerdi and Leman Akoglu
覆盖以官方为准
时间2018-10-02(更新日期)
规模7个文件
许可许可待核验
获取Harvard Dataverse
查看字段与详情

内容与字段

该数据集包含7个文件,为边列表(edge-list)数据,用于流式异构图中的异常检测。来源页未公开字段级说明。

适用研究

适用于图异常检测、流式图分析、异构图挖掘等机器学习研究。

本卡由来源页信息起草,机构/覆盖/时间/规模/字段与许可以官方为准(待人工核验)。

自行获取的难点

获取流式异构图异常检测的边列表数据时,常需明确字段含义和许可条件。

机器学习与语料免费访问

点云路缘检测数据集 Point Cloud Curb Detection Dataset

该数据集包含由车载移动激光扫描仪捕获的标注点云数据,用于大规模点云路缘检测基准测试,源自KITTI360数据集。

机构Jan-Christoph Schmitz, Adrian Bauer, Anton Kummert
覆盖以官方为准
时间2021
规模9个文件
许可许可待核验
获取Zenodo
查看字段与详情

内容与字段

该数据集包含标注的点云数据,由车载移动激光扫描仪捕获,用于路缘检测。数据集源自KITTI360数据集,包含9个文件。来源页未公开字段级说明。

适用研究

适用于自动驾驶中的路缘检测、3D点云语义分割、大规模点云处理等研究方向。

本卡由来源页信息起草,机构/覆盖/时间/规模/字段与许可以官方为准(待人工核验)。

自行获取的难点

获取大规模标注点云路缘数据用于训练和评估3D深度学习模型时,常面临数据标注成本高、公开基准稀缺的问题。

机器学习与语料免费访问

BenchTemp:评估时序图神经网络的通用基准数据集 Datasets for Paper "BenchTemp: A General Benchmark for Evaluating Temporal Graph Neural Networks"

BenchTemp 包含19个时序图数据集,用于评估时序图神经网络,每个数据集包含时序图CSV、边特征和节点特征文件。

机构Qiang Huang
覆盖19个时序图数据集,涵盖社交网络、电商、交通等
时间以官方为准
规模17个文件
许可许可待核验
获取Zenodo
查看字段与详情

内容与字段

每个数据集包含三个文件:ml_{data_name}.csv(时序图CSV文件)、ml_{data_name}.npy(边特征)、ml_{data_name}_node.npy(节点特征)。CSV文件包含5列:

  • u——用户ID
  • i——物品ID
  • ts——交互时间戳
  • label——交互标签
  • idx——交互索引

适用研究

适用于时序图神经网络(Temporal Graph Neural Networks)的基准测试和性能评估,可支持动态图表示学习、时序链路预测等研究方向。

本卡由来源页信息起草,机构/覆盖/时间/规模/字段与许可以官方为准(待人工核验)。

自行获取的难点

评估时序图神经网络时缺乏统一基准数据集,BenchTemp 提供了19个标准化数据集便于公平比较。

机器学习与语料免费访问

海因里希·冯·克莱斯特散文文本语料库分析(LancsBox X) Heinrich von Kleist's prose texts corpus analysis using LancsBox X

该语料库包含海因里希·冯·克莱斯特的八部中短篇小说、两篇散文及政治写作等散文作品,文本源自Project Gutenberg,使用LancsBox X进行词频和聚类分析。

机构Harvard Dataverse
覆盖海因里希·冯·克莱斯特的散文作品(中短篇小说、散文、政治写作等)
时间以官方为准
规模2个文件
许可许可待核验
获取Harvard Dataverse
查看字段与详情

内容与字段

该语料库包含克莱斯特散文作品的词频和聚类数据,涵盖单词到十词单元(最小频率为2),以及相对频率、平均降低频率、出现范围、范围百分比、变异系数、Juilland's D值和比例偏差。另有一个文件记录了“Recht”一词的所有派生词及其在聚类中的出现次数。来源页未公开完整的字段级说明。

适用研究

适用于克莱斯特写作风格的语言学分析、文学研究以及哲学与政治思想关联的探索。

本卡由来源页信息起草,机构/覆盖/时间/规模/字段与许可以官方为准(待人工核验)。

自行获取的难点

获取克莱斯特散文语料库的详细词频和聚类数据,但字段级说明缺失。

经济与社会科学免费访问

2020年公共服务员工调查 2020 Public Service Employee Survey

2020年公共服务员工调查由加拿大财政委员会秘书处(Treasury Board of Canada Secretariat)发布或维护。本说明从原发布方材料中确认其覆盖范围为覆盖 87 个联邦政府部门和机构的员工。,当前共有 25 项事实通过逐字引用核验;来源未说明的内容保持为空,不由模型推断。

机构加拿大财政委员会秘书处(Treasury Board of Canada Secretariat)
覆盖覆盖 87 个联邦政府部门和机构的员工。
时间调查期为 2020-11-30 至 2021-01-29;对重复问题同时包含 2019 年和 2018 年结果。
规模188786
许可Open Government Licence - Canada
获取可通过开放政府门户直接下载,无需注册。
查看字段与详情

数据内容与结构

  • 覆盖对象或范围:覆盖 87 个联邦政府部门和机构的员工。
  • 数据规模:188786
  • 时间覆盖:调查期为 2020-11-30 至 2021-01-29;对重复问题同时包含 2019 年和 2018 年结果。
  • 观测粒度:原始观测对象为受访员工个人,但公开数据按人口特征和组织单位汇总。
  • 变量或列定义:变量包括敬业度、领导力、劳动力、工作场所、工作场所福祉、薪酬、多样性、包容性、COVID-19 影响、人口特征(年龄、性别)和组织单位。
  • 文本语言:英语和法语(双语)
  • 文本单位和结构:调查回答按人口特征和组织单位汇总,不是个体层面的文本记录。
  • 字段、变量或文件结构:包含多个 CSV 子集(Subset 1-7)、一个合并 CSV、一个 XLS 多样性表、一个 XLS 就业公平衍生变量数据集,以及 DOCX/XLSX 格式的配套文档。

适用范围与限制

  • 适用与不适用场景:适合分析联邦雇员敬业度、领导力、劳动力、工作场所福祉、多样性、包容性以及 COVID-19 影响;数据按人口特征和组织单位汇总,不适合识别个人。
  • 已知限制或未实测边界:2019 年和 2018 年的结果仅覆盖 2020 年调查中重复设置的问题;数据为汇总结果,不提供个体层面答卷。

来源与核验边界

仍未闭合的事项:

  • 文本标签、实体或关系定义:来源尚未形成可确认事实
  • 文本训练、验证和测试划分:来源尚未形成可确认事实

本卡只呈现能够回到原发布方材料的事实;公开可访问、开放许可、免费获取、商用和再分发分别判断。

适用范围与使用边界

适用方向:适合分析联邦雇员敬业度、领导力、劳动力、工作场所福祉、多样性、包容性以及 COVID-19 影响;数据按人口特征和组织单位汇总,不适合识别个人。。已知限制:2019 年和 2018 年的结果仅覆盖 2020 年调查中重复设置的问题;数据为汇总结果,不提供个体层面答卷。。

要找的数据,库里没有?

把研究需要的数据与必须满足的条件告诉我们,先做可得性评估,再真实检索与整理;确实找不到会直接告诉你,不绕弯子。

找数据