数据集是专为配送时间预测与回归建模而合成的50000条食品配送订单数据集,核心价值在于利用餐厅、骑手、顾客、交通、天气、路距及备餐时间等23个输入特征与真实逻辑关系生成目标变量,有效解决配送预测领域缺乏高质量结构化数据的问题。适用于数据科学从业者与机器学习开发者进行回归建模与特征工程实践。
消费
表格
数据集是专为全球科技人才市场与薪资分析而构建的大规模结构化招聘数据集,核心价值在于整合北美、欧洲、亚太及远程岗位的科技职位、薪资范围与技术栈要求,经NLP与LLM技术从HackerNews、USAJOBS等公开来源提取结构化信息,有效解决全球科技劳动力数据分散且缺乏标准化的问题。适用于数据科学家与HR分析师进行薪资预测与技能需求趋势研究。
人力资源
表格
数据集是专为体育分析与历史研究而构建的1930–2026年英联邦运动会奖牌得主综合数据集,核心价值在于提供涵盖夏季与冬季(仅1958/1962/1966/1970)全部届次的运动员/队伍奖牌记录,含年份、项目、国家、运动员、奖牌等14个字段,有效解决体育历史数据分散且缺乏标准化整合的问题。适用于体育分析师与数据科学从业者进行奖牌趋势分析与预测建模。
其他
表格
数据集是专为学业成功预测与学习分析而构建的25万条学生记录合成数据集,核心价值在于提供涵盖人口统计、学科成绩、出勤率、学习习惯、在线参与度、家庭背景及行为特征等45个多维指标,全面刻画影响学生学业发展的关键因素,有效解决教育数据分析中缺乏大规模结构化样本的问题。适用于教育研究者与数据科学从业者进行学业风险识别与个性化教育干预分析。
教育
表格
数据集是专为学生就业力与职业成功预测而合成的50000条学生记录数据集,核心价值在于提供涵盖学业表现、技术技能、实习经历、证书、项目、沟通能力及面试表现等29个特征的完整画像,支持从分类到回归的多任务建模需求,有效解决教育领域缺乏高质量合成数据进行职业预测研究的问题。适用于数据科学从业者与教育研究者进行就业预测与职业推荐系统开发。
教育
表格
数据集是专为美国航空市场分析与交通预测而构建的1990–2026年航空交通汇总数据集,核心价值在于提供国家、机场、航空公司三个层级的旅客量、航班数、座位数及载客率等关键指标,支持从宏观市场趋势到微观主体表现的完整分析,有效解决原始BTS T-100细粒度数据量过大且难以直接分析的问题。适用于交通分析师与数据科学从业者进行市场趋势研究与预测建模。
交通
表格
数据集是专为肺癌风险因素分析与预测建模而构建的89万份匿名化患者健康记录数据集,核心价值在于提供跨越10年(2014年6月至2024年5月)的17项临床与人口统计特征,涵盖人口统计、临床病史、生活方式与生物标志物等多维度信息,有效解决癌症研究领域缺乏大规模结构化患者数据的问题。适用于医疗研究者与数据科学从业者进行风险因素分析与预后建模。
医疗
表格
数据集是专为电影推荐系统与影视趋势分析而构建的3万余部高分电影元数据集,核心价值在于提供影片ID、标题、概述、流派、评分、投票数、人气值及海报路径等15个字段,支持从内容过滤到NLP分析的多种数据科学实践,有效解决电影推荐教学缺乏大规模标准化数据集的问题。适用于数据科学学习者与推荐系统开发者进行算法练习与趋势探索。
其他
表格
数据集是专为建筑电力负荷估算与变压器选型而合成的6000条工程计算记录,依据IS 732等标准的需求系数逻辑模拟从建筑面积到变压器容量的完整计算流程,有效解决电气工程数据因保密性难以获取的问题。适用于电气工程师与数据科学从业者进行负荷预测建模与AI辅助设计工具原型开发。
建筑
表格
数据集是专为中药毒性预测与毒理学研究而构建的中药毒性标注数据集,核心价值在于通过领域专家手工检索古代医典、本草专著、药典及现代毒理学文献,为原始数据库中缺乏标准化毒性注释的中药材补充三级毒性标签,有效解决中药毒性数据缺失严重且常规填充方法不适用的问题。适用于中药研究者与计算毒理学从业者进行毒性预测建模与毒性机制分析。
医疗
表格
数据集是专为气候变化分析与预测建模而构建的覆盖30个国家35年月度气候与能源指标数据集,核心价值在于整合NOAA、全球碳计划、ERA5等国际权威来源的温度异常、CO₂浓度、温室气体排放、海冰范围及可再生能源等54个特征,并内置气候风险评分与变暖类别等机器学习就绪目标变量,有效解决气候数据分散且缺乏标准化整合的问题。适用于气候研究者与数据科学家进行趋势分析、预测建模及可视化研究。
能源
时序
表格
数据集是专为心血管疾病风险预测与医疗分析而合成的20000条患者记录数据集,核心价值在于提供包含人口统计、生活方式、临床测量及实验室生物标志物等38个特征的完整健康画像,配合二分类目标变量,帮助练习从数据预处理到模型评估的完整预测流程,有效解决医疗预测教学中缺乏高质量结构化数据的问题。适用于机器学习学习者与医疗分析从业者进行预测建模与特征工程实践。
医疗
表格
数据集是专为金融欺诈检测与风险分析而合成的综合银行与数字支付交易数据集,核心价值在于整合客户档案、商户信息、支付详情、卡片记录及设备信息等多表关联数据,提供含欺诈标签的真实模拟交易模式,帮助构建从数据整合到模型部署的完整分析流程,有效解决真实金融数据隐私受限且缺乏系统化结构的问题。适用于数据科学学习者与金融分析从业者进行欺诈检测、客户分群及风险建模实践。
金融
表格
数据集为24种关键矿产×35个国家×2015至2026年的年度供应面板数据,涵盖产量、储量、精炼集中度、价格、出口管制及供应风险指数等字段,可支撑资源地缘政治分析与供应中断预测建模,适用于关键矿产供应链风险评估、资源安全预警建模及地缘政治经济分析等场景。
其他
时序
表格
数据集为GitHub公开仓库的结构化快照,涵盖历史最高星标项目与新近快速增长的热门仓库,包含星标数、复刻数、编程语言、主题标签及许可证等字段,可支撑开源生态趋势分析与开发者工具研究,适用于开源项目流行度分析、编程语言趋势研究及技术生态可视化等场景。
其他
时序
表格
数据集是专为AI模型对比、成本效益分析与趋势研究而构建的大规模结构化LLM元数据集,核心价值在于持续每日更新收集GPT-4o、Claude 3.5 Sonnet、Llama 3.1等数百个前沿模型的架构、基准评分、API定价、推理性能及开源许可等130+维度的丰富元数据,有效解决AI模型信息分散且更新滞后的问题。适用于AI研究者与开发者进行模型选型与性能趋势分析。
其他
表格
数据集是专为AI生成文本检测而合成的10200条模拟学术提交记录数据集,核心价值在于结合语言结构指标与行为遥测数据,模拟类别不平衡、缺失值、异常值与系统重复等真实数据缺陷,有效解决传统抄袭检测与现代AI文本检测之间的技术断层问题。适用于数据科学从业者与NLP研究者进行二分类模型开发与稳健性测试。
教育
表格
数据集是专为AI工程生态分析与开源软件研究而构建的30198个AI工程GitHub仓库结构化数据集,核心价值在于提供仓库身份、参与度、生命周期、维护状态、架构分类及框架栈等37列丰富元数据,特别包含4,000个深度富化仓库的治理健康度与依赖共现信息,有效解决AI工程工具生态分散且缺乏系统化分类的问题。适用于开发者与研究者进行工具筛选与生态趋势分析。
其他
表格
数据集是专为体育分析与世界杯历史研究而构建的1930–2026年全部世界杯赛事记录数据集,核心价值在于提供包括参赛队伍、比分、阶段、场地及冠军等详尽的23个字段的标准化赛事信息,有效解决了世界杯历史数据分散且格式不一的问题。适用于体育分析师与数据科学爱好者进行赛事趋势预测与历史表现分析。
文旅
表格
数据集是专为印度劳动力市场分析与就业能力建模而合成的12000份职业档案数据集,核心价值在于依据印度技能报告2026、NASSCOM等公开劳动市场统计校准分布与相关性,提供职位、技能、薪资、就业能力等26个字段的结构化画像,有效解决真实个人职业数据无法通过公开API获取且受平台条款限制的问题。适用于数据科学从业者与研究者进行薪资预测与技能缺口分析。
人力资源
表格
数据集是专为国家信息标准化查询与地理分析而构建的全球国家元数据数据集,核心价值在于提供包含ISO 3166-1双字母/三字母代码、国际电话区号、首都、官方货币代码及地理区域/次区域等12个标准化字段的国家信息参考,有效解决了多源国家数据格式不一致与编码映射困难的问题。适用于开发者与数据分析师进行地理编码、API集成与数据预处理。
其他
表格
数据集是专为配送时间预测与回归建模而合成的50000条食品配送订单数据集,核心价值在于利用餐厅、骑手、顾客、交通、天气、路距及备餐时间等23个输入特征与真实逻辑关系生成目标变量,有效解决配送预测领域缺乏高质量结构化数据的问题。适用于数据科学从业者与机器学习开发者进行回归建模与特征工程实践。
消费
表格
数据集是专为全球科技人才市场与薪资分析而构建的大规模结构化招聘数据集,核心价值在于整合北美、欧洲、亚太及远程岗位的科技职位、薪资范围与技术栈要求,经NLP与LLM技术从HackerNews、USAJOBS等公开来源提取结构化信息,有效解决全球科技劳动力数据分散且缺乏标准化的问题。适用于数据科学家与HR分析师进行薪资预测与技能需求趋势研究。
人力资源
表格
数据集是专为体育分析与历史研究而构建的1930–2026年英联邦运动会奖牌得主综合数据集,核心价值在于提供涵盖夏季与冬季(仅1958/1962/1966/1970)全部届次的运动员/队伍奖牌记录,含年份、项目、国家、运动员、奖牌等14个字段,有效解决体育历史数据分散且缺乏标准化整合的问题。适用于体育分析师与数据科学从业者进行奖牌趋势分析与预测建模。
其他
表格
数据集是专为学业成功预测与学习分析而构建的25万条学生记录合成数据集,核心价值在于提供涵盖人口统计、学科成绩、出勤率、学习习惯、在线参与度、家庭背景及行为特征等45个多维指标,全面刻画影响学生学业发展的关键因素,有效解决教育数据分析中缺乏大规模结构化样本的问题。适用于教育研究者与数据科学从业者进行学业风险识别与个性化教育干预分析。
教育
表格
数据集是专为学生就业力与职业成功预测而合成的50000条学生记录数据集,核心价值在于提供涵盖学业表现、技术技能、实习经历、证书、项目、沟通能力及面试表现等29个特征的完整画像,支持从分类到回归的多任务建模需求,有效解决教育领域缺乏高质量合成数据进行职业预测研究的问题。适用于数据科学从业者与教育研究者进行就业预测与职业推荐系统开发。
教育
表格
数据集是专为美国航空市场分析与交通预测而构建的1990–2026年航空交通汇总数据集,核心价值在于提供国家、机场、航空公司三个层级的旅客量、航班数、座位数及载客率等关键指标,支持从宏观市场趋势到微观主体表现的完整分析,有效解决原始BTS T-100细粒度数据量过大且难以直接分析的问题。适用于交通分析师与数据科学从业者进行市场趋势研究与预测建模。
交通
表格
数据集是专为肺癌风险因素分析与预测建模而构建的89万份匿名化患者健康记录数据集,核心价值在于提供跨越10年(2014年6月至2024年5月)的17项临床与人口统计特征,涵盖人口统计、临床病史、生活方式与生物标志物等多维度信息,有效解决癌症研究领域缺乏大规模结构化患者数据的问题。适用于医疗研究者与数据科学从业者进行风险因素分析与预后建模。
医疗
表格
数据集是专为电影推荐系统与影视趋势分析而构建的3万余部高分电影元数据集,核心价值在于提供影片ID、标题、概述、流派、评分、投票数、人气值及海报路径等15个字段,支持从内容过滤到NLP分析的多种数据科学实践,有效解决电影推荐教学缺乏大规模标准化数据集的问题。适用于数据科学学习者与推荐系统开发者进行算法练习与趋势探索。
其他
表格
数据集是专为建筑电力负荷估算与变压器选型而合成的6000条工程计算记录,依据IS 732等标准的需求系数逻辑模拟从建筑面积到变压器容量的完整计算流程,有效解决电气工程数据因保密性难以获取的问题。适用于电气工程师与数据科学从业者进行负荷预测建模与AI辅助设计工具原型开发。
建筑
表格
数据集是专为中药毒性预测与毒理学研究而构建的中药毒性标注数据集,核心价值在于通过领域专家手工检索古代医典、本草专著、药典及现代毒理学文献,为原始数据库中缺乏标准化毒性注释的中药材补充三级毒性标签,有效解决中药毒性数据缺失严重且常规填充方法不适用的问题。适用于中药研究者与计算毒理学从业者进行毒性预测建模与毒性机制分析。
医疗
表格
数据集是专为气候变化分析与预测建模而构建的覆盖30个国家35年月度气候与能源指标数据集,核心价值在于整合NOAA、全球碳计划、ERA5等国际权威来源的温度异常、CO₂浓度、温室气体排放、海冰范围及可再生能源等54个特征,并内置气候风险评分与变暖类别等机器学习就绪目标变量,有效解决气候数据分散且缺乏标准化整合的问题。适用于气候研究者与数据科学家进行趋势分析、预测建模及可视化研究。
能源
时序
表格
数据集是专为心血管疾病风险预测与医疗分析而合成的20000条患者记录数据集,核心价值在于提供包含人口统计、生活方式、临床测量及实验室生物标志物等38个特征的完整健康画像,配合二分类目标变量,帮助练习从数据预处理到模型评估的完整预测流程,有效解决医疗预测教学中缺乏高质量结构化数据的问题。适用于机器学习学习者与医疗分析从业者进行预测建模与特征工程实践。
医疗
表格
数据集是专为金融欺诈检测与风险分析而合成的综合银行与数字支付交易数据集,核心价值在于整合客户档案、商户信息、支付详情、卡片记录及设备信息等多表关联数据,提供含欺诈标签的真实模拟交易模式,帮助构建从数据整合到模型部署的完整分析流程,有效解决真实金融数据隐私受限且缺乏系统化结构的问题。适用于数据科学学习者与金融分析从业者进行欺诈检测、客户分群及风险建模实践。
金融
表格
数据集为24种关键矿产×35个国家×2015至2026年的年度供应面板数据,涵盖产量、储量、精炼集中度、价格、出口管制及供应风险指数等字段,可支撑资源地缘政治分析与供应中断预测建模,适用于关键矿产供应链风险评估、资源安全预警建模及地缘政治经济分析等场景。
其他
时序
表格
数据集为GitHub公开仓库的结构化快照,涵盖历史最高星标项目与新近快速增长的热门仓库,包含星标数、复刻数、编程语言、主题标签及许可证等字段,可支撑开源生态趋势分析与开发者工具研究,适用于开源项目流行度分析、编程语言趋势研究及技术生态可视化等场景。
其他
时序
表格
数据集是专为AI模型对比、成本效益分析与趋势研究而构建的大规模结构化LLM元数据集,核心价值在于持续每日更新收集GPT-4o、Claude 3.5 Sonnet、Llama 3.1等数百个前沿模型的架构、基准评分、API定价、推理性能及开源许可等130+维度的丰富元数据,有效解决AI模型信息分散且更新滞后的问题。适用于AI研究者与开发者进行模型选型与性能趋势分析。
其他
表格
数据集是专为AI生成文本检测而合成的10200条模拟学术提交记录数据集,核心价值在于结合语言结构指标与行为遥测数据,模拟类别不平衡、缺失值、异常值与系统重复等真实数据缺陷,有效解决传统抄袭检测与现代AI文本检测之间的技术断层问题。适用于数据科学从业者与NLP研究者进行二分类模型开发与稳健性测试。
教育
表格
数据集是专为AI工程生态分析与开源软件研究而构建的30198个AI工程GitHub仓库结构化数据集,核心价值在于提供仓库身份、参与度、生命周期、维护状态、架构分类及框架栈等37列丰富元数据,特别包含4,000个深度富化仓库的治理健康度与依赖共现信息,有效解决AI工程工具生态分散且缺乏系统化分类的问题。适用于开发者与研究者进行工具筛选与生态趋势分析。
其他
表格
数据集是专为体育分析与世界杯历史研究而构建的1930–2026年全部世界杯赛事记录数据集,核心价值在于提供包括参赛队伍、比分、阶段、场地及冠军等详尽的23个字段的标准化赛事信息,有效解决了世界杯历史数据分散且格式不一的问题。适用于体育分析师与数据科学爱好者进行赛事趋势预测与历史表现分析。
文旅
表格
数据集是专为印度劳动力市场分析与就业能力建模而合成的12000份职业档案数据集,核心价值在于依据印度技能报告2026、NASSCOM等公开劳动市场统计校准分布与相关性,提供职位、技能、薪资、就业能力等26个字段的结构化画像,有效解决真实个人职业数据无法通过公开API获取且受平台条款限制的问题。适用于数据科学从业者与研究者进行薪资预测与技能缺口分析。
人力资源
表格
数据集是专为国家信息标准化查询与地理分析而构建的全球国家元数据数据集,核心价值在于提供包含ISO 3166-1双字母/三字母代码、国际电话区号、首都、官方货币代码及地理区域/次区域等12个标准化字段的国家信息参考,有效解决了多源国家数据格式不一致与编码映射困难的问题。适用于开发者与数据分析师进行地理编码、API集成与数据预处理。
其他
表格