数据集是专为企业级数据分析与AI应用练习而生成的规则驱动合成公司数据,核心价值在于通过单一种子生成11种业务模态、16张关联关系表的完整企业数字孪生,并提供员工流失、客户流失、采购/财务异常、SLA违约、项目超支等真实标签及6项基准任务,有效解决真实企业数据因隐私限制和复杂关联而不适合算法开发与验证的问题。适用于构建预测、异常检测、图学习及RAG等企业AI应用的数据从业者与研究人员。
其他
文本
表格
数据集是专为学习描述性统计和EDA而合成的员工数据,核心价值在于提供无缺失、无噪声的纯净练习数据,帮助初学者聚焦统计概念本质与规范分析流程,有效解决入门阶段缺乏标准化练习数据的问题,典型应用涵盖均值方差计算、分布观察、异常值检测及多变量关系探索等教学任务。适用于正在学习Pandas、NumPy、Matplotlib、Seaborn及统计基础的数据分析初学者和教育场景。
人力资源
表格
数据集是专为数据分析与机器学习练习而合成的1000部迪士尼宇宙电影数据,核心价值在于通过内置一致性规则模拟真实票房与评分逻辑,帮助学习者掌握EDA、回归与分类建模技术,有效解决娱乐领域数据杂乱不适合教学的问题。适用于学习Pandas、Scikit-learn及可视化的数据分析练习者与教学演示场景。
其他
表格
数据集是医疗临床多特征结构化表格数据集,单CSV文件,包含60000条仿真患者记录,131项临床特征与1个六分类目标标签。覆盖人口信息、生活习惯、病史、症状、检验、影像、肿瘤标志物、基因指标,目标标签为健康/高风险/胰腺癌I-IV期。适用于胰腺癌多分类预测、疾病风险分层、医疗AI、可解释机器学习教学实训。
医疗
表格
数据集为地震灾害时序地理空间表格数据集,单CSV文件,21个特征字段,11808条5.0级以上经核实全球地震记录。数据源自USGS官方公开地震目录,包含时间、经纬度、震级、震源深度、台网质量指标,衍生出震级分类区间字段,部分监测指标保留原始空值。适用于地震时空探索分析、震级分类、地震风险统计、地理空间数据分析教学实训。
其他
表格
数据集为合成工科学生就业调研多文件表格数据集,包含15000条学生记录,主csv共25个特征字段,附带5份说明文档。包含学业、技能、实习、项目经历,具备就业签约分类结果、薪资连续数值两套预测目标。适用于就业签约二分类预测、薪资回归预测、学生分群、教育数据分析教学实训。
教育
表格
数据集为二手车市场结构化表格数据集,单份CSV文件,共18个特征字段。数据集涵盖多品牌二手车的厂商、车型、出厂年份、动力规格、行驶里程、车况、售价等信息,目标为车辆销售价格连续数值。适用于二手车价格回归预测、汽车市场EDA分析、特征工程与数据可视化教学实训。
消费
表格
数据集为仿真问卷表格数据集,共1000条合成调研记录,30个特征字段。模拟人群夜间设备使用、消极刷信息流、睡眠状态、心理情绪指标;内置二分类、三分类两套均衡完整标签,部分字段仿真问卷缺失值。适用于睡眠行为预测、心理行为相关性分析、缺失值填充、聚类分析与数据科学教学实训。
其他
表格
数据集是仿真银行信贷审批表格数据集,单份 CSV 文件,包含20000条贷款申请记录、39个特征字段。数据为业务逻辑合成,带有贷款审批结果二元标签,覆盖申请人画像、就业收入、信贷、抵押物、贷款申请信息。适用于信贷风险二分类建模、风控分析、特征工程、金融数据教学实训。
金融
表格
数据集是仿真金融客户行为表格数据集,包含1份CSV文件,30个特征字段。数据集采用业务规则合成,保留金融变量间逻辑关联,模拟客户画像、消费刷卡、还款、权益参与、信用相关行为。适用于客户分群聚类、用户画像分析、消费行为挖掘、金融数据分析教学实训。
金融
表格
数据集是多语言舆情时序数据集,时间覆盖2026‑04‑22至2026‑07‑21,共6960条记录。该数据集聚合维基百科、GDELT新闻、RSS资讯、谷歌趋势公开数据,包含热点文本、地域时间、热度指标,自带10类话题、三分类情感自动标注。适用于主题建模、情感分析、热点时序预测、跨地域舆情对比,服务舆情挖掘、NLP科研与教学实训。
其他
文本
时序
表格
数据集为1200条合成笔记本电脑电池记录,模拟电池随使用模式、充电周期、工作负载及热条件变化的健康退化规律,包含电池特征、硬件负载、充放电行为与温度环境等字段,可支撑回归建模与预测性维护研究,适用于电池健康预测、回归建模及特征工程实践等场景。
其他
表格
数据集为沙特阿拉伯多城市零售门店食用油产品的合成销售数据,涵盖产品类别、包装规格、价格区间及销售金额与销量等字段,可支撑数据预处理练习与销售预测建模,适用于销售预测、数据清洗实践及业务决策分析等场景。
消费
时序
表格
数据集为2026年福布斯全球2000强企业榜单,基于销售额、利润、资产和市值四项指标对全球最大上市公司进行排名,涵盖各行业头部企业,可支撑企业财务分析与全球商业格局研究,适用于企业财务绩效分析、行业分布研究及数据可视化实践等场景。
金融
表格
数据集为2014至2026年世界杯球员个人表现统计数据,按届分文件存储,包含球员基本信息、出场时间、进攻输出及每90分钟效率指标等字段,可支撑球员表现分析与足球数据研究,适用于球员效率评估、球队阵容分析及体育数据可视化等场景。
其他
表格
本数据集是一个合成生成的城市交通仿真数据集,旨在模拟印度德里市的行程时间。数据基于25个真实德里地标区域构建,整合了出发时间、天气、道路类型及交通密度等多维特征,模拟了行程距离、速度与时间之间的现实关系,目标变量为行程时间(分钟)。通过嵌入高峰拥堵等强相关性,本数据集为构建高精度预测模型、分析交通关键因素及智慧城市模拟提供了结构化的仿真环境,是机器学习回归与交通工程研究的理想实践资源。
交通
图像
表格
本数据集是一个结构化表格数据集,旨在量化分析个人晨间习惯与日间工作效率之间的关联。数据记录了晨间起床时间、是否运动、是否冥想、早餐习惯及工作前屏幕使用时间等行为指标,并以标准化的生产力综合评分作为核心产出。通过整合生理、心理与数字化行为等多维度变量,本数据集为探索影响日间精力与专注度的关键因素提供了实证基础,适合用于执行回归建模预测生产力、进行特征重要性分析以及可视化生活习惯与工作效率的相关性。
其他
图像
表格
本数据集记录了健身房会员的每日出勤情况与详细的锻炼活动日志。每条记录对应单次到店访问,字段包括会员标识、访问日期、完成的锻炼类型以及单次锻炼的持续时间。数据以个体会员为追踪单位,覆盖了一段时间内的连续观测,从而能有效捕捉每位会员的健身频率、习惯偏好与行为变化。该数据集结构清晰、主题聚焦,为深入分析会员参与度、识别主流健身趋势、优化课程与设备配置,以及开展个性化的健康行为研究提供了坚实的数据基础。
其他
图像
表格
本数据集整合了全球食肉植物的物种分布记录与高分辨率的环境变量数据,为物种分布模型与生态位分析提供了完备的基础。数据核心包含了物种信息与地理坐标和对应的19个标准生物气候变量与海拔数据。这些变量全面概括了温度与降水的年平均趋势、季节变化及极端事件。数据集已完成关键的空间关联,使用者可直接聚焦于探索性分析、生态位建模与机器学习预测,是研究食肉植物环境适应性与地理分布驱动机制的理想资源。
其他
图像
表格
本数据集包含10000条合成生成的招聘信息,旨在反映就业市场现状及技能需求趋势的关系。数据聚焦于人工智能、区块链、绿色科技与量子计算四大前沿领域,记录了包括职位名称、行业类别、工作地点、模拟年薪、必备技能等多维度信息。该数据集专为教育、探索性数据分析及机器学习实践而设计,通过模拟现实行业模式,为用户提供一个安全、规范的沙箱环境,可用于研究薪资分布、技能图谱、远程工作趋势以及不同规模企业的招聘偏好。
人力资源
图像
表格
本数据集系统记录了2020/21至2024/25连续五个赛季欧洲足球“五大联赛”(英超、西甲、德甲、意甲、法甲)的球员伤病情况,共包含15,603条具体伤病记录与11个相关特征。它完整涵盖了从新冠疫情时期到当前高强度、密集赛程下的过渡阶段,为深入研究精英运动员的伤病类型、发生规律、恢复周期及其对球队表现的影响提供了独特且全面的实证数据基础,是体育科学和俱乐部管理领域的重要分析资源。
其他
图像
表格
数据集是专为企业级数据分析与AI应用练习而生成的规则驱动合成公司数据,核心价值在于通过单一种子生成11种业务模态、16张关联关系表的完整企业数字孪生,并提供员工流失、客户流失、采购/财务异常、SLA违约、项目超支等真实标签及6项基准任务,有效解决真实企业数据因隐私限制和复杂关联而不适合算法开发与验证的问题。适用于构建预测、异常检测、图学习及RAG等企业AI应用的数据从业者与研究人员。
其他
文本
表格
数据集是专为学习描述性统计和EDA而合成的员工数据,核心价值在于提供无缺失、无噪声的纯净练习数据,帮助初学者聚焦统计概念本质与规范分析流程,有效解决入门阶段缺乏标准化练习数据的问题,典型应用涵盖均值方差计算、分布观察、异常值检测及多变量关系探索等教学任务。适用于正在学习Pandas、NumPy、Matplotlib、Seaborn及统计基础的数据分析初学者和教育场景。
人力资源
表格
数据集是专为数据分析与机器学习练习而合成的1000部迪士尼宇宙电影数据,核心价值在于通过内置一致性规则模拟真实票房与评分逻辑,帮助学习者掌握EDA、回归与分类建模技术,有效解决娱乐领域数据杂乱不适合教学的问题。适用于学习Pandas、Scikit-learn及可视化的数据分析练习者与教学演示场景。
其他
表格
数据集是医疗临床多特征结构化表格数据集,单CSV文件,包含60000条仿真患者记录,131项临床特征与1个六分类目标标签。覆盖人口信息、生活习惯、病史、症状、检验、影像、肿瘤标志物、基因指标,目标标签为健康/高风险/胰腺癌I-IV期。适用于胰腺癌多分类预测、疾病风险分层、医疗AI、可解释机器学习教学实训。
医疗
表格
数据集为地震灾害时序地理空间表格数据集,单CSV文件,21个特征字段,11808条5.0级以上经核实全球地震记录。数据源自USGS官方公开地震目录,包含时间、经纬度、震级、震源深度、台网质量指标,衍生出震级分类区间字段,部分监测指标保留原始空值。适用于地震时空探索分析、震级分类、地震风险统计、地理空间数据分析教学实训。
其他
表格
数据集为合成工科学生就业调研多文件表格数据集,包含15000条学生记录,主csv共25个特征字段,附带5份说明文档。包含学业、技能、实习、项目经历,具备就业签约分类结果、薪资连续数值两套预测目标。适用于就业签约二分类预测、薪资回归预测、学生分群、教育数据分析教学实训。
教育
表格
数据集为二手车市场结构化表格数据集,单份CSV文件,共18个特征字段。数据集涵盖多品牌二手车的厂商、车型、出厂年份、动力规格、行驶里程、车况、售价等信息,目标为车辆销售价格连续数值。适用于二手车价格回归预测、汽车市场EDA分析、特征工程与数据可视化教学实训。
消费
表格
数据集为仿真问卷表格数据集,共1000条合成调研记录,30个特征字段。模拟人群夜间设备使用、消极刷信息流、睡眠状态、心理情绪指标;内置二分类、三分类两套均衡完整标签,部分字段仿真问卷缺失值。适用于睡眠行为预测、心理行为相关性分析、缺失值填充、聚类分析与数据科学教学实训。
其他
表格
数据集是仿真银行信贷审批表格数据集,单份 CSV 文件,包含20000条贷款申请记录、39个特征字段。数据为业务逻辑合成,带有贷款审批结果二元标签,覆盖申请人画像、就业收入、信贷、抵押物、贷款申请信息。适用于信贷风险二分类建模、风控分析、特征工程、金融数据教学实训。
金融
表格
数据集是仿真金融客户行为表格数据集,包含1份CSV文件,30个特征字段。数据集采用业务规则合成,保留金融变量间逻辑关联,模拟客户画像、消费刷卡、还款、权益参与、信用相关行为。适用于客户分群聚类、用户画像分析、消费行为挖掘、金融数据分析教学实训。
金融
表格
数据集是多语言舆情时序数据集,时间覆盖2026‑04‑22至2026‑07‑21,共6960条记录。该数据集聚合维基百科、GDELT新闻、RSS资讯、谷歌趋势公开数据,包含热点文本、地域时间、热度指标,自带10类话题、三分类情感自动标注。适用于主题建模、情感分析、热点时序预测、跨地域舆情对比,服务舆情挖掘、NLP科研与教学实训。
其他
文本
时序
表格
数据集为1200条合成笔记本电脑电池记录,模拟电池随使用模式、充电周期、工作负载及热条件变化的健康退化规律,包含电池特征、硬件负载、充放电行为与温度环境等字段,可支撑回归建模与预测性维护研究,适用于电池健康预测、回归建模及特征工程实践等场景。
其他
表格
数据集为沙特阿拉伯多城市零售门店食用油产品的合成销售数据,涵盖产品类别、包装规格、价格区间及销售金额与销量等字段,可支撑数据预处理练习与销售预测建模,适用于销售预测、数据清洗实践及业务决策分析等场景。
消费
时序
表格
数据集为2026年福布斯全球2000强企业榜单,基于销售额、利润、资产和市值四项指标对全球最大上市公司进行排名,涵盖各行业头部企业,可支撑企业财务分析与全球商业格局研究,适用于企业财务绩效分析、行业分布研究及数据可视化实践等场景。
金融
表格
数据集为2014至2026年世界杯球员个人表现统计数据,按届分文件存储,包含球员基本信息、出场时间、进攻输出及每90分钟效率指标等字段,可支撑球员表现分析与足球数据研究,适用于球员效率评估、球队阵容分析及体育数据可视化等场景。
其他
表格
本数据集是一个合成生成的城市交通仿真数据集,旨在模拟印度德里市的行程时间。数据基于25个真实德里地标区域构建,整合了出发时间、天气、道路类型及交通密度等多维特征,模拟了行程距离、速度与时间之间的现实关系,目标变量为行程时间(分钟)。通过嵌入高峰拥堵等强相关性,本数据集为构建高精度预测模型、分析交通关键因素及智慧城市模拟提供了结构化的仿真环境,是机器学习回归与交通工程研究的理想实践资源。
交通
图像
表格
本数据集是一个结构化表格数据集,旨在量化分析个人晨间习惯与日间工作效率之间的关联。数据记录了晨间起床时间、是否运动、是否冥想、早餐习惯及工作前屏幕使用时间等行为指标,并以标准化的生产力综合评分作为核心产出。通过整合生理、心理与数字化行为等多维度变量,本数据集为探索影响日间精力与专注度的关键因素提供了实证基础,适合用于执行回归建模预测生产力、进行特征重要性分析以及可视化生活习惯与工作效率的相关性。
其他
图像
表格
本数据集记录了健身房会员的每日出勤情况与详细的锻炼活动日志。每条记录对应单次到店访问,字段包括会员标识、访问日期、完成的锻炼类型以及单次锻炼的持续时间。数据以个体会员为追踪单位,覆盖了一段时间内的连续观测,从而能有效捕捉每位会员的健身频率、习惯偏好与行为变化。该数据集结构清晰、主题聚焦,为深入分析会员参与度、识别主流健身趋势、优化课程与设备配置,以及开展个性化的健康行为研究提供了坚实的数据基础。
其他
图像
表格
本数据集整合了全球食肉植物的物种分布记录与高分辨率的环境变量数据,为物种分布模型与生态位分析提供了完备的基础。数据核心包含了物种信息与地理坐标和对应的19个标准生物气候变量与海拔数据。这些变量全面概括了温度与降水的年平均趋势、季节变化及极端事件。数据集已完成关键的空间关联,使用者可直接聚焦于探索性分析、生态位建模与机器学习预测,是研究食肉植物环境适应性与地理分布驱动机制的理想资源。
其他
图像
表格
本数据集包含10000条合成生成的招聘信息,旨在反映就业市场现状及技能需求趋势的关系。数据聚焦于人工智能、区块链、绿色科技与量子计算四大前沿领域,记录了包括职位名称、行业类别、工作地点、模拟年薪、必备技能等多维度信息。该数据集专为教育、探索性数据分析及机器学习实践而设计,通过模拟现实行业模式,为用户提供一个安全、规范的沙箱环境,可用于研究薪资分布、技能图谱、远程工作趋势以及不同规模企业的招聘偏好。
人力资源
图像
表格
本数据集系统记录了2020/21至2024/25连续五个赛季欧洲足球“五大联赛”(英超、西甲、德甲、意甲、法甲)的球员伤病情况,共包含15,603条具体伤病记录与11个相关特征。它完整涵盖了从新冠疫情时期到当前高强度、密集赛程下的过渡阶段,为深入研究精英运动员的伤病类型、发生规律、恢复周期及其对球队表现的影响提供了独特且全面的实证数据基础,是体育科学和俱乐部管理领域的重要分析资源。
其他
图像
表格