该数据集系统覆盖现代物理理论的四大核心支柱(量子力学、电动力学、热力学统计物理、分析力学),是物理学中抽象程度最高、推理链条最长、数学结构最复杂的一类问题集合。其核心价值在于为 AI 提供科研级理论物理推理样本,解决模型在变分原理、算符形式主义、统计系综、电磁场理论等方面的能力缺失。典型应用于科研型 AI、理论物理辅助系统以及高端 AI for Science 模型的能力上限探索。
教育
文本
本数据集涵盖Cu-Ni-Co-Si、Cu-Fe-P、Cu-Cr-Zr等多个合金体系数据,按照成分配比、生产工艺、材料性能、微观结构的全链路关联主线,结构化收录了化学成分、工艺参数、显微组织特征及力学与物理性能等关键维度,有效解决了该领域实验数据分散、整合成本高的痛点,可为机器学习与材料计算提供高质量、即用型的数据集,直接支撑合金设计、性能预测与工艺优化等AI研发场景。
制造
文本
本数据集精选大学阶段普通物理经典习题,系统覆盖力学、热学、电磁学、振动与波、光学等内容,是高中物理向理论物理与工程物理过渡的关键桥梁。其核心价值在于提供“物理建模 → 数学表达 → 定量求解 → 物理意义解释”的完整推理样本,弥补模型在高于中学、低于专业理论物理层级的物理理解断层。典型应用于 AI 物理解题、科学推理模型训练、AI for Science 基础能力构建以及物理教育智能系统。
教育
文本
本数据集系统覆盖高中物理的力学、电磁学、热学与光学等核心模块,其题目设计强调物理建模、定量计算与物理意义分析。核心价值在于为AI提供大量从实际情境抽象为数学模型,再经数学推导求解的完整样本,专门针对模型在理解物理概念本质、判断公式适用条件及执行严谨多步计算等方面的短板进行训练。该数据集适用于开发专用物理解题模型、构建智能AI物理教辅系统,以及对通用大模型进行物理世界建模与科学推理能力的专项增强。
教育
文本
这不仅仅是一个数据集;它是一个鲜活的、不断发展的项目,在健康、营养和可持续发展领域有着切实的应用。无论您对营养、供应链还是食品对环境的影响感兴趣,您都有能力做出改变。
消费
文本
本数据集系统收录高中阶段数学核心题型,覆盖函数、数列、立体几何、解析几何、概率统计等高频与难点内容,完整体现高中数学的知识结构与解题逻辑。其核心价值在于为大模型提供结构化、层次清晰的基础数学推理样本,解决模型在基础数学理解、符号运算、逻辑推导与规范解题表达方面能力不足的问题。典型应用场景包括智能题库生成、AI 数学辅导、教育大模型预训练与对齐,以及通用推理模型的基础数学能力增强。
教育
文本
数据集为2026-2027赛季欧洲五大联赛(英超、西甲、德甲、意甲、法甲)的球员统计数据,涵盖球员基本信息、出场时间、进攻、射门、防守及门将表现等100余个字段,可用于球员对比、球探分析与赛季趋势研究,适用于足球数据分析、球员表现评估及体育数据可视化等场景。
其他
表格
数据集为2026年7月21日至8月18日美国12个ZIP市场DDR5内存、内置机械硬盘与NVMe固态硬盘的140637条价格观测记录,涵盖产品标题、容量、标价及容量标准化价格,可支撑PC升级预算与组件价格对比分析,适用于组件价格趋势分析、区域价格差异研究及容量性价比评估等场景。
消费
时序
表格
数据集为2026年8月通过TMDB API采集的988部热门、高分及趋势影视作品,涵盖电影与电视剧两种类型,包含类型、评分、流行度、上映日期及剧情概述等14个字段,可支撑影视趋势分析与内容推荐研究,适用于影视类型偏好分析、评分对比研究及文本挖掘实践等场景。
文旅
文本
表格
数据集为PRISM基准评估结果,涵盖4个小型语言模型在2个科学问答数据集(ARC-Challenge和SciQ)上、400个问题与5种提示条件下的表现,包含准确性、指令遵循、一致性及提示敏感性等评估指标,可支撑小语言模型可靠性与提示敏感性研究,适用于小型语言模型鲁棒性评估、提示工程研究及模型对比基准测试等场景。
其他
文本
表格
数据集为5000名Netflix用户的订阅行为与流失记录,涵盖订阅类型、观看时长、登录活跃度、设备偏好、支付方式及人口统计等14个特征,可支撑客户流失预测与留存策略研究,适用于客户流失分类预测、用户行为分群及留存策略分析等场景。
文旅
表格
数据集为2006至2025年南极洲五个代表性地点(南极点、麦克默多站、南极半岛、西南极洲、东南极洲)的每日气候与天气数据,涵盖温度、降水、风速、日照等17个字段,可支撑气候趋势分析与极端天气研究,适用于气候变化趋势分析、极地极端天气识别及时间序列预测建模等场景。
其他
时序
表格
数据集为200,000条合成交通与应急响应记录,涵盖时间动态、环境物理、基础设施与交通流、驾驶员特征及应急调度操作等29个工程化变量,可支撑事故风险预测与响应时间建模研究,适用于交通风险预测、应急响应时间回归及事故严重程度分类等场景。
交通
时序
表格
数据集为2023至2025年印度国内航班运行记录,涵盖主要航空公司、起降机场、航班时刻及星期等特征,已结构化预处理为机器学习输入格式,可支撑航班延误预测与航空绩效分析研究,适用于航班延误分类预测、航空公司准点率对比分析及机场拥堵模式研究等场景。
交通
时序
表格
数据集为1884道知名菜肴在24个国家/菜系中的食材重叠度测量结果,每道菜以7种语言描述,包含菜系、食材、菜系-食材关系及菜系配对四张表格,可支撑烹饪文化相似性与地理邻近度关联研究,适用于跨文化烹饪比较研究、食材网络分析与数据可视化教学等场景。
其他
文本
表格
数据集为7,786部Netflix影视内容(5,376部电影、2,410部剧集)的增强版元数据,通过实体解析管道整合IMDb评分与TMDb流行度数据,包含匹配置信度、数据完整性评分及衍生特征等40个字段,可支撑推荐系统原型开发与多源数据融合研究,适用于跨源影视数据整合研究、推荐系统原型开发及内容探索性分析等场景。
文旅
文本
表格
数据集为20,000条模拟电动汽车电池遥测记录,涵盖电池健康状态、充电行为、车辆使用、环境条件及维护诊断等参数,目标变量为电池故障二分类标签(1=故障/0=健康),可支撑电池健康分析与故障预测建模,适用于电池故障预测分类、特征工程实践及电池健康研究等场景。
其他
时序
表格
数据集为300条合成参与者记录,涵盖人口统计、社交媒体使用模式、注意力与生产力指标及数字健康等66个特征,可支撑社交媒体行为与生产力关联分析研究,适用于探索性数据分析、行为模式挖掘及机器学习分类回归实践等场景。
其他
表格
数据集为经过清洗与转换的电商交易数据,整合订单、客户、产品、支付等信息于单一分析表,可支撑销售绩效分析与客户行为研究,适用于销售趋势分析、客户行为分析及商业智能仪表盘开发等场景。
消费
时序
表格
数据集为Smart India Hackathon(智慧印度黑客松)2026官方发布的所有问题陈述的结构化汇总,涵盖组织、类别、主题、提交截止日期及问题详细描述等字段,可支撑参赛者快速筛选与趋势分析研究,适用于问题陈述检索筛选、主题趋势分析及推荐系统开发等场景。
教育
文本
表格
数据集为全球200余个文化群体与国家的传统服饰与纺织文化遗产记录,涵盖服装类型、文化意义、材质、纺织技术、仪式用途及地理分布等23个字段,可支撑文化遗产研究与跨文化比较分析,适用于人类学研究、文化教育及纺织工艺传承分析等场景。
其他
文本
表格
该数据集系统覆盖现代物理理论的四大核心支柱(量子力学、电动力学、热力学统计物理、分析力学),是物理学中抽象程度最高、推理链条最长、数学结构最复杂的一类问题集合。其核心价值在于为 AI 提供科研级理论物理推理样本,解决模型在变分原理、算符形式主义、统计系综、电磁场理论等方面的能力缺失。典型应用于科研型 AI、理论物理辅助系统以及高端 AI for Science 模型的能力上限探索。
教育
文本
本数据集涵盖Cu-Ni-Co-Si、Cu-Fe-P、Cu-Cr-Zr等多个合金体系数据,按照成分配比、生产工艺、材料性能、微观结构的全链路关联主线,结构化收录了化学成分、工艺参数、显微组织特征及力学与物理性能等关键维度,有效解决了该领域实验数据分散、整合成本高的痛点,可为机器学习与材料计算提供高质量、即用型的数据集,直接支撑合金设计、性能预测与工艺优化等AI研发场景。
制造
文本
本数据集精选大学阶段普通物理经典习题,系统覆盖力学、热学、电磁学、振动与波、光学等内容,是高中物理向理论物理与工程物理过渡的关键桥梁。其核心价值在于提供“物理建模 → 数学表达 → 定量求解 → 物理意义解释”的完整推理样本,弥补模型在高于中学、低于专业理论物理层级的物理理解断层。典型应用于 AI 物理解题、科学推理模型训练、AI for Science 基础能力构建以及物理教育智能系统。
教育
文本
本数据集系统覆盖高中物理的力学、电磁学、热学与光学等核心模块,其题目设计强调物理建模、定量计算与物理意义分析。核心价值在于为AI提供大量从实际情境抽象为数学模型,再经数学推导求解的完整样本,专门针对模型在理解物理概念本质、判断公式适用条件及执行严谨多步计算等方面的短板进行训练。该数据集适用于开发专用物理解题模型、构建智能AI物理教辅系统,以及对通用大模型进行物理世界建模与科学推理能力的专项增强。
教育
文本
这不仅仅是一个数据集;它是一个鲜活的、不断发展的项目,在健康、营养和可持续发展领域有着切实的应用。无论您对营养、供应链还是食品对环境的影响感兴趣,您都有能力做出改变。
消费
文本
本数据集系统收录高中阶段数学核心题型,覆盖函数、数列、立体几何、解析几何、概率统计等高频与难点内容,完整体现高中数学的知识结构与解题逻辑。其核心价值在于为大模型提供结构化、层次清晰的基础数学推理样本,解决模型在基础数学理解、符号运算、逻辑推导与规范解题表达方面能力不足的问题。典型应用场景包括智能题库生成、AI 数学辅导、教育大模型预训练与对齐,以及通用推理模型的基础数学能力增强。
教育
文本
数据集为2026-2027赛季欧洲五大联赛(英超、西甲、德甲、意甲、法甲)的球员统计数据,涵盖球员基本信息、出场时间、进攻、射门、防守及门将表现等100余个字段,可用于球员对比、球探分析与赛季趋势研究,适用于足球数据分析、球员表现评估及体育数据可视化等场景。
其他
表格
数据集为2026年7月21日至8月18日美国12个ZIP市场DDR5内存、内置机械硬盘与NVMe固态硬盘的140637条价格观测记录,涵盖产品标题、容量、标价及容量标准化价格,可支撑PC升级预算与组件价格对比分析,适用于组件价格趋势分析、区域价格差异研究及容量性价比评估等场景。
消费
时序
表格
数据集为2026年8月通过TMDB API采集的988部热门、高分及趋势影视作品,涵盖电影与电视剧两种类型,包含类型、评分、流行度、上映日期及剧情概述等14个字段,可支撑影视趋势分析与内容推荐研究,适用于影视类型偏好分析、评分对比研究及文本挖掘实践等场景。
文旅
文本
表格
数据集为PRISM基准评估结果,涵盖4个小型语言模型在2个科学问答数据集(ARC-Challenge和SciQ)上、400个问题与5种提示条件下的表现,包含准确性、指令遵循、一致性及提示敏感性等评估指标,可支撑小语言模型可靠性与提示敏感性研究,适用于小型语言模型鲁棒性评估、提示工程研究及模型对比基准测试等场景。
其他
文本
表格
数据集为5000名Netflix用户的订阅行为与流失记录,涵盖订阅类型、观看时长、登录活跃度、设备偏好、支付方式及人口统计等14个特征,可支撑客户流失预测与留存策略研究,适用于客户流失分类预测、用户行为分群及留存策略分析等场景。
文旅
表格
数据集为2006至2025年南极洲五个代表性地点(南极点、麦克默多站、南极半岛、西南极洲、东南极洲)的每日气候与天气数据,涵盖温度、降水、风速、日照等17个字段,可支撑气候趋势分析与极端天气研究,适用于气候变化趋势分析、极地极端天气识别及时间序列预测建模等场景。
其他
时序
表格
数据集为200,000条合成交通与应急响应记录,涵盖时间动态、环境物理、基础设施与交通流、驾驶员特征及应急调度操作等29个工程化变量,可支撑事故风险预测与响应时间建模研究,适用于交通风险预测、应急响应时间回归及事故严重程度分类等场景。
交通
时序
表格
数据集为2023至2025年印度国内航班运行记录,涵盖主要航空公司、起降机场、航班时刻及星期等特征,已结构化预处理为机器学习输入格式,可支撑航班延误预测与航空绩效分析研究,适用于航班延误分类预测、航空公司准点率对比分析及机场拥堵模式研究等场景。
交通
时序
表格
数据集为1884道知名菜肴在24个国家/菜系中的食材重叠度测量结果,每道菜以7种语言描述,包含菜系、食材、菜系-食材关系及菜系配对四张表格,可支撑烹饪文化相似性与地理邻近度关联研究,适用于跨文化烹饪比较研究、食材网络分析与数据可视化教学等场景。
其他
文本
表格
数据集为7,786部Netflix影视内容(5,376部电影、2,410部剧集)的增强版元数据,通过实体解析管道整合IMDb评分与TMDb流行度数据,包含匹配置信度、数据完整性评分及衍生特征等40个字段,可支撑推荐系统原型开发与多源数据融合研究,适用于跨源影视数据整合研究、推荐系统原型开发及内容探索性分析等场景。
文旅
文本
表格
数据集为20,000条模拟电动汽车电池遥测记录,涵盖电池健康状态、充电行为、车辆使用、环境条件及维护诊断等参数,目标变量为电池故障二分类标签(1=故障/0=健康),可支撑电池健康分析与故障预测建模,适用于电池故障预测分类、特征工程实践及电池健康研究等场景。
其他
时序
表格
数据集为300条合成参与者记录,涵盖人口统计、社交媒体使用模式、注意力与生产力指标及数字健康等66个特征,可支撑社交媒体行为与生产力关联分析研究,适用于探索性数据分析、行为模式挖掘及机器学习分类回归实践等场景。
其他
表格
数据集为经过清洗与转换的电商交易数据,整合订单、客户、产品、支付等信息于单一分析表,可支撑销售绩效分析与客户行为研究,适用于销售趋势分析、客户行为分析及商业智能仪表盘开发等场景。
消费
时序
表格
数据集为Smart India Hackathon(智慧印度黑客松)2026官方发布的所有问题陈述的结构化汇总,涵盖组织、类别、主题、提交截止日期及问题详细描述等字段,可支撑参赛者快速筛选与趋势分析研究,适用于问题陈述检索筛选、主题趋势分析及推荐系统开发等场景。
教育
文本
表格
数据集为全球200余个文化群体与国家的传统服饰与纺织文化遗产记录,涵盖服装类型、文化意义、材质、纺织技术、仪式用途及地理分布等23个字段,可支撑文化遗产研究与跨文化比较分析,适用于人类学研究、文化教育及纺织工艺传承分析等场景。
其他
文本
表格