数据集是专为AI工具生态分析与市场趋势研究而构建的399个热门AI工具结构化目录数据集,核心价值在于整合工具身份信息、描述文本、分类标签及开源工具的GitHub开发者指标(星标数、复刻数、编程语言与开放问题数)等15个分析列,有效解决了AI工具信息分散且缺乏系统化对比数据的问题。适用于数据科学家与产品分析师进行市场趋势与开源生态研究。
其他
表格
数据集为1500条合成标注数据,覆盖编码、数学、RAG/QA、规划、客户支持5个任务领域与12种根因失败类别,包含任务提示、上下文、预期答案、智能体响应及失败类型与严重等级标注,可支撑智能体失败分类与AI可靠性研究,适用于AI智能体失败模式分类、LLM评估与AI安全研究等场景。
其他
文本
表格
数据集为全球科研与医疗粒子加速器的早期公开登记数据,包含447台已命名机器或明确单元组、298个设施、892条溯源记录及276个坐标限定记录,涵盖当前运行、历史、规划、调试、关闭及未知生命周期状态,可支撑加速器设施地理分布研究与科研基础设施分析,适用于科学设施地理空间分析、加速器生命周期研究及科研基础设施可视化等场景。
医疗
表格
地理空间
数据集为Spotify平台艺术家的综合流媒体表现数据,包含流媒体播放量、排名、流行度指标及音乐流派、语言分布等信息,可支撑艺术家表现分析与音乐趋势研究,适用于艺术家流行度分析、音乐行业趋势研究及数据可视化仪表盘开发等场景。
文旅
表格
数据集是专为跨国经济比较与消费模式研究而构建的全球家庭与为家庭服务的非营利机构人均最终消费支出数据集,核心价值在于提供世界银行以购买力平价(PPP)换算的国际美元计价的消费支出估算数据,涵盖多国多年份面板数据,经清洗后仅保留国家、年份与消费支出三列简洁格式,有效解决了原始SDMX数据格式繁杂难以直接使用的问题。适用于经济分析师与数据科学从业者进行消费趋势分析与经济建模。
其他
时序
表格
数据集是专为时间序列预测与算法交易研究而构建的沙特阿拉伯Emaar经济城(Tadawul: 4220)超过十年的日频股票历史数据集,核心价值在于提供开盘价、最高价、最低价、收盘价及成交量等完整的OHLCV市场数据,有效解决了中东地区房地产龙头股历史数据获取渠道分散的问题。适用于金融分析师与量化研究者进行趋势分析、波动率建模与交易策略开发。
金融
时序
表格
数据集为1705条JIRA风格用户故事与缺陷报告,来自虚构健康保险公司的Salesforce理赔处理系统实现,每条记录包含故事标题、描述、验收标准等完整结构,可支撑保险领域文本检索与RAG系统开发,适用于保险文本检索、用户故事分类及RAG系统评估等场景。
金融
文本
表格
数据集是专为长期人机社会智能研究而构建的对话级社会认知动态标注数据集,核心价值在于通过扩展MSC与LoCoMo长期对话数据集,为每轮对话提供人格特质、七维情绪分布、四维人格状态、十一维社会记忆表征及关系强度等连续认知变量,有效解决了长期交互中认知状态量化建模的数据缺失问题。适用于人机交互研究者与社交AI开发者进行社会智能建模与动态分析。
其他
表格
本数据库涵盖全球医疗领域专利数据,数据来源于美国专利商标局、欧洲专利局、日本专利局以及其他国家和地区的专利数据。数据库依据医疗产业细分体系分为医疗技术、制药、生物技术、生物材料分析四大子库,客观反映技术迭代、研发热点与产业竞争格局,适用于学术研究、行业趋势研判和政策分析等研究场景。关键创新在于提供全面创新指标列表,将医疗专利匹配到法人实体,覆盖全球主要公司(包括上市公司和私营公司)。
医疗
文本
时序
表格
数据集是专为比特币市场行为分析与投资预测而构建的每日OHLCV历史数据集,核心价值在于提供开盘、最高、最低、收盘价与成交量等核心价格信号,捕捉包括2026年78k至60k修正在内的重大价格波动,并支持锤子线、十字星与吞没形态等蜡烛图信号识别,有效解决了加密货币市场结构化历史数据缺乏的问题。适用于金融分析师与数据科学家进行市场周期可视化与预测建模。
金融
表格
数据集是专为欺诈检测与金融分析而构建的三月份电子卡交易记录数据集,核心价值在于提供交易ID、时间、卡信息、商户详情、金额、类型、位置及审批状态等14个字段的详细交易数据,支持从客户分群到异常检测的多维度金融分析,有效解决了金融交易数据获取受限且缺乏结构化公开数据的问题。适用于数据科学从业者与金融分析师进行欺诈检测与消费行为研究。
金融
表格
数据集是专为游戏销售预测与玩家行为分析而合成的2013–2026年全球销售与玩家生态数据集,核心价值在于整合全球销量、平台表现、收入构成、玩家活跃度、营销活动与区域经济指标等47个字段,构建互联互通的游戏商业分析矩阵,有效解决了游戏行业数据分散且难以系统化获取的问题。适用于数据科学从业者与游戏行业分析师进行销售预测与市场趋势研究。
其他
表格
数据集是专为膝关节异常检测模型训练而构建的轻量级元数据增强层,核心价值在于提供基于RSNA膝关节MRI挑战的5折分层交叉验证划分及由大语言模型从放射学报告中提取的12类病理软伪标签概率(0.0–1.0),有效解决了影像数据中标注成本高、硬标签信息不足及训练流程耦合重的问题。适用于医学影像研究者进行半监督学习与损失函数设计。
医疗
表格
数据集为涵盖纽约、伦敦、东京、孟买、圣保罗等全球主要城市的多表关系型数据库,包含餐厅元数据、动态菜单定价与配送物流信息,集成地理坐标、高峰配送乘数、详细营养构成及便利设施标识,可支撑回归预测、时序建模与空间商业智能分析,适用于配送时间预测、餐厅推荐系统开发及跨城市市场对比研究等场景。
其他
表格
地理空间
数据集是专为电商分析与预测建模而合成的50000条女性时尚服装产品记录数据集,核心价值在于通过嵌入层级定价、季节性约束及消费者行为逻辑等严格零售领域规则,确保销量与评论数量、退货率与品类等多元关联真实有效,有效解决了模拟数据缺乏真实零售逻辑的问题。适用于数据科学从业者进行多目标建模与推荐系统开发。
消费
表格
数据集为四张完全规范化的合成电商关系表(用户、产品、订单、订单明细),包含严格的参照完整性约束及隐藏的行为信号(会员等级与购买频率规则、商品关联规则),可支撑多表SQL查询、队列分析与推荐系统构建研究,适用于关系型数据库练习、用户行为分析与推荐算法开发等场景。
消费
表格
数据集是专为电子邮件营销点击率预测与营销分析而构建的1000+封营销邮件合成数据集,核心价值在于结合主题行、正文等非结构化文本特征与CTA数量、发送时间、内容标志等结构化设计特征,形成24个字段的多模态预测矩阵,有效解决了邮件营销数据中文本与行为特征难以系统化整合的问题。适用于数据科学从业者与营销分析师进行CTR回归建模与NLP特征工程实践。
其他
表格
数据集是专为食品营养研究与膳食推荐系统而构建的852种印度零售市场包装食品营养组成数据集,核心价值在于提供产品名称、品牌、食品类别、配料表、份量、营养数据、价格及元数据等25个字段的详细产品级信息,有效解决了印度包装食品营养数据分散且缺乏结构化整理的问题。适用于营养学家与数据科学从业者进行食品分类与健康分析。
消费
表格
数据集为基于物理模拟的卫星链路性能时间序列数据,涵盖三个气候区域(德里/圣保罗/柏林)与Ku/Ka双频段,包含卫星几何参数、传播损耗、接收信噪比及降雨衰减等完整观测状态,可支撑链路预算分析与机器学习预测建模,适用于卫星通信研究、降雨衰减建模及时间序列预测等场景。
其他
时序
表格
数据集为工厂能源消耗与城市固体废物产生量的高分辨率时序遥测数据,以5分钟间隔采集72小时窗口内15,480个样本,包含电力负载、电压电流、功率因数及废物输出等参数,可支撑轻量化Edge-AI模型开发与废物预测研究,适用于工业共生系统建模、废物产生量预测及边缘AI模型训练等场景。
其他
时序
表格
数据集为Hugging Face Hub上热门AI模型的结构化快照,涵盖模型名称、任务类型、下载量、点赞数、许可证等信息,可支撑AI趋势分析与模型生态研究,适用于AI模型生态趋势分析、热门模型排行榜构建及探索性数据分析教学等场景。
其他
表格
数据集是专为AI工具生态分析与市场趋势研究而构建的399个热门AI工具结构化目录数据集,核心价值在于整合工具身份信息、描述文本、分类标签及开源工具的GitHub开发者指标(星标数、复刻数、编程语言与开放问题数)等15个分析列,有效解决了AI工具信息分散且缺乏系统化对比数据的问题。适用于数据科学家与产品分析师进行市场趋势与开源生态研究。
其他
表格
数据集为1500条合成标注数据,覆盖编码、数学、RAG/QA、规划、客户支持5个任务领域与12种根因失败类别,包含任务提示、上下文、预期答案、智能体响应及失败类型与严重等级标注,可支撑智能体失败分类与AI可靠性研究,适用于AI智能体失败模式分类、LLM评估与AI安全研究等场景。
其他
文本
表格
数据集为全球科研与医疗粒子加速器的早期公开登记数据,包含447台已命名机器或明确单元组、298个设施、892条溯源记录及276个坐标限定记录,涵盖当前运行、历史、规划、调试、关闭及未知生命周期状态,可支撑加速器设施地理分布研究与科研基础设施分析,适用于科学设施地理空间分析、加速器生命周期研究及科研基础设施可视化等场景。
医疗
表格
地理空间
数据集为Spotify平台艺术家的综合流媒体表现数据,包含流媒体播放量、排名、流行度指标及音乐流派、语言分布等信息,可支撑艺术家表现分析与音乐趋势研究,适用于艺术家流行度分析、音乐行业趋势研究及数据可视化仪表盘开发等场景。
文旅
表格
数据集是专为跨国经济比较与消费模式研究而构建的全球家庭与为家庭服务的非营利机构人均最终消费支出数据集,核心价值在于提供世界银行以购买力平价(PPP)换算的国际美元计价的消费支出估算数据,涵盖多国多年份面板数据,经清洗后仅保留国家、年份与消费支出三列简洁格式,有效解决了原始SDMX数据格式繁杂难以直接使用的问题。适用于经济分析师与数据科学从业者进行消费趋势分析与经济建模。
其他
时序
表格
数据集是专为时间序列预测与算法交易研究而构建的沙特阿拉伯Emaar经济城(Tadawul: 4220)超过十年的日频股票历史数据集,核心价值在于提供开盘价、最高价、最低价、收盘价及成交量等完整的OHLCV市场数据,有效解决了中东地区房地产龙头股历史数据获取渠道分散的问题。适用于金融分析师与量化研究者进行趋势分析、波动率建模与交易策略开发。
金融
时序
表格
数据集为1705条JIRA风格用户故事与缺陷报告,来自虚构健康保险公司的Salesforce理赔处理系统实现,每条记录包含故事标题、描述、验收标准等完整结构,可支撑保险领域文本检索与RAG系统开发,适用于保险文本检索、用户故事分类及RAG系统评估等场景。
金融
文本
表格
数据集是专为长期人机社会智能研究而构建的对话级社会认知动态标注数据集,核心价值在于通过扩展MSC与LoCoMo长期对话数据集,为每轮对话提供人格特质、七维情绪分布、四维人格状态、十一维社会记忆表征及关系强度等连续认知变量,有效解决了长期交互中认知状态量化建模的数据缺失问题。适用于人机交互研究者与社交AI开发者进行社会智能建模与动态分析。
其他
表格
本数据库涵盖全球医疗领域专利数据,数据来源于美国专利商标局、欧洲专利局、日本专利局以及其他国家和地区的专利数据。数据库依据医疗产业细分体系分为医疗技术、制药、生物技术、生物材料分析四大子库,客观反映技术迭代、研发热点与产业竞争格局,适用于学术研究、行业趋势研判和政策分析等研究场景。关键创新在于提供全面创新指标列表,将医疗专利匹配到法人实体,覆盖全球主要公司(包括上市公司和私营公司)。
医疗
文本
时序
表格
数据集是专为比特币市场行为分析与投资预测而构建的每日OHLCV历史数据集,核心价值在于提供开盘、最高、最低、收盘价与成交量等核心价格信号,捕捉包括2026年78k至60k修正在内的重大价格波动,并支持锤子线、十字星与吞没形态等蜡烛图信号识别,有效解决了加密货币市场结构化历史数据缺乏的问题。适用于金融分析师与数据科学家进行市场周期可视化与预测建模。
金融
表格
数据集是专为欺诈检测与金融分析而构建的三月份电子卡交易记录数据集,核心价值在于提供交易ID、时间、卡信息、商户详情、金额、类型、位置及审批状态等14个字段的详细交易数据,支持从客户分群到异常检测的多维度金融分析,有效解决了金融交易数据获取受限且缺乏结构化公开数据的问题。适用于数据科学从业者与金融分析师进行欺诈检测与消费行为研究。
金融
表格
数据集是专为游戏销售预测与玩家行为分析而合成的2013–2026年全球销售与玩家生态数据集,核心价值在于整合全球销量、平台表现、收入构成、玩家活跃度、营销活动与区域经济指标等47个字段,构建互联互通的游戏商业分析矩阵,有效解决了游戏行业数据分散且难以系统化获取的问题。适用于数据科学从业者与游戏行业分析师进行销售预测与市场趋势研究。
其他
表格
数据集是专为膝关节异常检测模型训练而构建的轻量级元数据增强层,核心价值在于提供基于RSNA膝关节MRI挑战的5折分层交叉验证划分及由大语言模型从放射学报告中提取的12类病理软伪标签概率(0.0–1.0),有效解决了影像数据中标注成本高、硬标签信息不足及训练流程耦合重的问题。适用于医学影像研究者进行半监督学习与损失函数设计。
医疗
表格
数据集为涵盖纽约、伦敦、东京、孟买、圣保罗等全球主要城市的多表关系型数据库,包含餐厅元数据、动态菜单定价与配送物流信息,集成地理坐标、高峰配送乘数、详细营养构成及便利设施标识,可支撑回归预测、时序建模与空间商业智能分析,适用于配送时间预测、餐厅推荐系统开发及跨城市市场对比研究等场景。
其他
表格
地理空间
数据集是专为电商分析与预测建模而合成的50000条女性时尚服装产品记录数据集,核心价值在于通过嵌入层级定价、季节性约束及消费者行为逻辑等严格零售领域规则,确保销量与评论数量、退货率与品类等多元关联真实有效,有效解决了模拟数据缺乏真实零售逻辑的问题。适用于数据科学从业者进行多目标建模与推荐系统开发。
消费
表格
数据集为四张完全规范化的合成电商关系表(用户、产品、订单、订单明细),包含严格的参照完整性约束及隐藏的行为信号(会员等级与购买频率规则、商品关联规则),可支撑多表SQL查询、队列分析与推荐系统构建研究,适用于关系型数据库练习、用户行为分析与推荐算法开发等场景。
消费
表格
数据集是专为电子邮件营销点击率预测与营销分析而构建的1000+封营销邮件合成数据集,核心价值在于结合主题行、正文等非结构化文本特征与CTA数量、发送时间、内容标志等结构化设计特征,形成24个字段的多模态预测矩阵,有效解决了邮件营销数据中文本与行为特征难以系统化整合的问题。适用于数据科学从业者与营销分析师进行CTR回归建模与NLP特征工程实践。
其他
表格
数据集是专为食品营养研究与膳食推荐系统而构建的852种印度零售市场包装食品营养组成数据集,核心价值在于提供产品名称、品牌、食品类别、配料表、份量、营养数据、价格及元数据等25个字段的详细产品级信息,有效解决了印度包装食品营养数据分散且缺乏结构化整理的问题。适用于营养学家与数据科学从业者进行食品分类与健康分析。
消费
表格
数据集为基于物理模拟的卫星链路性能时间序列数据,涵盖三个气候区域(德里/圣保罗/柏林)与Ku/Ka双频段,包含卫星几何参数、传播损耗、接收信噪比及降雨衰减等完整观测状态,可支撑链路预算分析与机器学习预测建模,适用于卫星通信研究、降雨衰减建模及时间序列预测等场景。
其他
时序
表格
数据集为工厂能源消耗与城市固体废物产生量的高分辨率时序遥测数据,以5分钟间隔采集72小时窗口内15,480个样本,包含电力负载、电压电流、功率因数及废物输出等参数,可支撑轻量化Edge-AI模型开发与废物预测研究,适用于工业共生系统建模、废物产生量预测及边缘AI模型训练等场景。
其他
时序
表格
数据集为Hugging Face Hub上热门AI模型的结构化快照,涵盖模型名称、任务类型、下载量、点赞数、许可证等信息,可支撑AI趋势分析与模型生态研究,适用于AI模型生态趋势分析、热门模型排行榜构建及探索性数据分析教学等场景。
其他
表格