GitHub开发者社交网络机器学习与Web开发者分类数据集-2019年6月-rozemberczki

GitHub开发者社交网络机器学习与Web开发者分类数据集-2019年6月-rozemberczki

数据来源:互联网公开数据

标签:社交网络, GitHub, 开发者, 机器学习, Web开发, 节点分类, 图数据, 开发者关系

数据概述: 本数据集构建于2019年6月,基于GitHub的公开API收集,包含一个大型的GitHub开发者社交网络。数据集中,节点代表至少为10个仓库点赞的开发者,边代表开发者之间的关注关系。节点特征基于开发者的位置、点赞的仓库、雇主和电子邮件地址提取。该数据集的核心任务是进行二元节点分类,即预测GitHub用户是Web开发者还是机器学习开发者。此目标特征由每个用户的职位头衔推导而来。

数据用途概述: 该数据集主要用于社交网络分析、图机器学习任务,特别是二元节点分类、链接预测和社区发现。研究人员可以使用该数据集探索GitHub开发者之间的关系,分析Web开发者和机器学习开发者的特征差异,开发和评估图神经网络模型,进行社区结构检测和网络可视化。此外,该数据集也可用于教育目的,例如教授图数据分析、社交网络分析等相关课程。

packageimg

数据与资源

附加信息

字段
版本 1.0
数据集大小 3.31 MiB
最后更新 2025年4月23日
创建于 2025年4月23日
声明 当前数据集部分源数据来源于公开互联网,如果有侵权,请24小时联系删除(400-600-6816)。