GitHub开发者社交网络分析图数据集-2019年

GitHub开发者社交网络分析图数据集-2019年 数据来源:互联网公开数据 标签:GitHub,开发者,社交网络,图数据,节点分类,机器学习,Web开发,社交关系,开发者分析 数据概述: 本数据集为2019年6月通过GitHub公开API收集的大型开发者社交网络图数据。数据集中,节点代表在GitHub上至少star了10个仓库的开发者,边表示开发者之间的互相关注关系。节点特征基于开发者的地理位置、star的仓库、雇主信息和电子邮件地址提取。 数据集中包含的任务是二元节点分类,即预测GitHub用户是Web开发者还是机器学习开发者。目标特征由每个用户的职位信息派生而来。

数据用途概述: 该数据集适用于社交网络分析、图机器学习、开发者行为研究等多种场景。研究人员可以利用此数据进行节点分类任务,探索影响开发者职业方向的因素;可以分析开发者之间的社交关系,研究开发者之间的信息传播模式;也可以用于测试和评估图神经网络模型。此外,该数据集也适用于教育和培训,帮助学习者理解社交网络分析和图机器学习的相关知识。

packageimg

数据与资源

附加信息

字段
版本 1.0
数据集大小 2.28 MiB
最后更新 2025年4月14日
创建于 2025年4月14日
声明 当前数据集部分源数据来源于公开互联网,如果有侵权,请24小时联系删除(400-600-6816)。