新闻摘要生成评估数据集-新闻文章与人工摘要-随机抽样数据

新闻摘要生成评估数据集-新闻文章与人工摘要-随机抽样数据 数据来源:互联网公开数据 标签:新闻,摘要,文本摘要,自然语言处理,机器学习,评估,文本分析,内容生成 数据概述: 本数据集是从Kaggle上公开的“所有媒体机构首页新闻文章”数据集中随机抽取的30,000条样本。原始数据集包含了来自不同媒体机构的新闻文章及其人工撰写的新闻摘要。本数据集保留了新闻文章原文和对应的人工生成的摘要,为文本摘要算法的评估提供了基础。

数据用途概述: 该数据集主要用于评估文本摘要算法的性能。研究人员可以使用该数据集训练、测试和比较不同的摘要模型,评估模型在生成摘要时的准确性、流畅性和信息覆盖率。此外,该数据集也适用于自然语言处理领域的其他研究,如文本生成、信息抽取等。该数据集可以帮助研究者了解摘要模型在实际新闻语境下的表现,并促进摘要技术的进步。

packageimg

数据与资源

附加信息

字段
版本 1.0
数据集大小 80.37 MiB
最后更新 2025年4月24日
创建于 2025年4月24日
声明 当前数据集部分源数据来源于公开互联网,如果有侵权,请24小时联系删除(400-600-6816)。