zhongyangribao banned-historical-archives
- 类型
- dataset
- 下载量
- 181,056
- 点赞
- 2
- 访问
- public
- 文件
- 0
标签
- 文本数据集
- 数字人文
- 预训练语料
- 多语言语料
- NLP
- 语义搜索
- 文本分类
摘要
该数据集收录了《中央日报》的历史存档内容,属于中文历史文献类数据,下载量超过18万,具有较高关注度。可应用于中文历史研究、数字人文、文本分析及NLP领域,如历史语料检索、语义搜索、文本分类与舆情研究等场景。整体为典型的文本史料数据集,适合历史学者、数字人文学者及NLP研究者使用。