zhongyangribao banned-historical-archives

类型
dataset
下载量
181,056
点赞
2
访问
public
文件
0

标签

  • 文本数据集
  • 数字人文
  • 预训练语料
  • 多语言语料
  • NLP
  • 语义搜索
  • 文本分类

摘要

该数据集收录了《中央日报》的历史存档内容,属于中文历史文献类数据,下载量超过18万,具有较高关注度。可应用于中文历史研究、数字人文、文本分析及NLP领域,如历史语料检索、语义搜索、文本分类与舆情研究等场景。整体为典型的文本史料数据集,适合历史学者、数字人文学者及NLP研究者使用。

查看完整页面 · 查看原文