ultrachat_200k HuggingFaceH4

Dataset Card for UltraChat 200k Dataset Description This is a heavily filtered version of the UltraChat dataset and was used to train Zephyr-7B-β, a state of the art 7b chat model. The original datasets consists of 1.4M dialogues generated by ChatGPT and spanning a wide range of topics. To create UltraChat 200k, we applied the following logic: Selection of a subset of data for faster supervised fine tuning. Truecasing of the dataset, as we observed around 5% of… See the full description on the dataset page: https://huggingface.co/datasets/HuggingFaceH4/ultrachat_200k.

类型
dataset
许可
mit
语言
en
下载量
79,784
点赞
874
访问
public
文件
10

标签

  • 指令微调
  • 对话数据
  • 文本数据集
  • 文本生成
  • 大语言模型
  • NLP

摘要

UltraChat 200k 是从原始 UltraChat 约140万条对话中精筛出的高质量指令对话数据集,包含 SFT 和生成排序(gen)两类划分,适合监督微调及基于拒绝采样或 PPO 的生成式训练。该数据集由 ChatGPT 生成多领域对话并经真值校正、过滤无效回复,曾用于训练 Zephyr-7B-β 聊天模型。适用于大语言模型的指令微调与对话能力提升。

README

--- language: - en license: mit size_categories: - 100K<n<1M task_categories: - text-generation pretty_name: UltraChat 200k configs: - config_name: default data_files: - split: train_sft path: data/train_sft-* - split: test_sft path: data/test_sft-* - split: train_gen path: data/train_gen-* - split…

查看完整页面 · 查看原文