openassistant-guanaco timdettmers

This dataset is a subset of the Open Assistant dataset, which you can find here: https://huggingface.co/datasets/OpenAssistant/oasst1/tree/main This subset of the data only contains the highest-rated paths in the conversation tree, with a total of 9,846 samples. This dataset was used to train Guanaco with QLoRA. For further information, please see the original dataset. License: Apache 2.0

Typ
dataset
Downloads
4,577
Likes
444
Zugriff
public
Dateien
0

Tags

  • Instruction-Tuning
  • 对话数据
  • Präferenzdaten
  • 大语言模型
  • Feinabstimmung
  • Textdaten
  • 多语言

Zusammenfassung

Dieser Datensatz ist eine Teilmenge des Open-Assistant-Datensatzes und enthält nur die höchstbewerteten Konversationspfade mit insgesamt 9.846 Stichproben. Er wird zum Training des Guanaco-Modells mit QLoRA verwendet und dient als hochwertige Quelle für die Feinabstimmung von Sprachmodellen auf Bas…

README

Dieses Datenset ist eine Teilmenge des Open Assistant-Datensets, das Sie hier finden: https://huggingface.co/datasets/OpenAssistant/oasst1/tree/main Diese Teilmenge der Daten enthält nur die am höchsten bewerteten Pfade im Gesprächsbaum, mit insgesamt 9.846 Beispielen. Dieses Datenset wurde verwend…

查看完整页面 · 查看原文