roberta-large FacebookAI
- 種別
- model
- タスク
- fill-mask
- フレームワーク
- transformers
- ダウンロード
- 11,440,988
- いいね
- 319
- アクセス
- public
- ファイル
- 0
タグ
- 大言語モデル
- テキスト分類
- NLP
- 深層学習
- 変換器
- 表現学習
概要
RoBERTa largeは英語テキストでマスク言語モデリング(MLM)目的で事前学習された大規模Transformerモデルです。大規模コーパス(約160GB)から双方向の言語表現を学習しており、系列分類・トークン分類・質問応答など下流タスクへのファインチューニングを主目的とします。特徴抽出にも利用でき、各タスク向けに微調整した派生モデルの基盤として広く活用されます。
README
--- language: en tags: - exbert license: mit datasets: - bookcorpus - wikipedia --- # RoBERTa large モデル マスク言語モデリング(MLM)目的を使用して英語で事前学習されたモデルです。このモデルは [この論文](https://arxiv.org/abs/1907.11692)で紹介され、最初に [このリポジトリ](https://github.com/pytorch/fairseq/tree/master/examples/roberta)で公開されました。このモデルは大文字と小文字を区別し…