bert-base-multilingual-uncased google-bert
- 種別
- model
- タスク
- fill-mask
- フレームワーク
- transformers
- ダウンロード
- 4,123,114
- いいね
- 158
- アクセス
- public
- ファイル
- 0
タグ
- 多言語
- テキスト埋め込み
- NLP
- テキスト分類
- 機械学習
- transformers
- マスク言語モデリング
- 事前学習
概要
Googleが発表した多言語BERTモデルで、ウィキペディア上位102言語の大規模コーパスをマスク言語モデリング(MLM)で自己教師あり学習した基盤モデルです。文中のマスクされた単語を予測するfill-maskタスクに直接利用できるほか、分類やQAなどの下流タスクへのファインチューニング用のテキスト特徴抽出にも広く使用されます。uncased版のため大文字小文字を区別しません。多言語対応のテキスト埋め込みが必要なNLPタスク全般で活用できます。
README
--- language: - multilingual - af - sq - ar - an - hy - ast - az - ba - eu - bar - be - bn - inc - bs - br - bg - my - ca - ceb - ce - zh - cv - hr - cs - da - nl - en - et - fi - fr - gl - ka - de - el - gu - ht - he - hi - hu - is - io - id - ga - it - ja - jv - kn - kk - ky - ko - la - lv - lt -…