bert-base-multilingual-uncased google-bert

種別
model
タスク
fill-mask
フレームワーク
transformers
ダウンロード
4,123,114
いいね
158
アクセス
public
ファイル
0

タグ

  • 多言語
  • テキスト埋め込み
  • NLP
  • テキスト分類
  • 機械学習
  • transformers
  • マスク言語モデリング
  • 事前学習

概要

Googleが発表した多言語BERTモデルで、ウィキペディア上位102言語の大規模コーパスをマスク言語モデリング(MLM)で自己教師あり学習した基盤モデルです。文中のマスクされた単語を予測するfill-maskタスクに直接利用できるほか、分類やQAなどの下流タスクへのファインチューニング用のテキスト特徴抽出にも広く使用されます。uncased版のため大文字小文字を区別しません。多言語対応のテキスト埋め込みが必要なNLPタスク全般で活用できます。

README

--- language: - multilingual - af - sq - ar - an - hy - ast - az - ba - eu - bar - be - bn - inc - bs - br - bg - my - ca - ceb - ce - zh - cv - hr - cs - da - nl - en - et - fi - fr - gl - ka - de - el - gu - ht - he - hi - hu - is - io - id - ga - it - ja - jv - kn - kk - ky - ko - la - lv - lt -…

查看完整页面 · 查看原文