ModernBERT-base answerdotai

类型
model
任务
fill-mask
框架
transformers
下载量
5,618,765
点赞
1,085
访问
public
文件
0

标签

  • 文本嵌入
  • 语义搜索
  • 文本分类
  • NLP
  • 预训练
  • transformers
  • 深度学习
  • PyTorch

摘要

ModernBERT-base 是一个现代化改造的 BERT 风格双向编码器模型,在 2 万亿英文与代码 token 上预训练,原生支持 8192 token 长上下文。它采用 RoPE、局部全局交替注意力、Unpadding 与 Flash Attention 等改进,推理效率高。该模型主要作为 MLM 骨干用于下游微调,在 GLUE 自然语言理解、BEIR 检索及代码检索等任务上表现优异,适用于长文档检索、文本分类与语义搜索等场景。

README

--- library_name: transformers license: apache-2.0 language: - en tags: - fill-mask - masked-lm - long-context - modernbert pipeline_tag: fill-mask inference: false --- # ModernBERT ## 模型摘要 ModernBERT 是一个现代化的双向仅编码器 Transformer 模型(BERT 风格),在 2 万亿 token 的英语和代码数据上预训练,原生上下文长度最高可达 8,192 个 token。ModernBE…

查看完整页面 · 查看原文