masked-language-modeling

标签

Cards List
#masked-language-modeling

通过功能感知掩码学习任务特定的抗体表示

arXiv cs.LG · 2026-09-02 缓存

本文介绍了功能感知掩码,这是一种用于抗体语言模型的预训练算法,它将掩码放置与功能先验对齐,显著提升了结构和CDR相关任务的表现。

0 人收藏 0 人点赞
#masked-language-modeling

AraSSM:用于阿拉伯语掩码语言建模的双向状态空间编码器

arXiv cs.CL · 2026-08-11 缓存

介绍AraSSM,一种通过阿拉伯语语料库上的掩码语言建模进行预训练的双向Mamba状态空间编码器,在消费级GPU上从头训练,同时在阿拉伯语自然语言理解基准上取得了有竞争力的结果。

0 人收藏 0 人点赞
#masked-language-modeling

@jxmnop:我认为我们从来都不需要发明掩码语言建模。它在构造上就有点愚蠢。在大多数平行宇宙里,我们可能直接跳到自回归模型了,抱歉了 BERT

X AI KOLs Following · 2026-08-04

一条推文认为掩码语言建模没有必要,自回归模型就足够了,并顺便提到了 BERT。

0 人收藏 0 人点赞
#masked-language-modeling

语言中的JEPA悖论:语言替代的几何学

arXiv cs.CL · 2026-07-28 缓存

本文分析了为什么确定性JEPA风格的潜在预测适用于图像但不适用于文本,将失败归因于语言中的高条件方差,其中被屏蔽的上下文允许多个有效补全,而这些补全的表征缺乏一致的质心。

0 人收藏 0 人点赞
#masked-language-modeling

ModernBERT模型的法律领域适应

arXiv cs.CL · 2026-06-30 缓存

本文探讨了ModernBERT模型在法律领域的领域适应,通过在美国法院意见上进行进一步预训练,取得了相对于基础模型的显著改进,并公开发布了检查点。

0 人收藏 0 人点赞
#masked-language-modeling

预测与重建:自监督语言表示学习的联合目标

arXiv cs.CL · 2026-06-05 缓存

本文提出了一种混合预训练目标,结合了JEPA潜在空间预测和MLM重建,用于语言模型,显示出改进的嵌入均匀性和语义-词汇平衡。

0 人收藏 0 人点赞
#masked-language-modeling

LDARNet:用于基因组建模的具有可学习分词的DNA自适应表示网络

arXiv cs.CL · 2026-06-04 缓存

LDARNet 是一个拥有1.2亿参数的层次化基因组基础模型,引入了可学习的自适应分词机制(灵感来源于 H-Net 的动态分块),用于DNA序列的掩码语言建模。该模型在5项组蛋白修饰任务上取得了最先进的结果,并在多项基因组基准测试中超越了参数量多达其20倍的模型。其学习到的分词边界与启动子motif和剪接位点等生物学特征高度吻合。

0 人收藏 0 人点赞
#masked-language-modeling

google-bert/bert-base-uncased

Hugging Face Models Trending · 2022-03-02 缓存

对BERT base uncased模型的描述,这是一个在英文文本上使用掩码语言模型和下一句预测进行预训练的语言模型,可在Hugging Face上获取。

0 人收藏 0 人点赞
← 返回首页

提交意见反馈