bert

标签

Cards List
#bert

领域偏移下的可靠金融命名实体识别

arXiv cs.CL · 2026-08-21 缓存

本文研究了领域偏移下金融命名实体识别的置信度估计和选择性预测,评估了BERT和LoRA微调的Qwen模型,以提高在不同输入分布(如SEC文件和社交媒体)下的可靠性。

0 人收藏 0 人点赞
#bert

用于文本摘要的Transformer模型:BART、BERT与RoBERTa的比较研究

arXiv cs.CL · 2026-08-21 缓存

对BART、BERT和RoBERTa在文本摘要中的比较研究,探讨它们的架构以及在抽取式和生成式摘要任务中的适用性。

0 人收藏 0 人点赞
#bert

评估基于BERT的模型在问答任务中的可靠性

arXiv cs.CL · 2026-08-12 缓存

本文评估了基于BERT的问答模型(RoBERTa、ALBERT、DistilBERT)在蒙特卡洛Dropout和输入改写条件下的可靠性,发现RoBERTa更为一致,并验证了MCD作为可靠性指标的有效性。

0 人收藏 0 人点赞
#bert

STCAD: Scalable Trajectory Clustering and Anomaly Detection on Terabyte-Scale AIS Data

arXiv cs.LG · 2026-08-12 缓存

Presents STCAD, a scalable framework using BERT-based encoding and CURE clustering to perform trajectory clustering and anomaly detection on terabyte-scale AIS maritime data, demonstrating stable clusters and clear separation of anomalous vessel behavior.

0 人收藏 0 人点赞
#bert

立法证词中的自我介绍检测

arXiv cs.CL · 2026-08-11 缓存

本文介绍了一个用于检测立法委员会证词中自我介绍的机器学习流程,使用词袋和BERT概率等特征。XGBoost取得了最佳F1分数0.9747,并通过BERT增强特征进一步改进。

0 人收藏 0 人点赞
#bert

CNM-BERT:一种基于表意描述序列的汉字即插即用结构嵌入

arXiv cs.CL · 2026-08-07 缓存

本文提出CNM,一种轻量级增强方法,通过表意描述序列将汉字的离散组合结构注入BERT,在提升稀有字符和未登录字符性能的同时保持通用自然语言理解准确率。

0 人收藏 0 人点赞
#bert

联合仿射谱整形:超越仅权重Muon的权重与偏置更新耦合

arXiv cs.LG · 2026-08-05 缓存

本文提出联合仿射谱整形(JRI),将仅权重的谱优化器(如Muon)扩展到仿射层中联合更新权重和偏置,在BERT-mini IMDb分类任务上显示出小而一致的准确率提升。

0 人收藏 0 人点赞
#bert

@jxmnop:我认为我们从来都不需要发明掩码语言建模。它在构造上就有点愚蠢。在大多数平行宇宙里,我们可能直接跳到自回归模型了,抱歉了 BERT

X AI KOLs Following · 2026-08-04

一条推文认为掩码语言建模没有必要,自回归模型就足够了,并顺便提到了 BERT。

0 人收藏 0 人点赞
#bert

基于可解释Transformer模型的Mpox研究自动化多标签分类

arXiv cs.CL · 2026-07-30 缓存

本文提出了一种基于BERT的Mpox研究文章自动化多标签分类系统,准确率达到97%,并采用SHAP进行可解释性分析。该系统旨在帮助研究人员和医疗工作者快速找到相关信息。

0 人收藏 0 人点赞
#bert

基于BERT的模型与大型语言模型在低资源命名实体识别中的比较:以马拉地语为例

arXiv cs.CL · 2026-07-28 缓存

本文比较了微调后的MahaBERT模型与大型语言模型(Gemini、LLaMA-3.3-70B、Gemma)在马拉地语命名实体识别上的表现,发现专门的BERT模型显著优于这些大型语言模型,其F1分数为0.88–0.91,而后者仅为0.57–0.69。

0 人收藏 0 人点赞
#bert

@HuggingModels: 是否曾经需要在不进行微调的情况下从文本中提取丰富含义?认识一下 MyAwesomeModel,一个基于 BERT 的特征提取器,它……

X AI KOLs Timeline · 2026-07-23 缓存

MyAwesomeModel,一个基于 BERT 的特征提取器,将句子转换为稠密向量,用于语义搜索、聚类和 NLP 流水线。

0 人收藏 0 人点赞
#bert

翻译作为数据增强:翻译数据对难度评估的影响

arXiv cs.CL · 2026-07-22 缓存

本文提出了一种跨语言数据增强策略,利用机器翻译将专家标注的难度标签从高资源语言迁移到低资源语言。基于BERT的回归模型实验表明,用翻译语料库增强稀缺的本土数据显著提高了文本难度评估的准确性。

0 人收藏 0 人点赞
#bert

PAN 2026的DACTYL团队:贝叶斯数据混合与经验X风险最小化在AI文本检测中的应用

arXiv cs.CL · 2026-07-21 缓存

本文介绍了使用贝叶斯数据混合和经验X风险最小化检测AI生成文本的方法,通过ModernBERT-large和MCGrad分类器在OOD检测上取得了高性能。

0 人收藏 0 人点赞
#bert

使用BERT进行候选参与的对话状态追踪

arXiv cs.CL · 2026-07-20 缓存

本文提出了一个使用BERT的可扩展多领域对话状态追踪框架,实现了零样本泛化,并在SGD数据集上提升了性能。

0 人收藏 0 人点赞
#bert

翻译作为计算高效的桥梁:英语BERT用于低资源语言的可行性

arXiv cs.CL · 2026-07-15 缓存

本文探讨了基于翻译的微调作为低资源语言本地语言BERT模型的资源高效替代方案的可行性,发现在六项NLP任务中,53.3%的情况下其性能相当或更优。

0 人收藏 0 人点赞
#bert

使用Procrustes条件的联合端到端Top-K稀疏自编码器的跨种子可解释性

arXiv cs.CL · 2026-07-10 缓存

本文提出了一种Procrustes条件的联合端到端Top-K稀疏自编码器,用于从独立训练的BERT模型中提取通用特征,在跨种子特征对齐方面优于事后对齐方法。

0 人收藏 0 人点赞
#bert

将表示与重构分离实现可扩展文本编码器

arXiv cs.CL · 2026-07-07 缓存

CrossBERT将表示学习与令牌重构解耦,实现更高的掩码比例和更好的样本效率,在MTEB和GLUE基准测试上超越BERT。

0 人收藏 0 人点赞
#bert

@goyalayus:实际上,你不需要所有这些,只要这四本书,就可以进入任何领域并快速上手。(我……

X AI KOLs Timeline · 2026-07-04 缓存

@goyalayus 的一条推文指出,四本未指定的书籍足以学习任何领域,随后引用 Praveen Kumar Verma 的建议,按特定顺序阅读基础 LLM 论文,包括《Attention Is All You Need》、BERT、GPT、GPT-2、Scaling Laws 和 GPT-3。

1 人收藏 0 人点赞
#bert

BamiBERT: 一种新的基于BERT的越南语语言模型

arXiv cs.CL · 2026-07-03 缓存

BamiBERT 是一种新的基于BERT的越南语预训练语言模型,它解决了PhoBERT的局限性,支持更长的上下文,无需分词即可运行,并在多个越南语基准上取得了最先进的结果。

0 人收藏 0 人点赞
#bert

@TheTuringPost: 一个理解或复习Transformer架构的绝佳资源。它解释了Transformer如何逐个token处理文本…

X AI KOLs Timeline · 2026-07-03 缓存

推荐一个解释Transformer架构的教育资源,涵盖token嵌入、自注意力、残差连接,以及与GPT和BERT的联系。

0 人收藏 0 人点赞
Next →
← 返回首页

提交意见反馈