representations

标签

Cards List
#representations

Attention-based representations for multi-task computation

arXiv cs.LG · 5天前 缓存

This paper establishes theoretical bounds on the number of attention heads needed to produce vector representations that support multiple tasks, such as computing min/max and XOR, showing trade-offs between head count, embedding dimension, and precision.

0 人收藏 0 人点赞
#representations

从表征到行为:探索LLMs中的人-情境-行为三元组

arXiv cs.CL · 2026-07-30 缓存

本文将Funder的人格三元框架适配到大语言模型(LLM),利用稀疏自编码器发现并验证类似特质的内部表征,并通过特征层面的干预展示可控的双向行为偏移。

0 人收藏 0 人点赞
#representations

临床证据的强度可从语言模型表示中恢复,但无法从其陈述的等级中获取

arXiv cs.CL · 2026-06-30 缓存

本文表明,大型语言模型在内部编码了临床证据对主张的强度,但在被询问时未能准确表达这一强度,其陈述的证据等级表现近乎随机。

0 人收藏 0 人点赞
#representations

当探测精度饱和时,脆弱性解析:LLM预训练分析的补充指标

arXiv cs.CL · 2026-06-11 缓存

本文引入了'脆弱性'这一探测精度的补充指标,它衡量导致探测精度崩溃的激活噪声水平,从而能够在精度饱和后分析LLM预训练过程中的表示演化。

0 人收藏 0 人点赞
#representations

论词汇性在大语言模型中的持续影响

arXiv cs.CL · 2026-06-03 缓存

本文研究了词汇重叠(而非语义内容)如何影响跨层和跨架构的大语言模型表示,并证明即使在为语义相似性训练的模型中,这种词汇效应依然存在,导致下游任务性能下降。

0 人收藏 0 人点赞
#representations

人脑中的柏拉图式表示:通用几何的无监督复原

Hugging Face Daily Papers · 2026-05-19 缓存

本文研究了是否可以通过无监督几何方法对齐不同被试视觉皮层的fMRI表示,发现了个体间近似等距结构的证据,将柏拉图式表示假说扩展到人脑。

0 人收藏 0 人点赞
#representations

@Julian_a42f9a:后期交互检索模型的表示已超越检索本身,可直接用于RAG

X AI KOLs Following · 2026-04-17 缓存

新论文表明,后期交互检索模型的表示可替代原始文档文本,在RAG任务中拓展其应用边界。

0 人收藏 0 人点赞
← 返回首页

提交意见反馈