linguistics

标签

Cards List
#linguistics

字形非字母,记号非单词,空格非空格:Voynichese单元之否定

arXiv cs.CL · 17小时前 缓存

本文挑战了关于Voynich手稿语言单元的标准假设,通过定量分析表明,字形、记号和空格并不如普遍认为的那样对应于字母、单词和单词间隔。

0 人收藏 0 人点赞
#linguistics

词性的语义空间

arXiv cs.CL · 昨天 缓存

本文使用word2vec嵌入和神经网络来分析词性分类中的固有模糊性,创建一个三维语义空间来可视化典型词和语言类别之间的边界。

0 人收藏 0 人点赞
#linguistics

左分支Transformer在右分支语言中表现出色:数据塑造语言模型的词序偏好

arXiv cs.CL · 昨天 缓存

本文系统比较了decoder-only语言模型在人工语言和自然语言中的词序偏好,发现这些偏好是数据驱动的,并且随着LLMs的广泛采用,可能会减少语言多样性。

0 人收藏 0 人点赞
#linguistics

内涵照应

arXiv cs.CL · 5天前 缓存

本文研究内涵照应,认为基于描述的前提比现有的基于价值的解释更能说明代词的许可条件,并在一种名为 Plural Intensional Presuppositional predicate calculus (PIP) 的新逻辑中形式化了这一提议。

0 人收藏 0 人点赞
#linguistics

印欧语系谱系树

Hacker News Top · 6天前 缓存

印欧语系谱系树的交互式可视化,让用户探索语言之间的联系并听到高亮单词的发音。

0 人收藏 0 人点赞
#linguistics

无意义之虚妄:古典阿拉伯语中任意符号的结构不可能性

arXiv cs.CL · 2026-08-11 缓存

本文对古典阿拉伯语形态学进行数学建模,以反驳索绪尔的任意符号论和后现代语义不确定性,证明阿拉伯语词汇意义通过词根-词式配对在结构上被决定,并显示其与印欧语言相比存在系统复杂度不对称性。

0 人收藏 0 人点赞
#linguistics

超越“AI语言”:论LLM输出的个人言语特征本质

arXiv cs.CL · 2026-08-10 缓存

本文认为,大语言模型的输出展现出类似人类个人言语的模型特定语言特征,通过分析2024年和2026年的语料库,揭示了代际变化以及稳定的个体模型画像。

0 人收藏 0 人点赞
#linguistics

语调与词汇声调的交互:汉语方言中的边界现象

arXiv cs.CL · 2026-08-07 缓存

本文探讨了汉语方言中语调与词汇声调的相互作用,利用边界现象考察疑问句与陈述句等句子层面功能的基频线索,并讨论了理论模型。

0 人收藏 0 人点赞
#linguistics

Probing Character-level Transformers for the Spanish L-shaped Morphome

arXiv cs.CL · 2026-08-05 缓存

This paper probes character-level transformers to investigate whether they encode the Spanish L-shaped morphome, an irregular morphological pattern, as an abstract class or just surface alternations. The authors find that the encoding is item-specific and localized, but does not generalize like human learners.

0 人收藏 0 人点赞
#linguistics

Exemplars in Disguise: Pure Exemplar Models Mimic Abstraction-First Learning

arXiv cs.CL · 2026-08-04 缓存

This paper critiques recent methods claiming abstraction-first learning in large language models, showing that pure exemplar models can mimic abstraction-first learning depending on input distributional properties.

0 人收藏 0 人点赞
#linguistics

ChronoLens:跨时间、跨语言和语言层面的语言变化测量

Hugging Face Daily Papers · 2026-08-04 缓存

ChronoLens是一个框架,利用多语言语言模型和crosscoders测量五个议会传统(1803–2026年)中4498万篇文档跨语言层面的历史语言变化,表明变化幅度和方向在不同语言和不同时间会有所不同。

0 人收藏 0 人点赞
#linguistics

让AI来破译失传语言会怎样?

Ars Technica · 2026-07-29 缓存

AI可以通过压缩手动交叉引用的过程来加速破译失传语言,但没有比较锚点和严格的人工审核,它无法产生确定的翻译,因为意义和统计模式并不相同。

0 人收藏 0 人点赞
#linguistics

人类语言中上下文持久性的标度律

arXiv cs.CL · 2026-07-29 缓存

本文提出一个标度律,表明人类语言中词序的上下文影响随距离近似以1/d的速率衰减,该衰减通过大型语言模型测得的困惑度降低来衡量,且在不同语言和语料库中均成立。

0 人收藏 0 人点赞
#linguistics

就《语言理论对信息系统的影响》采访Kalle Lyytinen

arXiv cs.CL · 2026-07-28 缓存

对Kalle Lyytinen的一次采访,他回顾了自己1985年在《MIS Quarterly》上发表的关于信息系统语言理论的文章,并讨论了其对现代AI(包括大语言模型和生成式AI)的影响。

0 人收藏 0 人点赞
#linguistics

@gp_pulipaka: 自然语言中的代数结构! #BigData #Analytics #DataScience #AI #MachineLearning #IoT #IIoT #Python #RSt…

X AI KOLs Timeline · 2026-07-25 缓存

本书探讨了代数模型与深度学习在自然语言习得中的作用,汇集了计算语言学、心理学和数理语言学领域顶尖研究者的观点。

0 人收藏 0 人点赞
#linguistics

我如何知道接下来该说什么?巴伦霍茨的自生语言理论对哈里斯式整合主义的丰富

arXiv cs.CL · 2026-07-10 缓存

本文认为,埃兰·巴伦霍茨(Elan Barenholtz)基于大语言模型行为提出的自生语言理论,通过为前瞻开放性以及语言与非语言符号的连续性提供结构机制,丰富了罗伊·哈里斯(Roy Harris)的整合语言学,为计算方法提供了解释性内容。

0 人收藏 0 人点赞
#linguistics

@stanfordnlp:在大语言模型时代,仍有使用细致语言学的机会!

X AI KOLs Following · 2026-07-09 缓存

斯坦福NLP宣布,一篇题为《大语言模型中的未完成体悖论》的语言学视角NLP论文在ACL 2026上获得最佳论文奖,鼓励对大语言模型进行更细致的语言学评估。

0 人收藏 0 人点赞
#linguistics

缩写疲劳系列引言:我为何对缩写持谨慎态度

Hacker News Top · 2026-07-06 缓存

一篇博客文章,介绍了批评软件工程中过度使用缩写的系列内容,探讨了缩写疲劳的文化和营销原因。

0 人收藏 0 人点赞
#linguistics

AI如何改变语言

Reddit r/artificial · 2026-07-05 缓存

《卫报》文章探讨AI如何改变语言,语言学家和小说家讨论区分人类与机器写作的难度,同时涉及AI在文学中使用的争议。

0 人收藏 0 人点赞
#linguistics

语法负责工作:跨Universal Dependencies的功能性与词汇性依存长度最小化

arXiv cs.CL · 2026-07-03 缓存

本文分析了122种语言,表明依存长度最小化在功能性依存(短且不变)与词汇性依存(较长且可变)上的作用不同,这表明语法为语言处理提供了局部支撑。

0 人收藏 0 人点赞
Next →
← 返回首页

提交意见反馈