ambiguity

标签

Cards List
#ambiguity

多模态语言模型中的校准模糊性:人类倾向于文化引用,而模型描述画面

arXiv cs.CL · 3天前 缓存

本文探讨校准模糊性作为人类交流与多模态语言模型中的生成资源,通过Dixit游戏展示AI表现出模糊性崩溃且缺乏文化引用,与人类形成对比。

0 人收藏 0 人点赞
#ambiguity

基准评估:评估小语言模型的自动化安全基准

arXiv cs.AI · 2026-08-19 缓存

本文评估了小语言模型的自动化安全基准,发现判断中的高度模糊性损害了可靠性,并揭示了能力-安全性混淆。

0 人收藏 0 人点赞
#ambiguity

语言模型受困于歧义诅咒

arXiv cs.CL · 2026-08-18 缓存

本文发现语言模型中存在歧义诅咒:下一个词分布越模糊,学习难度越大,这源于架构和学习方面的原因,并通过合成数据和真实数据进行了验证。

0 人收藏 0 人点赞
#ambiguity

选择大语言模型擅长与不擅长的任务

Reddit r/AI_Agents · 2026-08-16

该文章强调,大语言模型在处理模糊判断任务方面表现卓越,但在执行一致性计算时表现平平,因此主张在多智能体系统中实现任务专门化。

0 人收藏 0 人点赞
#ambiguity

C89 中的一个永远不会被修复的歧义

Lobsters Hottest · 2026-08-10 缓存

一篇博客文章探讨了 C89 标准中关于隐式函数声明的歧义,GCC 和 Clang 对此解释不一,导致某些代码产生不同的编译结果。

0 人收藏 0 人点赞
#ambiguity

更少澄清,更好代码:编程助手中跨会话个性化歧义适应的基准测试

arXiv cs.AI · 2026-07-31 缓存

本文介绍了CAPA,一个用于编程助手中跨会话个性化歧义适应的基准测试,刻画了六种歧义机制,并在600个编码会话中评估了12个LLM,包括有无用户历史的情况。

0 人收藏 0 人点赞
#ambiguity

解析C语言中类型推断声明之险

Lobsters Hottest · 2026-07-25 缓存

这篇博文探讨了C23中涉及`auto`作为类型推断说明符或存储类说明符的解析歧义,展示了当`x`是typedef时,GCC和Clang在解析如`auto x = 67;`这样的声明上的分歧,以及属性如何使情况复杂化。

0 人收藏 0 人点赞
#ambiguity

每个人都在“构建AI代理”——但我们的意思相同吗?

Reddit r/AI_Agents · 2026-07-19

关于“AI代理”不同定义的讨论,以及每个人在使用该术语时是否意指相同的事物。

0 人收藏 0 人点赞
#ambiguity

人们认为AI代理已经准备好、但实际上并非如此的任务是什么?

Reddit r/artificial · 2026-07-04

讨论那些人们认为AI代理已经准备好、但实际上并未准备好的任务,重点突出了解读模棱两可的人类输入(例如恼怒但未明确说明的消息)的挑战。

0 人收藏 0 人点赞
#ambiguity

我的AI代理在遇到未曾预料的问题之前工作得很好。是继续添加规则,还是重新思考整体方法?

Reddit r/AI_Agents · 2026-06-12

一位开发者描述了构建多代理AI助手的挑战:这些助手无法优雅地处理意外情况,依赖显式规则导致打地鼠式问题,而非实现关于模糊性的自主推理。

0 人收藏 0 人点赞
#ambiguity

使用探针目标归因定位大型语言模型中的提示模糊性

arXiv cs.CL · 2026-06-05 缓存

介绍了PRIG,一种梯度归因方法,通过训练线性探针区分清晰提示和模糊提示,并将探针得分归因于残差流中的标记表示,从而定位大型语言模型中的提示模糊性,在合成和人工编写的基准测试上取得了强劲性能。

0 人收藏 0 人点赞
← 返回首页

提交意见反馈