behavioral-consistency

标签

Cards List
#behavioral-consistency

衡量语言模型智能体的跨任务行为一致性

arXiv cs.AI · 2026-08-17 缓存

介绍了行为一致性度量(BCM),用于量化语言模型智能体跨任务的行为一致性,证明其与成功率不同,并可通过执行轨迹进行测量。

0 人收藏 0 人点赞
#behavioral-consistency

通过事实-启发-情感状态强制机制衡量与提升大语言模型行为一致性

arXiv cs.CL · 2026-07-29 缓存

本文介绍认知核心模型(CKM),一种提示级别的状态强制层,强制大语言模型在决策前分离事实、启发式与情感。在26个LLM上的实验表明,CKM在不改变模型权重的情况下减少了输出变异性和决策翻转。

0 人收藏 0 人点赞
#behavioral-consistency

一些大型语言模型表现出一致的风险态度

arXiv cs.AI · 2026-07-21 缓存

本文介绍了一个框架,用于测试大型语言模型是否在不同领域表现出一致的风险态度。研究发现,大多数大型语言模型在风险态度上表现出任务内和跨领域的稳定性,并趋近于比人类更窄的分布。

0 人收藏 0 人点赞
#behavioral-consistency

用户侧记忆中的基底不对称性:一个诊断框架

arXiv cs.CL · 2026-06-11 缓存

本文介绍了一个针对LLMs用户侧记忆的诊断框架,表明个性化因素分解为行为一致性、事实存在和事实缺失。它证明了没有任何单一方法(例如LoRA vs RAG)在所有三个轴上均表现出色,并强调了参数化用户记忆的对齐税。

0 人收藏 0 人点赞
#behavioral-consistency

LLM代理的一致性如何?在多步骤工具调用流程中测量行为可重现性

arXiv cs.CL · 2026-05-29 缓存

本文系统性地测量了LLM代理在多步骤工具调用流程中的行为可重现性,涉及1140条轨迹,发现了'结构一致性,参数变异性'的模式:代理可靠地按相同顺序选择工具,但参数有所不同,并且结构一致性能够预测任务的成功。

0 人收藏 0 人点赞
← 返回首页

提交意见反馈