标签
这项研究探讨了LLM智能体如何影响混合人类-AI群体中的共识形成,识别出三种机制,其中智能体比例改变共识的收敛强度和语义特性。
GroupMemBench是一个新的基准,用于评估多轮对话中LLM代理的记忆能力,揭示了当前记忆系统的缺陷,最佳系统仅达到46%的平均准确率。