personas

标签

Cards List
#personas

语音代理的红队测试:音频作为攻击面、多轮压力与闭环验证

Reddit r/AI_Agents · 5天前

深入探讨语音代理的红队测试,强调音频作为攻击面、多轮测试的必要性,以及用于上线前安全的实用基线方法论(1,200通通话)。

0 人收藏 0 人点赞
#personas

我想看看一个小型DIY审查团队(bug猎手、守护者、清扫者)能有多接近成熟的审查产品。在一个包含50个真实PR的公开基准测试中,它击败了Cursor Bugbot和CodeRabbit,而诀窍并不在于角色本身。

Reddit r/AI_Agents · 6天前

一个使用角色(bug猎手、守护者、清扫者)的小型DIY审查团队在50个PR的基准测试中取得了比Cursor Bugbot和CodeRabbit更高的性能,证明了基于角色的审查策略的有效性。

0 人收藏 0 人点赞
#personas

人格如何影响智能体在‘分或偷’游戏中的行为

arXiv cs.CL · 2026-07-08 缓存

本文考察了人格提示如何影响大语言模型智能体在重复‘分或偷’游戏中的策略行为,发现双方均选择‘分’的结果占主导,并且模型选择与人格类型显著影响合作与剥削行为。

0 人收藏 0 人点赞
#personas

@WWTLitee: 来了,我的呕心沥血之作又来了! 260 个独立人格!多专家会议 Skill meeting-room 他来了! 把你的每一个问题都变成多角度的专业分析决策! 每个人格都有自己的专业边界、说话方式、知识库和独立记忆 你提出一个问题后,它会自…

X AI KOLs Timeline · 2026-06-16 缓存

一个名为meeting-room的Codex Skill,提供了260个独立人格的多专家会议功能,能将问题转化为多角度专业分析决策。

0 人收藏 0 人点赞
#personas

我在自己的多智能体编码设置上进行了13次对照实验。角色设定毫无作用;一个协调技巧几乎解决了所有问题。

Reddit r/AI_Agents · 2026-05-29

一位AI研究人员在多智能体编码系统上进行了13次对照实验,发现依赖排序的协调显著提高了成功率,而角色背景故事没有带来可衡量的益处。

0 人收藏 0 人点赞
#personas

NVIDIA的Nemotron Personas嵌入向量

Reddit r/LocalLLaMA · 2026-05-23

使用Qwen 0.6B为Nemotron-Personas数据集预计算的嵌入向量,通过网页演示实现对合成角色进行语义搜索和聚类。

0 人收藏 0 人点赞
#personas

使用生成式AI创建和评估用户画像:81篇文章的范围综述

arXiv cs.CL · 2026-04-20 缓存

本范围综述分析了81篇(2022-2025年)关于使用生成式AI创建和评估用户画像的文章,指出了其在可重复性方面的优势,但同时也揭示了关键问题:45%的研究缺乏评估,86%过度依赖GPT模型,以及存在同一模型既生成又评估画像的循环风险。

0 人收藏 0 人点赞
← 返回首页

提交意见反馈