user-feedback

标签

Cards List
#user-feedback

我们的评估分数上升了,同时点踩率也上升了,就在同一周

Reddit r/AI_Agents · 2天前

一个团队观察到,在同一周内,自动评估分数和用户点踩率都上升了,这表明客观指标与用户满意度之间存在不匹配。

0 人收藏 0 人点赞
#user-feedback

@jakevin7: 删了一大堆 SKILLS。 SKILLS 真的问题很大,管理起来有很大的问题。 全局的SKILLS真的不适合多装,SKILLS真的不该装,只适合临时读,SKILLS适合分发,但是不适合安装

X AI KOLs Following · 2026-07-21 缓存

用户jakevin7认为SKILLS管理存在问题,不建议全局安装,只适合临时读取和分发。

0 人收藏 0 人点赞
#user-feedback

Thunderbird 桌面设置研究:我们从您的反馈中学到了什么

Hacker News Top · 2026-07-13 缓存

Thunderbird 分享了关于桌面设置的用户研究发现,重点强调了信任、减少杂乱和导航挑战等关键主题,并概述了计划中的改进,例如更清晰的语言和精简的信息架构。

0 人收藏 0 人点赞
#user-feedback

@krishdotdev: 再见 Claude Max,我不会再花一分钱在你身上了。

X AI KOLs Following · 2026-07-10 缓存

一位用户公开宣布停止订阅 Claude Max,表达不满。

0 人收藏 0 人点赞
#user-feedback

ChatGPT 5.6 即将推出,但有人对新版桌面体验感到不适应吗?

Reddit r/artificial · 2026-07-10

一位用户对 ChatGPT 的新桌面 UI 表达了不满,认为它过度简化了聊天界面,同时将 Codex 作为重点,并且缺少了用于组织的文件夹;询问其他人是否有同感。

0 人收藏 0 人点赞
#user-feedback

dot.

Product Hunt · 2026-07-06

dot 是一个面向AI构建产品的反馈层,使开发者能够轻松收集和管理用户反馈。

0 人收藏 0 人点赞
#user-feedback

@cline: https://x.com/cline/status/2072173995366170840

X AI KOLs Following · 2026-07-01 缓存

Artillain 称赞 CLine 团队在他提交反馈和日志后修复了性能问题,并指出他们绕过了 IDE 的内部机制。

0 人收藏 0 人点赞
#user-feedback

@deployengineer: https://x.com/deployengineer/status/2071803742996115597

X AI KOLs Timeline · 2026-06-30 缓存

来自aiDotEngineer大会第一天的笔记,聚焦Kent Dodds关于AI时代产品工程的主题演讲。核心观点:当AI将实现过程商品化时,产品判断力成为最后需要掌握的技能。涵盖Arrow Metaphor、产品工程师与产品经理的区别、验证技巧(如The Mom Test)、Jobs-to-Be-Done Framework、用于功能优先级排序的Kano Model以及用户反馈循环。

0 人收藏 0 人点赞
#user-feedback

你更希望你的AI代理直接报告用户反馈,而不是把每次对话都发送给第三方?

Reddit r/AI_Agents · 2026-06-16

Correl8 AI 是一个 MCP 工具,让 AI 代理能够直接报告有意义的用户反馈,比如错误、困惑和功能请求,帮助团队在不查看所有聊天记录的情况下发现产品信号。

0 人收藏 0 人点赞
#user-feedback

以部署为中心的评估:预测临床LLM系统中的查询级拒绝风险

arXiv cs.AI · 2026-06-12 缓存

本文对集成在电子健康记录中的LLM系统进行了以部署为中心的评估,训练了一个分类器,利用提供者类型和科室等响应前上下文来预测查询级拒绝风险,在4.5个月的反馈中实现了0.719的AUROC。

0 人收藏 0 人点赞
#user-feedback

AcuRite承认新应用功能不足,推迟旧应用5月关闭以修复问题

Ars Technica · 2026-06-11 缓存

用户抱怨功能缺失和可用性问题后,AcuRite推迟了从My AcuRite强制迁移至AcuRite NOW的计划。

0 人收藏 0 人点赞
#user-feedback

有两类开发者在推出AI功能

Reddit r/AI_Agents · 2026-06-09

一位开发者反思了推出AI功能时输出质量不佳的不可避免性,并强调需要主动监控,而非仅依赖用户报告。

0 人收藏 0 人点赞
#user-feedback

MemToolAgent概述:以简单餐厅预订场景为例,代理检索相似记忆、收到无效时间格式的反馈并生成反思以更新其记忆

arXiv cs.AI · 2026-06-09 缓存

本文介绍了MemToolAgent,一个通过集成存储和检索过去经验的记忆系统来增强LLM代理工具使用能力的框架,在多个基准测试上取得了显著改进,且无需对模型进行微调。

0 人收藏 0 人点赞
#user-feedback

Qwen 3.6 27B 过度表现

Reddit r/LocalLLaMA · 2026-05-29

用户分享称 Qwen 3.6 27B 过于主动,擅自进行更改,并询问如何通过调整提示或参数来缓解此问题。

0 人收藏 0 人点赞
#user-feedback

@heyibinance: 自定义你的币安首页,你的币安你定义,期待您的反馈。

X AI KOLs Timeline · 2026-05-15 缓存

币安为其应用引入了自定义标签,允许用户个性化设置底部导航栏。

0 人收藏 0 人点赞
#user-feedback

@Taniyatweets_: 亲爱的 Anthropic,请别再像对待内测用户那样对待 Claude Code 用户了。付费计划下才发几条提示就触发限制……

X AI KOLs Following · 2026-05-12 缓存

一位用户在社交媒体上抱怨,在 Claude Code 的付费计划下迅速触达使用限额,并批评 Anthropic 对待用户的方式。

0 人收藏 0 人点赞
#user-feedback

@_catwu:我们希望听到您对 Claude Code 云端版在桌面端(云选项)、iOS 应用和 Android 应用上的反馈,请……

X AI KOLs Following · 2026-05-11 缓存

Anthropic 正通过专属办公时间,收集用户对 Claude Code 云端版在桌面、iOS 和 Android 平台上的反馈。

0 人收藏 0 人点赞
#user-feedback

@FinanceYF5: 2/ 回答更简洁 这次升级的一个重点,是让回答变得更简洁。 OpenAI 称,这是根据用户反馈重点改进的方向。

X AI KOLs Following · 2026-05-10 缓存

OpenAI announces an update focused on making model responses more concise, based on user feedback.

0 人收藏 0 人点赞
#user-feedback

@seclink: 阶跃星辰 根本不是 2C 的产品 ,又是搞手机 又是搞车机 C端用户都没试用满意呢,就推上市了,也是真着急... 感觉还是小米 mimo 最稳, 实测试用下来,AI写代码的体验和claude 模型 有的一拼,还比 claude 快。 甚至…

X AI KOLs Following · 2026-05-10 缓存

网友质疑阶跃星辰过早推进商业化,同时称赞小米 Mimo 的 AI 写代码体验优于或持平 Claude,速度更快。

0 人收藏 0 人点赞
#user-feedback

WildFeedback: 通过原位用户交互和反馈对齐大语言模型

arXiv cs.CL · 2026-04-20 缓存

WildFeedback是一个新颖的框架,它利用真实LLM对话中的原位用户反馈来自动创建偏好数据集,用于将语言模型与人类偏好对齐,解决了传统基于标注的对齐方法中的可扩展性和偏差问题。

0 人收藏 0 人点赞
← 返回首页

提交意见反馈