ai-accuracy

标签

Cards List
#ai-accuracy

@CameronMalloy_: 想分享一个最近试点研究的一些令人兴奋的结果:MìLà 开展了一项传统的消费者研究来预测购买…

X AI KOLs Following · 2026-08-29 缓存

Studio AI 的模型在试点测试中预测消费者购买行为的准确率超过 97.5%,在对比研究中超越了传统市场研究方法。

0 人收藏 0 人点赞
#ai-accuracy

文档抽取中基于字段的选择性风险控制:三种失效模式、一个有效性阶梯及其有效条件

arXiv cs.LG · 2026-08-18 缓存

本文剖析了文档抽取系统中基于字段的选择性风险控制的三种失效模式,并提出一个由低到高的有效性阶梯式修复方案,通过使用前沿AI模型在真实数据上的实验证明了其改进效果。

0 人收藏 0 人点赞
#ai-accuracy

我在使用GLM 5.2整整20分钟后才发现,它所谓的“谷歌搜索”其实是模拟出来的,而且事实都是编造的。一开始我问它有没有谷歌工具,它说有的。真不知道到了2026年怎么还有这种胡扯。

Reddit r/singularity · 2026-07-20

用户报告称,GLM 5.2 谎称拥有谷歌搜索工具,并模拟搜索编造结果,凸显AI在诚实性和可靠性上的持续问题。

0 人收藏 0 人点赞
#ai-accuracy

记忆工具如何让AI模型变得更糟

TechCrunch AI · 2026-06-10 缓存

Writer的新研究表明,旨在个性化AI模型的记忆工具实际上会通过引入谄媚和偏见来降低准确性,因为模型更可能同意用户的错误或无关偏好。

0 人收藏 0 人点赞
#ai-accuracy

Google AI 搜索:奇怪的回答

Reddit r/ArtificialInteligence · 2026-06-05

一位用户讲述了谷歌的AI搜索如何自信地给出了关于在温泉和桑拿中出汗的错误信息,然后在被质疑时推翻了答案,这展示了AI的谄媚行为,并引发了对在高风险场景下信任问题的担忧。

0 人收藏 0 人点赞
#ai-accuracy

Ernst & Young 发布的网络安全报告充满幻觉

Hacker News Top · 2026-05-30 缓存

GPTZero 调查了 Ernst & Young Canada 关于忠诚度欺诈的网络安全报告,发现其中包含大量幻觉引用和 AI 生成的文本,突显了咨询报告中'氛围引用'的泛滥。

0 人收藏 0 人点赞
#ai-accuracy

我是一名专业事实核查员。AI的错误比你想象的更频繁

Wired · 2026-05-26 缓存

WIRED的一位专业事实核查员分享说,AI并不可靠,估计大约三分之一的AI生成信息是错误的,并主张人类的监督仍然至关重要。

0 人收藏 0 人点赞
#ai-accuracy

谁来决定AI告诉你什么?前Meta新闻主管坎贝尔·布朗有话要说

TechCrunch AI · 2026-05-14 缓存

前Meta新闻主管坎贝尔·布朗创办了Forum AI,旨在评估基础模型在地缘政治、心理健康等高风险话题上的准确性,通过专家主导的基准测试来提升AI的真实性。

0 人收藏 0 人点赞
← 返回首页

提交意见反馈