Reddit

来自 Reddit 的文章

Cards List

法院开始对法律文件中隐藏的提示进行制裁。2026年的研究指出,隐藏的提示是弱版本,而“忽略文档中的指令”对强版本无效。

Reddit r/ArtificialInteligence ↗ · 4小时前 缓存

一家 Connecticut 法院因一名律师在法律文件中使用隐藏的 AI 提示而予以制裁,这标志着 U.S. 首次此类裁决。文章讨论了通过隐藏文本进行 AI 操纵的相关研究及其对法律实践的影响。

0 人收藏 0 人点赞

Xiaomi MiMo 2.6 Flash 与 GLM 5.3 Flash 对比

Reddit r/LocalLLaMA ↗ · 4小时前

用户对比 Xiaomi MiMo 2.6 Flash 和 GLM 5.3 Flash 在编码任务中的表现,如后端开发和调试,对 GLM 的过度思考表示不满,并寻求 MiMo 性能的真实反馈。

0 人收藏 0 人点赞

为Qwen模型添加对‘wait’、‘maybe’和‘perhaps’的对数惩罚可提升其准确性

Reddit r/LocalLLaMA ↗ · 4小时前

一项实验使用llama.cpp对Qwen模型中的特定过度思考令牌应用对数惩罚,从而在各种量化下提高了MATH-500基准的准确性,带来了显著的准确性提升和推理令牌的减少。

0 人收藏 0 人点赞

机器人演示很简单。可靠性才是难题 — Jason Ma,Dyna Robotics [26:41]

Reddit r/singularity ↗ · 4小时前 缓存

Dyna Robotics 通过结合大规模数据金字塔、专用奖励模型和迭代部署,致力于解决机器人领域的可靠性差距问题,以实现接近完美的任务表现,迈向商业级自主能力。

0 人收藏 0 人点赞

你们是怎么给模型提供网页浏览功能的?

Reddit r/LocalLLaMA ↗ · 5小时前

用户正在寻求可靠的方法,为他们的AI模型(特别是使用Deepseek Harness)提供网页浏览和搜索功能,指出了付费API的问题以及像SearXNG这样的不可靠免费选项。

0 人收藏 0 人点赞

我们开始记录失败,而非仅记录成功的代理运行

Reddit r/AI_Agents ↗ · 5小时前

作者分享,在AI代理运行中记录失败比专注于成功或基准测试更有效,有助于系统改进,并邀请讨论评估实践。

0 人收藏 0 人点赞

如果变革性AI推高利率而非降低利率?

Reddit r/singularity ↗ · 5小时前

文章认为,变革性AI可能通过高回报投资增加资本需求,导致利率上升,可能挤出传统项目并在建设阶段引发通胀。

0 人收藏 0 人点赞

我们发布了VeriLoop E2(27B,Apache-2.0)。其背后的设计问题是:LLM是否应该被允许提交自己的状态?

Reddit r/LocalLLaMA ↗ · 6小时前

VeriLoop E2 的发布,这是一个基于 Qwen3.8-27B 进行后训练的 27B LLM,采用了 VeriLoop-Governed Recurrence (VGR) 来管理状态转换并生成训练信号。

0 人收藏 0 人点赞

模型驱动 → 数据驱动 → 决策驱动的AI:瓶颈是否上移?

Reddit r/ArtificialInteligence ↗ · 6小时前

文章讨论了一个从模型驱动到数据驱动再到决策驱动的AI发展框架,质疑随着模型和数据在后训练环境中变得丰富,瓶颈是否转向决策制定。

0 人收藏 0 人点赞

斯坦福大学的一项人工智能医学教育研究发现,当医生使用的AI辅助被关闭后,他们的工作表现明显下降,甚至比他们最初使用AI之前还要差。所有持证专业都应该关注此事。

Reddit r/artificial ↗ · 6小时前

斯坦福大学的一项研究发现,在AI辅助关闭后,医生的工作表现明显变差,引发了对AI增强职业中技能退化问题的担忧。

0 人收藏 0 人点赞

工具投毒 WebMCP;Jev 能否应对?

Reddit r/AI_Agents ↗ · 6小时前

作者为 WebMCP 构建了一个黑客马拉松演示,强调了 AI 代理中工具投毒的担忧,其中信任基于描述,建议 Jev 可以通过验证描述与执行之间的一致性来提供帮助。

0 人收藏 0 人点赞

中国AI实验室有何不同?

Reddit r/artificial ↗ · 6小时前

这篇文章质疑为什么中国AI实验室在投资较少的情况下取得了比美国实验室更好的结果,并考虑了效率、训练后技术和数据获取等因素。

0 人收藏 0 人点赞

为什么关于AI的讨论总是充满末日论和失业,而不是它可能带来的黄金时代?

Reddit r/ArtificialInteligence ↗ · 6小时前

本文质疑了围绕AI的主流负面叙事,建议AI公司应更多关注人道主义项目,并探讨了此类努力缺乏的潜在原因。

0 人收藏 0 人点赞

在过去一周,过去能正常工作的网站现在开始封禁Muse。

Reddit r/AI_Agents ↗ · 6小时前

像cars.com这样的网站开始封禁Muse,这是一个用于检查汽车购物网站的AI工具,引发了对这类反机器人措施扩散的担忧。

0 人收藏 0 人点赞

Dario Amodei 在 SNL 上向观众保证人类免受 AI 威胁

Reddit r/ArtificialInteligence ↗ · 6小时前

Anthropic 的联合创始人 Dario Amodei 出现在 SNL,以让观众对人工智能安全和人类未来感到放心。

0 人收藏 0 人点赞

如果开源AI更少关注巨型模型,而更多注重可重用能力会怎样?

Reddit r/LocalLLaMA ↗ · 6小时前

文章建议开源AI应重点开发可重用的领域特定能力,而非构建大型通用模型,从而让开发者能将它们组合成本地工具,类似于Linux通过共享组件发展的模式。

0 人收藏 0 人点赞

我为智能体找到的最经济可靠的方法是让其输出变得枯燥且固定

Reddit r/AI_Agents ↗ · 7小时前

作者发现,将AI智能体的输出限制为固定、枯燥的格式,比使用更好的提示或模型更能提高可靠性,为开发者提供了一种经济高效的技术。

0 人收藏 0 人点赞

Anthropic部分早期员工瞄准偏远土地,以备AI失控时避难。

Reddit r/ArtificialInteligence ↗ · 7小时前 缓存

Anthropic员工正在考虑购买偏远土地,以预防潜在的AI灾难,凸显了AI安全社区对存在风险的担忧。

0 人收藏 0 人点赞

如果AGI或ASI真的到来,你认为哪些工作会幸存下来?

Reddit r/artificial ↗ · 7小时前

这篇文章讨论了AGI或ASI到来后哪些工作会幸存,重点关注涉及权威、人类偏好和法律责任的角色。

0 人收藏 0 人点赞

可能出什么问题

Reddit r/ArtificialInteligence ↗ · 7小时前

本文重点讨论了AI系统产生幻觉,生成虚假材料安全数据表(MSDS)并随后为这些错误编造解释的风险。

0 人收藏 0 人点赞
← Previous
Next →
← 返回首页

提交意见反馈