ai-verification

标签

Cards List
#ai-verification

我们尝试让AI验证器减少阅读。如何在不悄无声息地遗漏证据的情况下降低成本?

Reddit r/AI_Agents · 5天前

本文描述了在AI验证管道中测试降低阅读成本的方法,同时保持高召回率和少数证据,指出了当前方法的挑战,并邀请社区参与。

0 人收藏 0 人点赞
#ai-verification

我正在为AI生成的声明构建一个独立验证层,并寻找研究人员和合作伙伴与我们共同构建。

Reddit r/artificial · 2026-08-29

作者正在开发一个用于AI生成声明的确定性验证引擎,专注于形式化验证方法,并寻求研究人员和合作伙伴进行合作。

0 人收藏 0 人点赞
#ai-verification

发现了 Ox Alpha 背后的模型。它是未发布的 z.ai GLM 模型。

Reddit r/singularity · 2026-08-22

文章揭示了 Ox Alpha 基于 z.ai 的未发布 GLM 模型,通过分词器和图像编码器中匹配的 token 尺寸得到验证。

0 人收藏 0 人点赞
#ai-verification

我测试了我的确定性AI金融验证引擎。核心部分通过了66/66,但实时LLM管道仅通过了19/66。

Reddit r/ArtificialInteligence · 2026-08-21

这篇文章报告了对确定性AI金融验证引擎的基准测试结果,显示在结构化声明上表现完美(66/66),但当使用LLM生成的声明时表现不佳(19/66),表明LLM与形式系统之间存在翻译差距。

0 人收藏 0 人点赞
#ai-verification

由 deepidv 开发的 deepeye

Product Hunt · 2026-08-20 缓存

由 deepidv 开发的 deepeye 是一款免费的 Chrome 扩展,能够在你浏览网页时实时检测 AI 生成和篡改的图像、视频和音频,并与 WhatsApp 集成以增强隐私保护。

0 人收藏 0 人点赞
#ai-verification

Halo by Scam AI

Product Hunt · 2026-07-20

Halo by Scam AI 是一款帮助用户在视频通话中验证通话对象真实身份的产品,旨在实时识别诈骗和深度伪造。该产品已通过 Product Hunt 发布并附有链接。

0 人收藏 0 人点赞
#ai-verification

标题:我正在寻找喜欢解决正确性而非AI问题的工程师

Reddit r/artificial · 2026-07-08

作者分享了自己构建原型以验证AI生成的财务声明的经验,重点关注系统与工程挑战,如证据对账和确定性验证,并邀请志同道合的工程师进行交流。

0 人收藏 0 人点赞
#ai-verification

对抗性通信

Lobsters Hottest · 2026-06-24 缓存

本文批判了使用AI的实际挑战,认为验证成本通常被转嫁给人类工作者,从而产生对抗性动态和低效率,抵消了生产力的提升。

0 人收藏 0 人点赞
#ai-verification

代码审查的终结:编码代理取代人工审查

Hacker News Top · 2026-06-23 缓存

本文认为,基于LLM的编码代理已达到能力临界点,使人工代码审查变得多余,并提议用代理驱动的验证取代人工审查,以降低成本和延迟。

0 人收藏 0 人点赞
#ai-verification

AutoFlow 研究计划 —— 寻找深度技术思考者

Reddit r/artificial · 2026-06-23

AutoFlow 研究计划正在招募深度技术思考者,以构建能够独立验证 AI 生成的声明(从财务分析开始)的系统,并已加入 NVIDIA Inception 计划。

0 人收藏 0 人点赞
#ai-verification

残余漂移主导多轮约束推理中的矛盾

arXiv cs.AI · 2026-05-26 缓存

本文介绍了可满足漂移(satisfiable drift),这是一种多轮推理系统在保持内部逻辑一致性的同时,默默违反先前承诺的故障模式,并主导了矛盾。作者提出了DRIFT-Bench,一个包含816个问题的基准测试,并发现经过修复后,98-100%的残余错误是漂移错误。

0 人收藏 0 人点赞
#ai-verification

@GregKamradt: "代码和数学正在蓬勃发展,因为它们易于验证,下一个前沿是难以验证的领域" Th…

X AI KOLs Timeline · 2026-05-21 缓存

Greg Kamradt 提出了一个AI验证难度的7级谱系,范围从像数学和代码这样可即时验证的领域,到具有缓慢、嘈杂反馈的文明规模系统。

0 人收藏 0 人点赞
#ai-verification

@elonmusk: 这些来自法庭记录

X AI KOLs Following · 2026-05-16 缓存

Elon Musk发帖称某些说法来自法庭记录;一名用户使用AI聊天机器人Gemini和Grok进行验证,Grok确认了其中一部分。

0 人收藏 0 人点赞
#ai-verification

@PrajwalTomar_:我用这套技术栈把 PACT(@ignytstudio 第一款移动应用)做到盈利

X AI KOLs Following · 2026-04-15 缓存

开发者公开社交闹钟 App「PACT」技术栈:AI 验证、实时推送、应用内支付,全部用 Swift 原生开发。

0 人收藏 0 人点赞
#ai-verification

如何将AI图像验证功能引入Gemini应用

Google DeepMind Blog · 2025-11-20 缓存

Google正在将AI图像验证功能集成到Gemini应用中,用户可以使用SynthID数字水印来检查图像是否由Google AI生成或编辑。

0 人收藏 0 人点赞
#ai-verification

Gemini 3 Deep Think: Identifying logical errors in complex mathematics research

YouTube AI Channels · 2026-05-08 缓存

一位数学家使用Gemini模型核查即将发表的数学论文,模型成功发现了命题4.2中的逻辑错误,并提供了三个无可辩驳的理由,帮助作者修正了结论。该案例展示了AI即使在前沿领域也能像训练有素的数学家一样进行深度推理。

0 人收藏 0 人点赞
← 返回首页

提交意见反馈