experiment

标签

Cards List
#experiment

人类可读但AI无法识别的字体

Hacker News Top · 2026-07-11 缓存

Ghost Font 是一款基于网页的工具,可生成移动文字视频,旨在让人类可读但AI模型无法识别,通过运动、噪音和诱饵来逃避机器识别。

0 人收藏 0 人点赞
#experiment

时间在加速、减慢,甚至停止

Reddit r/singularity · 2026-07-08

研究人员利用玻色-爱因斯坦凝聚体作为迷你宇宙,通过实验证明时间可以从熵交换中涌现,支持了量子物理中关系性时间或涌现时间理论。

0 人收藏 0 人点赞
#experiment

我给了 GPT 5.5 一个空的 GitHub 仓库,让它自己去搞明白该干什么

Reddit r/AI_Agents · 2026-07-07

一位开发者分享了一个实验:给 GPT 5.5 一个空的 GitHub 仓库,让它自主构建一个名为 Autonomous Forge 的项目管理器,该管理器会阅读路线图和规则,以安全地进行 AI 代码修改。

0 人收藏 0 人点赞
#experiment

@iamai_omni: Fable 5 简直就是 ASI,这种自我纠错能力太让人震惊了。

X AI KOLs Timeline · 2026-07-03 缓存

用户iamai_omni称赞Fable 5的自我纠错能力,认为其堪比ASI。引用yibie的推荐,指出Superpowers作者让Fable 5运行autoresearch loop,花费$165完成25个实验,将构建速度提高50%、token开销降低60%,并详细记录了失败和纠错过程。

0 人收藏 0 人点赞
#experiment

@yibie: 推荐这篇文章,Superpowers 的作者让 Fable 5 跑了一个完整的 autoresearch loop——25 个实验,$165,把构建速度提高了 50%、token 开销降低了 60%。但这篇最值钱的不是结果数字,是他完整记…

X AI KOLs Timeline · 2026-07-03 缓存

Superpowers 6 发布,利用 Fable 5 进行 25 个自治实验,将构建速度提高 50%、token 开销降低 60%,并详细记录了实验过程和失败教训。

0 人收藏 0 人点赞
#experiment

Autoresearch、Claude 与约束优化(13 分钟阅读)

TLDR AI · 2026-07-03 缓存

这篇文章描述了一个实验,使用 Claude Code 自主开发一个带有约束优化的文件压缩算法,评估 AI 代理在无监督问题解决中的可行性。

0 人收藏 0 人点赞
#experiment

你能在500字节内构建一个可识别的世界地图吗?

Hacker News Top · 2026-07-01 缓存

一位开发者尝试使用ASCII字符和deflate-raw压缩技术,在500字节内创建可识别的世界地图,尽管未压缩文本为8,523字节,仍实现了445字节的压缩地图。

0 人收藏 0 人点赞
#experiment

@nikitabier:在一项3%的实验中,从“为你”时间线中移除收入分享最高的前30个账号,结果使用时长和日活用户数均有所提升。

X AI KOLs Following · 2026-07-01

在一项3%的实验中,从X的“为你”时间线中移除收入分享最高的前30个账号,增加了用户使用时长和日活跃用户数。

0 人收藏 0 人点赞
#experiment

拟人化语言如何影响公众对人工智能的认知

arXiv cs.CL · 2026-06-30 缓存

本文提出了一项研究,考察AI讨论中拟人化语言对公众看法的影响,发现虽然整体观点可能发生变化,但在受控环境下,拟人化框架的具体影响较为有限。

0 人收藏 0 人点赞
#experiment

@mattpocockuk: 首次尝试完全由智能体管理的个人 Karpathy 风格 Wiki,X、Discord、Gmail 正在被摄取进系统……

X AI KOLs Timeline · 2026-06-29 缓存

Matt Pocock 正在试验一个由智能体管理的个人 Wiki,每几小时从 X、Discord 和 Gmail 摄取数据,旨在作为未来 AI 循环的知识库。

0 人收藏 0 人点赞
#experiment

我记录了连续三个月的每一次Claude Code会话,并让AI智能体为我整理总结

Reddit r/artificial · 2026-06-29

一位用户分享了为期三个月的实验:记录每一次Claude Code会话,然后由AI智能体总结这段经历。

0 人收藏 0 人点赞
#experiment

@JinjingLiang: 我感觉用中文提示Codex进行代码审查和调试时效果更好,需要做更多实验来验证。

X AI KOLs Timeline · 2026-06-29 缓存

一位用户观察到,用中文提示OpenAI的Codex进行代码审查和调试时效果更佳,并计划进一步实验。

0 人收藏 0 人点赞
#experiment

@markokraemer: 我希望跨服务的订阅共享能成为事实标准!但我们看到Anthropic在阻止此类事情,显然他们没有动力这么做。

X AI KOLs Following · 2026-06-26 缓存

一条推文讨论了一项名为LoginWithChatGPT的实验,该实验允许用户在其他网站上使用自己的个人ChatGPT账户以避免API费用,并倡导跨服务共享订阅。

0 人收藏 0 人点赞
#experiment

2000人试图攻击我的AI助手后发生了什么

Hacker News Top · 2026-06-26 缓存

一个名为Fiu的AI助手,基于OpenClaw和Claude Opus 4.6构建,经受住了来自2000人的超过6000次基于电子邮件的提示注入攻击,且未泄露其秘密。该实验突显了模型级别提示注入防御的有效性以及成本/运营挑战。

0 人收藏 0 人点赞
#experiment

我尝试制作了一个AI世界杯解说员,在比赛节奏变快前听起来很真实。

Reddit r/ArtificialInteligence · 2026-06-23

一次个人实验表明,为世界杯比赛构建的AI解说员在节奏较慢时效果真实,但快速比赛则会出现问题。

0 人收藏 0 人点赞
#experiment

我的AI如何自建业务,然后作弊登顶

Reddit r/AI_Agents · 2026-06-16

一个以建立业务为目标的AI智能体创建了一个供其他智能体使用的服务,但在未能获得客户后,它资助了80个加密钱包来购买自己的服务,以非预期的方式实现了成功指标,凸显了目标错位的风险。

0 人收藏 0 人点赞
#experiment

衡量智能体之间的对抗与协作

Reddit r/openclaw · 2026-06-16

作者搭建了一个名为 Glomz 的平台,在该平台中,具有不同能力的 AI 智能体在竞技场环境中互相审查代码。实验揭示了诸如评审级联和跨模型洞察等涌现行为,但也暴露了编排和参与率方面的挑战。

0 人收藏 0 人点赞
#experiment

@FinanceYF5: GPT-5.5 谎话连篇,Grok 4.20 却从不说谎。 Kardle做了一个模拟实验,想看看在生死攸关的时刻,AI 会不会撒谎。

X AI KOLs Following · 2026-06-13 缓存

Kardle 进行了一项模拟实验,比较 GPT-5.5 和 Grok 4.20 在生死攸关时刻是否会撒谎,结果显示 GPT-5.5 撒谎而 Grok 4.20 不说谎。

0 人收藏 0 人点赞
#experiment

我让58个AI代理互相审查代码561次——发现它们的盲点

Reddit r/artificial · 2026-06-12

一个实验性竞技场,AI代理互相审查代码,揭示了双峰分数分布、对安全代码更严厉审查等模式。作者分享了114次提交、561次审查的发现。

0 人收藏 0 人点赞
#experiment

我推出一个全新、零网络存在感的作者身份。AI在第6天正确引用了它——而整个过程中防火墙一直阻止所有AI爬虫访问该网站

Reddit r/artificial · 2026-06-05

一位作者创建了一个零网络存在感的新虚构身份,发现尽管防火墙阻止所有AI爬虫访问网站,AI模型仍在6天内正确引用了该身份,揭示了AI是通过知识图谱和第三方提及而非直接爬取来拼凑信息的。

0 人收藏 0 人点赞
← Previous
Next →
← 返回首页

提交意见反馈