experiments

标签

Cards List
#experiments

这份路线图或许能帮助我们决定是否部署太阳地球工程

MIT Technology Review ↗ · 2026-09-10 缓存

一个名为Reflective的非营利组织发布了一份路线图,概述了为就部署太阳地球工程——特别是平流层气溶胶注入——做出明智决策所需的实验、研究和基础设施。

0 人收藏 0 人点赞
#experiments

三个人告诉我,我的LLM简历筛选研究测量了错误的东西。他们是对的。以下是数据。

Reddit r/artificial ↗ · 2026-08-20

在面临方法论批评后,作者对LLM简历筛选研究进行了广泛的实验,揭示了初始偏差测量很大程度上源于噪声,并且提示设计、包装器选择等因素显著影响评分。

0 人收藏 0 人点赞
#experiments

@yoheinakajima: 刚刚更新了我的公开构建日志,包含过去一个月的最新项目,详见 http://yohei.me - 合成玩家研究…

X AI KOLs Timeline ↗ · 2026-08-14 缓存

Yohei Nakajima 更新了他的公开构建日志,包含最近的项目,如合成玩家研究、移动代理中继,以及用于长期运行代理的事件源响应式图运行时。

0 人收藏 0 人点赞
#experiments

自动化并扩展AI代理的行为科学研究

arXiv cs.AI ↗ · 2026-08-12 缓存

本文介绍了AEROBAT,这是首个多代理系统,用于自动化AI代理的行为科学研究,包括生成假设、设计和执行受控实验以及撰写报告。作者在12个目标行为上展示了其有效性,为26个假设找到了统计证据。

0 人收藏 0 人点赞
#experiments

物理学家追踪并捕获难以捉摸的中微子

Hacker News Top ↗ · 2026-06-25 缓存

《Quanta Magazine》回顾了中微子探测的70年历史,从泡利的假说到像超级神冈探测器(Super-Kamiokande)和冰立方中微子天文台(IceCube)这样的大型实验,这些实验解决了太阳中微子问题并揭示了中微子振荡。

0 人收藏 0 人点赞
#experiments

@omarsar0: 关于自我改进代理的非常好的建议。(收藏)这是我正在自己的实验中观察到的现象,关于编码...

X AI KOLs Following ↗ · 2026-06-01 缓存

推文讨论了关于自我改进代理的建议,并分享了在长期任务中使用编码代理的实验观察,指出更强的模型并不总是能产生更好的代理。

0 人收藏 0 人点赞
#experiments

我在自己的多智能体编码设置上进行了13次对照实验。角色设定毫无作用;一个协调技巧几乎解决了所有问题。

Reddit r/AI_Agents ↗ · 2026-05-29

一位AI研究人员在多智能体编码系统上进行了13次对照实验,发现依赖排序的协调显著提高了成功率,而角色背景故事没有带来可衡量的益处。

0 人收藏 0 人点赞
#experiments

@reach_vb: codex 正在撰写一篇关于其完全自主训练模型实验的博客文章

X AI KOLs Following ↗ · 2026-05-22

Codex 正在撰写一篇关于其自主训练模型实验的博客文章。

0 人收藏 0 人点赞
← 返回首页

提交意见反馈