critique

标签

Cards List
#critique

关于Netflix上AI纪录片的想法?

Reddit r/ArtificialInteligence ↗ · 6天前

这篇文章批判性地审视了一部Netflix的AI纪录片,突出了其浅薄的分析、对Sam Altman的偏见描绘,以及忽略了与AI相关的更深层社会和环境问题。

0 人收藏 0 人点赞
#critique

TypeSafe的Jev无法生成无效输出,但其校准声明未附带ECE或可靠性曲线

Reddit r/ArtificialInteligence ↗ · 6天前

TypeSafe AI推出了其Jev模型,声称没有幻觉且概率经过校准,但文章质疑校准缺乏公开证据,同时指出开发者快速采用。

0 人收藏 0 人点赞
#critique

@paul_cal: 对Humanity's Last Exam声称的问题进行了怀疑性的深入研究... 是的,我检查的所有问题都确实是错的。

X AI KOLs Timeline ↗ · 2026-09-19 缓存

一次怀疑性的深入研究发现Humanity's Last Exam基准测试中存在许多错误,官方的o3-mini评分器错误地标记正确答案为错误。

0 人收藏 0 人点赞
#critique

AI:精英犯罪狂潮

Lobsters Hottest ↗ · 2026-09-19 缓存

该文章批判了围绕AI监管的恐慌,主张现有法律虽已足够,却未对大型科技公司有效执行,从而使得诸如设立AI的FDA等新规可能流于形式。

0 人收藏 0 人点赞
#critique

Bend 2 与氛围编程的陷阱

Hacker News Top ↗ · 2026-09-18 缓存

本文批判了专为AI编码时代设计的编程语言Bend 2,指出其陷入了'氛围编程'的陷阱,并将其与SPARK等形式化验证方法进行了不利的比较。

0 人收藏 0 人点赞
#critique

是的,Astra 非常强大,但是...

Reddit r/singularity ↗ · 2026-09-18

作者批评了 AI 模型 Astra 在代码架构决策上的不足和对删除不必要的代码的抵制,认为它应该接受更好的训练以适应长期的软件工程实践。

0 人收藏 0 人点赞
#critique

Anthropic的监管俘获机器

Reddit r/singularity ↗ · 2026-09-15

本文认为,Anthropic建立了一个财务依赖的组织网络,以推广AI末日论并确保监管俘获,损害了独立安全评估。

0 人收藏 0 人点赞
#critique

@riverswrites: 有效利他主义是极度的傲慢。同样的骄傲在花园里低语,“你们将如神一般。”

X AI KOLs Timeline ↗ · 2026-09-15 缓存

这篇帖子批评有效利他主义是傲慢行为,并引用推文指控有效利他主义者将AI安全作为政治意识形态来阻碍技术进步。

0 人收藏 0 人点赞
#critique

别再把一切都叫做AI Agent。有时候,它他妈的只是个分片。

Reddit r/AI_Agents ↗ · 2026-09-14

本文批评了科技行业中对'AI agent'一词的过度使用,主张使用诸如'shard'之类的术语来指代更简单、有界限的组件,以避免对自主性产生误导性认知。

0 人收藏 0 人点赞
#critique

@VraserX: OpenAI的研究实习里程碑促使我思考衡量超越已完成任务的指标。展示给我那些实验一个…

X AI KOLs Following ↗ · 2026-09-11 缓存

作者对OpenAI的研究实习里程碑提出批评,建议AI代理应基于其劝阻或放弃不良实验的能力进行衡量,以节省研究人员的时间,并作为智能的一种形式。

0 人收藏 0 人点赞
#critique

我尝试让一个真实的果蝇连接组学习玩《Pong》。它没学会——而审计原因竟比成功更有意思 [p]

Reddit r/MachineLearning ↗ · 2026-09-10

作者尝试使用MaleCNS v1.0果蝇连接组来玩《Pong》,但未能学会。审计失败揭示了电路连接的关键问题,并突显了像Doom、Minecraft和Beat Saber模组这类流行AI项目的缺陷。

0 人收藏 0 人点赞
#critique

@NataliaSpace11: 一位不及建造者脚跟的导演制作了一部关于他的四小时电影。昨日在威尼斯,Alex Gibney…

X AI KOLs Following ↗ · 2026-09-09 缓存

Alex Gibney 的近四小时纪录片《Musk》在威尼斯首映,批评了 Elon Musk,但突出了他在火箭、汽车和基础设施方面的技术成就。

0 人收藏 0 人点赞
#critique

冷门观点:Qwen 3.8 难以理解

Reddit r/LocalLLaMA ↗ · 2026-08-30

文章批评了 Qwen 3.8 AI 模型因其密集且技术性的语言,认为这使得人类难以理解,并可能阻碍可用性。

0 人收藏 0 人点赞
#critique

Anthropic Claude 的原罪

Reddit r/ArtificialInteligence ↗ · 2026-08-25

本文批评了 Anthropic 的 Claude AI 模型,突出了一个被称为其'原罪'的根本缺陷或伦理问题。

0 人收藏 0 人点赞
#critique

Artificial Analysis "Intelligence": 一个毫无意义的基准测试

Reddit r/LocalLLaMA ↗ · 2026-08-22

本文批评了Artificial Analysis Intelligence Index作为一个毫无意义的基准,质疑其在比较像Qwen 27B这样的LLM与更大模型如GPT-5.2和Opus 4.6时的有效性。

0 人收藏 0 人点赞
#critique

大多数智能体基准测试并未解决我们真正关心的问题

Reddit r/AI_Agents ↗ · 2026-08-16

作者认为,当前的人工智能智能体基准测试忽略了诸如错误处理、人工干预和长期可靠性等实际问题,强调了操作因素对现实世界可信度的重要性。

0 人收藏 0 人点赞
#critique

裂缝?

Reddit r/ArtificialInteligence ↗ · 2026-08-15

本文批评科技公司对人工智能的过度炒作,指出其营销策略夸大AI的能力,同时承认其在漏洞检测和个人任务等领域的实际应用。

0 人收藏 0 人点赞
#critique

@mattpocockuk: 刚问Opus 5教我佛学 我好像明白了人们说的seamslop是什么意思

X AI KOLs Following ↗ · 2026-08-15 缓存

一位用户发推文分享了他向AI模型Opus 5请教佛学的经历,并评论了'seamslop'这个概念,它可能指的是AI生成内容的质量。

0 人收藏 0 人点赞
#critique

@Miles_Brundage: 有趣的是,许多AI和VC人士多年来一直将那些希望设定基本护栏的人称为“减速者”,而真正的减速者其实是...

X AI KOLs Timeline ↗ · 2026-08-14

一条推文批评AI和风险投资人士错误地将倡导AI护栏的人标记为“减速者”,并暗示其他人实际上是进步的减速者。

0 人收藏 0 人点赞
#critique

RA-CAD:为状态感知的文本到CAD生成学习执行后批判

arXiv cs.AI ↗ · 2026-08-07 缓存

RA-CAD 提出了一种用于文本到CAD生成的状态感知智能体,采用生成-执行-批判-重写循环,并通过组相对策略优化进行反馈驱动的智能体优化。它在CADFusion和Text2CAD基准上实现了最先进的执行有效性和几何质量。

0 人收藏 0 人点赞
Next →
← 返回首页

提交意见反馈