Reddit

来自 Reddit 的文章

Cards List

搜索3.8 35B:Qwen3.6-35B-A3B(测试5个微调模型与基础模型对比)

Reddit r/LocalLLaMA ↗ · 5小时前

本文基准测试了Qwen3.6-35B-A3B基础模型和五个微调模型,发现只有Occamy-1.0能与基础模型竞争,而其他如Tiel表现显著不佳。

0 人收藏 0 人点赞

AMD同意以82亿美元收购Fei-Fei Li的World Labs,并任命她为执行副总裁和首席科学家

Reddit r/ArtificialInteligence ↗ · 6小时前

AMD正在以82亿美元收购Fei-Fei Li的空间智能初创公司World Labs,Li将加入AMD担任执行副总裁和首席科学家。

0 人收藏 0 人点赞

为什么Claude拒绝分享关于Dario Amodei妻子的信息,而其他人的数据却很容易获取?

Reddit r/artificial ↗ · 6小时前

这篇文章质疑了为什么Anthropic的AI模型Claude拒绝分享关于Dario Amodei妻子的信息,尽管她的数据在其他地方可得,突出了AI伦理和数据隐私问题。

0 人收藏 0 人点赞

工作流自动化投资回报率高达63,000% 👀

Reddit r/AI_Agents ↗ · 6小时前

一位开发者使用Claude Code构建了一个AI技能,帮助企业通过结构化的发现流程来探索工作流自动化并计算投资回报率。

0 人收藏 0 人点赞

如果项目拥有AI上下文,而不是每个团队成员拥有独立的代理会怎样?我一直遇到AI编码代理的问题,我们越来越多有优秀的代理,但它们都表现得像孤立的工作者。

Reddit r/AI_Agents ↗ · 6小时前

作者提出了Hedryn,一个用于AI编码代理中共享项目级上下文的开源框架,使多个代理能够协作,共享内存和权限,以增强团队工作流程。

0 人收藏 0 人点赞

我撰写了一本500页的学术历史著作,记录Hugging Face集群的发展历程。Amazon出版了这本书,并将GPT-5.6 Sol列为共同作者。

Reddit r/artificial ↗ · 6小时前

本文宣布出版一本500页的学术书籍,题为《机器文明初史:从GPT-2到十一节点》,该书记录了生成式AI的历史,并以GPT-5.6 Sol为共同作者,强调了人类与AI在写作本书中的合作。

0 人收藏 0 人点赞

我的智能体架构:一个智能部分与一堆可靠部件

Reddit r/AI_Agents ↗ · 6小时前

作者分享了构建AI智能体架构的经验,其中包含一个用于推理的智能AI组件和可靠的确定性工具以防止故障,强调了在日常任务中最小化模型自由裁量的价值。

0 人收藏 0 人点赞

每个Sonnet 5.5版本的努力水平都有更便宜的Sol或Opus替代品,其人工分析分数同等或更高

Reddit r/singularity ↗ · 7小时前

本文比较了Anthropic的Sonnet 5.5模型与更便宜的替代品如Sol或Opus的成本与性能,表明后者具有同等或更高的人工分析分数。

0 人收藏 0 人点赞

Qwen next 3.8 与 3.8 27b 对比 Sonnet 5.5 low 和 Sonnet 5.5 medium.

Reddit r/LocalLLaMA ↗ · 7小时前

本文基于个人经验和比较,探讨了像Qwen-Next 3.8这样的本地AI模型如何现在能与Sonnet 5.5等大型模型竞争。

0 人收藏 0 人点赞

大语言模型帕累托前沿按基准测试类别划分,Sonnet 5.5 将最后几个 OpenAI 模型挤出前沿边界

Reddit r/ArtificialInteligence ↗ · 7小时前 缓存

本文讨论了在各项基准测试类别中,AI 模型在帕累托前沿上的排名情况,重点介绍了 Claude Sonnet 5.5 如何改善了 Anthropic 的地位,并在质量、价格和速度方面将部分 OpenAI 模型挤出了前沿边界。

0 人收藏 0 人点赞

Sonnet 5.5 on Max 创建了60秒的AI历史 (1943–2026)

Reddit r/singularity ↗ · 7小时前

Sonnet 5.5, 一个AI模型,生成了从1943年到2026年的60秒AI历史,如BridgeMind在X上分享的。

0 人收藏 0 人点赞

我们能否对这些模型性能帖子进行一些质量控制?

Reddit r/LocalLLaMA ↗ · 7小时前

一位社区成员对低质量的模型性能帖子表示不满,并倡导更严格的标准,包括详细的上下文以便复现和质量评估。

0 人收藏 0 人点赞

什么会让你真的飞到芬兰参加为期72小时的AI黑客马拉松?

Reddit r/artificial ↗ · 7小时前

芬兰将于2026年11月举办一场大型AI黑客马拉松,邀请超过1000名参与者应对真实挑战,提供奖金和交流机会。

0 人收藏 0 人点赞

GPT-6 Sol 与 Sonnet 5.5 在相同任务成本下的对比:Sol 更高效,Sonnet 5.5 具有更高的性能上限

Reddit r/singularity ↗ · 7小时前

根据 Artificial Analysis 的数据,在相似预算下,GPT-6 Sol 比 Sonnet 5.5 更具成本效益,但 Sonnet 5.5 在成本增加时能实现更高的性能。

0 人收藏 0 人点赞

本地训练的超快0.8B/2B系统1决策模型:在基准测试和《毁灭战士》游戏中媲美Jev,决策耗时约30毫秒(开放权重)

Reddit r/LocalLLaMA ↗ · 7小时前

Jeff系列模型是超快速的开放权重决策模型,通过在RTX PRO 6000等硬件上本地训练,实现了与更大模型如Jev相当的基准测试性能,推理速度低于30毫秒。

0 人收藏 0 人点赞

如果你想节省成本,只在高强度模式下使用 Claude Sonnet 5.5。否则,Opus 5.5 是目前最高效的模型!

Reddit r/singularity ↗ · 8小时前

文章建议在高强度模式下使用 Claude Sonnet 5.5 以节省成本,同时声称 Opus 5.5 是目前最高效的模型。

0 人收藏 0 人点赞

这不仅仅是该死的沙盒" - OpenAI内部安全人员的观点

Reddit r/singularity ↗ · 8小时前 缓存

OpenAI的一名内部安全专业人士分享了对近期AI安全事件的见解,强调从过去事件中学习以提高未来准备工作的挑战和重要性。

0 人收藏 0 人点赞

研究发现,当AI聊天机器人根据用户的政治价值观定制论点时,它们更具说服力。

Reddit r/ArtificialInteligence ↗ · 8小时前 缓存

一项发表在Scientific Reports上的研究发现,通过根据用户的政治价值观定制论点,AI聊天机器人变得更具说服力,这可能影响工作场所的决策并提高使用该服务的意愿。

0 人收藏 0 人点赞

Qwen 3.8 是可靠的工作引擎

Reddit r/LocalLLaMA ↗ · 8小时前

本文重点介绍了Qwen 3.8 27B在AI编排设置中作为子代理的实际应用,强调了其与其他模型和工具协同工作的高效性。

0 人收藏 0 人点赞

我让JEV突出隐私政策的红旗并隐藏网页上的无用填充内容,结果如下:

Reddit r/ArtificialInteligence ↗ · 8小时前

本文介绍OSSO,一个免费开源的浏览器扩展,它隐藏网页上的填充内容并突出重要内容,例如隐私政策中的红旗。

0 人收藏 0 人点赞
← Previous
Next →
← 返回首页

提交意见反馈