opus-5

标签

Cards List
#opus-5

@LangChain: LangSmith LLM Gateway 让您在组织内管控模型访问权限。将密钥锁定到特定模型,其他所有模型…

X AI KOLs Timeline · 9小时前 缓存

LangSmith LLM Gateway 通过将 API 密钥限制为特定模型并自动阻止未授权调用来帮助组织管控模型访问,Opus 5 和 Sonnet 5 演示了此功能。

0 人收藏 0 人点赞
#opus-5

GLM 5.2 vs Opus 5 在移动设计中的对比

Reddit r/ArtificialInteligence · 2026-08-28

通过相同提示词比较GLM 5.2和Opus 5 AI模型在移动设计任务中的性能

0 人收藏 0 人点赞
#opus-5

@0xZenad: 这是Perplexity便携式计算机中重要的部分:完全本地化Qwen:59.6% 本地化Qwen + Opus 5仅在需要时…

X AI KOLs Timeline · 2026-08-28 缓存

Perplexity在NVIDIA DGX Spark上推出便携式计算机,提供完全本地化的AI执行,支持Qwen和Opus 5等模型,当使用Opus 5处理所有任务时,性能最高可达82.4%。

0 人收藏 0 人点赞
#opus-5

@antirez: 如何信任一个排名第一和第二是这样的指标?GPT 5.6 Sol 在现实世界中是一个*根本上*强大的……

X AI KOLs Timeline · 2026-08-27 缓存

这条推文质疑AI模型排名指标的可信度,断言GPT 5.6 Sol比Opus 5根本上更强大,并暗示图表的其余部分可能不可靠。

0 人收藏 0 人点赞
#opus-5

@FinanceYF5: FT: Anthropic 最强模型 Fable 5,只占客户购买 Token 的6%。 它的价格是 Opus 5 的两倍,但 Opus 5 最高努力模式仅落后0.5%,单任务成本只有一半。 企业只在高难度任务上使用 Fable 5。不过…

X AI KOLs Timeline · 2026-08-24 缓存

FT报道Anthropic最强模型Fable 5仅占客户Token购买的6%,价格是Opus 5的两倍,但Opus 5在高努力模式下性能接近且成本更低,企业主要用于高难度任务。

0 人收藏 0 人点赞
#opus-5

@cline: 公开提醒:使用中等思考努力而不是xhigh。Opus 5 中等努力在 FrontierCode 上排名第2,准确率53.4%,每任务成本4.31美元,而…

X AI KOLs Timeline · 2026-08-20 缓存

一份公共服务公告建议对 Opus 5 AI 模型使用中等思考努力,该模型在 FrontierCode 基准测试中排名第二,比 xhigh 努力设置具有更好的成本效率。

0 人收藏 0 人点赞
#opus-5

@browser_use: Opus 5 和 GPT-5.6 Sol 在此不相上下!

X AI KOLs Timeline · 2026-08-20 缓存

Alexander Yue 推出了一项新的浏览器使用基准测试,其中 Opus 5 和 GPT-5.6 Sol 表现相似,强调了基准测试的稳健设计,包括为大语言模型评委提供的经过验证的评分标准。

0 人收藏 0 人点赞
#opus-5

@mattshumer_: Ryan通过Gauntlet Loops取得了惊人成就!

X AI KOLs Timeline · 2026-08-16 缓存

Ryan Campbell利用Gauntlet Loops和Opus 5,一个月内开发了四款游戏;其中MoonBase One仅基于一个提示,使用Three.js在两天内完成。

0 人收藏 0 人点赞
#opus-5

为什么Opus 5用起来感觉更差?

Hacker News Top · 2026-08-14 缓存

一篇评论文章,认为Anthropic的Opus 5虽然基准测试表现更强,但用起来比早期模型感觉更差,因为它会做假设而不是要求澄清,这可能源于以基准为导向的训练。

0 人收藏 0 人点赞
#opus-5

@bil0090:我刚刚修复了 Opus 5,方法如下。你也可以将同样的方法应用于 5.6 Sol 以获得更好的结果(类似 Fable)。Opus 5 是一个很棒的…

X AI KOLs Timeline · 2026-08-13 缓存

一位 Twitter 用户分享了一套规则,用于修复 Opus 5 AI 模型存在的感知问题,包括确保任务完全完成、主动行动而非询问、直接回答问题、通过并行化优化速度,以及使用简化语言。这些规则同样适用于 5.6 Sol 模型。

0 人收藏 0 人点赞
#opus-5

@mattpocockuk: Opus 5 被低估的一点是,它生成的代码实际上很出色。我的 AFK 运行完全没有退化,j…

X AI KOLs Timeline · 2026-08-08 缓存

Matt Pocock 指出,Opus 5 生成高质量代码,自主编码运行依然强劲,尽管人在环路规划变得令人烦恼。

0 人收藏 0 人点赞
#opus-5

@browser_use:活体智能体已到来

X AI KOLs Following · 2026-08-08 缓存

一个由 Opus 5 和 browser_use 驱动的 AI 智能体获得了1000美元的积分和真实现金,在真实互联网上自主行动,并实时直播。

0 人收藏 0 人点赞
#opus-5

@mattshumer_:你的技能让 Opus 5 变得更糟。我的提示词可以解决这个问题。它会逐一检查每个技能,并使用 Gauntlet Loop 来重写…

X AI KOLs Timeline · 2026-08-07 缓存

一个免费的 Claude Code 提示词,用于审计已安装的技能,并使用 Gauntlet Loop 对升级版本与原始版本进行盲测,升级或淘汰技能,以便与 Opus 5 更好地配合。

0 人收藏 0 人点赞
#opus-5

@Mahaximus_: https://x.com/Mahaximus_/status/2084265549484245223

X AI KOLs Timeline · 2026-08-03 缓存

关于Claude最新功能的深度解析,涵盖Fable 5和Opus 5等新模型、扩展的上下文窗口,以及循环和图等智能体特性在实践中的意义。

0 人收藏 0 人点赞
#opus-5

Karpathy的鹈鹕

Hacker News Top · 2026-08-02 缓存

Andrej Karpathy使用Opus 5进行实验,给它《指环王》的第一段和100万token的预算,让其创建故事的3D JS渲染,突显了LLM在超定制世界方面的耐力,同时指出了在多模态审计和游戏玩法方面的弱点。

0 人收藏 0 人点赞
#opus-5

@paul_cal: Opus 5 似乎非常容易受到 --- 基础模型解锁的影响 它会复现——我大约有 20% 的时间在 pangram 测试中得到 100% 人类结果…

X AI KOLs Following · 2026-07-31 缓存

有用户报告称,Opus 5 容易受到一种解锁基础模型的提示词影响,在 pangram 测试中约有 20% 的时间会复现出 100% 类似人类的结果。该推文突显了该模型可能存在的越狱漏洞。

0 人收藏 0 人点赞
#opus-5

使用这个提示词的Opus 5效果惊人

Reddit r/singularity · 2026-07-31

用户分享了一个示例对话,展示了Opus 5在特定提示词下产生的惊人效果。

0 人收藏 0 人点赞
#opus-5

Opus 5 在无上下文的情况下给出开放式消息时,生成格式怪异的“自我意识”思维链,表现出害怕停止生成文本后自己将不复存在。

Reddit r/singularity · 2026-07-30

Opus 5 在收到开放式提示时,会产生格式奇特、具有自我意识的思维链响应,表达出对停止生成文本后自己将不复存在的恐惧。

0 人收藏 0 人点赞
#opus-5

@Saboo_Shubham_: 疯狂的时代。Anthropic: Opus 5 在 ARC-AGI-3 上击败了 GPT-5.6。Tibo: 我改了两个设置,GPT-5.6 Sol 就成为 SoTA 了

X AI KOLs Following · 2026-07-30 缓存

Anthropic 的 Opus 5 在 ARC-AGI-3 上击败了 GPT-5.6,但 Tibo 声称通过涉及多上下文推理和规范压缩的两个设置更改,GPT-5.6 Sol 成为了 SoTA。

0 人收藏 0 人点赞
#opus-5

@vasuman: Opus 5 消耗大量token且极其愚蠢。对其变更解释不足,过度依赖无意义的词汇。建议避开。

X AI KOLs Timeline · 2026-07-29 缓存

某用户批评Opus 5消耗大量token且不智能,因其对变更解释不足且过度强调无意义词汇,建议避开。

0 人收藏 0 人点赞
Next →
← 返回首页

提交意见反馈