agentic-work

标签

Cards List
#agentic-work

Artificial Analysis Capability Indices v1.1 (2分钟阅读)

TLDR AI · 5天前 缓存

Artificial Analysis 发布了 Intelligence Index v4.2,这是一个临时更新,包含新评估如 AA-Briefcase 和 GDP.pdf,增加了私人测试集以防止作弊,关键结果显示 Anthropic 和 OpenAI 领先。

0 人收藏 0 人点赞
#agentic-work

随着生产力平台推动自主工作,Superhuman 收购 YC 支持的笔记工具 Fathom

TechCrunch AI · 5天前 缓存

Superhuman 收购 YC 支持的笔记工具 Fathom,以通过 AI 驱动的会议笔记功能增强其生产力套件,实现更主动和智能代理的工作自动化。

0 人收藏 0 人点赞
#agentic-work

@ArizePhoenix:Meta 在维持标准定价的同时,声称在编程和智能体工作方面取得了迄今最大的跃升,并且有了一些……

X AI KOLs Following · 2026-09-08

Meta 在维持标准定价的同时,声称在编程和智能体任务方面有显著改进,并引入了一个独特的定价表,其中训练同意是模型名称的一部分。

0 人收藏 0 人点赞
#agentic-work

Qwen3.8-27b 是第一个我能够盲目信任的本地模型

Reddit r/LocalLLaMA · 2026-09-04

一位用户赞扬了 Qwen3.8-27b 本地 AI 模型在连续代理工作中表现出的可靠性,连续运行超过8小时而没有任何错误,称这是第一个他们可以盲目信任的本地模型。

0 人收藏 0 人点赞
#agentic-work

Anthropic 推出 Claude Fable 5.1,并表示其用于智能体任务的成本降低高达45%

The Verge · 2026-09-01 缓存

Anthropic 推出 Claude Fable 5.1 和 Mythos 5.1,声称用于智能体任务的成本降低高达45%,性能提升,并提供新的数据隐私选项。

0 人收藏 0 人点赞
#agentic-work

@omarsar0: 这是一个很棒的模型。我一直在用它配合Pi玩得很开心。你可以通过Pi或Hermes Agent免费在我们的…测试Ox Alpha。

X AI KOLs Timeline · 2026-08-24 缓存

Ox Alpha被描述为OpenRouter上最受欢迎的免费推理模型,具有1M令牌上下文窗口,适用于编码和代理任务,并可通过Pi或Hermes Agent进行测试。

0 人收藏 0 人点赞
#agentic-work

@thegenioo: 为什么这隐身模型在前端方面这么厉害?

X AI KOLs Timeline · 2026-08-20 缓存

OpenRouter 发布了一款名为 Ox Alpha 的新型隐身 AI 模型,该模型针对高效编码和代理任务进行了优化,具备 1M 令牌上下文窗口,并支持文本、图像和视频输入。

0 人收藏 0 人点赞
#agentic-work

对Laguna S2.1及其用途的真实评价(基于实际使用)

Reddit r/LocalLLaMA · 2026-07-24

用户分享了使用Laguna S2.1模型的经验,发现其因详尽的推理风格在复杂调试中效果显著,但不适合作为通用规划器。它成功修复了Qwen和Claude等其他模型无法解决的错误。

0 人收藏 0 人点赞
#agentic-work

Gemma 4 仍然偷懒

Reddit r/LocalLLaMA · 2026-07-20

用户报告称,Gemma 4 在多轮代理任务中表现懒散且不佳,相比 Qwen、DeepSeek 和 GPT-OSS 等其他模型,尽管它是一款优秀的聊天机器人。

0 人收藏 0 人点赞
#agentic-work

@sama:让我惊讶的是有些人竟然想要静音版

X AI KOLs · 2026-07-15 缓存

Sam Altman 发推文介绍 Codex Micro 键盘,这是一款与 Work Louder 合作打造的、用于配合 OpenAI 的 Codex 进行代理工作的物理设备。

0 人收藏 0 人点赞
#agentic-work

Qwen 3.6 27B 在代理任务上完全失败

Reddit r/LocalLLaMA · 2026-07-07

一位用户报告称,Qwen 3.6 27B 虽然在单次提示任务中表现强劲,但在代理任务中频繁出错,导致其不得不回退到 Qwen 3.5 122B。

0 人收藏 0 人点赞
#agentic-work

@haider1: GLM 5.2 感觉像是开放权重模型的 opus 4.5 时刻,真正让我印象深刻的是在长时间、多步骤的…

X AI KOLs Following · 2026-06-17 缓存

GLM 5.2 标志着开放权重模型的一个重要里程碑,展示了在长多步骤任务中强大的上下文保留能力以及更可靠的工具调用。

0 人收藏 0 人点赞
#agentic-work

你真的能用本地模型替代付费模型吗?

Reddit r/LocalLLaMA · 2026-06-10

一位社区成员认为,尽管取得了令人瞩目的进展,但在复杂的代理任务上,本地开源模型仍然远远落后于前沿闭源模型,并警告不要过度吹嘘替代的说法。

0 人收藏 0 人点赞
#agentic-work

那些写烂代码的智能体也正是维护它的智能体。人类清理大军在哪里?

Reddit r/AI_Agents · 2026-06-05

作者认为,AI智能体既在创建也在维护代码库,质疑了关于需要人类清理大军的预测,并指出中级开发者的角色正在被压缩。

0 人收藏 0 人点赞
#agentic-work

@populartourist: 在智能体工作中的个人最爱技能,以及巨大的 token 效率:atomic-ops

X AI KOLs Timeline · 2026-05-24 缓存

介绍 atomic-ops,这是一种针对智能体 AI 系统的技术,它将多个工具调用批量处理为单个 Python 脚本,通过 MTP 实现高达 98% 的 token 减少和更快的推理。该方法通过一个通用的 SKILL.md 文件实现,并可在 alpha-prompts 仓库中获取。

0 人收藏 0 人点赞
← 返回首页

提交意见反馈