ai-systems

标签

Cards List
#ai-systems

通过认知实验范式探究智能体记忆中的稳定性-可塑性权衡

arXiv cs.CL ↗ · 2天前 缓存

本文介绍了MemProbe,一个认知科学启发的框架,通过实验范式评估智能体记忆系统中的稳定性-可塑性权衡,提供记忆维护随时间变化的可解释剖面。

0 人收藏 0 人点赞
#ai-systems

从标识符到推断:身份重构、跨模态链接与人工智能系统中实际隐蔽性的崩溃

Reddit r/artificial ↗ · 2天前

本文探讨了人工智能系统如何利用标识符通过跨模态链接来推断和重构身份,导致实际隐蔽性的崩溃,并引发重大隐私问题。

0 人收藏 0 人点赞
#ai-systems

人工智能系统中的可达全局优化:全局性如何界定?

arXiv cs.AI ↗ · 6天前 缓存

本文介绍Reachability-Induced Optimization (RIO),主张人工智能系统中的全局优化声明应基于实际可达区域,并提供理论结果和基准数据以支持此框架。

0 人收藏 0 人点赞
#ai-systems

Sakeena Fiza 助力 NVIDIA 硬件实现规模化成功

NVIDIA Blog ↗ · 6天前 缓存

Sakeena Fiza 是 NVIDIA 的验证工程师,她确保像 NVIDIA Rubin GPU 这样的硬件系统在大规模生产之前能够在规模上正确运行,凸显了验证在AI基础设施中的重要性。

0 人收藏 0 人点赞
#ai-systems

我开始认为可恢复性是自主代理的真正考验

Reddit r/AI_Agents ↗ · 2026-09-18

作者认为可恢复性是自主AI代理的真正考验,强调了任务持久性和健壮恢复机制的必要性,以确保真正的自主性。

0 人收藏 0 人点赞
#ai-systems

无人预算的自动化故障:操作已执行,但超时显示失败

Reddit r/AI_Agents ↗ · 2026-09-17

本文讨论了一种关键的自动化失败模式,即操作成功但响应超时,导致重复执行,并提倡使用稳定的操作ID和状态检查来增强代理评估的鲁棒性。

0 人收藏 0 人点赞
#ai-systems

LSREP:一种用于评估对话记忆的纵向状态重放协议,以经审计的本地优先架构 ICE v2 为例

arXiv cs.AI ↗ · 2026-09-16 缓存

本文介绍了 LSREP,一种用于评估对话记忆的纵向状态重放协议,并以 ICE v2 作为案例研究,通过与向量 RAG 对比的重放和审计,揭示了故障模式。

0 人收藏 0 人点赞
#ai-systems

我认为AI代理没有记忆问题,而是存在状态完整性问题。

Reddit r/AI_Agents ↗ · 2026-09-16

作者认为AI代理存在状态完整性问题而非记忆问题,并提出一个状态账本(State Ledger)来区分历史事实与当前状态,并跟踪来源。

0 人收藏 0 人点赞
#ai-systems

AttnFuse: 一种用于将注意力编译为融合GPU内核的可组合DSL

arXiv cs.LG ↗ · 2026-09-15 缓存

AttnFuse引入了一种可组合的DSL,用于将自定义注意力模式(包括RoPE)编译为融合GPU内核,相比现有方法如PyTorch的flex_attention实现了加速。

0 人收藏 0 人点赞
#ai-systems

硅谷正在变革美国军事工业复合体

Hacker News Top ↗ · 2026-09-10 缓存

本文分析了硅谷和大型科技公司如何通过AI系统和大型国防合同重塑美国军事工业复合体,并突出了透明度和有效性方面的问题。

0 人收藏 0 人点赞
#ai-systems

Φ-Bench:大型语言模型能设计为其提供动力的基础设施吗?

arXiv cs.CL ↗ · 2026-09-10 缓存

Φ-Bench 是一个新的基准测试,用于评估大型语言模型在工程化和优化人工智能基础设施方面的能力,涵盖从内核级代码补全到端到端系统优化的任务。

0 人收藏 0 人点赞
#ai-systems

@elonmusk: 如果你注意到𝕏的任何问题,请在回复中直接告诉我。

X AI KOLs Following ↗ · 2026-09-08 缓存

埃隆·马斯克邀请用户报告关于X的担忧,而安全主管迈克尔·奥赫利希宣布他关注安全、AI系统和言论自由。

0 人收藏 0 人点赞
#ai-systems

@imryven: 有人刚刚发布了10个Claude系统的完整参考图,这些系统可以在没有你的情况下运行,此图展示了……

X AI KOLs Timeline ↗ · 2026-08-14 缓存

有人发布了10个Claude系统的完整参考图,这些系统自动化任务,分为信息、工作和判断层,并详细说明了设置要求和功能。

0 人收藏 0 人点赞
#ai-systems

@alex_prompter:多智能体 AI 系统会在四个环节出问题。路由误触发,并行永不发生,交接丢失上下文,以及覆盖…

X AI KOLs Timeline ↗ · 2026-08-06 缓存

多智能体AI系统通常会在路由、并行、交接和覆盖方面出问题。本文推荐使用分派矩阵、并行执行、结构化交接和带日志的兜底后备方案来修复这些问题。

0 人收藏 0 人点赞
#ai-systems

冗余调整人工年龄评分(AAS)框架下AI系统的长期持续性理论

arXiv cs.AI ↗ · 2026-08-06 缓存

本文提出了一种基于冗余调整人工年龄评分(AAS)的AI系统长期持续性框架,表明无限循环运行不必然导致无界的结构老化。

0 人收藏 0 人点赞
#ai-systems

评估盲区:静默测量失败如何从训练到部署破坏AI系统

arXiv cs.LG ↗ · 2026-08-05 缓存

本文介绍了“评估盲区”(evaluation blindness),这是一个用于描述从训练到部署过程中破坏AI系统的静默测量失败的正式框架,包含案例研究、基于50个真实事件验证的失败分类法,以及失败预算框架。

0 人收藏 0 人点赞
#ai-systems

这不是烟斗:AI系统作为语义抽象

arXiv cs.AI ↗ · 2026-07-13 缓存

本文提出了一种语义框架来描述AI系统,区分合理的声明与误导性的输出,并定义了常见的失败现象,如幻觉和无根据的断言。

0 人收藏 0 人点赞
#ai-systems

@Huahuazo: 现在 AI Agent 概念满天飞,可真要落地复杂业务,一堆硬骨头就全冒出来了——架构怎么搭、记忆怎么管、多 Agent 怎么协调才不互相拆台。 越写越乱,最后代码直接糊成一锅粥,上线更是想都别想。 看到一本开源书,叫 Agentic D…

X AI KOLs Timeline ↗ · 2026-07-06 缓存

这是一本名为《Agentic Design Patterns》的开源书,提供21章和7个附录,系统讲解AI Agent的设计模式,覆盖从基础到企业级生产环境,每章配有Jupyter Notebook实践。

0 人收藏 0 人点赞
#ai-systems

@ianchanning: 如果你的RAG系统并不比https://google.com/ai好,那你已经浪费了一大笔钱(我怀疑有很多…

X AI KOLs Following ↗ · 2026-07-04 缓存

伊恩·钱宁批评那些在表现并不优于Google AI的RAG系统上浪费资金的公司,他认为能够访问语料库并不等同于拥有深厚专业知识,并且推理无法与知识完全分离。

0 人收藏 0 人点赞
#ai-systems

@rohanpaul_ai: Sakana Fugu 技术报告——核心理念是,智能正从模型转移到围绕其构建的系统。Fugu 是一种……

X AI KOLs Following ↗ · 2026-06-28 缓存

Sakana Fugu 技术报告介绍了一个经过训练的编排器,它能动态选择并协调专用模型来执行任务。其中包含一个快速版本(Fugu)和一个较慢的工作流版本(Fugu-Ultra),后者可根据每个请求设计定制化的协作模式。

0 人收藏 0 人点赞
Next →
← 返回首页

提交意见反馈