architecture

标签

Cards List
#architecture

2026年Xilem批判性回顾

Lobsters Hottest · 20小时前 缓存

对Rust GUI框架Xilem的批判性回顾,重点指出了严重的开发者体验问题、架构死胡同和组织问题。作者认为当前架构不可行,需要进行重大变革。

0 人收藏 0 人点赞
#architecture

@Saccc_c: L站网友还是太超模了,有人根据GitHub上泄漏的DeepSeek Harness 内测生态插件仓库,反推出了部分技术架构 供参考,只能说对DeepSeek Harness期待住了!

X AI KOLs Following · 昨天 缓存

L站网友根据GitHub上泄漏的DeepSeek Harness内测生态插件仓库,反推出了部分技术架构,引发对DeepSeek Harness的期待。

0 人收藏 0 人点赞
#architecture

我如何编排19个专门AI代理,跨86个数据源生成销售情报报告(每份报告约97次LLM调用)

Reddit r/AI_Agents · 昨天

作者描述了Recon,一个使用19个专门AI代理跨86个数据源生成销售情报报告的多代理系统,每份报告涉及约97次LLM调用。文章涵盖了编排、来源归因、冲突解决和技术栈。

0 人收藏 0 人点赞
#architecture

V-Simba:释放RL在视觉连续控制中的架构潜力

arXiv cs.LG · 2天前 缓存

本文介绍了V-Simba,一种视觉RL架构,通过添加归一化层和逐点卷积来提高样本效率和稳定性。它在DMC、Adroit和Meta-World基准测试中达到或超越了最先进的方法,同时比DrQ-v2更具计算效率。

0 人收藏 0 人点赞
#architecture

DiffusionGemma Explained

ML at Berkeley · 2天前 缓存

An annotated from-scratch reimplementation of Google's DiffusionGemma, a 26B open-weight state diffusion language model, explaining its architecture, sampling procedure, and design choices.

0 人收藏 0 人点赞
#architecture

如何在语音AI管道中实现低于800毫秒的延迟和降低50%的电话成本(架构解析)

Reddit r/AI_Agents · 2天前

一篇关于企业级语音AI架构的技术解析,该架构通过批发运营商将电话成本降低40-60%,并利用Deepgram、Claude/GPT-4o-mini和ElevenLabs/Cartesia实现低于500毫秒的延迟,通过n8n和Supabase进行编排。

0 人收藏 0 人点赞
#architecture

Pathway的BDH(后Transformer架构)在从零训练的10M到1B参数规模上匹配GPT-2的缩放规律,可在普通GPU上运行

Reddit r/LocalLLaMA · 3天前

据报道,Pathway的BDH(一种后Transformer架构)在标准GPU上从零训练时,在10M到1B参数范围内匹配GPT-2的缩放性能。

0 人收藏 0 人点赞
#architecture

@zostaff: Cognition(Devin 背后的团队)联合创始人 Walden Yan 在 AI Engineer 演讲中谈及 agent 框架:“很多……”

X AI KOLs Timeline · 4天前 缓存

在 AI Engineer 演讲中,Cognition 联合创始人 Walden Yan 不建议使用多智能体系统,称它们很脆弱,而 Devin 背后的团队现在使用的是具有连贯上下文的单一智能体。

0 人收藏 0 人点赞
#architecture

我们能否就智能体“自主性”的架构幻觉进行一次坦诚的对话?

Reddit r/AI_Agents · 5天前

一篇观点文章,批判性地解构了AI智能体自主性的架构幻觉,认为思维链和多智能体系统只是由脚本编排的文本预测把戏,而非真正的推理或独立。

0 人收藏 0 人点赞
#architecture

@venkateshdotdev:自认了解系统设计?试试不谷歌回答这10道面试题。1. 你会如何设计一个 UR…

X AI KOLs Timeline · 5天前 缓存

@venkateshdotdev 的一条推文,列出了10个具有挑战性的系统设计面试题,涵盖URL缩短器、扩展、一致性、限流、容错以及处理流量高峰。

0 人收藏 0 人点赞
#architecture

MCP 服务器是否正在成为架构依赖?

Reddit r/AI_Agents · 6天前

引发了关于 MCP 服务器可能引入新的架构依赖的担忧,质疑绑定到特定服务器认证和实现的智能体是否真正可移植。

0 人收藏 0 人点赞
#architecture

面向分布式系统工程师的ATProto

Hacker News Top · 6天前 缓存

从分布式系统工程的视角解释AT协议架构,涵盖从SQL到NoSQL再到流处理的转变,以及AT协议如何将这些服务外部化以实现去中心化后端。

0 人收藏 0 人点赞
#architecture

@GitHub_Daily: 用 Claude Code 写项目,不少人上来就让它开干,写到一半发现架构跑偏了,推倒重来更费时间。 The Architect 这个 Claude Code 插件,专门在写代码之前先做一轮架构设计,产出一份完整的项目蓝图。 它会先问清楚…

X AI KOLs Timeline · 2026-08-06 缓存

介绍 The Architect,一个 Claude Code 插件,能在写代码前通过访谈生成完整项目蓝图,支持 14 种项目类型,帮助避免架构跑偏和推倒重来。

0 人收藏 0 人点赞
#architecture

@shubh6200:想要提升你的系统设计与架构技能?这里是40家顶级科技公司分享其真实世界…

X AI KOLs Timeline · 2026-08-06 缓存

一条推文,汇集了40家顶级科技公司的工程博客,帮助你从真实世界的生产实战手册中学习系统设计和架构。

0 人收藏 0 人点赞
#architecture

Nvidia Vera 白皮书中的纰漏

Hacker News Top · 2026-08-05 缓存

对 NVIDIA Vera 白皮书的一篇分析性评论,审视了 Olympus 核心令人印象深刻的架构,同时认为该论文的反 x86 叙事和基准测试主张被夸大了,而独立测试表明该硬件确实强大。

0 人收藏 0 人点赞
#architecture

Gemma 4 31b AttnRes 项目

Reddit r/LocalLLaMA · 2026-08-05

一位独立开发者更新了 AttnRes 项目:用基于注意力的路由替代标准残差流,通过渐进式切换计划和 top-K logits 从 Gemma 4 31b 进行蒸馏,并计划推出一个 Apache 2.0 社区模型。

0 人收藏 0 人点赞
#architecture

@googledevs:查看开发者社区提供的5条架构建议,以构建更好、更可靠的AI智能体。

X AI KOLs Following · 2026-08-05 缓存

Google Developers 以主题帖形式分享了开发者社区提供的五条架构建议,用于构建更好、更可靠的AI智能体。

0 人收藏 0 人点赞
#architecture

Intern S2 Mobius

Reddit r/LocalLLaMA · 2026-08-05

Intern-S2 Mobius 是一个基于 Qwen3.5-35B 的模型,其架构差异据称可提高吞吐量并减少 token 消耗。

0 人收藏 0 人点赞
#architecture

设计查询系统

Lobsters Hottest · 2026-08-04 缓存

Arya Dradjica 撰写的一篇详细博客文章,描述了为 Rust 编译器 Krabby 设计查询系统的过程。文章解释了为什么基于拉取的架构优于基于推送的架构,并概述了期望的功能特性。

0 人收藏 0 人点赞
#architecture

@AI_Whisper_X: 转一下苏剑林老师对 K3 架构的复盘。 一句话概括,K3 = KDA + MLA + Stable LatentMoE + AttnRes。整套设计没什么炫技,核心就是在模型效果、计算效率和训练稳定性之间做取舍。 这里稍微解释一下: KD…

X AI KOLs Timeline · 2026-08-04 缓存

苏剑林对K3架构进行复盘,核心为KDA + MLA + Stable LatentMoE + AttnRes的组合,讲解其设计取舍、MoE稳定性改进、为何保留MLA,以及DSV4与MLA的关系。

0 人收藏 0 人点赞
Next →
← 返回首页

提交意见反馈