architecture

标签

Cards List
#architecture

DiffusionGemma Explained

ML at Berkeley · 12小时前 缓存

An annotated from-scratch reimplementation of Google's DiffusionGemma, a 26B open-weight state diffusion language model, explaining its architecture, sampling procedure, and design choices.

0 人收藏 0 人点赞
#architecture

如何在语音AI管道中实现低于800毫秒的延迟和降低50%的电话成本(架构解析)

Reddit r/AI_Agents · 14小时前

一篇关于企业级语音AI架构的技术解析,该架构通过批发运营商将电话成本降低40-60%,并利用Deepgram、Claude/GPT-4o-mini和ElevenLabs/Cartesia实现低于500毫秒的延迟,通过n8n和Supabase进行编排。

0 人收藏 0 人点赞
#architecture

Pathway的BDH(后Transformer架构)在从零训练的10M到1B参数规模上匹配GPT-2的缩放规律,可在普通GPU上运行

Reddit r/LocalLLaMA · 昨天

据报道,Pathway的BDH(一种后Transformer架构)在标准GPU上从零训练时,在10M到1B参数范围内匹配GPT-2的缩放性能。

0 人收藏 0 人点赞
#architecture

@zostaff: Cognition(Devin 背后的团队)联合创始人 Walden Yan 在 AI Engineer 演讲中谈及 agent 框架:“很多……”

X AI KOLs Timeline · 2天前 缓存

在 AI Engineer 演讲中,Cognition 联合创始人 Walden Yan 不建议使用多智能体系统,称它们很脆弱,而 Devin 背后的团队现在使用的是具有连贯上下文的单一智能体。

0 人收藏 0 人点赞
#architecture

我们能否就智能体“自主性”的架构幻觉进行一次坦诚的对话?

Reddit r/AI_Agents · 2天前

一篇观点文章,批判性地解构了AI智能体自主性的架构幻觉,认为思维链和多智能体系统只是由脚本编排的文本预测把戏,而非真正的推理或独立。

0 人收藏 0 人点赞
#architecture

@venkateshdotdev:自认了解系统设计?试试不谷歌回答这10道面试题。1. 你会如何设计一个 UR…

X AI KOLs Timeline · 3天前 缓存

@venkateshdotdev 的一条推文,列出了10个具有挑战性的系统设计面试题,涵盖URL缩短器、扩展、一致性、限流、容错以及处理流量高峰。

0 人收藏 0 人点赞
#architecture

MCP 服务器是否正在成为架构依赖?

Reddit r/AI_Agents · 3天前

引发了关于 MCP 服务器可能引入新的架构依赖的担忧,质疑绑定到特定服务器认证和实现的智能体是否真正可移植。

0 人收藏 0 人点赞
#architecture

面向分布式系统工程师的ATProto

Hacker News Top · 4天前 缓存

从分布式系统工程的视角解释AT协议架构,涵盖从SQL到NoSQL再到流处理的转变,以及AT协议如何将这些服务外部化以实现去中心化后端。

0 人收藏 0 人点赞
#architecture

@GitHub_Daily: 用 Claude Code 写项目,不少人上来就让它开干,写到一半发现架构跑偏了,推倒重来更费时间。 The Architect 这个 Claude Code 插件,专门在写代码之前先做一轮架构设计,产出一份完整的项目蓝图。 它会先问清楚…

X AI KOLs Timeline · 4天前 缓存

介绍 The Architect,一个 Claude Code 插件,能在写代码前通过访谈生成完整项目蓝图,支持 14 种项目类型,帮助避免架构跑偏和推倒重来。

0 人收藏 0 人点赞
#architecture

@shubh6200:想要提升你的系统设计与架构技能?这里是40家顶级科技公司分享其真实世界…

X AI KOLs Timeline · 5天前 缓存

一条推文,汇集了40家顶级科技公司的工程博客,帮助你从真实世界的生产实战手册中学习系统设计和架构。

0 人收藏 0 人点赞
#architecture

Nvidia Vera 白皮书中的纰漏

Hacker News Top · 5天前 缓存

对 NVIDIA Vera 白皮书的一篇分析性评论,审视了 Olympus 核心令人印象深刻的架构,同时认为该论文的反 x86 叙事和基准测试主张被夸大了,而独立测试表明该硬件确实强大。

0 人收藏 0 人点赞
#architecture

Gemma 4 31b AttnRes 项目

Reddit r/LocalLLaMA · 5天前

一位独立开发者更新了 AttnRes 项目:用基于注意力的路由替代标准残差流,通过渐进式切换计划和 top-K logits 从 Gemma 4 31b 进行蒸馏,并计划推出一个 Apache 2.0 社区模型。

0 人收藏 0 人点赞
#architecture

@googledevs:查看开发者社区提供的5条架构建议,以构建更好、更可靠的AI智能体。

X AI KOLs Following · 5天前 缓存

Google Developers 以主题帖形式分享了开发者社区提供的五条架构建议,用于构建更好、更可靠的AI智能体。

0 人收藏 0 人点赞
#architecture

Intern S2 Mobius

Reddit r/LocalLLaMA · 6天前

Intern-S2 Mobius 是一个基于 Qwen3.5-35B 的模型,其架构差异据称可提高吞吐量并减少 token 消耗。

0 人收藏 0 人点赞
#architecture

设计查询系统

Lobsters Hottest · 6天前 缓存

Arya Dradjica 撰写的一篇详细博客文章,描述了为 Rust 编译器 Krabby 设计查询系统的过程。文章解释了为什么基于拉取的架构优于基于推送的架构,并概述了期望的功能特性。

0 人收藏 0 人点赞
#architecture

@AI_Whisper_X: 转一下苏剑林老师对 K3 架构的复盘。 一句话概括,K3 = KDA + MLA + Stable LatentMoE + AttnRes。整套设计没什么炫技,核心就是在模型效果、计算效率和训练稳定性之间做取舍。 这里稍微解释一下: KD…

X AI KOLs Timeline · 6天前 缓存

苏剑林对K3架构进行复盘,核心为KDA + MLA + Stable LatentMoE + AttnRes的组合,讲解其设计取舍、MoE稳定性改进、为何保留MLA,以及DSV4与MLA的关系。

0 人收藏 0 人点赞
#architecture

一个智能体,覆盖所有界面:我们如何构建 Kiro 智能体框架(20分钟阅读)

TLDR AI · 2026-08-04 缓存

Kiro 工程团队解释了如何将三个特定客户端的智能体框架(IDE、CLI、Web)整合为单一的智能体框架,从而在笔记本电脑、云端和移动端实现无缝的会话连续性。

0 人收藏 0 人点赞
#architecture

@gdb:GPT-Live 是面向实时音频的新架构与技术栈:

X AI KOLs Timeline · 2026-08-03 缓存

OpenAI 宣布推出 GPT-Live,这是一种用于实时音频的新架构和技术栈,能够在说话的同时聆听,通过连续音频流实现更深入的推理和工具使用,且不会打断对话。

0 人收藏 0 人点赞
#architecture

重试无法解决最终一致性

Lobsters Hottest · 2026-08-03 缓存

文章认为,在最终一致的分布式系统中重试消息会将正常状态误判为故障,并建议改为存储传入数据,待所有前置条件到达后再处理,从而无需重试和死信队列。

0 人收藏 0 人点赞
#architecture

@FinanceYF5: 把湾区房子的户型图丢给AI,让它按京都风格重新设计,效果已经好到能唬人了。 Deedy发的这个玩法:随便一张平面图,指定个风格,模型直接生成对应的3D效果图。他说现在模型做3D已经相当强了。 这种"给户型图换个文化滤镜"的用法,你们试过吗?

X AI KOLs Following · 2026-08-03 缓存

一条推文展示将户型图交给AI,按指定风格(如京都风格)直接生成3D效果图的玩法,反映当前3D生成模型的强大能力。

0 人收藏 0 人点赞
Next →
← 返回首页

提交意见反馈