标签
@venkateshdotdev 的一条推文,列出了10个具有挑战性的系统设计面试题,涵盖URL缩短器、扩展、一致性、限流、容错以及处理流量高峰。
AWS工程师Zak van der Merwe分享了他14年来为EC2和DSQL构建控制平面的见解,讨论了大规模运行基础设施时面临的分布式系统挑战。
本文概述了HRL实验室的新量子点量子比特技术以及一款采用金刚石空位的处理器,突显了可扩展量子计算硬件的进展。
Model Context Protocol 迎来重大更新,转变为无状态协议,在可扩展性、治理和安全性方面得到改进,适用于企业 AI 集成。
这篇博文驳斥了 Postgres LISTEN/NOTIFY 无法扩展的传言,展示了如何优化它以实现每秒6万次写入,延迟为毫秒级。
本文提出了一种基于约束多源推理的框架,用于准确识别配电系统拓扑,利用异构电力数据和物理约束。在三个包含超过8000个AMI智能电表的馈线上测试,实现了超过95%的重构准确率。
本文解释了 Gnutella 如何通过从泛洪路由演进到查询路由协议 (QRP) 来扩展其查询流量,该协议使用紧凑摘要避免泛洪所有对等点。
本文介绍了drXAI,一种利用XAI归因减少时间序列分类数据大小的方法,在保持准确性的同时实现80-90%的数据缩减,使大型模型能够扩展。
Google讨论了AI代理的单一提示(monolithic prompts)所面临的挑战,并提出了一种使用模板、包含和构建系统的模块化提示转译方法,以提高可维护性和可靠性。
CityBehavEx是一个可扩展的LLM辅助城市仿真平台,它结合了成熟的人类移动模型与微调后的交叉编码器,为城市规模的人口生成真实且经实证验证的移动模式。在单个消费级GPU上,不到一小时即可模拟100,000个智能体在75天内的行为。
PRIME-RL是一个用于大规模异步强化学习的框架,设计上易于定制,可扩展至1000+块GPU,并支持多种模型和环境。
讨论了在超过50个节点的大规模多智能体系统中共享状态的故障模式,包括竞态条件、多节点不同步和中毒上下文,并向实践者征集战地故事。
一份关于 40 个后端概念的指南,分为六个阶段,从 HTTP 基础到系统架构,旨在帮助工程师准备系统设计面试。
ClickHouse Managed Postgres通过运行一组使用SO_REUSEPORT的进程,将PgBouncer扩展到4倍吞吐量,实现了多核利用率,并通过对等连接解决了取消转发问题。
介绍AgenticAI-Supervisor,一个基于API和UI驱动的仿真环境,用于LLM智能体的可扩展强化学习,通过可验证的执行结果和奖励塑造来缓解奖励破解。
Aaron Levie 认为,最有价值的数据存在于组织内部,而非开放网络。如何将这些数据有效传递给AI代理,将决定未来的竞争优势。
PgDog是一个新的Postgres连接池,它通过处理SET语句和LISTEN/NOTIFY来保留应用程序代码,与需要权衡的现有连接池不同。
Google AI Devs强调了平台设计需要与快速AI进步同步演进,并邀请Kevin Hou在aiDotEngineer讨论Antigravity。