标签
Exa 宣布其服务 800 亿个页面并跟踪 1.4 万亿个 URL,将自己定位为最大的网络索引之一,并计划在 2027 年初达到 Google 规模。
Hoplite(YC S26)推出一个平台,用于部署云端编码智能体,可迁移本地设置,并支持跨用户流程、API 和 CLI 对功能进行并发 QA。创始人 Bence 和 Ryan 在 AWS、Temporal、Modal 和 Planetscale 上构建了自定义智能体框架,可通过代码 'HACKERNEWS' 获取免费额度。
Pinterest Engineering 分享了一项关于 CPU 瓶颈和网络驱动程序问题的详细调查,这些问题导致基于 Ray 的训练任务在其 Kubernetes 平台上崩溃,并提供了分析性能问题的经验教训。
据报道,Moonshot AI的Kimi模型正在使用来自阿里巴巴的2万块Nvidia芯片集群,这凸显了中国在AI计算基础设施方面的重要合作。
作者将 AI 运营层定义为一个新的企业类别,用于在规模上编排、治理和监控 AI 代理,并正在寻找投资者将其生产 MVP 推进到试点部署阶段。
一位开发者反思将 AI 智能体工作流迁移到服务器的经历,发现 systemd、日志、幂等性和故障告警这些枯燥的基础设施问题比智能体本身更重要。
美国参议院听证会警告称,监管延误以及社区对数据中心基础设施的反对可能会让中国在AI竞赛中占据领先地位。
Dili AI 宣布完成 1500 万美元 A 轮融资,由 Khosla Ventures 和 Y Combinator 领投,将 AI 应用于资本项目的合规与项目交付,六个月内增长 500%。
Dili 筹集 2170 万美元,利用 AI 进行基础设施项目的合规管理,帮助处理建筑和数据中心的复杂法规。
Mitchell Hashimoto 宣布推出 Superlogical,以终端复用器为基础,构建一个面向 AI 的原生智能体操作系统。
DoorDash 推出 DoorDash Air,这是一个获得 FAA 认证的新无人机配送部门,将自建无人机和地面基础设施,用于中距离餐饮配送。
作者分享了在其组织中构建基础设施的经验基础上,用于在 Kubernetes 上部署内部 LLM 推理的运行手册。
费城郊区向计划建设大型数据中心的开发商提出43项条件,导致因社区利益和分区规则而陷入法律僵局。
AMD 与 OpenAI 的工程师合作分享性能优化方面的见解,并邀请 OpenAI 计算策略副总裁 Sachin Katti 进行幕后解读。
美国最大电网运营商PJM将从2027年6月起,在电力短缺时暂时切断大型数据中心的供电,以防电网瘫痪。此举可能推动现场发电,但也引发了对柴油发电机污染的担忧。
Recursive Superintelligence 是一家专注于自我改进系统的人工智能公司,与亚马逊网络服务(AWS)签署了价值 4.1 亿美元的计算协议,以扩展其基础设施。
Netflix使用vLLM和NVIDIA Triton构建了一个内部LLM服务平台,通过统一的gRPC和兼容OpenAI的API将自托管模型集成到生产基础设施中,并分享了生产经验。
菲尔兹奖得主Jacob Tsimerman宣布离开学术界,加入OpenAI的安全团队;同时,NVIDIA正在探讨为一座数据中心提供大规模融资,而开源模型Kimi K3(2.8万亿参数)也已发布。
Infrawrench 是一款统一的云管理工具,可连接 25 个以上的提供商,提供 SSH、Kubernetes 管理、SQL 编辑、对象存储浏览和自定义仪表盘,全部集成于一个界面中。