scaling

标签

Cards List
#scaling

固定状态,长距离影响:常量大小缓存在大规模块扩散中的优势

arXiv cs.LG ↗ · 2026-09-14 缓存

本文介绍了一种用于块扩散模型的常量大小状态缓存,与基于注意力的方法相比,显著降低了内存和延迟,实现了高效的长上下文生成,且无质量损失。

0 人收藏 0 人点赞
#scaling

当智能体减速时:通过每令牌Elo分析理解LLM智能体的测试时策略

Hugging Face Daily Papers ↗ · 2026-09-14 缓存

本文引入Elo每令牌分析来研究LLM智能体如何分配测试时计算资源,揭示智能体最初优于独立采样但随时间减速,并行会话提供性能提升。

0 人收藏 0 人点赞
#scaling

@dabit3:我们正在提升容量以应对SWE-2超出预期的需求。好消息是:免费促销将……

X AI KOLs Timeline ↗ · 2026-09-11 缓存

SWE-2正面临超出预期的需求,导致容量短缺。为应对这一情况,SWE-2的免费促销活动已延长至十月,以容纳所有用户。

0 人收藏 0 人点赞
#scaling

快速扩展在线存储以服务超过10亿ChatGPT用户

OpenAI Blog ↗ · 2026-09-11 缓存

OpenAI详细介绍了Habitat的演变,这个在线存储平台从Python库扩展到每秒处理超过7000万请求的服务,以支持ChatGPT的十亿用户规模。

0 人收藏 0 人点赞
#scaling

PlanetScale 的 Neki

Hacker News Top ↗ · 2026-09-10 缓存

Neki 是由 PlanetScale 提供的分片式 Postgres 解决方案,可实现水平扩展至数亿 QPS 和 PB 级数据,且操作零停机。

0 人收藏 0 人点赞
#scaling

@cognition: 推出 SWE-2,这是我们迄今最接近前沿的模型。在主流评估中,它的得分与近期前沿模型持平…

X AI KOLs Timeline ↗ · 2026-09-10 缓存

SWE-2 是一个AI模型,通过扩展强化学习,在成本降低高达70%的情况下匹配前沿性能。

0 人收藏 0 人点赞
#scaling

@LangChain: 人工审核在小规模时有效。当每月运行数百万次智能体时,它就会崩溃,因此@Clay依赖LangSmith的o…

X AI KOLs Following ↗ · 2026-09-10 缓存

Clay依赖LangSmith的在线评估器来扩展人工审核,以处理每月数百万次的智能体运行,并正在测试其洞察产品以更好地理解智能体行为。

0 人收藏 0 人点赞
#scaling

@VraserX:我认为这颠倒了最重要的问题。AI实验室里聪明人害怕……的事实是……

X AI KOLs Timeline ↗ · 2026-09-09 缓存

作者反对全面暂停AI发展,强调负责任的进展比冻结进步更安全,后者可能将发展转移到安全措施较少的行为者手中,并突出了AI在医学、清洁能源等方面的潜在益处。

0 人收藏 0 人点赞
#scaling

@ClaudeDevs: 我们与@WisprFlow、@useactively和@pendoio的创始人进行了座谈,他们正在基于Claude Managed Agents进行开发。Lea…

X AI KOLs Timeline ↗ · 2026-09-08 缓存

WisprFlow、useactively和pendoio的创始人分享他们如何利用Claude Managed Agents的成果、沙箱和记忆等功能来扩展他们的产品。

0 人收藏 0 人点赞
#scaling

@lateinteraction:一年后,RLM 设计原则持续有效

X AI KOLs Timeline ↗ · 2026-09-04 缓存

一条推文讨论了 RLM 设计原则(包括避免破坏性摘要和支持模型在上下文中搜索)在过去一年中依然有效,并引用了一篇关于 Codex 压缩的博客文章。

0 人收藏 0 人点赞
#scaling

GE-Act 2.0: 用于机器人操作的预训练与扩展世界-动作模型

Hugging Face Daily Papers ↗ · 2026-09-04 缓存

本文介绍了GE-Act 2.0,这是一个从头预训练的世界-动作模型,旨在实现可扩展的零样本机器人操作,提升在多样化任务和条件下的成功率。

0 人收藏 0 人点赞
#scaling

@rohanpaul_ai: 大多数AI代理仍然根据它们返回的答案来评判。来自@Apodex_AI的Apodex 1.1正在训练更难的事情:…

X AI KOLs Following ↗ · 2026-09-03 缓存

Apodex 1.1是一个AI系统,将焦点从简单答案转移到完成和验证整个工作,具备环境扩展和代理协调的能力。

0 人收藏 0 人点赞
#scaling

@jakecastilloooo:刚刚发布了关于构建和扩展消费级应用的最佳文章续集,我认为值得一读……

X AI KOLs Following ↗ · 2026-09-03 缓存

Jake Castillo 在新文章中分享了扩展一个年经常性收入为5000万美元的消费级应用的经验教训,这是他关于构建消费级应用的热门文章的续集。

0 人收藏 0 人点赞
#scaling

在企业中规模化扩展智能体AI试点项目

MIT Technology Review ↗ · 2026-09-03 缓存

本文探讨了企业在将智能体AI从试点扩展至全面部署时所面临的挑战,强调了需要制定连贯的策略、整合工作流程以及实施强有力的治理措施,以实现有意义的成果。

0 人收藏 0 人点赞
#scaling

OR-Transformer:将实时决策扩展到1,000个物品

arXiv cs.LG ↗ · 2026-09-03 缓存

该论文介绍了OR-Transformer,一种基于置换等变Transformer架构的深度强化学习框架,用于供应链中的联合补货,可扩展到超过1,000个物品,在优于基线方法的同时将决策时间减少数百万倍。

0 人收藏 0 人点赞
#scaling

@HuggingPapers:将视频预训练扩展到12万小时 ZimaBlue将视频缩放视为实现可泛化世界行动模型的途径……

X AI KOLs Timeline ↗ · 2026-09-03 缓存

将视频预训练扩展到12万小时,可将世界行动模型在真实机器人上的零样本成功率从36.1%提升至77.8%,实现更快的动作预测。

0 人收藏 0 人点赞
#scaling

@ti_morse: 我的首次访谈,对象是@EthanrThornton,@Mach_Industries的创始人。0:09 开始建立固体火箭发动机工厂 11:00 …

X AI KOLs Following ↗ · 2026-09-02 缓存

与Mach Industries创始人EthanrThornton的访谈,讨论建立固体火箭发动机工厂、国防工业挑战、制造扩展以及公司增长策略。

0 人收藏 0 人点赞
#scaling

更大的批次何时有助于扩展LLM强化学习?

arXiv cs.LG ↗ · 2026-09-01 缓存

本文通过分离算法和系统层面的效应,研究更大的批量大小是否可以减少大语言模型强化学习中的实际达到目标时间,并提供优化决策规则。

0 人收藏 0 人点赞
#scaling

GitHub 上的 @openclaw 2.0 已到来!但要达到这一步经历了什么?快来了解创作者 @steipete 和维护者是如何构建的,…

X AI KOLs Following ↗ · 2026-08-31 缓存

OpenClaw 2.0 是 GitHub 上增长最快的开源项目,现已发布。本文详细阐述了它从个人 WhatsApp 中继到流行 AI 代理工具的演变,并强调了在 AI 时代扩展与维护所面临的挑战。

0 人收藏 0 人点赞
#scaling

超越人类监督的大型推理模型扩展:迈向超级智能之路

Hugging Face Daily Papers ↗ · 2026-08-31 缓存

本文提出一种结构化的阶梯框架,用于将大型推理模型扩展到超越人类监督的范畴,重点解决自主奖励和自生成经验方面的挑战,并指出相关风险和评估维度。

0 人收藏 0 人点赞
← Previous
Next →
← 返回首页

提交意见反馈