@dbreunig:大版本发布:RLM 优化、优化链串联、LiteLLM 解耦启动,并有 24 位首次贡献者…
摘要
重磅开源版本:RLM 优化、优化链串联、LiteLLM 解耦启动,迎来 24 位新贡献者。
大版本发布:RLM 优化、优化链串联、LiteLLM 解耦启动,并有 24 位首次贡献者!
查看缓存全文
缓存时间: 2026/04/22 06:20
本次大版本带来 RLM 改进、优化链式调用、开启 LiteLLM 解耦,并有 24 位首次贡献者!
相似文章
@vllm_project: vLLM v0.21.0 发布!367 次提交,来自 202 位贡献者(其中 49 位新贡献者)。亮点:KV 卸载 + HMA、带思考预算的推测解码(适用于推理模型)……
vLLM v0.21.0 已发布,新增 KV 卸载 + HMA、面向推理模型的带思考预算的推测解码、适用于 DSR1/Kimi K2.5 的 Blackwell 上的 TOKENSPEED_MLA、Mooncake 分布式 KV、DeepSeek V4 流水线并行,以及 C++20 + Transformers v5 基线。
@diblacksmith: [开源发布] 这是我工作中使用RLM的经历。自其发布(1月26日)以来,我就开始用它处理日常任务(编码、处理数百万token的日志,甚至自动化浏览器操作)。
作者分享了他使用RLM处理日常任务(如编码、处理数百万token的日志和浏览器自动化)的经验,并将其作为一个可通过pip安装的开源Python包发布。
@huang_chao4969: LightRAG v1.5 来了!史上最大更新!35k+ GitHub | 1.1M+ 下载量 | 251 位贡献者 | 1.1k+ PR 已合并…
LightRAG v1.5 已发布,带来六大重大改进,包括多模态文档处理、增强的解析功能以及角色特定的 LLM 配置,使 RAG 更简单、更快速、更强大。
@RedHat_AI: Michael Goin (@mgoin_) 详解 @vllm_project v0.20.0。752 次提交。320 位贡献者。123 位新贡献者。DeepSeek V4, TurboQ…
Michael Goin 回顾了 vLLM v0.20.0 的发布,重点介绍了 752 次代码提交以及新功能,包括对 DeepSeek V4 的支持、TurboQuant 技术以及 PyTorch 2.11 的集成。
@ggerganov:llama.cpp 的第10000次发布
庆祝 llama.cpp 的第10000次发布,这是一个用于本地运行大型语言模型的工具。