efficiency

标签

Cards List
#efficiency

AI是否提升了你的整体工作效率,还是仅仅转移了瓶颈?

Reddit r/artificial ↗ · 2026-09-16

本文探讨AI在加速单个任务的同时是否转移了更广泛工作流程中的瓶颈,强调需要衡量端到端流程的改进,并考虑在工具连接性、所有权和步骤上的优化。

0 人收藏 0 人点赞
#efficiency

简单且高效的行级安全性

Lobsters Hottest ↗ · 2026-09-16

文章讨论了一种实现行级安全性的简单且高效的方法,可能用于数据库系统或软件应用程序以控制数据访问。

0 人收藏 0 人点赞
#efficiency

FlexEE:用于卸载感知LLM推理的自推测与KV兼容早期退出框架

arXiv cs.AI ↗ · 2026-09-16 缓存

FlexEE介绍了一种自推测和KV缓存兼容的早期退出框架,用于卸载部署中的高效LLM推理,在Llama模型上实现了显著加速,且精度损失最小化。

0 人收藏 0 人点赞
#efficiency

VideoMM:用于高效视频MLLMs的自适应宏微观推理

arXiv cs.AI ↗ · 2026-09-16 缓存

VideoMM 引入了一种自适应宏微观推理框架,可减少视频MLLMs中的视觉token开销,实现6.13倍的速度提升和7.4%的准确率增益,从而高效地理解长视频。

0 人收藏 0 人点赞
#efficiency

EchoPath:GUI代理的执行级可重放记忆系统

arXiv cs.AI ↗ · 2026-09-16 缓存

EchoPath 引入了一种模型无关的记忆系统,用于GUI代理,该系统重放经过验证的执行轨迹,显著降低了企业重复任务的token成本和执行时间。

0 人收藏 0 人点赞
#efficiency

基于潜在叙事推理的高效多模态生成式推荐

arXiv cs.CL ↗ · 2026-09-16 缓存

本文提出了NarraLite,一个高效的多模态生成式推荐框架,它利用潜在叙事推理来改进剧集内容预测,以提高准确性和效率。

0 人收藏 0 人点赞
#efficiency

State of Thought 实现内生推理

arXiv cs.CL ↗ · 2026-09-16 缓存

State of Thought (SoT) 为LLMs提出内生推理,通过提取内部动态几何状态来选择性激活历史支持,提高各种推理任务的准确性和效率。

0 人收藏 0 人点赞
#efficiency

@NathanFlurry:无炒作的JEV解释:JEV并不取代GPT/Claude,JEV只是一个*非常*智能的switch语句,比如如果2…

X AI KOLs Timeline ↗ · 2026-09-16 缓存

Diogo Almeida发布了JEV,这是一个新的AI模型,它作为智能switch语句处理分类和路由等任务,声称在速度和效率上显著优于现有模型。

0 人收藏 0 人点赞
#efficiency

我发现当使用Codex作为工具时,你必须多问AI一个问题:"去GitHub搜索是否已有…"

X AI KOLs Timeline ↗ · 2026-09-16 缓存

本文建议开发者在使用Codex等AI工具构建项目前,先在GitHub搜索现有解决方案,以避免浪费时间和资源。

0 人收藏 0 人点赞
#efficiency

GAVEL:基于图世界模型的验证高效长时域LLM任务规划

Hugging Face Daily Papers ↗ · 2026-09-16 缓存

本文介绍了GAVEL,这是一个使用图世界模型来验证和修复机器人任务长时域LLM规划的框架,显著提高了仿真中的成功率和效率。

0 人收藏 0 人点赞
#efficiency

CERA-MoA:协同进化路由机制与持续学习的LLM代理

Hugging Face Daily Papers ↗ · 2026-09-16 缓存

CERA-MoA介绍了一个协同进化框架,用于混合代理系统,该框架使用强化学习动态路由查询并调整代理能力,从而提升任务性能和效率。

0 人收藏 0 人点赞
#efficiency

@chetaslua: sol 5.6 正在为少数选定用户路由到 sol 6。sol 6 在强化学习方面优化得很好,而且兄弟,它真的很快,就像 o…

X AI KOLs Timeline ↗ · 2026-09-15 缓存

这条推文宣布 sol 5.6 正在为选定用户路由到 sol 6,强调了其强化学习优化和速度,并承诺将与 OpenAI 和 Anthropic 模型进行比较。

0 人收藏 0 人点赞
#efficiency

LayerRoute: 一种通过LoRA保持质量的自适应层跳过方法,用于高效LLM推理

arXiv cs.CL ↗ · 2026-09-15 缓存

LayerRoute引入了一种参数高效的自适应transformer层跳过方法,结合了逐层路由与联合LoRA微调,在LLM推理中实现了经过验证的速度提升和质量改进。

0 人收藏 0 人点赞
#efficiency

UkisAI Swift-Qwen3.8-27B / 思考量减少58.3%,速度提升1.95倍,同时保持xhigh准确率

Reddit r/LocalLLaMA ↗ · 2026-09-14

UkisAI 对 Qwen 3.8 27B 模型进行了后训练,以减少不必要的思考令牌,从而在准确率损失不到1%的情况下,实现思考量降低58%和速度提升1.95倍,模型已开源并提供免费的研究API。

0 人收藏 0 人点赞
#efficiency

大众汽车的滑溜新电动汽车打破多项效率记录

The Verge ↗ · 2026-09-14 缓存

大众汽车的Mission Efficiency原型车在空气动力学阻力和电动汽车能效方面创下新纪录,风阻系数仅为0.158,在实际测试中能耗极低。

0 人收藏 0 人点赞
#efficiency

性能、效率与崩溃——代码LLMs离线后训练的优势与挑战

arXiv cs.LG ↗ · 2026-09-14 缓存

本文研究了用于代码生成LLMs后训练的离线强化学习,表明通过使用现有数据集,无需在线采样,就能提升零样本代码生成的性能。

0 人收藏 0 人点赞
#efficiency

@0xTykoo: 小时候,我真不懂老师说的:如果一个人耽搁一分钟,全班就会……

X AI KOLs Timeline ↗ · 2026-09-14

作者分享了一个个人领悟,即使用AI Agent帮助他理解了延误的连锁效应,并联系到课堂上的教训。

0 人收藏 0 人点赞
#efficiency

Recurrent Looped Transformer

Hacker News Top ↗ · 2026-09-13 缓存

Recurrent Looped Transformer (RLT) 是一种新颖的架构,它结合了因果编码器和循环解码器,以实现具有无界时间深度的潜在推理、模型-硬件协同设计以及模型-强化学习算法协同设计。

0 人收藏 0 人点赞
#efficiency

@AlexanderKr:我看到一些文章指出瑞典的沃尔沃和斯堪尼亚在续航里程上击败了特斯拉Semi的电动卡车。…

X AI KOLs Following ↗ · 2026-09-12 缓存

本文比较了特斯拉Semi、沃尔沃和斯堪尼亚电动半挂卡车的续航里程和能效,认为尽管特斯拉续航较低,但其更高的能效可能因成本和欧洲的运营考虑而更具优势。

0 人收藏 0 人点赞
#efficiency

@ethantsliu: LLMs能够为长上下文自主控制注意力!在文本生成过程中,LLMs通常读取完整的KV缓存……

X AI KOLs Timeline ↗ · 2026-09-12 缓存

该论文介绍了声明式注意力技术,LLMs明确声明需要关注哪些上下文段,从而将令牌使用量最多减少52%,同时准确率下降极小。

0 人收藏 0 人点赞
← Previous
Next →
← 返回首页

提交意见反馈