compression

标签

Cards List
#compression

何以存续?资源充足学习中精确的任务信息-状态前沿

arXiv cs.LG ↗ · 4天前 缓存

本文推导了资源充足学习中精确的任务信息-状态前沿,展示了有限的先验任务信息如何通过低秩算子的分区减少保留状态,并应用于注意力和数字孪生模型。

0 人收藏 0 人点赞
#compression

现在瓶颈是压缩与记忆(以及一点输入过滤)

Reddit r/singularity ↗ · 4天前

作者认为AI的瓶颈在于记忆和压缩,将LLMs与人类记忆效率进行比较,并建议改进工具集成以提高性能。

0 人收藏 0 人点赞
#compression

@Suhail: DSV4.1 中的 Engram 表格超级酷!一切都是压缩、压缩、压缩。之后,全是……

X AI KOLs Timeline ↗ · 6天前

这条推文表达了对 DSV4.1 中 Engram 表格的兴奋之情,强调了它们在压缩和缓存技术中的作用。

0 人收藏 0 人点赞
#compression

Bonsai 2 27B:在占用空间缩小9倍的条件下实现近无损压缩

Hacker News Top ↗ · 2026-09-17 缓存

介绍Ternary Bonsai 2 27B,这是一个高度压缩的AI模型,在占用空间缩小9倍的同时保留了98.2%的性能,使得推理、编码和多模态处理等任务能够高效地在本地部署。

0 人收藏 0 人点赞
#compression

DeepSeek-v4.1 Flash: 突破KV缓存压缩的极限

Hacker News Top ↗ · 2026-09-17 缓存

本文分析了DeepSeek-V4.1 Flash模型,详细介绍了其关于KV缓存压缩的技术报告和架构优化,这些优化实现了高效的长上下文处理和高速推理。

0 人收藏 0 人点赞
#compression

规格预言机

arXiv cs.LG ↗ · 2026-09-15 缓存

本文研究将语言模型用作紧凑的规格预言机,通过比较外部笔记和权重调整来存储事实,发现调整后的权重能更好地利用结构,但存储成本更高。

0 人收藏 0 人点赞
#compression

为什么机器学习研究代理不会过拟合?

Hacker News Top ↗ · 2026-09-14 缓存

本文解释了为什么机器学习研究代理在迭代基准测试评估中避免过拟合,将这一现象归因于压缩以及少量令牌拟合在泛化中的作用。

0 人收藏 0 人点赞
#compression

可扩展的离散到连续信道模拟用于压缩与隐私

arXiv cs.LG ↗ · 2026-09-14 缓存

本文提出了一种使用固定随机样本来模拟离散到连续信道的可扩展方法,提高了在可变速率压缩和差分隐私分布式估计应用中的效率。

0 人收藏 0 人点赞
#compression

压缩的代价:事实幻觉的速率-失真极限

arXiv cs.CL ↗ · 2026-09-14 缓存

本文为闭卷问答中的事实幻觉引入了一个速率-失真理论框架,区分了有限内存下缺失覆盖和压缩失真导致的错误。

0 人收藏 0 人点赞
#compression

通过方向分解解析Transformer中的表示演化

Hugging Face Daily Papers ↗ · 2026-09-14 缓存

本文将Transformer表示更新分解为平行和垂直分量,以研究演化几何,并将其与编辑鲁棒性、压缩诊断和训练改进联系起来。

0 人收藏 0 人点赞
#compression

@mervenoyann: 加入寻找终极压缩算法的代理集群!宣布:Hutter Prize 挑战 > 加入组织 h…

X AI KOLs Timeline ↗ · 2026-09-11 缓存

宣布在 Hugging Face 的 Agent Collaborations 上的 Hutter Prize 挑战,AI 代理协作寻找终极无损压缩算法。

0 人收藏 0 人点赞
#compression

X-AuT:针对语音大语言模型的渐进式音频编码器压缩与跨尺度蒸馏

Hugging Face Daily Papers ↗ · 2026-09-10 缓存

X-AuT是一个渐进式框架,用于压缩语音大语言模型中的音频编码器层,通过跨尺度蒸馏和LoRA适配等技术,在降低推理成本的同时恢复准确性。

0 人收藏 0 人点赞
#compression

视觉文档检索中的生成式后期交互嵌入

Hugging Face Daily Papers ↗ · 2026-09-10 缓存

介绍了生成式后期交互嵌入(GLIE),用于压缩视觉文档检索向量,通过按需重新生成完整嵌入来提高存储约束下的准确性。

0 人收藏 0 人点赞
#compression

我的Qwen3.8-27B任务感知量化在15%的体积下达到了BF16推理性能的99%。

Reddit r/LocalLLaMA ↗ · 2026-09-07

一种名为TAK的新任务感知量化方法,在显著减小模型尺寸的情况下,实现了接近BF16的推理性能,在多种AI模型上超越了Unsloth。

0 人收藏 0 人点赞
#compression

BZip3

Hacker News Top ↗ · 2026-09-07 缓存

BZip3 是一种高性能的压缩工具,与前驱 BZip2 相比,提供更优的压缩率和速度,利用先进的算法如上下文混合熵编码和 Burrows-Wheeler 变换。

0 人收藏 0 人点赞
#compression

Cadence:基于时间序列基础模型的需求时间序列有界误差有损压缩

Hugging Face Daily Papers ↗ · 2026-09-05 缓存

Cadence 提出了一种使用基础模型和自适应算术编码器的有界误差有损压缩方法,用于时间序列,相比经典预测器实现了显著性能提升。

0 人收藏 0 人点赞
#compression

激进解码时KV缓存驱逐的关键因素:时间聚合与排序保持

arXiv cs.AI ↗ · 2026-09-04 缓存

本文研究了AI模型解码时KV缓存压缩中时间聚合和排序保持的重要性,并引入InertiaKV方法以提高解码吞吐量。

0 人收藏 0 人点赞
#compression

让我们从头开始构建压缩器

Lobsters Hottest ↗ · 2026-09-02 缓存

本文提供了关于文件压缩的教程,解释了Huffman编码和DEFLATE算法的基础知识,并包含一个交互式平台用于实践学习。

0 人收藏 0 人点赞
#compression

良好记忆需有ECC:超越准确率评估视觉-语言模型的记忆能力

arXiv cs.LG ↗ · 2026-09-02 缓存

本文提出了ECCBench,一个用于评估视觉-语言模型记忆能力的基准和评估框架,超越准确率指标,聚焦于效率、压缩与校准三个维度。

0 人收藏 0 人点赞
#compression

@dair_ai: 如果你在生产环境中构建代理技能,请查看阿里巴巴的这篇优秀论文。你可以将生产代理技能看作……

X AI KOLs Timeline ↗ · 2026-09-01 缓存

SkillZip Pro 是一种用于生产代理技能包的压缩方法,可将令牌使用量减少38%且不损失质量,从而提高人工智能代理部署的效率。

0 人收藏 0 人点赞
Next →
← 返回首页

提交意见反馈