compression

标签

Cards List
#compression

@_yusufknl: In 1948, Claude Shannon invented the math behind every LLM you use today. He tested it by making his wife guess the nex…

X AI KOLs Timeline · 2026-07-21 缓存

A detailed walkthrough explains how Claude Shannon's 1948 information theory underlies LLMs and shows that the 'next-token prediction' story is misleading, linking compression and prediction mathematically.

0 人收藏 0 人点赞
#compression

为什么是 l(k 和 q 的新运行时)

Lobsters Hottest · 2026-07-21 缓存

K 和 Q 编程语言的新运行时,利用 SIMD、并行、融合和压缩技术重新构想执行方式,以更好地发挥现代硬件的性能。

0 人收藏 0 人点赞
#compression

SelKV:基于逐标记合并或丢弃及注意力补偿的选择性 KV 缓存合并

arXiv cs.AI · 2026-07-21 缓存

SelKV 是一个无需训练的 KV 缓存压缩框架,它使用软余弦门进行选择性合并,并通过注意力比例补偿机制纠正 softmax 不平衡,在仅保留 25% 缓存大小的情况下实现近乎无损的生成,在 LongBench 上取得 3.3 倍解码加速。

0 人收藏 0 人点赞
#compression

Postgres 19 压缩:从 pglz 到 LZ4

Lobsters Hottest · 2026-07-20 缓存

PostgreSQL 19 计划将默认的 TOAST 压缩算法从 pglz 改为 LZ4,提供更好的性能和效率。文章介绍了 Postgres 压缩的历史以及切换的原因。

0 人收藏 0 人点赞
#compression

@0xSero: https://x.com/0xSero/status/2079230064840106173

X AI KOLs Timeline · 2026-07-20 缓存

一个由爱好者组成的社区成功在15000美元的预算下,使用REAP剪枝和2位GGUF量化,以接近无损质量运行了753B参数的GLM-5.2混合专家模型,牺牲吞吐量以降低成本。

0 人收藏 0 人点赞
#compression

VarRate: 无训练的可变速率KV缓存压缩用于长上下文大语言模型

arXiv cs.CL · 2026-07-20 缓存

介绍VarRate,一种无训练的KV缓存压缩方法,根据查询显著性为每个令牌分配可变低秩预算,避免了不可逆的令牌驱逐,并且在LongBench上以匹配的内存预算优于均匀秩方法。

0 人收藏 0 人点赞
#compression

Looped Latent Attention: Cross-Loop KV Compression for Looped Transformers

arXiv cs.LG · 2026-07-20 缓存

提出循环隐注意力(LLA),一种训练后编解码器,通过利用递归步骤间的低秩结构压缩循环变压器中的KV缓存,在保持性能的同时实现显著压缩比。

0 人收藏 0 人点赞
#compression

基于隐式神经表示的数据驱动视频编解码器

arXiv cs.AI · 2026-07-20 缓存

本文提出一种视频编解码器,将视频和音频存储为正弦表示网络(SIREN)的权重,利用知识蒸馏和量化进行压缩。实验显示,与原始网络相比压缩比为2.61倍,但质量落后于H.264和HEVC等标准编解码器。

0 人收藏 0 人点赞
#compression

@_yusufknl: 作为一个从GPT-2时代就开始部署LLM的人,这位斯坦福数学毕业生关于交叉熵的讲座是…

X AI KOLs Timeline · 2026-07-19 缓存

一位从业者推荐了一场免费的33分钟关于交叉熵的讲座,该讲座将语言模型重新定义为压缩而非下一个词预测,并比作斯坦福机器学习博士资格考试。

0 人收藏 0 人点赞
#compression

@mihirp98: 图像、视频、音频、动作——生成式建模已趋同于一个范式:压缩成连续潜变量,生成…

X AI KOLs Timeline · 2026-07-16 缓存

研究人员提出Latent Thought Flows,将256个文本令牌压缩为8个连续潜变量,实现单步生成,在推理计算与生成质量的帕累托前沿上优于自回归基线。

0 人收藏 0 人点赞
#compression

@Ryrenz: Mac 用了五年才找到这 6 个免费开源的实用工具! 1、IINA — 45.5k star,Mac 上最好看的视频播放器。为 macOS 原生设计,什么格式都支持,拖进去就播。 https://iina.io 2、Stats — 40.…

X AI KOLs Timeline · 2026-07-16 缓存

推荐6个免费开源的Mac实用工具,包括IINA视频播放器、Stats系统监控、MonitorControl外接显示器控制、Ice菜单栏管理、AltTab窗口切换、Keka压缩解压。

0 人收藏 0 人点赞
#compression

ShortOPD:通过短到长在策略蒸馏恢复剪枝后的大语言模型

arXiv cs.LG · 2026-07-16 缓存

ShortOPD提出了一种短到长的在策略蒸馏方案,通过将训练集中在有效前缀上,恢复用于自由形式生成的剪枝后大语言模型,相较于未恢复模型实现了高达9倍的改进,并以四分之一的训练时间达到了长视界蒸馏的效果。

0 人收藏 0 人点赞
#compression

@0x0SojalSec: 这个工具将6000万个文本块从201GB压缩到仅6GB,且精度无损,可在本地笔记本上运行

X AI KOLs Timeline · 2026-07-15 缓存

该工具将6000万个文本块从201GB压缩到6GB,用于RAG且精度无损,使得在笔记本上实现强大的本地检索增强生成成为可能。

0 人收藏 0 人点赞
#compression

Show HN: misa77 - 一种比 LZ4 解码快 2 倍的编解码器(且压缩率更高)

Hacker News Top · 2026-07-15 缓存

misa77 是一种基于 LZ 的新型编解码器,其解压吞吐量比 LZ4 快达 2 倍,同时还能提供更好的压缩比。它适用于一次写入多次读取的工作负载,并且内存占用恒定。

0 人收藏 0 人点赞
#compression

@thesupermanmx: SAM ALTMAN 疯了。Google 刚刚将 AI 内存从 31GB 压缩到 4GB。他们开源了一个向量索引,可容纳 10…

X AI KOLs Timeline · 2026-07-15 缓存

Google 开源了一个向量索引,将 31GB 的 AI 内存压缩到 4GB,可容纳 1000 万文档,搜索速度比 FAISS 更快,且无需训练或 GPU。

0 人收藏 0 人点赞
#compression

智能的原子单元:压缩层视角

arXiv cs.AI · 2026-07-15 缓存

本文提出了一个将智能视为原子压缩与组合复用的理论框架,引入了压缩演算与复合级联论点。

0 人收藏 0 人点赞
#compression

查询可见性如何改变KV-Cache压缩排名:一项匹配预算的审计

arXiv cs.LG · 2026-07-15 缓存

本文在查询无关协议下审计了六种KV-cache压缩方法,发现与查询感知评估相比,排名发生了显著变化,这对长上下文推理中的缓存重用具有重要意义。

0 人收藏 0 人点赞
#compression

KV缓存压缩的消融、统计推断与验证

arXiv cs.LG · 2026-07-14 缓存

本文对KV缓存压缩方案(TurboQuant和SpectralQuant)进行了系统的比较研究,介绍了一种统计验证方法,并针对高效Transformer推理提供了特定场景下的建议。

0 人收藏 0 人点赞
#compression

@charliermarsh: 我们发现了一些优化,通过“压缩”环境标记来减小 uv.lock 文件的大小。…

X AI KOLs Timeline · 2026-07-13 缓存

uv 的锁文件大小通过压缩环境标记减少了 40-50%。

0 人收藏 0 人点赞
#compression

优化Lua字符串字面量以节省400字节

Hacker News Top · 2026-07-13 缓存

一篇技术博客文章,探讨在ComputerCraft程序环境下,通过选择最优表示方式(引号字符串与原始字符串)来减小Lua字符串字面量大小的方法,实现了400字节的节省。

0 人收藏 0 人点赞
← Previous
Next →
← 返回首页

提交意见反馈