BitTide
首页
最新
模型
工具
新闻
产品
论文
事件
今日日报
搜索
订阅
English
登录
lookahead-sparse-attention
标签
Cards
List
#lookahead-sparse-attention
FlashMemory-DeepSeek-V4:通过前瞻稀疏注意力实现闪电索引超长上下文
Hugging Face Daily Papers
↗
· 2026-06-08
缓存
提出在DeepSeek-V4上结合神经记忆索引器的前瞻稀疏注意力,将GPU内存使用降至全上下文基线的约13.5%,同时保持或略微提升准确率。
0 人收藏
0 人点赞
← 返回首页
意见反馈
×
提交意见反馈
感谢您的反馈!
提交