context-size

标签

Cards List
#context-size

[基准测试] DFlash2 与 MTP 比较。5090RTX, Qwen 3.8 27B, Dynamic v3 GGUF, llama.cpp。令牌生成、延迟和可用上下文。

Reddit r/LocalLLaMA · 4天前

该基准测试对 llama.cpp 中的 DFlash2 与 MTP 技术进行了比较,结果表明 DFlash2 的令牌生成速度提高了约 20%,但可用上下文减少了 38%。

0 人收藏 0 人点赞
#context-size

@GergelyOrosz: 我开始意识到理解上下文大小、上下文退化、上下文压缩等行为的重要性……

X AI KOLs Following · 2026-07-02 缓存

Gergely Orosz 强调了理解 AI 模型中的上下文大小、退化和压缩的重要性,以解释为什么模型会忘记大型输入中的部分内容。

0 人收藏 0 人点赞
#context-size

vibe coding 的昂贵部分不是重试次数,而是你带入每一次重试的上下文

Reddit r/AI_Agents · 2026-06-10

一位开发者揭示,在AI辅助调试会话中,实际成本驱动因素是每次重试累积的上下文,而非重试次数,并介绍了一款名为codeburn的开源工具来分析会话成本。

0 人收藏 0 人点赞
#context-size

(吐槽;)) 让你的基准测试更贴近现实

Reddit r/LocalLLaMA · 2026-05-08

社区吐槽:呼吁AI模型基准测试应更贴近现实,考虑上下文大小、多模态特性、具体硬件配置和并行处理,而不仅仅是原始速度。

0 人收藏 0 人点赞
← 返回首页

提交意见反馈