performance-benchmarks

标签

Cards List
#performance-benchmarks

@msimoni:我在为Wasm GC开发的新语言中实现的红黑树与原生……一样快,并且内存消耗大致相同。

X AI KOLs Following · 5天前 缓存

作者的红黑树实现在一种用于Wasm GC的新语言中,在速度和内存使用上与原生C相匹配,并计划发布代码库。

0 人收藏 0 人点赞
#performance-benchmarks

Qwen3.8-Flash-Next NVFP4 第3天对4xV100的支持

Reddit r/LocalLLaMA · 2026-08-30

RadixArk/Qwen3.8-Flash-Next-NVFP4 现已在 SGLang-V100 中得到支持,使得在 4xV100 GPU 上能够进行全上下文操作,性能指标显示高吞吐量,上下文处理能力高达 256k tokens。

0 人收藏 0 人点赞
#performance-benchmarks

@vicky_grok:https://x.com/vicky_grok/status/2092448354815099378

X AI KOLs Timeline · 2026-08-26 缓存

本文深入探讨了检索增强生成(RAG)和向量搜索,基于10万份文档的基准测试,展示了精确搜索与IVF索引在速度和召回率之间的权衡。

0 人收藏 0 人点赞
#performance-benchmarks

Ornith-1.0-35B GGUF 更新:原生 MTP 推测解码嫁接 + 完整服务/TTFT/长上下文数据(llama.cpp, tp=1)

Reddit r/LocalLLaMA · 2026-06-28

Ornith-1.0-35B GGUF 模型更新引入了原生 MTP 推测解码嫁接,可在单 GPU 上实现更快推理,解码速度提升约 1.3-1.35 倍,同时保持几乎相同的 token 分布。提供了多个量化版本的吞吐量、TTFT 和长上下文性能的基准数据。

0 人收藏 0 人点赞
#performance-benchmarks

为何中国AI模型正在重塑AI经济学

Reddit r/AI_Agents · 2026-06-03

像DeepSeek和Qwen这样的中国AI模型,以比西方同类产品低5至20倍的成本提供有竞争力的性能,正在重塑AI经济学并推动多模型部署策略。

0 人收藏 0 人点赞
← 返回首页

提交意见反馈