performance-benchmarks

标签

Cards List
#performance-benchmarks

Ornith-1.0-35B GGUF 更新:原生 MTP 推测解码嫁接 + 完整服务/TTFT/长上下文数据(llama.cpp, tp=1)

Reddit r/LocalLLaMA · 2026-06-28

Ornith-1.0-35B GGUF 模型更新引入了原生 MTP 推测解码嫁接,可在单 GPU 上实现更快推理,解码速度提升约 1.3-1.35 倍,同时保持几乎相同的 token 分布。提供了多个量化版本的吞吐量、TTFT 和长上下文性能的基准数据。

0 人收藏 0 人点赞
#performance-benchmarks

为何中国AI模型正在重塑AI经济学

Reddit r/AI_Agents · 2026-06-03

像DeepSeek和Qwen这样的中国AI模型,以比西方同类产品低5至20倍的成本提供有竞争力的性能,正在重塑AI经济学并推动多模型部署策略。

0 人收藏 0 人点赞
← 返回首页

提交意见反馈