token-speed

标签

Cards List
#token-speed

我现在(主要)根据速度而非智能来挑选模型

Lobsters Hottest · 2026-08-02 缓存

作者认为前沿大语言模型已经达到了“足够好”的智能门槛,因此现在选择模型时更看重速度而非原始智能,并举例说像GLM5.2和DeepSeek V4 Flash这样快速的开源权重模型已成为日常主力。

0 人收藏 0 人点赞
#token-speed

我制作了一个离线、单文件的GPU构建选择器,用于估算一台设备能运行哪些本地模型以及以多少tok/s的速度运行

Reddit r/LocalLLaMA · 2026-06-27

一位开发者创建了一个离线、单文件的GPU构建选择器,用于估算系统能运行哪些本地AI模型以及其token生成速度。

0 人收藏 0 人点赞
#token-speed

N tokens per second 到底有多快?

Hacker News Top · 2026-05-18 缓存

一个网页工具,让用户直观体验不同LLM token生成速率(例如5–800 tok/s)在代码、文本、推理和智能体模式下的表现,帮助内化基准测试中的性能数据。

0 人收藏 0 人点赞
← 返回首页

提交意见反馈