由 Qwen 3.8 27B 驱动的操作系统,速率达每秒 1950 令牌!以下是 @Alibaba_Qwen 的 3.8 27b 在 1,950 令牌/秒下的实际效果…

X AI KOLs Following 新闻

摘要

演示一个基于 Qwen 3.8 27B 的操作系统,在 Cerebras 硬件上以每秒 1950 令牌的速率运行,其中模型权重充当实时软件生成的运行时环境。

由 Qwen 3.8 27B 驱动的操作系统,速度达每秒 1950 令牌! 以下是 @Alibaba_Qwen 的 3.8 27b 在 @cerebras 上以每秒 1,950 令牌运行时的实际样子: 我编写了一个最小的 Python Web 服务器,将 Cerebras 推理转变为实时操作系统。 磁盘上没有任何应用程序。 当你双击图标时: 1) Python 代理从 Qwen 27b 以 1,950 令牌/秒的速率获取原始 SSE 流 2) 计算器编译并安装在 11 秒内 3) 完整的画布绘画工作室与笔刷引擎编译在 10 秒内完成。 在每秒 2,000 令牌的速度下,软件只是一种按需生成的幻象,能够即时运行。 模型权重就是操作系统的运行时环境。 在每秒 1,950 令牌的速度下,你还会构建什么?
查看原文
查看缓存全文

缓存时间: 2026/09/15 05:37

由通义千问3.8 27B驱动的操作系统,速度达1950 tokens/秒!

以下是@cerebras上@Alibaba_Qwen 3.8 27B在1,950 tokens/秒的实际表现:

我编写了一个极简的Python Web服务器,将Cerebras推理转化为实时操作系统。

磁盘上零预装应用。

当你双击图标时:

  1. Python代理从通义千问27B获取1,950 tok/s的原始SSE流
  2. 计算器编译并挂载仅需11秒
  3. 完整的画布绘画工作室(含笔刷引擎)编译耗时10秒

在2,000 tokens/秒的速度下,软件即刻成为按需生成的即时幻觉。

模型权重本身就是操作系统运行时。

在1,950 tokens/秒的速度下,你还会构建什么?

Alok (@analogalok): 通义千问3.8 27B Cerebras推理数据:

速度:1,850 tok/s 成本:输入 $0.99/百万token | 输出 $1.49/百万token

智能涌现如数据库查询般迅捷。

标准60Hz屏幕每16.6ms刷新一次。

  • 本地3090/4090(4-bit):75 tok/s(1.2 tokens/帧)
  • Cerebras 通义千问3.8 27B:1,850 tok/s(31

相似文章

Qwen 3.8 27B 比预期更快

Reddit r/LocalLLaMA

一位用户报告称,Qwen 3.8 27B 模型在双 5060 TI 显卡上达到了 50-60 个令牌每秒的速度,显示出比之前版本(如 Qwen 3.6)更令人意外的速度提升。