关于动态图形的Opus 5.5帖子很酷,但Qwen 27B在4090上做了这个
摘要
本文讨论了使用Qwen 27B模型在4090 GPU上创建动态图形,突出了受Opus 5.5启发的本地AI能力。
看到数百条推文,人们不断向Opus 5.5索要动态图形视频。决定让qwen看看它们并自己制作一个。本地能实现的效果真是令人惊叹。**编辑** 看起来卡顿是因为reddit的.gif限制,顺便说一下,完整高清版本(带音频)在这里:https://x.com/mkultraware/status/2104192428664127555 提示和构建于:https://github.com/mkultraware/accuretta https://i.redd.it/5gmotgxx82sh1.gif
相似文章
在单卡5090上本地运行Qwen 3.8 27B的测试
本文展示了在单卡5090 GPU上本地运行Qwen 3.8 27B AI模型的能力,使用Row-Bot生成丰富的动画,展示从语言合成到物理模拟的任务。
Wow!Qwen 3.6:35b-a3b 在 3090 上……太惊人了。
一位用户分享了在二手 RTX 3090 上运行量化版 Qwen 3.6:35b-a3b 模型的惊人结果:将模型放入显存后,输出速度达到每秒 160 个 token,并以 75 秒的视频处理时间展示了视觉能力。
@xenovacom:Opus 4.7 刚写了一个定制 WebGPU 内核,用融合 LinearAttention 算子把 Qwen3.5 推理速度提升最高 13 倍!智能内核…
Opus 4.7 自动生成定制 WebGPU 内核,通过融合 LinearAttention 将 Qwen3.5 推理加速最高 13 倍,现已随 Transformers.js v4.2.0 发布。
@RoundtableSpace: Qwen 3.8 27B 在本地 RTX 5090 上运行时,在个人基准测试中击败 Opus 4.8,速度高达每秒200个令牌,无需...
Qwen 3.8 27B 是一个拥有270亿参数的AI模型,在本地RTX 5090 GPU上运行时,在个人基准测试中超越Opus 4.8,速度高达每秒200个令牌,无需互联网或API访问。
大家忽略了 Qwen 3.8 27B Q2 + Q2 DFlash + Q5 KV 的实力
一位用户分享了使用 QAT Q2 和 Q5 KV 运行量化版 Qwen 3.8 27B 模型的经验,在 12GB 显卡上实现了高达 200K token 上下文的高性能,性能超越了 Sonnet 4.6 等模型。