rtx-3060

标签

Cards List
#rtx-3060

@DogukanUrker: Ornith-1.5-9B在单张RTX 3060上使用Q5量化:200k上下文约52 token/s,预填充约1700 token/s。占用11.8GB(共12GB),零CPU卸载。

X AI KOLs Timeline · 昨天 缓存

这篇文章详细介绍了在RTX 3060上运行Ornith-1.5-9B AI模型,使用200k上下文,通过高级量化技术实现高速推理。

0 人收藏 0 人点赞
#rtx-3060

@DogukanUrker: 单张RTX 3060上运行Gemma 4 12B:完整262,144上下文,速度约100 tok/s。(配置如下)密集模型 -> MTP推测…

X AI KOLs Timeline · 2026-07-21 缓存

DogukanUrker演示了在单张RTX 3060上使用推测解码和KV缓存拆分运行Gemma 4 12B,拥有完整262,144上下文,速度约100 tok/s,实现了接近满GPU利用率且无需CPU卸载。

0 人收藏 0 人点赞
#rtx-3060

@alamin_ai_: 天哪,伙计们,这太难以置信了 请听一下黎凡特阿拉伯语和英语之间的无缝代码切换,提高了7…

X AI KOLs Following · 2026-07-06 缓存

在黎凡特阿拉伯语语音合成和英语代码切换方面取得了重大突破,使用单张RTX 3060在一晚上实现了76%的提升。

0 人收藏 0 人点赞
#rtx-3060

在RTX 3060上运行的Qwen3.6-35B-A3B能否取代Google Vision进行收据到JSON的提取?

Reddit r/LocalLLaMA · 2026-06-26

一位开发者分享了在RTX 3060上使用本地Qwen VL模型将日语收据解析为JSON的经验,取代了Google Vision,结果显示关键字段提取准确,每张收据约需31秒。

0 人收藏 0 人点赞
← 返回首页

提交意见反馈