a100

标签

Cards List
#a100

@ivanalog_com: 调试了一会儿,现在在Google A100上运行Qwen Flash的速度(3000+预填充,90+ tps)已经更快了…

X AI KOLs Timeline ↗ · 昨天 缓存

一个名为collabosm的GitHub仓库提供了一个优化设置,用于在Google Colab A100上运行Qwen3.8-Flash-Next模型,实现了比商业API更快的推理速度,并附有详细的性能指标和说明。

0 人收藏 0 人点赞
#a100

@QuixiAI:我让 DeepSeek v4 Flash 0731 在 4x A100 上用 SlimServe 运行起来。单请求 175 tok/s,64 并发 1k tok/s…

X AI KOLs Timeline ↗ · 2026-08-10 缓存

QuixiAI 报告称,使用 SlimServe 在 4x A100 上运行 DeepSeek v4 Flash 0731,单请求达到 175 tok/s,64 并发请求达到 1k tok/s。

0 人收藏 0 人点赞
#a100

DeepSeek-V4-Flash-0731 unsloth gguf 在 A100 上

Reddit r/LocalLLaMA ↗ · 2026-07-31

展示了 DeepSeek-V4-Flash-0731 在单块 40GB A100 上以 unsloth GGUF 量化版本运行,速度为 17.7 tok/s,并将 6 个专家加载到显存中,从而实现了完整的智能体编码循环。

0 人收藏 0 人点赞
#a100

如果需要四颗GPU,那么“GPU小时”就不再是商品了(6分钟阅读)

TLDR AI ↗ · 2026-07-24 缓存

对Vast.ai上GPU租赁价格的分析显示,由于供应限制,多GPU配置的定价与每GPU小时的标价存在显著偏差,较大的集群往往不可用或更昂贵。

0 人收藏 0 人点赞
#a100

PSA:Nvidia的CMP 170HX完全计算和内存(80GB)可能可通过漏洞解锁

Reddit r/LocalLLaMA ↗ · 2026-07-16

Nvidia Falcon安全处理器中的一个潜在漏洞可能允许将性能受限的CMP 170HX加密货币挖矿GPU解锁为完整的A100 80GB,有望使高端AI硬件以不到1000美元的价格获得。

0 人收藏 0 人点赞
#a100

RunPod、Vast.ai 和 AWS 上 Spot/可抢占型 H100 和 A100 定价 - 2026 年 6 月数据 [D]

Reddit r/MachineLearning ↗ · 2026-07-01

截至 2026 年 6 月,RunPod、Vast.ai 和 AWS 上 H100 和 A100 的 Spot/可抢占型 GPU 定价分析,指出了显著折扣但也存在波动性和可用性问题。

0 人收藏 0 人点赞
#a100

A100上Qwen3.6-27B-FP8运行缓慢

Reddit r/LocalLLaMA ↗ · 2026-06-21

Qwen3.6-27B-FP8模型在A100 GPU上运行时性能较慢

0 人收藏 0 人点赞
#a100

在实际工作负载下,DiffusionGemma 与基准演示的表现截然不同

Reddit r/LocalLLaMA ↗ · 2026-06-11

DiffusionGemma 的内部测试显示,在实际工作负载下,H100 与 A100 GPU 之间存在显著的性能差异;H100 在并发下的扩展性更好,且效率因工作负载类型而异,这引发了对基准测试可靠性的质疑。

0 人收藏 0 人点赞
← 返回首页

提交意见反馈