ai-workloads

标签

Cards List
#ai-workloads

Mac Mini 供货情况:长时间等待与更高价格

Wired · 2026-07-29 缓存

由于本地AI工作负载的需求旺盛,苹果Mac Mini持续面临供应限制,高内存配置的出货时间延长至三个月,第三方零售商价格也更高。

0 人收藏 0 人点赞
#ai-workloads

@RituWithAI: 有人打造了一款工具,能自动找到全球最便宜的GPU来运行你的AI工作负载,并直接在那里执行。AWS…

X AI KOLs Timeline · 2026-07-25 缓存

SkyPilot是一个开源工具,可自动在18个云提供商中寻找并配置最便宜的GPU用于AI工作负载,通过竞价实例和自动管理将成本降低高达10倍。

0 人收藏 0 人点赞
#ai-workloads

@quasagroup: Modal Review: Run AI Workloads Without Managing Servers https://youtu.be/a8vuwYK90-Q?si=vYj7YpobSXGNCDpQ… via @YouTube

X AI KOLs Timeline · 2026-07-24 缓存

Modal 是一个专为 AI 工作负载设计的无服务器云平台,支持推理、训练和沙箱,通过纯 Python 代码实现从零到上千 GPU 的瞬间扩展,大幅降低延迟并加速产品上市。

0 人收藏 0 人点赞
#ai-workloads

NVLink 何时值得使用?

Hacker News Top · 2026-07-22 缓存

在双 RTX 3090 上测试 NVLink 用于 AI 推理和训练,发现张量并行提示处理(30%)和 FSDP 训练(3 倍)有显著加速,但对令牌生成或分层推理影响极小。

0 人收藏 0 人点赞
#ai-workloads

AMD ROCm 7.14 "TheRock" 技术预览已发布,针对最新 AMD GPU 计算堆栈

Reddit r/LocalLLaMA · 2026-07-16 缓存

AMD 发布了 ROCm 7.14 'TheRock' 技术预览,带来了AI训练增强、针对Comfy UI等特定AI工作负载的性能提升高达16%,以及对开源GPU计算堆栈的持续Windows支持。

0 人收藏 0 人点赞
#ai-workloads

从双3090升级 - 应该添加什么?(双A6000/5090/48GB 4090?)

Reddit r/LocalLLaMA · 2026-07-11

关于从双RTX 3090升级到替代方案(如双A6000、RTX 5090或48GB RTX 4090)的讨论,可能用于AI/ML工作负载。

0 人收藏 0 人点赞
#ai-workloads

@charles_irl: 费率不是成本!无服务器 GPU 每小时可能更贵,但在许多实际情况下,它们总成本更低。…

X AI KOLs Following · 2026-07-08 缓存

无服务器 GPU 的每小时费率可能更高,但根据工作负载的峰值与平均需求比,总体而言可能更具成本效益。Modal 博客上的这篇文章用一个小组件进行了说明。

0 人收藏 0 人点赞
#ai-workloads

在任何云上运行AI工作负载,存储在Hugging Face:SkyPilot的零出口存储

Hugging Face Blog · 2026-07-07 缓存

Hugging Face Storage现已成为SkyPilot的一级后端,允许用户将Hugging Face仓库和存储桶挂载到任何云上的任务中,无需支付出口费用,从而在多个提供商之间实现灵活的GPU计算。

0 人收藏 0 人点赞
#ai-workloads

@FinanceYF5: 以下是正在把 AI 工作负载迁移到中国模型的西方公司名单: 这正在变成一个采购决策层面的故事!!!

X AI KOLs Timeline · 2026-06-30 缓存

有报道指出西方公司正将AI工作负载迁移到中国模型,这正在演变为一个采购决策层面的趋势。

0 人收藏 0 人点赞
#ai-workloads

中国凭借全球最快超级计算机击败美国,但该机器未针对AI工作优化

Reddit r/ArtificialInteligence · 2026-06-23

中国凭借全球最快的超级计算机超越了美国,不过该机器并未针对AI工作负载进行优化。

0 人收藏 0 人点赞
#ai-workloads

@jerryjliu0: LiteParse,我们的开源/基于Rust的文档解析器,运行速度之快,连Claude Fable 5都难以置信 🔥

X AI KOLs Following · 2026-06-09 缓存

LiteParse 是一款快速的开源文档解析器,采用 Rust 编写,提供带边界框的高质量空间文本提取功能,支持多种语言和平台,适用于 AI 文档工作负载。

0 人收藏 0 人点赞
#ai-workloads

Intel Optane 用于 AI 工作负载

Reddit r/ArtificialInteligence · 2026-06-03 缓存

英特尔已停产的 Optane 持久内存技术在 AI 工作负载中找到了第二春,用户可以利用廉价的二手 Optane 模块,在本地以大约每秒 4 个 token 的速度运行一个 1 万亿参数的模型。文章强调了 Optane 相比 SSD 具有更低的延迟,使其尽管比 DRAM 慢,但依然适用于大型模型推理。

0 人收藏 0 人点赞
#ai-workloads

Computex 2026:英特尔发布Crescent Island GPU,最高配备480GB显存

Reddit r/LocalLLaMA · 2026-06-01

英特尔在Computex 2026上发布了Crescent Island GPU,最高配备480GB显存,基于Arc Xe 3P架构,面向下一代AI工作负载。

0 人收藏 0 人点赞
#ai-workloads

阿里巴巴推出新款AI芯片,推动国产替代方案(3分钟阅读)

TLDR AI · 2026-05-21

阿里巴巴发布了Zhenwu M890 AI芯片,该芯片专为满足AI智能体工作负载的内存和通信需求而设计,是其推动国产替代方案的一部分。

0 人收藏 0 人点赞
#ai-workloads

AMD呼吁IT领导者重新思考AI基础设施规划:代理型AI不仅仅是往GPU机箱里加更多CPU

Reddit r/ArtificialInteligence · 2026-05-08

AMD认为,代理型AI需要重新思考基础设施规划,需要专用的CPU机架来处理编排和控制工作负载,将CPU:GPU比例从1:8或1:4转变为1:1或更高,而不是简单地给GPU密集型服务器增加更多CPU。

0 人收藏 0 人点赞
← 返回首页

提交意见反馈