@AYi_AInotes: Damn,英伟达和老黄真的是憋了个大的啊,真特么牛逼 今天全网都在转黄仁勋这台拔了电源还能满帧跑 3A 的笔记本,但大多数人看错了重点,游戏其实只是这台机器的糖衣。 真正的核弹是那 128GB 统一内存,它意味着你桌上一台轻薄本,能在本地…
摘要
文章评价NVIDIA新款笔记本,其128GB统一内存使本地运行200B大模型成为可能,拔电不掉帧,瞄准AI本地部署用户,认为这是将数据中心能力下放至便携设备的重要一步。
查看缓存全文
缓存时间: 2026/06/03 01:40
Damn,英伟达和老黄真的是憋了个大的啊,真特么牛逼
今天全网都在转黄仁勋这台拔了电源还能满帧跑 3A 的笔记本,但大多数人看错了重点,游戏其实只是这台机器的糖衣。
真正的核弹是那 128GB 统一内存,它意味着你桌上一台轻薄本,能在本地直接跑起 200B 参数的大模型,这在过去是只有数据中心机柜才干得动的事。
所以 NVIDIA 这次干的根本已经不是又一个游戏本那么简了,它把数据中心那套 Grace CPU 加 Blackwell GPU 整个下放,
1 PetaFLOP 的 FP4 算力、RTX 5070 级的显卡、CPU 和 GPU 共享的统一内存,一起塞进一个能背着走的壳子里。
拔电不掉帧、续航炸裂,这些是讲给所有人听的甜头,这回真正瞄准的,是要在本地跑 AI 的那波人。
如果把游戏本三个字去掉,你会看见一件更大的事。
这就像一个一直只卖发动机的厂商,突然开始造整车,顺手还把高速公路也给铺了,CUDA 是发动机,Grace 是底盘,Windows on Arm 是路,
从今往后你想跑得快,就只能在它修的这条路上跑。
当然,舞台上拔电不掉帧是十分钟的高光,长时间满载会不会降频、ARM 版 Windows 靠兼容层跑老软件会掉多少性能、这套东西最后卖一个什么价,发布会一个都没回答。
但方向已经很清楚了,Intel 和 AMD 还能追性能追制程,但CUDA 攒了十几年的那群开发者肯定是追不上了,
老黄卖的从来不是一台更强的电脑,是一条你用顺手了,就再也下不来的路!
Geeklik ve Ötesine (@GeeklikOtesine): NVIDIA, ARM tabanlı yeni işlemcisi RTX Spark’ı duyurdu.
- İşlemcide RTX 5070’e denk bir GPU bulunuyor.
- Modern oyunlarda 1440P’de 100 FPS’te çalışıyor.
- Laptop, Windows olmasına rağmen prizden çektiğinizde performans düşmüyor.
- Batarya ömrü uzun.
- Sadece laptoplar için değil
相似文章
@YRSM_Simon: 老黄的刀法,精准到让人牙痒 NVIDIA 宣传 DGX Station:748GB 统一内存。 听起来碾压一切,4× RTX PRO 6000 的 384GB?不够看。 但拆开看——748GB = 252GB HBM3e + 496GB …
揭露NVIDIA DGX Station宣传的748GB统一内存中实际只有252GB高速HBM可用,其余496GB慢速LPDDR5X在大模型推理中基本无用,体现了NVIDIA精准的产品差异化策略。
@AISuperDomain: 别再为了跑大模型去买多卡工作站了! 开源推理引擎 FreeToken 把 CPU、GPU、内存统合为一体: 8G 显存轻薄本 跑 35B MoE,家用单卡游戏本直接干 290B+! 彻底解决显存塞不下的难题,开源免费: #AI #LLM …
开源推理引擎FreeToken将CPU、GPU和内存统合为一体,使消费级硬件如8G显存笔记本能运行35B MoE模型,家用单卡游戏本可运行290B+模型,彻底解决显存限制。
@VincentLogic: 一台 8GB 显存的入门笔记本 现在可以跑一个完全自主的 AI Agent 方法:Gemma 4 26B + Hermes Desktop 本地跑 26B 模型,8GB 显存 + 16GB 内存就够 接上 Hermes 之后它能做什么: …
介绍使用 Gemma 4 26B 模型与 Hermes Desktop 工具在 8GB 显存入门笔记本上运行完全自主的 AI Agent,实现本地文件操作、代码修改、网页浏览等功能,显著降低了本地 Agent 的门槛。
@rickawsb: 英伟达也认为存储是比gpu更大的瓶颈 — nvda最新文章解读 NVIDIA 最新发布的《AI Model Co-Design》是一篇介绍 TensorRT-LLM 和 Blackwell 的技术文章, 但也是一份未来几年大模型设计和 A…
本文深入解读NVIDIA最新发布的《AI Model Co-Design》文章,指出在AI推理场景中,存储(内存带宽、权重读取)已取代GPU算力成为主要瓶颈,并阐述了TensorRT-LLM和Blackwell架构围绕Roofline模型的设计策略,强调减少数据移动比提升计算能力更为关键。
@PandaTalk8: 这个测试效果太惊艳了。 原贴作者测试了 @antirez 刚刚用 C 写的 DS4 推理引擎,本地部署效果看起来非常快。 好消息时只需要128G内存就可以跑一个相当于gpt-4o 本地模型。 坏消息时需要128G 的Mac book pr…
该文章报道了对 @antirez 使用 C 语言编写的 DS4 推理引擎的测试,指出其在 128G 内存的 MacBook Pro 上运行等效于 GPT-4o 的模型时速度惊人。