tpu

标签

Cards List
#tpu

据报道,Google 与 AMD 合作设计下一代 TPU —— 混合 AI ASIC 可能集成片上 CPU 核心用于强化学习(3 分钟阅读)

TLDR AI ↗ · 2026-08-17 缓存

据报道,Google 与 AMD 合作设计下一代 TPU,该 TPU 可能集成片上 CPU 核心以处理强化学习工作负载,有望推动 AI 硬件架构的发展。

0 人收藏 0 人点赞
#tpu

谷歌向Anthropic出售TPU产能,挤压自家研究人员

Reddit r/ArtificialInteligence ↗ · 2026-08-06

谷歌积极将TPU产能商业化出售给Anthropic等外部客户,加剧了内部不满情绪,并促使关键AI研究人员离职投奔竞争对手,使人才和竞争紧张局势进一步加剧。

0 人收藏 0 人点赞
#tpu

@ycombinator:2001年,@JeffDean 和 Sanjay Ghemawat 做了个计算,发现谷歌的整个搜索索引可以放进内存中——然后……

X AI KOLs Timeline ↗ · 2026-07-30 缓存

在 Startup School 2026 上,谷歌首席科学家 Jeff Dean 讲述了那个让谷歌搜索索引能装进内存的餐巾纸计算,以及 TPU 的研发过程,探讨了推理硬件专业化的趋势,以及初创公司如何依然有机会竞争。

0 人收藏 0 人点赞
#tpu

@googledevs: 重大消息:@Google 和 @RadixArk 合作,将 @sgl_project 引入 Google Cloud TPU!今天即可在 TPU 上运行 SGLang,通过…

X AI KOLs Timeline ↗ · 2026-07-30 缓存

Google Cloud 和 RadixArk 合作,将开源推理框架 SGLang 引入 Google Cloud TPU,初期通过 SGL-JAX,后续推出 SGL-torchtpu 提供原生 PyTorch 支持,让开发者能够无缝在 GPU 和 TPU 上运行生产工作负载。

0 人收藏 0 人点赞
#tpu

JAXBench:对自主TPU内核优化进行基准测试

arXiv cs.AI ↗ · 2026-07-24 缓存

JAXBench是一个新的基准测试套件,包含50个JAX工作负载,用于评估在谷歌云TPU上的AI生成内核优化,提供人工调优基线和智能体评估框架。论文发现,基于精选TPU文档进行条件化处理能显著提升正确性和加速比,其中Autocomp波束搜索在人工调优内核上相比XLA实现了高达1.6倍的几何平均加速。

0 人收藏 0 人点赞
#tpu

@googledevs:Tunix 重大更新,助力规模化 Agentic RL 训练。新的异步解耦式回滚引擎解决了多轮交互瓶颈……

X AI KOLs Following ↗ · 2026-07-21 缓存

谷歌宣布其训练后优化库 Tunix 迎来重大更新,推出了异步解耦式回滚引擎,用于在 JAX/TPU 上规模化实施基于智能体的强化学习,消除空闲时间,提升吞吐量。

0 人收藏 0 人点赞
#tpu

一种基于MLIR的大型语言模型编译方法

arXiv cs.CL ↗ · 2026-07-20 缓存

本文提出了一种基于MLIR的大型语言模型编译方法,通过两种自定义方言(TopOp和TpuOp)将模型从框架无关的语义逐层降低为硬件专用指令,并针对自回归推理阶段(预填充、预填充KV和解码)引入三阶段静态编译。

0 人收藏 0 人点赞
#tpu

@googledevs: 扩展前沿的混合专家(MoE)模型需要的不仅仅是试错调优。探索Qwen 3.5-397B是如何…

X AI KOLs Following ↗ · 2026-07-15 缓存

Google Cloud 详细介绍了他们如何在 Ironwood TPU 上使用模块化、模型无关的工程手册优化 Qwen 3.5-397B MoE,实现了 3.1 倍的解码性能和 4.7 倍的预填充性能提升。

0 人收藏 0 人点赞
#tpu

@googledevs:构建、训练、推理。全新 TPU 开发者中心现已上线。一站式获取文档和框架指南,用于构建…

X AI KOLs Following ↗ · 2026-07-15 缓存

谷歌推出了 TPU 开发者中心,这是一个集中式资源,包含在 Google Cloud TPU 上构建、训练和提供 AI 服务的文档和框架指南,支持 JAX、PyTorch 和 vLLM。

0 人收藏 0 人点赞
#tpu

Google宣布为Pixel 10的TPU优化的Gemma 4(两分钟阅读)

TLDR AI ↗ · 2026-07-15 缓存

Google宣布了为Pixel 10的TPU优化的Gemma 4 E2B,实现了设备端多模态AI能力,如离线聊天、图像识别和音频转录。

0 人收藏 0 人点赞
#tpu

@ryanlpeterman: David Patterson 是图灵奖得主,以对计算机架构的贡献而闻名。我采访了他,聊了…

X AI KOLs Timeline ↗ · 2026-07-13 缓存

对图灵奖得主 David Patterson 的采访,涵盖 RISC 与 CISC 的历史、GPU/TPU 比较、摩尔定律及职业建议。

0 人收藏 0 人点赞
#tpu

@vivekgalatage: 了解TPU的系统架构非常有趣。 https://henryhmko.github.io/posts/tpu/tpu.html…

X AI KOLs Timeline ↗ · 2026-06-28 缓存

深入探讨谷歌TPU架构,解释脉动阵列、流水线和提前编译的设计理念,这些设计带来了高吞吐量和能效。

0 人收藏 0 人点赞
#tpu

@mkvenkit: Google的Tensor Processing Unit (TPU)采用脉动阵列架构——一个源自1978年的想法——来加速矩阵乘法…

X AI KOLs Timeline ↗ · 2026-06-27 缓存

Google的TPU采用源自1978年的脉动阵列架构,以更少的内存移动来加速矩阵乘法。该帖子分享了原始论文和TPU设计的链接,并建议在FPGA上构建一个小型版本。

0 人收藏 0 人点赞
#tpu

谷歌正在使用英伟达的策略来打造有竞争力的AI芯片业务(11分钟阅读)

TLDR AI ↗ · 2026-06-19

谷歌正在采用英伟达的策略来打造有竞争力的AI芯片业务,向Anthropic出租TPU计算能力,并提升推理性能以与英伟达的主导地位竞争。

0 人收藏 0 人点赞
#tpu

@ying11231:在TPU上令人印象深刻的性能。

X AI KOLs Timeline ↗ · 2026-06-17 缓存

LMSYS Org 的一篇博客文章详细介绍了使用 SGLang-JAX 在 TPU v7x 上优化 Ling-2.6-1T(一个 1 万亿参数的混合 MoE 模型),通过单个 Pallas 内核将 MoE 数据移动隐藏在计算之后,从而实现高效的推理。

0 人收藏 0 人点赞
#tpu

谷歌与三星洽谈合作制造下一代芯片部分组件

Reddit r/singularity ↗ · 2026-06-11

谷歌正与三星洽谈,计划使用2纳米技术为其下一代AI芯片(代号Icefish)制造部分组件,而主要部分将由台积电生产。该芯片旨在成为英伟达GPU的替代品,预计最早于2028年进入量产。

0 人收藏 0 人点赞
#tpu

@_philschmid: Google Colab CLI 和 Skills 已发布。从终端完全操控 Colab 运行时。 - GPU/TPU 配置 (colab --gpu A100) …

X AI KOLs Following ↗ · 2026-06-09 缓存

一款适用于 Google Colab 的全新 CLI 工具,支持从终端进行 GPU/TPU 配置、远程脚本执行和交互式 REPL 访问,内置 Agent Skills 功能,可自动完成模型微调等任务。

0 人收藏 0 人点赞
#tpu

@snowboat84: https://x.com/snowboat84/status/2061962883651731602

X AI KOLs Timeline ↗ · 2026-06-03 缓存

本文是AI工程全景系列的上篇,从历史角度梳理了GPU从游戏显卡到AI加速器的演化、CUDA的豪赌、谷歌TPU的独立路径,以及英伟达为何最终胜出,详细剖析了芯片、供应链、网络、电力等AI基础设施的底层逻辑。

0 人收藏 0 人点赞
#tpu

Midjourney表示使用TPU导致研究进度延迟一年,后悔没有坚持只使用Nvidia硬件

Reddit r/singularity ↗ · 2026-05-20

Midjourney表示,使用Google TPU使他们的研究落后了一年,并对没有完全坚持使用Nvidia硬件表示遗憾。

0 人收藏 0 人点赞
#tpu

@mweinbach: 谁说TPU不能快!这大致是TPU 8i达到Groq的速度,但搭载Gemini Flash模型,智能程度远胜…

X AI KOLs Timeline ↗ · 2026-05-19 缓存

谷歌展示了Gemini Flash模型在TPU 8i上实现每秒600-1400 token的处理速度,与Groq的推理速度相当。

0 人收藏 0 人点赞
← Previous
Next →
← 返回首页

提交意见反馈