@Modular: 当今AI软件碎片化。每个加速器都有自己的编译器、内核库、运行时和开发路径…
摘要
Modular推出统一计算层以解决AI软件碎片化问题,通过与HTEC和d-Matrix合作,展示更快的硬件启用能力,将MAX和Mojo扩展到Google TPU等新加速器。
查看缓存全文
缓存时间: 2026/09/08 23:39
当今的AI软件生态呈现碎片化现状。每款加速器都拥有自己的编译器、内核库、运行时及开发路径,开发者不得不承担这种碎片化带来的额外成本。
在ModCon 2026技术演讲中,Modular首席科学家Abdul Dakkak展示了我们的解决方案:构建统一计算层,使其能灵活扩展至新模型、新模态与新硬件。
Abdul通过三个案例展示了适配新硬件的实践路径:
- AWS Trainium:由Modular团队独立完成适配,实现Gemma 4 31B全流程部署
- Google TPU v6e:通过合作伙伴@HTECgroup实现适配,该团队在没有LLVM后端支持、未预习Mojo/MAX内部架构且Modular仅提供有限协助的情况下完成开发
- d-Matrix Corsair:由@dMatrix_AI团队基于自有技术栈实现适配,从获取仓库权限(周二)到实现矩阵乘法功能(次周一)仅用5天
特别感谢HTEC与d-Matrix的技术协作,以及Mihailo对HTEC实践经验的分享。
阅读HTEC合作详情:https://htec.com/insights/media-coverage/htec-and-modular-extend-max-and-mojo-to-google-tpu-cutting-ai-hardware-enablement-from-years-to-months/…
观看完整演讲:https://youtube.com/watch?v=hYjKbTAGOo0…
HTEC与Modular将MAX和Mojo扩展至Google TPU,AI硬件适配周期从年级缩短至月级 | HTEC
来源:https://htec.com/insights/media-coverage/htec-and-modular-extend-max-and-mojo-to-google-tpu-cutting-ai-hardware-enablement-from-years-to-months/ 通过先进编译器与运行时工程验证:无需重建软件栈即可快速、可复用地将AI工作负载迁移至新型芯片
加利福尼亚州帕洛阿尔托,2026年9月8日 — 全球AI优先工程技术服务商HTEC与Modular共同宣布,Modular的AI软件栈已成功在Google TPU架构上运行。这项在ModCon 2026展示的成果证明:通过扩展现有软件基础而非为每个加速器重建系统,即可实现对新芯片架构的支持。
该项目仅用数月时间将Modular的MAX/Mojo生态系统移植至Google TPU,而传统硬件适配工程通常需要数年时间。这为AI基础设施发展提供了可行新模式:可移植的软件层结合专业编译器与运行时工程,能加速新计算架构的落地应用。
随着AI算力需求激增,企业正突破单一硬件生态体系以寻求性能与可扩展性的提升,同时降低对成本、产能和供应链限制的依赖。而主要障碍往往来自软件层面——每个新加速器都需要在编译器、运行时及推理系统进行大量适配工作,才能有效运行AI负载。
Modular通过设计支持跨芯片AI负载的技术方案破解该障碍。HTEC运用其在编译器工程与运行时系统领域的专业能力,以较大技术自主权应对高难度技术要求,成功将基础架构扩展至Google TPU。
HTEC首席技术官Darko Todorovic表示:“我们证明了Modular的MAX/Mojo生态系统能在数月而非数年内触达新硬件平台。这既验证了Modular架构的先进性,也为企业快速采用新AI硬件提供了可落地路径。”
Modular首席执行官Chris Lattner补充道:“AI发展无法承受为每个新加速器重建整套软件栈的代价。HTEC在Google TPU上的实践表明,统一的软件基础能以前所未有的速度和规模将新芯片引入AI生态。这从根本上改变了芯片厂商的发展逻辑:他们可以将工程资源集中在硬件创新上,而非重复构建软件栈。”
除Google TPU里程碑外,该项目同时验证了HTEC在AI硬件适配领域的长期投入,以及Modular推行硬件无关AI软件的战略价值。此次合作进一步巩固了HTEC支持行业未来半导体与AI推理创新的能力。
关于HTEC
HTEC集团(https://htec.com/)是总部位于硅谷的全球技术工程公司,提供以AI为核心的全栈解决方案,帮助企业以可复制的方式从战略规划走向产品落地。融合顶尖工程能力与数字战略、设计及创业孵化服务,HTEC支持覆盖从构思到部署的全产品生命周期。
凭借超过15年企业级AI与机器学习实施经验,HTEC在从芯片到应用的完整技术栈中具备深厚专业知识,涵盖数据工程、模型优化与AI应用开发等领域。这确保了新兴技术能转化为可量化的投资回报、可扩展的增长与持续的商业价值。通过弥合愿景与执行之间的鸿沟,HTEC协助全球领先企业定义可能性并实现规模化落地。
媒体联系:[email protected]
相似文章
@dMatrix_AI: #ModCon2026 凸显了异构计算和开放AI基础设施背后的发展势头。与 @Qualcomm, d-Matrix…
在 ModCon 2026 上,Modular 宣布 Mojo 1.0 在 Apache 2.0 许可下完全开源,Modular Cloud 已公开可用,该平台现在支持多种 AI 加速器,包括 AWS Trainium、Google TPU 和 Qualcomm 硬件。
@Modular: 可移植性横跨CPU、GPU和加速器,看似简单,实则不然。在#ModCon2026上,@clattner…
Modular首席执行官Chris Lattner与高通首席执行官Cristiano Amon在ModCon2026大会上探讨了CPU、GPU及加速器间的可移植性问题,重点强调了高通收购Modular后双方在异构计算软件改进上的合作。
@PyTorch:新芯片出货速度空前,但生态系统因需反复重写和调试代码而受阻…
在 PyTorch Conference North America 上的一场主题演讲将展示一个由 Mojo 和 MAX 驱动的异构计算开放软件平台,以解决在多样化硬件上部署 AI 模型时的生态系统挑战。
@Modular: 碎片化在整个AI生态系统中造成了税负。在本年度的@PyTorch Conference上,@clattner_llvm将展示一个…
2026年的PyTorch Conference北美版将包括Chris Lattner关于统一软件栈以解决AI生态系统中碎片化的演讲,并提供注册详情。
@clattner_llvm:我很高兴分享,高通正在收购Modular:这将加速我们统一加速计算的道路……
高通已同意收购Modular,这是一家专注于通过开放平台统一加速计算的人工智能基础设施公司。此次收购旨在推进高通以开发者为先的AI战略,并扩展其从边缘到云端的AI软件能力。