@PyTorch: 如何从每一美元的人工智能投入中获得更多有用的工作——而不仅仅是更多的令牌?本周三上午11:50在@AMD #Advancing…
摘要
PyTorch Foundation CTO Matt White将在AMD的AdvancingAI活动上发表演讲,探讨如何使用vLLM和SGLang等开源工具优化AI推理经济学,倡导使用规模合适的模型和智能路由,以改善每美元智能。
查看缓存全文
缓存时间: 2026/07/21 18:49
如何从每一笔AI支出中获得更多有效工作——而不仅仅是更多token?本周三上午11:50,在@AMD #AdvancingAI活动上,PyTorch Foundation CTO @matthew_d_white 将探讨开源、@vllm_project 和 @radixark 的 @sgl_project 如何重塑推理经济学。
在“加速开源AI:恰到好处的智能”演讲中,Matt将提出一个实用方案,替代对所有任务都使用前沿模型的做法: → 分解工作流 → 选择合适大小的模型 → 智能路由与缓存 → 仅在必要时升级 → 衡量每项成功完成任务的成本
目标是实现更优的“每美元智能”:每一美元支出都能带来更多正确且与业务相关的结果,并将失败、重试和审核环节的成本也纳入计算。
Matt将率先开启AI训练与推理专题的一系列演讲,随后是 @simon_mo_(@inferact 联合创始人兼CEO、vLLM主要贡献者)和 @ying11231(RadixArk联合创始人兼CEO、SGLang共同创建者)。
旧金山Moscone West 7月22日周三 太平洋夏令时上午11:50
探索该专题:
相似文章
@AMD: 从系统启动到调优,AMD 与 @OpenAI 的工程师们正在分享见解,以进一步提升性能。深入合作幕后…
AMD 与 OpenAI 的工程师合作分享性能优化方面的见解,并邀请 OpenAI 计算策略副总裁 Sachin Katti 进行幕后解读。
@PyTorch: 对优化ARM CPU上的混合专家模型LLM推理感兴趣吗?在他于PyTorch Conference North America的演讲中,…
在PyTorch Conference North America上,来自Fujitsu Research India的Maajid Khan将发表演讲,探讨使用vLLM和OpenVINO优化ARM CPU上的混合专家模型LLM推理。
@twimlai: 随着推理模型消耗更多token且AI系统运行成本上升,理解这些token的实际价值变得愈发关键。
本集播客讨论了AI token经济学和新兴问题‘tokenflation’,重点讨论如何衡量AI token的价值、基准测试的局限性以及AI效率的未来创新。
@PyTorch:在PyTorch Conference North America 2026上,直接聆听并与PyTorch、@vllm_project等工作者交流。
PyTorch Conference North America 2026将举办与PyTorch及相关项目专家的讨论会,重点关注AI框架、推理引擎和硬件集成的最新进展。
@PyTorch:探索开源智能搜索和硬件引导工作流如何在GPU和TPU上实现显著加速
PyTorch北美大会将在圣何塞举行,设有智能搜索、硬件引导工作流和AI性能优化等专场,演讲者来自主要科技公司。