inference-framework

标签

Cards List
#inference-framework

@googledevs: 重大消息:@Google 和 @RadixArk 合作,将 @sgl_project 引入 Google Cloud TPU!今天即可在 TPU 上运行 SGLang,通过…

X AI KOLs Timeline · 2026-07-30 缓存

Google Cloud 和 RadixArk 合作,将开源推理框架 SGLang 引入 Google Cloud TPU,初期通过 SGL-JAX,后续推出 SGL-torchtpu 提供原生 PyTorch 支持,让开发者能够无缝在 GPU 和 TPU 上运行生产工作负载。

0 人收藏 0 人点赞
#inference-framework

@DanKornas: 需要在设备上运行神经网络而不添加一堆运行时依赖?ncnn 是一个神经网络推理…

X AI KOLs Timeline · 2026-07-27 缓存

ncnn 是一个轻量级的开源神经网络推理框架,用于将 PyTorch 和 ONNX 模型部署到移动端、嵌入式设备和桌面端,无需繁重的依赖,支持 CPU 和 Vulkan GPU 后端。

0 人收藏 0 人点赞
#inference-framework

推出 Scylla's Band,一款带有 Android 示例的新 TTS 模型和推理框架!

Reddit r/LocalLLaMA · 2026-07-20

Scylla's Band 是一款新的 TTS 模型和推理框架,包含用于部署的 Android 示例。

0 人收藏 0 人点赞
#inference-framework

VLA-Corrector:一种用于自适应动作视野的轻量级检测与纠正推理框架

Hugging Face Daily Papers · 2026-07-02 缓存

VLA-Corrector 提出了一种轻量级的检测与纠正推理框架,可在无需重新训练的情况下自适应调整视觉-语言-动作策略中的动作视野,提升机器人操控任务的鲁棒性和效率。

0 人收藏 0 人点赞
#inference-framework

@kazukifujii: 这篇vLLM博客文章以非常清晰和图示化的方式解释了强化学习中的权重更新和KV缓存重计算,还涵盖了…

X AI KOLs Timeline · 2026-06-22 缓存

本文解释了vLLM用于强化学习的权重同步API,涵盖了它如何促进RL训练中的权重更新和KV缓存重计算,重点关注降低训练框架的复杂性。

0 人收藏 0 人点赞
← 返回首页

提交意见反馈