ml-inference

标签

Cards List
#ml-inference

在生产级边缘设备上进行供应商无关的机器学习推理 [R]

Reddit r/MachineLearning · 2026-07-29

描述了使用 ncnn 的 Vulkan 后端在生产级边缘设备上进行供应商无关的机器学习推理,在人脸检测和嵌入模型上相比 CPU ONNX 实现了 10 倍加速。

0 人收藏 0 人点赞
#ml-inference

@robertnishihara: 我最近了解到 @onepot_ai 可以在5天内合成并交付定制分子,这非常快。通常…

X AI KOLs Following · 2026-05-29 缓存

Onepot AI 通过将机器人合成与在 Anyscale 上进行的大规模机器学习推理相结合,仅需5天即可合成并交付定制分子,从而极大地加速了药物发现。

0 人收藏 0 人点赞
#ml-inference

Gemma 4 MTP 与 DFlash 在单张 H100 上:密集模型 vs MoE 模型结果

Reddit r/LocalLLaMA · 2026-05-12

该基准测试将 Gemma 4 的多 Token 预测 (MTP) 与 z-lab 的 DFlash 推测性解码方法在单张 H100 GPU 上进行了比较,结果显示 MTP 在密集模型上更快,而 DFlash 在 MoE 模型上更快。

0 人收藏 0 人点赞
← 返回首页

提交意见反馈