@jichiep: privacy-filter.cpp 与 PyTorch 实现的性能对比。大约快 1.6 倍至 18 倍:
摘要
privacy-filter.cpp 在性能上比 PyTorch 实现快约 1.6 倍至 18 倍。
查看缓存全文
缓存时间: 2026/06/17 01:43
privacy-filter.cpp 性能对比 PyTorch 实现,速度提升约 1.6 倍至 18 倍:https://t.co/U0I4npCQgc
相似文章
评估OpenAI隐私过滤器:跨语言、跨领域的42个基准上的PII检测
本文首次对OpenAI隐私过滤器(OPF)——一个15亿参数的个人身份信息(PII)检测器——进行了独立的系统性评估,涵盖22种语言、5个领域的42个基准,并与Presidio、GLiNER、GPT-4o和XLM-RoBERTa进行了比较。主要发现包括:OPF在结构化合成PII上表现强劲,但在非拉丁文字和叙事性散文中性能严重下降。
OpenAI 隐私过滤模型
OpenAI 悄悄在 Hugging Face 发布了一款 Apache-2.0 授权的隐私过滤模型,权重完全开放,旨在帮用户在本地运行隐私保护过滤器的同时,仍享受大实验室级别的质量。
openai/privacy-filter
OpenAI 发布了 Privacy Filter,这是一个包含 15 亿参数的双向令牌分类模型,用于检测和处理个人身份信息(PII)。该模型采用 Apache 2.0 许可证,并支持长上下文,以实现高通量的数据清理。
@PyTorch: PyTorch AOTI 后端在 NVIDIA 的 HSTU 推理测试中,相较于 Python 后端,实现了 1.14 倍至 1.28 倍的加速,当……
NVIDIA 报告了在 HSTU 推理测试中使用 PyTorch AOTI 后端的显著加速,在理想情况下最高可达 2.38 倍,并强调了用于大规模生成式推荐系统的工具如 recsys-examples 和 nv-embedding-cache。
@dair_ai:NVIDIA新论文。(收藏)光速性能分析告诉你工作负载的理论下限,…
NVIDIA的SOLAR框架从PyTorch/JAX代码自动进行光速性能分析,使用LLM前端和确定性分析,提供经过验证的执行时间理论下限。它覆盖了KernelBench 100%的操作符,且未观察到违反情况。