@liquidai: 如今,与AI分享机密信息已成为常态!我们可以做得更好。我们最新的编码器模型发现并……
摘要
Liquid AI的LFM2.5-Encoders能够在一次处理中识别并剥离16种语言的40种个人身份信息,专为在私有管道中进行安全AI数据处理而设计。
查看缓存全文
缓存时间: 2026/08/17 08:22
如今与AI共享机密信息已成常态!但我们可以做得更好。我们最新的编码模型能在单次同步处理中,横跨16种语言识别并清除40种个人身份信息,实现与AI的安全信息共享。
LFM2.5-Encoders可一次性识别文本中的所有实体类型,且支持自定义实体检测。该模型运行于您的内部管道中,确保私有数据始终留在您的环境中。无需生成,无需解析。
相似文章
@vivmarquez: 并非所有AI问题都是生成问题。对于路由、分类、检索、策略检查以及类似任务,…
Liquid AI 发布了 LFM2.5-Encoder-230M 和 LFM2.5-Encoder-350M,这些双向编码器针对分类和检索等非生成任务进行了优化,在长上下文中提供快速的CPU推理。
LiquidAI/LFM2.5-Encoder-350M
Liquid AI releases LFM2.5-Encoder-350M, a multilingual bidirectional encoder built on the LFM2 architecture, offering strong quality for its size, 8k context, and efficient on-device performance across 15 languages.
LiquidAI/LFM2.5-Embedding-350M
Liquid AI 发布了 LFM2.5-Embedding-350M,这是一种密集双编码器,用于多语言检索,支持11种语言,可作为 RAG 流水线的直接替代方案。
@maximelabonne:像2020年那样训练编码器!
Liquid AI 对其 LFM2.5-Encoder 模型(230M 和 350M)进行了微调,使其能够在单次前向传播中执行多标签分类,无需解码循环或解析。这展示了在 NLP 任务中进行高效标签评分的潜力。
@iotcoi:OpenAI 训练了完美 LLM,让 OpenAI 自己都看不到数据 openai/privacy-filter Apache 2.0,1B 参数 MoE,本地运行 我的……
OpenAI 发布 10 亿参数 Apache-2.0 MoE 模型,可在任何 LLM 接收前自动脱敏,实现完全本地、零泄露的工作流。