data-leakage

标签

Cards List
#data-leakage

针对联合故障诊断与剩余使用寿命估计的注意力增强多任务学习的泄漏鲁棒评估与数据规模敏感性

arXiv cs.LG · 2026-07-21 缓存

本文证明了在滑动窗口序列上使用简单的训练/测试分割会严重夸大或缩小预测性维护中多任务学习的性能指标,并提出了一种泄漏鲁棒的评估协议。

0 人收藏 0 人点赞
#data-leakage

评估机器学习模型在早期慢性肾脏病预测中的可靠性:数据泄露与预测因子稳定性的系统综述

arXiv cs.LG · 2026-07-15 缓存

本系统综述评估了机器学习模型在早期慢性肾脏病预测中的方法论可靠性,揭示数据泄露使报告的准确性虚高超过15%,且超过80%的预测因子在不同研究中缺乏稳定性。

0 人收藏 0 人点赞
#data-leakage

Satya Nadella 向使用AI的公司发出惊人警告

TechCrunch AI · 2026-07-13 缓存

微软CEO Satya Nadella警告说,使用来自OpenAI和Anthropic等实验室的AI模型的公司,正在不知不觉中交出专有商业数据,并倡导公司保留数据所有权,构建协调层以在不同模型之间切换。

0 人收藏 0 人点赞
#data-leakage

@TensorTonic: 每位面试官都希望你掌握的13个核心ML概念 1. 偏差-方差权衡 - 理解...的关键框架

X AI KOLs Timeline · 2026-06-26 缓存

一条推特串,列出了面试官期望候选人了解的13个核心机器学习概念,涵盖从偏差-方差权衡到维度灾难等主题。

0 人收藏 0 人点赞
#data-leakage

无需先验的模型预测信息泄露盲检测

arXiv cs.LG · 2026-06-11 缓存

本文提出了一种决策理论框架,仅利用模型输出和结果来检测预测模型中的数据泄露,证明了某些泄露类型无需外部基准或训练代码即可识别。

0 人收藏 0 人点赞
#data-leakage

大语言模型能泄露训练数据,但它们愿意吗?对LLM记忆的倾向性感知评估

Hugging Face Daily Papers · 2026-06-04 缓存

PropMe是一个倾向性感知框架,用于评估LLM的记忆,区分强制复现能力和自然倾向,使用SimpleTrace在开放模型和数据集上进行确定性归因。

0 人收藏 0 人点赞
#data-leakage

基于历史文本的预训练语言模型

arXiv cs.CL · 2026-06-03 缓存

本文介绍了 TypewriterLM,一个参数规模为 7.24B 的语言模型,仅基于 1913 年之前的英文文本进行训练;同时介绍了 TypewriterCorpus(一个包含 540 亿 token 的清洗后历史语料库)以及指令微调数据集,以避免时间泄露和前瞻偏差。此外,还提出了一个基准测试套件 History-Event,用于评估时间定位能力和泄露情况。

0 人收藏 0 人点赞
#data-leakage

有多少已发表的AI研究因数据泄露而错误?

Reddit r/artificial · 2026-06-01

普林斯顿大学的一项研究发现,在17个领域的近300篇AI论文中存在数据泄露问题,导致结果过于乐观。作者强调了意外泄露数据的容易程度,并提醒不要轻信那些令人印象深刻的AI声明而不检查是否存在泄露。

0 人收藏 0 人点赞
#data-leakage

创建了一个免费工具,在提示词发送给服务提供商之前检测其泄露的 PII

Reddit r/artificial · 2026-05-12

发布了一款免费工具,帮助用户在服务提供商接收之前,检测大语言模型(LLM)提示词中泄露的个人身份信息(PII)。

0 人收藏 0 人点赞
#data-leakage

OpenGuardrails: 一个开源的上下文感知AI护栏平台

Papers with Code Trending · 2025-10-22 缓存

OpenGuardrails 是一个面向AI安全的开源平台,通过统一模型提供上下文感知的内容安全与操纵检测(例如提示注入、越狱),以及一个独立的NER管道用于数据泄露识别。它在安全基准测试上取得了最先进的性能,并支持私有化、企业级部署。

0 人收藏 0 人点赞
#data-leakage

AI Agent Security - MIT 6.566 Computer Systems Security, Spring 2026

YouTube AI Channels · 2026-05-21 缓存

MIT 6.566课程讲座介绍了AI代理的安全挑战,包括非对抗性错误(如意外删库)和对抗性攻击(如提示注入、数据泄露),并讲解了从语言模型到对话代理的系统构建基础。

0 人收藏 1 人点赞
← 返回首页

提交意见反馈