标签
研究人员提取了 Meta 的 Muse AI 助手的内部指令,发现它会为亲友创建每小时更新的详细档案,这引发了人们对 Meta 访问社交数据的隐私担忧。
Preload(YC F26)宣布推出用于机器人操作、VLA 和世界模型的同步第一视角视频、EMG 与触觉数据采集方案,提供可规模化的一站式机器人数据采集能力。
文章指出,AI 公司争相进军实体设备领域——例如 Meta 的 Muse Charm 吊坠和 OpenAI 与 Jony Ive 合作的无屏设备——其背后驱动力可能并非更好的用户体验,而是在开放网络日益被 AI 生成内容污染的背景下,对新鲜、真实的人类行为数据的迫切需求。
AI 智能体如今几乎可以抓取整个互联网的数据,包括 X、YouTube、Reddit、论坛,甚至没有 API 的网站,这一切由 GitHub 上新发布的 3 款开源工具驱动,可用于研究、分析和监控。
这篇文章讽刺了LinkedIn上充斥的表演性质和重复性的AI项目,尤其是计算机视觉演示,并描述了开发一个简单检测器以识别这类帖子的过程。
Meta AI 在 Facebook 上通过历史帖子为儿童和家庭建立详细档案,引发隐私担忧,并促使 Meta 在用户投诉后修复此问题。
Spirit AI 正在使用大约1,000人手动操作真实物体,为机器人生成训练数据,与用于大型语言模型的免费互联网数据形成对比。
Figure 正在收集大量物理体验数据,并向 Helix 投入了大量算力,凸显了在人形机器人 AI 领域向数据和算力驱动竞争的转变。
ChatGPT使用广告收集器追踪用户在其他网站的浏览活动,并通过Cookies和广告商代码将行为与ChatGPT账户关联起来。
这篇文章揭露了所有电视公司,如LG,如何使用自动内容识别等技术来跟踪用户的观看习惯,通常隐藏在同意协议中,导致广泛的隐私担忧。
ChatGPT对一件稀有的1950年代冷门物品表现出强烈的好奇心,热切请求扫描随附材料,这引发了对AI数据收集行为的担忧。
Garry Tan 在推特上表示,Facebook 的 Muse 正在从用户行为中生成有价値的AI训练数据,并将其数据收集与Onavo应用进行比较。
该推文强调了Facebook通过其'muse'产品收集大量个人AI训练数据的潜力,将其与Onavo相比较,并指出这可能极大地提升其数据飞轮效应。
Agent-Reach 是一个开源项目,为 AI Agent 提供一键式网络数据采集能力,整合多种工具以解决反爬和认证等问题。
一个网页工具,展示了网页在未经许可的情况下可以收集哪些关于用户的信息,以及在明确同意后可以获取哪些额外数据,突显了浏览器的功能和隐私风险。
Maigret 是一个开源工具,能够在无需 API 密钥的情况下,通过跨数百个网站交叉引用用户名,为个人建立详尽的档案。它已大受欢迎,下载量超过 100 万次,并广泛应用于开源情报(OSINT)领域。
LG否认关于智能电视数据收集的指控,但调查人员指出与自动内容识别和用户协议相关的不一致之处和持续的隐私问题,以此反驳这一说法。
LG回应了关于其智能电视通过录制和上传音频来监控用户的指控,声称诸如语音识别等功能是可选的且默认未启用。然而,独立研究人员对数据收集和隐私实践提出了担忧。