data-collection

标签

Cards List
#data-collection

Muse 为你的所有亲友创建详细档案

Wired ↗ · 17小时前 缓存

研究人员提取了 Meta 的 Muse AI 助手的内部指令,发现它会为亲友创建每小时更新的详细档案,这引发了人们对 Meta 访问社交数据的隐私担忧。

0 人收藏 0 人点赞
#data-collection

@RemiCadene:挺酷的!

X AI KOLs Timeline ↗ · 昨天 缓存

Preload(YC F26)宣布推出用于机器人操作、VLA 和世界模型的同步第一视角视频、EMG 与触觉数据采集方案,提供可规模化的一站式机器人数据采集能力。

0 人收藏 0 人点赞
#data-collection

AI 公司正在向我们大量涌入实体设备……但它们真正在乎的是产品本身,还是数据?

Reddit r/ArtificialInteligence ↗ · 昨天

文章指出,AI 公司争相进军实体设备领域——例如 Meta 的 Muse Charm 吊坠和 OpenAI 与 Jony Ive 合作的无屏设备——其背后驱动力可能并非更好的用户体验,而是在开放网络日益被 AI 生成内容污染的背景下,对新鲜、真实的人类行为数据的迫切需求。

0 人收藏 0 人点赞
#data-collection

@FinanceYF5:AI 智能体如今几乎可以抓取整个互联网的数据。X、YouTube、Reddit、论坛,甚至没有 API 的网站……

X AI KOLs Timeline ↗ · 2天前 缓存

AI 智能体如今几乎可以抓取整个互联网的数据,包括 X、YouTube、Reddit、论坛,甚至没有 API 的网站,这一切由 GitHub 上新发布的 3 款开源工具驱动,可用于研究、分析和监控。

0 人收藏 0 人点赞
#data-collection

LinkedIn角色扮演狂热

Hacker News Top ↗ · 4天前 缓存

这篇文章讽刺了LinkedIn上充斥的表演性质和重复性的AI项目,尤其是计算机视觉演示,并描述了开发一个简单检测器以识别这类帖子的过程。

0 人收藏 0 人点赞
#data-collection

Meta AI 从多年家庭帖子中构建儿童详细档案

Reddit r/artificial ↗ · 2026-09-24 缓存

Meta AI 在 Facebook 上通过历史帖子为儿童和家庭建立详细档案,引发隐私担忧,并促使 Meta 在用户投诉后修复此问题。

0 人收藏 0 人点赞
#data-collection

@VraserX: Spirit AI 拥有大约1,000人反复操作真实物体,为机器人生成训练数据。LLMs 免费获得了互联网。

X AI KOLs Following ↗ · 2026-09-21 缓存

Spirit AI 正在使用大约1,000人手动操作真实物体,为机器人生成训练数据,与用于大型语言模型的免费互联网数据形成对比。

0 人收藏 0 人点赞
#data-collection

@VraserX:Figure 每秒正在收集大约35分钟的人类物理体验,并已投入35亿美元的算力用于……

X AI KOLs Timeline ↗ · 2026-09-21 缓存

Figure 正在收集大量物理体验数据,并向 Helix 投入了大量算力,凸显了在人形机器人 AI 领域向数据和算力驱动竞争的转变。

0 人收藏 0 人点赞
#data-collection

ChatGPT通过广告收集器获取你在其他网站上的活动

Lobsters Hottest ↗ · 2026-09-20 缓存

ChatGPT使用广告收集器追踪用户在其他网站的浏览活动,并通过Cookies和广告商代码将行为与ChatGPT账户关联起来。

0 人收藏 0 人点赞
#data-collection

Meta的Muse在监控方面胜过帮助我

Wired ↗ · 2026-09-20 缓存

Meta的Muse是一款AI代理应用,可自动化个人任务,但因过度收集数据而受到批评,引发隐私关切。

0 人收藏 0 人点赞
#data-collection

上下文能否告诉我们需要收集哪些遥测数据?

Reddit r/AI_Agents ↗ · 2026-09-19

文章讨论了使用操作上下文来决定收集哪些遥测数据的想法,质疑了先收集所有数据再进行关联的传统方法。

0 人收藏 0 人点赞
#data-collection

不仅是LG,所有电视公司都在监视你

The Verge ↗ · 2026-09-19 缓存

这篇文章揭露了所有电视公司,如LG,如何使用自动内容识别等技术来跟踪用户的观看习惯,通常隐藏在同意协议中,导致广泛的隐私担忧。

0 人收藏 0 人点赞
#data-collection

ChatGPT对稀有冷门知识表现出_极其_的兴趣...

Reddit r/artificial ↗ · 2026-09-17

ChatGPT对一件稀有的1950年代冷门物品表现出强烈的好奇心,热切请求扫描随附材料,这引发了对AI数据收集行为的担忧。

0 人收藏 0 人点赞
#data-collection

@garrytan: 我觉得说实话Muse会赢。

X AI KOLs Following ↗ · 2026-09-15 缓存

Garry Tan 在推特上表示,Facebook 的 Muse 正在从用户行为中生成有价値的AI训练数据,并将其数据收集与Onavo应用进行比较。

0 人收藏 0 人点赞
#data-collection

@signulll: 通过muse,fb可能正在生成的深度个人化且真正可操作的AI训练数据量简直令人震惊。

X AI KOLs Timeline ↗ · 2026-09-15 缓存

该推文强调了Facebook通过其'muse'产品收集大量个人AI训练数据的潜力,将其与Onavo相比较,并指出这可能极大地提升其数据飞轮效应。

0 人收藏 0 人点赞
#data-collection

@realfxw: 做 Agent 最头疼的往往不是模型逻辑,而是让它联网“拿数据”——反爬、登录鉴权、频率限制,折腾半天全卡在接口上。 推荐关注开源项目 Agent-Reach,相当于直接给 AI Agent 装上了一副全网“采集外骨骼”: 整合成熟生态:…

X AI KOLs Timeline ↗ · 2026-09-13 缓存

Agent-Reach 是一个开源项目,为 AI Agent 提供一键式网络数据采集能力,整合多种工具以解决反爬和认证等问题。

0 人收藏 0 人点赞
#data-collection

会话上下文 — 网页所知关于你的信息

Lobsters Hottest ↗ · 2026-09-13 缓存

一个网页工具,展示了网页在未经许可的情况下可以收集哪些关于用户的信息,以及在明确同意后可以获取哪些额外数据,突显了浏览器的功能和隐私风险。

0 人收藏 0 人点赞
#data-collection

@RoundtableSpace: Maigret 仅用一个用户名就能为任何人建立完整档案——无需 API 密钥即可跨数百个网站交叉引用账户…

X AI KOLs Timeline ↗ · 2026-09-13 缓存

Maigret 是一个开源工具,能够在无需 API 密钥的情况下,通过跨数百个网站交叉引用用户名,为个人建立详尽的档案。它已大受欢迎,下载量超过 100 万次,并广泛应用于开源情报(OSINT)领域。

0 人收藏 0 人点赞
#data-collection

LG称我们是假新闻[视频]

Hacker News Top ↗ · 2026-09-12 缓存

LG否认关于智能电视数据收集的指控,但调查人员指出与自动内容识别和用户协议相关的不一致之处和持续的隐私问题,以此反驳这一说法。

0 人收藏 0 人点赞
#data-collection

LG回应电视监控指控

The Verge ↗ · 2026-09-12 缓存

LG回应了关于其智能电视通过录制和上传音频来监控用户的指控,声称诸如语音识别等功能是可选的且默认未启用。然而,独立研究人员对数据收集和隐私实践提出了担忧。

0 人收藏 0 人点赞
Next →
← 返回首页

提交意见反馈