AI在现实世界中的部署
摘要
Reddit已部署AI/LLM实时分析所有帖子和评论中的仇恨言论与有害内容,能在几秒内自动封禁用户,这与Instagram和Facebook形成对比,后两者并未如此严格地应用此类分析。
Reddit已大规模部署AI/LLM来分析帖子和评论。这一过程实时进行,相比旧的仇恨言论/有害内容分类器性能显著提升。你写的每条评论在被展示到帖子之前都会经过分析,甚至可能在发布后几秒内就导致被Reddit自动封禁。然而,Instagram和Facebook的情况并非如此,那里仍存在大量仇恨言论和暴力呼吁。为什么Instagram和Facebook不像Reddit那样使用AI来分析每条帖子和评论中的仇恨言论与煽动暴力内容呢?
相似文章
Reddit 正在为新社区推出 AI 版主,距离每个 subreddit 都有 AI 版主还有多久?
这篇文章讨论了 Reddit 为新社区推出 AI 版主一事,对在一个充满讽刺和微妙语境的平台上依赖 AI 版主表示怀疑,并呼吁在广泛采用之前加强监管。
Reddit正在使用大语言模型解决大语言模型带来的问题
Reddit开发了使用大语言模型(LLMs)的工具来对抗AI生成的垃圾信息,从2026年1月到3月,垃圾信息的曝光率减少了20%。
Reddit 推出新“版主”:AI
Reddit 推出 Rules Hub,这是一套由 AI 驱动的审核套件,利用大语言模型自动执行社区规则,并将扩展到所有新社区,随后于2026年更大规模推出。该公司还宣布计划要求第三方应用使用其开发者平台,并继续打击未经授权的数据抓取行为。
完全由AI生成的图片获得900多条评论,版主却屏蔽了AI指控。平台积极帮助掩盖内容是AI的事实
文章讨论了发布在社交媒体上的AI生成图片如何欺骗用户和版主,强调平台未能标记或标示AI内容,并积极掩盖其来源。
仅靠 AI 不足以保护社交媒体社区免受 AI 侵害
Ars Technica 报道了基于 AI 的内容审核的局限性,强调了对边缘群体的偏见以及人工监督的必要性,同时提到 Reddit 扩展 Rules Hub 以赋予人工版主更多控制权。