标签
这篇文章讨论了 Reddit 为新社区推出 AI 版主一事,对在一个充满讽刺和微妙语境的平台上依赖 AI 版主表示怀疑,并呼吁在广泛采用之前加强监管。
作者评论X平台(现属XAI/SpaceX)诈骗帖泛滥,认为因X用户数据是SpaceX估值重要依据,平台不愿清理骗子流量,并质疑管理层的道德问题。
Ars Technica 报道了基于 AI 的内容审核的局限性,强调了对边缘群体的偏见以及人工监督的必要性,同时提到 Reddit 扩展 Rules Hub 以赋予人工版主更多控制权。
Reddit 推出 Rules Hub,这是一套由 AI 驱动的审核套件,利用大语言模型自动执行社区规则,并将扩展到所有新社区,随后于2026年更大规模推出。该公司还宣布计划要求第三方应用使用其开发者平台,并继续打击未经授权的数据抓取行为。
Discord承认其AI审核系统的漏洞误封了超过8000名用户,原因是棋盘和游戏纹理等无害图片,凸显了自动化内容审核的挑战。
Meta曾秘密使用Google的Gemini处理客户服务、广告工具和内容审核,因为其表现优于自家的Llama模型,直至Google因过度使用容量而切断访问。
数字仇恨对抗中心(CCDH)的一份新报告显示,Meta放宽内容审核规则后,针对政治人物的种族歧视言论增加了三倍,暴力威胁和仇恨言论增加了四倍,欺凌行为增加了一倍。