我厌倦了AI统计文章相互循环引用,于是追溯了93个统计数据到原始来源
摘要
一位研究者手动追溯了93个AI统计数据到原始来源,揭示了关于企业投资、能源使用、工资溢价和AI生成内容的已核实数据,并发布了附有原始来源链接的结果。
每次我需要一个AI统计数据时,总会遇到一些列表文章,它们引用另一个列表文章,而那个又引用一条推文。所以我这几天直接去翻阅原始来源——斯坦福AI指数、国际能源署报告、高德纳新闻稿、Crunchbase数据、实际法庭文件——只保留了我能在源头确认的数字。其中一些让我惊讶:- 2025年企业AI投资达到5817亿美元,一年内增长130%(斯坦福HAI)- AI数据中心用电量在一年内增长了50%(国际能源署)- 具备AI技能的工人比相同岗位没有AI技能的工人工资溢价62%- 74.2%的新网页现在至少包含一些AI生成的文本(Ahrefs,90万页面样本)- 尽管Agent热度很高,但实际企业部署的AI代理仍是个位数。完整列表在此,每个统计数据都链接到其原始来源:https://thebotpost.com/guides/ai-statistics-2026 这是我的网站,完全公开——无付费墙,无需填邮箱。如果你发现哪个数字有误,请告诉我,我会修正。
相似文章
我审计了AI事实核查工具引用的来源。大约每18个中就有1个不存在。
一位作者分享了对其AI事实核查工具引用的审计,发现大约每18个中就有1个是失效或捏造的,并提供了实用修复方法来提高AI系统的可靠性。
自托管AI分析师:编写SQL查询、自我核对数据并引用每个主张的查询来源
一个自托管的AI分析师工具,它编写SQL查询,自我检查结果中的一致性问题,并为每个主张引用源查询,强调数据分析中的透明度和可追溯性。
我能够复现AI基准测试,但仍然无法验证业务声明。
一位研究人员复现了AI基准测试,但发现由于指标聚合和模型集成问题,验证业务声明具有挑战性,强调了对AI性能声明进行仔细审查的必要性。
各位,好好检查你们那该死的消息来源
一篇关于技术文章中虚假引用和AI幻觉数据泛滥的吐槽,以瑞典乌鸦的假故事和代码审查缺陷检测的夸大说法为例。
@WSInsights: AI 圈的"信息源头",就这 30 个人。 These 30 accounts power the global AI signal. 刷 100 个二手解读,不如关注 10 个一手账号。 Skip the 100 hot takes. …
The article curates 30 influential AI accounts across seven dimensions (research, engineering, education, open source, evals, AGI, and global ecosystem), encouraging readers to follow primary sources instead of secondary hot takes.