@DeRonin_: 每个人都认为你可以把LLM指向预测市场然后“印钱”,我在Limitless上测试了,根本不是那样……
摘要
在实时预测市场上测试了7个前沿模型,只有2个盈利;基于Limitless API构建的预测工具会标记模型真正具有优势的市场。
查看缓存全文
缓存时间: 2026/07/07 00:14
所有人都以为,你可以把大语言模型扔进预测市场,然后就能“躺着赚钱“。
我在 Limitless 上测试了一下,事实并非如此。
最近的基准测试:7 个前沿模型在真实市场中运行。
结果只有 2 个赚了钱。
其余的都赔了钱,同时还以高置信度输出预测。
所以,关键不在于“让 AI 去交易“。
关键在于:搞清楚模型到底在哪方面是敏锐的。
下面是我基于 Limitless API 构建的预测器:
[ 运作方式 ]
- 通过 Limitless API 拉取实时市场
- 每个市场都交给一个 LLM,并附上一个研究步骤(新闻、价格、上下文)
- 强制输出一个概率,而不是模糊的“感觉“
- 将模型给出的数值与真实市场赔率进行对比
- 只在差距真实存在且推理过程站得住脚时,才标记该市场
有用的部分是:
它会过滤掉那些模型只是“嗓门大“且高置信度的市场。
而这样的市场占了绝大多数。
剩下的是一份简短的列表,里面是模型可能真正具备优势的市场。
每一部分都是可复现的。
代码仓库 + 完整解析将在下一篇推文中放出。
目前仍处于早期阶段。 金融风险真实存在。 这是研究,不是建议。
相似文章
@DeRonin_: Limitless 发布了为智能体准备的预测市场构建堆栈,这不是一个仓库,而是完整的开发者层级…
Limitless 发布了一套完整的开发者堆栈,专为编码智能体操作预测市场交易而设计,旨在用自主智能体执行取代手动连接。
模型现在能预测未来事件并在Polymarket上赚钱吗?
马克斯·普朗克研究所的研究人员推出了FutureSim,这是一个通过回放历史网络数据让AI代理预测真实世界未来事件的环境。在Codex上运行的GPT 5.5在部分Polymarket市场(如超级碗LX)上取得了近乎完美的Brier技能分数,超越了人类聚合市场,但在英国大选和格莱美奖等其他市场上表现不佳。
剖析预测市场背后的数据
对Polymarket和Kalshi等预测市场的分析,探讨其庞大的交易量是否真正产生了有价值的预测信息,还是仅仅沦为赌博,并参考了历史上的学术支持和当前数据。
预言者何时能在预测市场中盈利?
本文在基于订单簿的预测市场中,正式建立了预测准确性与盈利能力之间的等价关系,提出了一种将准确性转化为利润的适当投注策略,并通过在Kalshi上的实时部署验证了该策略,实现了80.33%的投资回报率。
预测市场中谁赢谁输?来自Polymarket的证据
本文分析Polymarket的预测市场数据,以确定哪些交易者盈利或亏损,为市场效率和参与者行为提供证据。