olympiad

标签

Cards List
#olympiad

求解非绘制:奥赛几何中图表推理的基准

arXiv cs.AI ↗ · 2026-08-20 缓存

本文介绍了一个用于评估几何中图表推理的开源基准,揭示了尽管基础模型如GPT和Claude在解决问题上表现出色,但它们难以生成忠实的图表。

0 人收藏 0 人点赞
#olympiad

Opus 5 在 IMO 中获得满分

Reddit r/singularity ↗ · 2026-07-24

Opus 5 是一款人工智能模型,在国际数学奥林匹克竞赛中取得了满分,展现了先进的数学推理能力。

0 人收藏 0 人点赞
#olympiad

@jasongyang365: 竞赛范式在批量生产创始人。 1. 数学/编程奥赛出身者,在当今科技创始人中占比远超人口比例——Hyperliquid、Cognition、Scale、Perplexity、Pika、Cartesia 的创始人全来自同一个圈子。 2. 核心…

X AI KOLs Timeline ↗ · 2026-07-14 缓存

该线程探讨了数学/编程奥赛背景如何批量培养科技创始人,指出竞赛范式内化的系统化解题能力、信念和同侪效应是核心引擎,量化金融作为中转站,但也提醒创业需要超越解题的技能。

0 人收藏 0 人点赞
#olympiad

@ClementDelangue: 今日论文!https://huggingface.co/papers/2605.13301…

X AI KOLs Following ↗ · 2026-05-15 缓存

一篇论文介绍了一种统一配方(SU-01),结合了反向困惑度课程、两阶段强化学习和测试时缩放,使用30B-A3B主干在IMO和IPhO问题上实现了金牌级别的表现。

0 人收藏 0 人点赞
#olympiad

Physics-R1: 经过审计的奥赛语料库与视觉物理推理配方

arXiv cs.CL ↗ · 2026-05-15 缓存

本文对多模态物理评估流程进行了审计,揭示了诸如训练-评估污染、翻译漂移和多项选择题(MCQ)饱和等问题。它发布了新数据集(PhysCorp-A、PhysR1Corp、PhysOlym-A)和一个训练配方(Physics-R1),显著提高了在保留的奥赛问题上的性能。

0 人收藏 0 人点赞
#olympiad

通过简单统一缩放实现金牌级奥赛推理

Hugging Face Daily Papers ↗ · 2026-05-13 缓存

一篇介绍SU-01的论文,该模型为30B-A3B推理模型,通过反向困惑度课程、两阶段强化学习和测试时缩放,在IMO和IPhO问题上达到金牌级表现。

0 人收藏 0 人点赞
#olympiad

麻省理工学院科学家构建了全球最大规模的奥数级数学问题集,并向所有人开放

MIT News — Artificial Intelligence ↗ · 2026-04-24 缓存

麻省理工学院(MIT)研究人员与沙特阿卜杜拉国王科技大学(KAUST)及 HUMAIN 公司合作,发布了 MathNet。这是目前最大的开源奥数级数学问题数据集,包含来自 47 个国家的超过 30,000 道由专家编写的问题。

0 人收藏 0 人点赞
#olympiad

解决(部分)形式化数学奥林匹克问题

OpenAI Blog ↗ · 2022-02-02 缓存

# 解决(部分)形式化数学奥林匹克问题 来源:[https://openai.com/index/formal-math/](https://openai.com/index/formal-math/) 我们在 [miniF2F](https://arxiv.org/abs/2109.00110) 基准测试上实现了新的最先进成果(41.2% vs 29.3%),这是一个具有挑战性的高中奥林匹克问题集合。我们的方法称为*语句课程学习*,包括手动收集一组难度级别不同的陈述(不含证明)

0 人收藏 0 人点赞
← 返回首页

提交意见反馈