Qwen 3.8 27B 在 RTX 3090 上运行63小时以解决黎曼猜想
摘要
一项实验在RTX 3090上运行了Qwen 3.8 27B模型63小时,试图解决黎曼猜想,展示了自主推理、自我纠正和无幻觉的能力。
我让Qwen 3.8 27B 4bit量化版本以100K上下文窗口自主运行了63小时(超过5000万令牌),尝试解决黎曼猜想。当然它没有解决,但实验仍然展示了它的内部工作、记忆组织、使用的策略等。有趣的是,它从未产生幻觉答案,也从未停止尝试新想法来解决它。它多次纠正了自己的错误。我真的很希望在未来12个月内,其中一个未解决的千禧年大奖问题将由一个代理或一群由开源模型驱动的代理解决。如果你想查看它的内部记忆、代码、策略等,我已经在HF上发布了所有内容:https://huggingface.co/datasets/gr0010/artificium-riemannhypothesis-experiment 我的下一个目标是实际使用一个代理,或许由像GLM 5.3 flash这样更智能的开源模型或一群代理驱动,来解决一个开放的数学问题。请告诉我你是否尝试过类似的事情,你会建议下一个解决什么问题,以及如果你有任何问题。如果你有GPU,请考虑联系我,我们可以运行多个代理来创建一个群体,并让它们解决一个简单但开放的数学/编程问题。
相似文章
在 RTX 5090 上实时运行 Qwen 3.8 27B 解决开放数学问题 - 覆盖设计 C(25,15,5)
在 RTX 5090 上实时运行 Qwen 3.8 27B 模型以解决覆盖设计数学问题的实验,展示了开源 AI 在消费级硬件上推动科学创新的潜力。
Wow!Qwen 3.6:35b-a3b 在 3090 上……太惊人了。
一位用户分享了在二手 RTX 3090 上运行量化版 Qwen 3.6:35b-a3b 模型的惊人结果:将模型放入显存后,输出速度达到每秒 160 个 token,并以 75 秒的视频处理时间展示了视觉能力。
Qwen 3.6 27B 投机解码基准测试:单张 RTX 3090 上实现 ~100 TPS
一份详细的基准测试,比较了单张 RTX 3090 上 Qwen 3.6 27B 的投机解码引擎,显示 ik_llama 在代码生成中达到约每秒 100 个 token。结果包括 5 种引擎变体的解码 TPS、TTFT、显存占用和上下文退化情况。
熊也能跳舞:在单个3090上运行Qwen 3.8 27B三周
一项实验显示,一个量化的Qwen 3.8 27B模型在单个RTX 3090 GPU上本地运行,自主优化CUDA推理超过三周,生成了功能性的内核和基准测试,同时保持了连贯的长期目标跟踪。
@ItsmeAjayKV: 成就解锁:得益于RTX 3090,现在我可以运行Qwen3.6-27b密集模型。正在运行 @Alibaba_Qwen Qwen 3…
用户使用llama.cpp在RTX 3090上对Qwen3.6-27B进行基准测试,实现了35 tok/s的生成速度和1247 tok/s的提示处理速度。