我让 Qwen 3.8 27B 4bit 量化版本以 100K 上下文窗口自主运行了 63 小时(超过 5000 万 token),试图解决 RH。
当然它没有解决,但实验仍然展示了它的内部工作、记忆组织、使用的策略等等。
有趣的是,它从未幻觉出一个答案,也从未停止尝试新的想法来解决它。
它多次纠正了自己的错误。
我真的希望,在未来 12 个月内,某个未解决的千禧年大奖难题能被一个由开源模型驱动的智能体或智能体集群解决。
如果你想查看它的内部记忆、代码、策略等,我把所有内容都发布在 HF 上了:
https://huggingface.co/datasets/gr0010/artificium-riemannhypothesis-experiment
我的下一个目标是实际使用一个智能体——也许由更聪明的开源模型如 GLM 5.3 flash 驱动,或者一个智能体集群——来解决一个开放的数学问题。
如果你尝试过类似的事情,建议接下来攻克什么问题,或者有任何问题,请告诉我。
如果你有 GPU,考虑联系我,我们可以运行多个智能体组成集群,让它们攻克一个简单但开放的数学/编程问题。
阅读更多
讨论精选
LetsGoBrandon4256 (346↑):有趣的是,它从未幻觉出一个答案 它多次纠正了自己的错误。
真心提问:你在该领域(这里是数论)是否有足够的知识,能在 AI 犯错时指出错误?