GPT-5.6 Sol Pro 90 分钟推翻30年统计猜想,人类此前未能破解
Decision Brief
变化宾夕法尼亚大学统计学教授使用 OpenAI 的 GPT-5.6 Sol Pro 在约 90 分钟内推翻了一个关于 Benjamini-Hochberg 方法的悬而未决的中心猜想。
为什么重要这是大模型首次在数小时内解决一个人类长期未能攻克的数学猜想,证明当前模型已具备产生新知识的潜力,关注 AI 研究能力的团队应重新评估模型上限。
谁该关注所有 AI builder
受影响技术栈OpenAI
来源可信度中 · 可靠媒体或一手报导
宾夕法尼亚大学统计学教授使用 OpenAI 的 GPT-5.6 Sol Pro 在约 90 分钟内推翻了一个关于 Benjamini-Hochberg 方法的中心开放猜想,而前代模型 GPT-5.5 即使运行 20 小时也未能找到答案。据称该解答以新颖方式组合了已知方法,引发了公众讨论:AI 是否能真正产生新知识,抑或只是重新组合其已学习的内容。 对于从事数学、统计学或科学发现的研究人员而言,这一事件表明大模型在辅助破解长期难题上可能成为有力工具;同时也提醒 AI 开发者思考:当模型能以极短时间推翻人类多年未解的猜想时,我们应如何验证其“新知识”的可靠性,并及时调整对模型能力的预期。
摘要依据:官方/RSS 来源详摘依据上方标注的来源范围整理,内容以原文为准。
来源
- The Decoder:AI News
- The Decoder:AI News
留言
登入后即可留言,和其他 builder 交换实测心得。
还没有留言,抢头香。