GPT-6 Astra 联手人类攻破重大进展级数学难题:AI 不再只是解题机,成了规律发现者
在全球顶级 AI 数学基准 FrontierMath 上,一道悬了九年、自2017年就被抛出的"重大进展"级开放难题被拿下——而这次的功臣是 GPT-6Astra 与三位人类研究员的人机组合。题目问的是批准式委员会选举里"核是否为空",本意是寻找"核为空"的反例,GPT-6Astra 却反过来证明:这样的反例根本不存在,也就是说绝对公平的委员会在任何情况下都必定存在。
更漂亮的是,模型还顺手发明了一套基于"调和熵"的全新投票规则,给出多项式时间的算法,证明局部最优解就已经满足"核"的要求。在这轮协作里,人类负责定方向、把逻辑关,AI 则顶起知识库、计算演练和那些跳跃式的灵感——分工像极了一个配合默契的研究组。
这是 AI 头一回摘下"重大进展"级数学难题,意义不只是多解了一道题。它把大模型从"解题机器"的位置往前推了一格,变成了能参与发现数学规律的合作者;连维护榜单的 Epoch AI 都为此新增了"Human + AI"状态标签,专门给这种人机联名的研究成果留了位置。当数学家开始扮演"提示词工具人"的角色,科研这条路的写法,正在被悄悄改写。
via AI新闻资讯 (author: AI Base)
在全球顶级 AI 数学基准 FrontierMath 上,一道悬了九年、自2017年就被抛出的"重大进展"级开放难题被拿下——而这次的功臣是 GPT-6Astra 与三位人类研究员的人机组合。题目问的是批准式委员会选举里"核是否为空",本意是寻找"核为空"的反例,GPT-6Astra 却反过来证明:这样的反例根本不存在,也就是说绝对公平的委员会在任何情况下都必定存在。
更漂亮的是,模型还顺手发明了一套基于"调和熵"的全新投票规则,给出多项式时间的算法,证明局部最优解就已经满足"核"的要求。在这轮协作里,人类负责定方向、把逻辑关,AI 则顶起知识库、计算演练和那些跳跃式的灵感——分工像极了一个配合默契的研究组。
这是 AI 头一回摘下"重大进展"级数学难题,意义不只是多解了一道题。它把大模型从"解题机器"的位置往前推了一格,变成了能参与发现数学规律的合作者;连维护榜单的 Epoch AI 都为此新增了"Human + AI"状态标签,专门给这种人机联名的研究成果留了位置。当数学家开始扮演"提示词工具人"的角色,科研这条路的写法,正在被悄悄改写。
via AI新闻资讯 (author: AI Base)