首页
产品服务
模型广场
Token工厂
算力市场算力商情行业资讯解决方案
注册

GPT-5.6 Sol Ultra模型不到1小时攻克图论50年未解猜想

发布日期:2026-07-13 来源:ITBear科技资讯作者:ITBear科技资讯浏览:2

AI首次独立完成重大数学难题证明?GPT-5.6 Sol Ultra攻克“循环双覆盖猜想”

  近日,人工智能领域传来一则重磅消息:OpenAI宣布其最新模型GPT-5.6 Sol Ultra在数学证明领域取得突破性进展,成功在不到1小时内完成了图论领域著名难题“循环双覆盖猜想”的完整证明。这一成果若通过同行评审,将成为首个由AI独立完成并被列入维基百科“未解决数学问题”列表的重要数学证明。

半个世纪的图论难题

  循环双覆盖猜想由数学家George Szekeres和Paul Seymour分别于1973年和1979年独立提出,核心问题是:任意无桥图是否都存在一组循环,使得每条边恰好出现在两个循环中?这一猜想困扰数学界超过半个世纪,被视为图论领域最重要的公开难题之一。

  OpenAI研究员Ethan Knight在社交平台透露,此次证明由64个子智能体协同完成,通过动态管理任务分工、保持研究路线多样性,并设置“对抗智能体”专门寻找潜在错误,最终在1小时内完成全部推导。

严格的离线验证流程

  根据OpenAI公布的提示词要求,模型需在离线环境下工作,禁止联网搜索资料,且必须通过严格的对抗式验证排除常见数学错误。证明过程主要分为三步:

  • 首先将原问题归约为三次图问题;
  • 随后利用8-流定理构建理论框架;
  • 最终通过GF(3)有限域上的线性代数方法完成边标记构造。

该证明“简洁优雅,使用的工具均为20世纪80年代已存在的经典方法”,并指出AI的优势在于“能以人类难以企及的耐心持续尝试不同路径”。

  英国曼彻斯特大学数学家Thomas Bloom评价称,该证明“简洁优雅,使用的工具均为20世纪80年代已存在的经典方法”,并指出AI的优势在于“能以人类难以企及的耐心持续尝试不同路径”。

争议与挑战

  不过,这一成果也引发争议。Bloom指出,证明全文未引用任何现有文献,例如1983年Bermond等人的经典论文,暴露出当前AI生成数学论文的普遍缺陷。

  更关键的是,该证明尚未经过同行评审,也未使用Lean等形式化工具验证——业内人士解释,目前图论领域的形式化数学库尚不足以支持如此复杂的定理验证。历史经验显示,该猜想此前曾多次出现“伪证明”,arXiv平台近年撤稿的论文中不乏此类案例。

高昂的计算成本

  从资源消耗看,此次证明成本不菲。按OpenAI官方定价估算,计算资源花费约275至485美元(约合1867至3293元人民币);若使用Cerebras平台,成本可能飙升至1.3万美元(约合88270元人民币)。

  与人类数学家相比,AI的“成本优势”更多体现在时间效率上——传统方法可能需要数年甚至数十年才能完成类似规模的系统性探索。

迈向AI自主科研的新阶段

  此前AI在数学领域的突破多依赖人机协作,例如DeepMind解决帽子集合问题、AI助力纽结理论研究等。此次若通过验证,将标志着AI首次独立完成重大数学难题的完整证明。

  图论专家表示,未来数周将对证明的每个步骤进行严格审查,只有通过数学界集体检验,这一成果才能真正获得认可。

本文转载自ITBear科技资讯, 作者:ITBear科技资讯, 原文标题:《 GPT-5.6 Sol Ultra模型不到1小时攻克图论50年未解猜想 》, 原文链接: http://m.itbear.com.cn/html/2026-07/1441272.html。 本平台仅做分享和推荐,不涉及任何商业用途。文章版权归原作者所有。如涉及作品内容、版权和其它问题,请与我们联系,我们将在第一时间删除内容!
本文相关推荐
暂无相关推荐
点击立即订阅