凯时AG

OpenAI GPT-5.6 Sol Ultra证实晰一个已有50年历史的数学意料

作者:卢火群
宣布时间:2026-07-22 07:34:14
阅读量:500

OpenAI GPT-5.6 Sol Ultra证实晰一个已有50年历史的数学意料

IT之家 7 月 12 日新闻 ,,,,,OpenAI 于 7 月 10 日宣布 ,,,,,旗下 GPT-5.6 Sol Ultra 模子在不到 1 小时内 ,,,,,乐成天生了“循环双笼罩意料”(Cycle Double Cover Conjecture)的完整证实。。。这一意料是图论领域悬而未决长达 50 多年的主要难题。。。

OpenAI 已将这份证实以及用于天生证实的提醒词(Prompt)以 PDF 形式宣布到公司的内容分发网络(CDN) ,,,,,并体现整套数学证实均由 AI 模子自力完成。。。

循环双笼罩意料由数学家 George Szekeres 于 1973 年、Paul Seymour 于 1979 年划分自力提出。。。该意料指出:关于恣意无桥图(bridgeless graph) ,,,,,是否都保存一组循环(cycle) ,,,,,使得图中的每一条边都恰恰泛起在两个循环中???

这一问题恒久以来被以为是图论最主要的果真难题之一。。。

OpenAI 研究员 Ethan Knight 在 X 平台宣布了这一效果。。。他体现:“昨天 ,,,,,我们正式向所有用户开放 GPT-5.6 Sol Ultra。。。今天 ,,,,,我们分享一个新闻:它使用 64 个子智能体(subagents) ,,,,,在不到一小时内证实晰已有 50 年历史的循环双笼罩意料。。。”

凭证 OpenAI 宣布的提醒词 ,,,,,GPT-5.6 Sol Ultra 被要求:最多同时挪用 64 个并行子智能体;;;;;动态治理各智能体的事情内容;;;;;在早期阶段坚持研究蹊径多样性 ,,,,,让差别智能体划分实验差别数学体现要领、代数思绪以及结构归纳;;;;;同时安排专门的“反抗智能体”(Adversarial Agents) ,,,,,认真寻找误差、界线情形以及潜在过失。。。

别的 ,,,,,提醒词还明确要求:榨取联网搜索资料;;;;;拒绝仅证实特殊情形或不完整证实;;;;;必需通过反抗式验证 ,,,,,检查常见数学过失。。。

虽然系统原本预留了 8 小时盘算时间 ,,,,,但最终仅耗时约 1 小时便完玉成部证实。。。凭证 OpenAI 宣布的内容 ,,,,,这份证实主要包括以下几个方法:

将原意料归约为三次图(Cubic Graph)问题;;;;;使用 8-流定理(8-flow theorem);;;;;通过 GF (3)(三元有限域)上的线性代数结构边标记(Edge Labeling) ,,,,,最终证实每条边都能够恰恰属于两个环。。。

英国曼彻斯特大学数学家 Thomas Bloom 是最早果真评价这份证实的学者之一。。。他以为:“这是一个很是漂亮的证实。。。”Bloom 体现 ,,,,,这份证实:精练、基础、使用的要领并不重大;;;;;若是昔时有人想到 ,,,,,20 世纪 80 年月就有可能完成这一证实。。。

他以为 ,,,,,AI 最大的优势并不是提出全新的数学头脑 ,,,,,而是在一直实验种种细微转变时具有远超人类的耐心。。。

Bloom 写道:“人类数学家通;;;;;崾笛橐恢肿匀坏囊 ,,,,,若是失败了 ,,,,,很可能就会放弃;;;;;而 AI 不会因此气馁 ,,,,,会继续一直实验种种细微转变。。。”

不过 ,,,,,他也指出了一个显着问题。。。整篇证实没有引用任何已有文献。。。例如 ,,,,,1983 年 Bermond、Jackson 和 Jaeger 的经典论文本应被引用 ,,,,,却完全没有泛起。。。Bloom 以为 ,,,,,这是现在 AI 自动天生数学论文普遍保存的问题。。。

需要注重的是 ,,,,,这份证实现在尚未经由正式偕行评审。。。多家媒体和数学界人士都强调 ,,,,,将 PDF 上传至公司 CDN ,,,,,与正式揭晓经由偕行评审的数学论文 ,,,,,是完全差别的两件事。。。

事实上 ,,,,,循环双笼罩意料历史上已经泛起过多次所谓“证实”。。。已往几年中 ,,,,,arXiv 上也曾泛起不少宣称完成证实的论文 ,,,,,但厥后均被发明保存误差 ,,,,,部分甚至最终撤稿。。。因此 ,,,,,数学界对此坚持相当审慎。。。

别的 ,,,,,这份证实也没有使用 Lean 等形式化证实工具举行机械验证。。。不少业内人士指出 ,,,,,现在图论相关的形式化数学库仍缺乏以支持云云重大的研究级定理 ,,,,,因此短时间内也无法依赖自动化工具验证其准确性。。。

凭证业内人士估算 ,,,,,完成这次推理所消耗的盘算资源本钱约为:凭证 OpenAI 官方 Sol 定价 ,,,,,约莫 275 至 485 美元(IT之家注:现汇率约合 1867 至 3293 元人民币);;;;;若是接纳 Cerebras 平台运行 ,,,,,本钱最高可能抵达 1.3 万美元(现汇率约合 88270 元人民币)。。。

若是最终通过数学界验证 ,,,,,这将意味着:大型语言模子首次自力解决了一个被列入维基百科“未解决数学问题”列表的主要数学难题。。。

此前 AI 在数学领域取得的主要效果 ,,,,,例如:DeepMind 在帽子荟萃问题(Cap Set Problem)上的研究;;;;;AI 在纽结理论(Knot Theory)方面的突破;;;;;都属于人类与 AI 协同完成 ,,,,,而不是 AI 自力完成完整证实。。。

Bloom 以为 ,,,,,这项效果也引发了关于数学发明实质的新讨论。。。由于这份证实接纳的大多是几十年前就已保存的经典数学工具 ,,,,,因此 AI 的优势未必在于提出全新的数学看法 ,,,,,而更多体现在:拥有远超人类的盘算耐心和一连实验能力。。。

现在 ,,,,,图论专家预计将在未来数天至数周内 ,,,,,对证明的每一个推导方法举行严酷审查 ,,,,,只有所有通过验证后 ,,,,,这一效果才华真正获得数学界认可。。。

 

文章点评

未盘问到任何数据!

揭晓谈论

◎接待加入讨论 ,,,,,请在这里揭晓您的看法、交流您的看法。。。

最新文章

热门文章

随机推荐

【网站地图】