凯时AG

2026-07-23 08:31:19 设为首页 | 加入珍藏

OpenAI GPT-5.6 Sol Ultra证实晰一个已有50年历史的数学意料

2026-07-23 08:31:19 宣布 泉源:凤凰财经 作者:黄正萍 浏览:9766次

IT之家 7 月 12 日新闻 ,,,,,,OpenAI 于 7 月 10 日宣布 ,,,,,,旗下 GPT-5.6 Sol Ultra 模子在不到 1 小时内 ,,,,,,乐成天生了“循环双笼罩意料”(Cycle Double Cover Conjecture)的完整证实。。 。这一意料是图论领域悬而未决长达 50 多年的主要难题。。 。

OpenAI 已将这份证实以及用于天生证实的提醒词(Prompt)以 PDF 形式宣布到公司的内容分发网络(CDN) ,,,,,,并体现整套数学证实均由 AI 模子自力完成。。 。

循环双笼罩意料由数学家 George Szekeres 于 1973 年、Paul Seymour 于 1979 年划分自力提出。。 。该意料指出:关于恣意无桥图(bridgeless graph) ,,,,,,是否都保存一组循环(cycle) ,,,,,,使得图中的每一条边都恰恰泛起在两个循环中????

这一问题恒久以来被以为是图论最主要的果真难题之一。。 。

OpenAI 研究员 Ethan Knight 在 X 平台宣布了这一效果。。 。他体现:“昨天 ,,,,,,我们正式向所有用户开放 GPT-5.6 Sol Ultra。。 。今天 ,,,,,,我们分享一个新闻:它使用 64 个子智能体(subagents) ,,,,,,在不到一小时内证实晰已有 50 年历史的循环双笼罩意料。。 。”

凭证 OpenAI 宣布的提醒词 ,,,,,,GPT-5.6 Sol Ultra 被要求:最多同时挪用 64 个并行子智能体;;;动态治理各智能体的事情内容;;;在早期阶段坚持研究蹊径多样性 ,,,,,,让差别智能体划分实验差别数学体现要领、代数思绪以及结构归纳;;;同时安排专门的“反抗智能体”(Adversarial Agents) ,,,,,,认真寻找误差、界线情形以及潜在过失。。 。

别的 ,,,,,,提醒词还明确要求:榨取联网搜索资料;;;拒绝仅证实特殊情形或不完整证实;;;必需通过反抗式验证 ,,,,,,检查常见数学过失。。 。

虽然系统原本预留了 8 小时盘算时间 ,,,,,,但最终仅耗时约 1 小时便完玉成部证实。。 。凭证 OpenAI 宣布的内容 ,,,,,,这份证实主要包括以下几个方法:

将原意料归约为三次图(Cubic Graph)问题;;;使用 8-流定理(8-flow theorem);;;通过 GF (3)(三元有限域)上的线性代数结构边标记(Edge Labeling) ,,,,,,最终证实每条边都能够恰恰属于两个环。。 。

英国曼彻斯特大学数学家 Thomas Bloom 是最早果真评价这份证实的学者之一。。 。他以为:“这是一个很是漂亮的证实。。 。”Bloom 体现 ,,,,,,这份证实:精练、基础、使用的要领并不重大;;;若是昔时有人想到 ,,,,,,20 世纪 80 年月就有可能完成这一证实。。 。

他以为 ,,,,,,AI 最大的优势并不是提出全新的数学头脑 ,,,,,,而是在一直实验种种细微转变时具有远超人类的耐心。。 。

Bloom 写道:“人类数学家通;;;崾笛橐恢肿匀坏囊 ,,,,,,若是失败了 ,,,,,,很可能就会放弃;;;而 AI 不会因此气馁 ,,,,,,会继续一直实验种种细微转变。。 。”

不过 ,,,,,,他也指出了一个显着问题。。 。整篇证实没有引用任何已有文献。。 。例如 ,,,,,,1983 年 Bermond、Jackson 和 Jaeger 的经典论文本应被引用 ,,,,,,却完全没有泛起。。 。Bloom 以为 ,,,,,,这是现在 AI 自动天生数学论文普遍保存的问题。。 。

需要注重的是 ,,,,,,这份证实现在尚未经由正式偕行评审。。 。多家媒体和数学界人士都强调 ,,,,,,将 PDF 上传至公司 CDN ,,,,,,与正式揭晓经由偕行评审的数学论文 ,,,,,,是完全差别的两件事。。 。

事实上 ,,,,,,循环双笼罩意料历史上已经泛起过多次所谓“证实”。。 。已往几年中 ,,,,,,arXiv 上也曾泛起不少宣称完成证实的论文 ,,,,,,但厥后均被发明保存误差 ,,,,,,部分甚至最终撤稿。。 。因此 ,,,,,,数学界对此坚持相当审慎。。 。

别的 ,,,,,,这份证实也没有使用 Lean 等形式化证实工具举行机械验证。。 。不少业内人士指出 ,,,,,,现在图论相关的形式化数学库仍缺乏以支持云云重大的研究级定理 ,,,,,,因此短时间内也无法依赖自动化工具验证其准确性。。 。

凭证业内人士估算 ,,,,,,完成这次推理所消耗的盘算资源本钱约为:凭证 OpenAI 官方 Sol 定价 ,,,,,,约莫 275 至 485 美元(IT之家注:现汇率约合 1867 至 3293 元人民币);;;若是接纳 Cerebras 平台运行 ,,,,,,本钱最高可能抵达 1.3 万美元(现汇率约合 88270 元人民币)。。 。

若是最终通过数学界验证 ,,,,,,这将意味着:大型语言模子首次自力解决了一个被列入维基百科“未解决数学问题”列表的主要数学难题。。 。

此前 AI 在数学领域取得的主要效果 ,,,,,,例如:DeepMind 在帽子荟萃问题(Cap Set Problem)上的研究;;;AI 在纽结理论(Knot Theory)方面的突破;;;都属于人类与 AI 协同完成 ,,,,,,而不是 AI 自力完成完整证实。。 。

Bloom 以为 ,,,,,,这项效果也引发了关于数学发明实质的新讨论。。 。由于这份证实接纳的大多是几十年前就已保存的经典数学工具 ,,,,,,因此 AI 的优势未必在于提出全新的数学看法 ,,,,,,而更多体现在:拥有远超人类的盘算耐心和一连实验能力。。 。

现在 ,,,,,,图论专家预计将在未来数天至数周内 ,,,,,,对证明的每一个推导方法举行严酷审查 ,,,,,,只有所有通过验证后 ,,,,,,这一效果才华真正获得数学界认可。。 。

“好比同样是毛绒玩具 ,,,,,,我们把五六十种有趣的毛绒玩具群集在一起 ,,,,,,那这种调性就完全差别。。 。现在我们把种种品牌里有意思的工具 ,,,,,,加上我们自己设计的产品都荟萃在一起。。 。把这些有同样调性的工具群集在一起 ,,,,,,也就提炼出响应的消耗人群 ,,,,,,当这类人和这类产品汇总在一起的时间 ,,,,,,产品就更好销售。。 。”在她看来 ,,,,,,这是很要害的场景导向头脑 ,,,,,,“不适合这个场景的产品会显得突兀 ,,,,,,而适合这个场景的产品 ,,,,,,哪怕再不起眼也能被陪衬出效果来。。 。”

责任编辑:钟逸治    校对:翁怡君

今日热门

  1. 河北承德、唐山市防汛三级应急响应提升至二级
  2. 北京推动大中小学思政教育一体化建设再升级
  3. 美军:已完成对伊朗新一轮攻击
  4. 一站式服务“护航” 台胞扎根平潭拓事业国界
  5. “多人将两女子关铁笼游街”系摆拍
  6. “我的晚年我做主” 重庆北碚探索“六亨衢径”破解意定监护难题
  7. 机械人跳起“国风舞” 黑龙江30所高校师生竞技多元智能应用场景
  8. 一见·防汛救灾 ,,,,,,总书记时时放心不下
  9. 湖南苗乡迎来四月八女人节
  10. 旅行社破损生态被判赔11万元 自动设公益基金加入修复

相关推荐

【网站地图】