10+年产品经理专注分享AI 工具、AI 资讯、AI Coding、Vibe Coding与下一代产品创新,按 Ctrl+D 收藏我们
关于我 留言板 标签云 排行榜

苏米客

  • 首页
  • AIGC
    • AI最新动态
    • AI学习教程
    • AI工具集合
    • AI产品百科
    • AI编程开发
    • AI提示词
    • AI开源项目
    • AI智能体
  • Axure
    • Axure动态
    • Axure教程
  • 产品
    • 用户体验
    • 产品设计
    • 苏米杂谈
  • 资源
    • 产品UI组件库
    • 开源图标库
    • 中后台框架
  • 书单
    • AI书籍
    • 用户体验
    • UI视觉
    • 产品研究
    • 其他类型
  • 下载
    • Axure组件
    • Axure原型
    • 文档报告
    • 素材资源
  • 登录
  • 首页
  • AIGC
    • AI最新动态
    • AI学习教程
    • AI工具集合
    • AI产品百科
    • AI编程开发
    • AI提示词
    • AI开源项目
    • AI智能体
  • Axure
    • Axure动态
    • Axure教程
  • 产品
    • 用户体验
    • 产品设计
    • 苏米杂谈
  • 资源
    • 产品UI组件库
    • 开源图标库
    • 中后台框架
  • 书单
    • AI书籍
    • 用户体验
    • UI视觉
    • 产品研究
    • 其他类型
  • 下载
    • Axure组件
    • Axure原型
    • 文档报告
    • 素材资源
当前位置: 首页 » AI最新动态

OpenAI 公开 722 篇数学论文:宣称证明准黎曼假设,形式化验证零错误

51分钟前 AI最新动态 0 0

刚刚,OpenAI 把一个内部前沿模型做出来的数学成果,一股脑放上了 GitHub

OpenAI 数学论文

来源:OpenAI 官方账号

Github 仓库位于 openai/math,里面收了 722 篇论文,并把结果归成 372 个族,涉及大约 4000 道问题,平均每个结果,花掉约 3 小时 ChatGPT Pro 的思考算力

如果你打开第 003 号,会发现惊人的一幕:OpenAI 宣称,它证明了准黎曼假设

这事儿,非常离谱,眩晕瘫坐了算是

OpenAI 的这份 pdf

整个 PDF 一共 41 页,按数论、代数几何、理论计算机、数学物理等 17 个学科排开,数论打头

OpenAI 数学论文

总览第 2 页,数论部分

数论这里面所涉及到的问题,每条都悬了几十年,比如...

准黎曼假设(003):黎曼假设说,ζ 函数的非平凡零点全都落在实部 1/2 那条竖线上。退一大步,只问"实部大于某个比 1 小的数,那片区域里一个零点都没有",此前也没人证出来。003 说:实部大于 7/8 的地方,没有零点

有理数版希尔伯特第十问题(004):有没有一个算法,能判断任意一个整系数多项式方程有没有有理数解。整数版 1970 年由马季亚谢维奇收尾,答案是没有;有理数版一直悬着。004 说:也没有

卡塔兰常数是无理数(005):1 − 1/9 + 1/25 − 1/49 + …… 一路加下去得到的这个数,是不是分数,一直没人知道。005 说:不是

π 的无理性指数是 2(017):用分数去逼近 π,逼不出比一般无理数更好的精度。此前能证到的上界在 7.1 左右。顺手还证了 Flint Hills 级数收敛,一个长得很简单、却没人判断得了的级数

BSD 猜想的一大块(002、006):BSD 是七个千禧年大奖难题之一。这里没证全,证的是:任取一条有理数上的椭圆曲线,它的二次扭曲里,密度为 1 的那部分都满足完整的 BSD 公式

往后翻,还有 CM 阿贝尔簇上的霍奇猜想、正特征下几何朗兰兹的一个版本、一串推翻 Kaplansky 猜想的反例,和一长串埃尔德什问题

这里得补充一下:此处编号只是目录顺序,不代表排名(编号第三的是准黎曼假设)

怎么来的

这批论文,是 OpenAI 拿开放研究问题评测模型时攒下的,毕竟现有的数学评测被做满了,考卷就换成了人类还没解开的题

于是 OpenAI 就把找到了大约 4000 道“人类未解之谜”拿去 bench、把结果汇总成族,再按"够分量"筛一遍,剩下 372 族

作为新文档另一层面,在过去两个多月里,OpenAI 已经发了四轮学术公开:

8 月 1 日:OpenAI 发布《数学与理论计算机科学的十项进展》,10 个结果

9 月 8 日:OpenAI 说,内部模型解决了纳维–斯托克斯千禧年难题,证明光滑的流体能在有限时间里冒出奇点。最后得手的那组,约 1 万个智能体并行跑了 88 小时,用的模型 8 月 28 日才开始训练

9 月 21 日:OpenAI 说,同一个内部模型又解决了 100 多个公开问题

10 月 6 日:722 篇论文,一次放出

仓库里每篇论文的目录名都带着日期,你可以根据日期看到模型的每日突破,比如 9 月 23 日 177 篇,9 月 24 日 193 篇

OpenAI 数学论文

署名栏:此处无人

问题验证

模型解决了很多问题,验证的方法也在与时俱进,Lean 便是证明写成代码,交给电脑一步步核

对于准黎曼假设,通过 Lean 来表达,核心便只有下面三行:

theorem riemannZeta_ne_zero_of_seven_eighths_lt_re

{s : ℂ} (hs : (7 / 8 : ℝ)

sorry翻成人话:任取一个复数 s,只要它的实部大于 7/8,ζ(s) 就不等于 0,对了...末尾的 sorry 是占位符,意思是「证明待填」,OpenAI 所做的,就是把这个 sorry 填满

而判卷则是通过 Comparator 的程序完成:

题面是同一个命题

只用了三条标准公理

Lean 内核逐步检查,全部通过

OpenAI 开发者论坛上,已经有人自己编译了一遍:2924 个模块,零错误零警告

仓库里的形式化清单收了 162 篇论文的主结果,而对于剩下的五百多篇,眼下只有论文本身,只能回到老办法:人读

OpenAI 数学论文

数学家们眩晕瘫坐

9 月,25 位菲尔兹奖得主联名发了公开信,说 AI 正在威胁数学家的智力工作

9 月 21 日,OpenAI 宣布成立数学与 AI 顾问组,挂在普林斯顿高等研究院。成员由九位知名数学家组成,包括高尔斯、海雷尔、威滕、梅兰妮·伍德...这些人不从 OpenAI 拿钱,也不归 OpenAI 管9 月 29 日,顾问组参考六百多份问卷,发了一份 AI 实验室发布数学成果的指南。OpenAI 说,这次发布参考了这份指南:仓库带版本记录和引用格式,附上 Lean、10 份推理摘要、算力口径和问了多少题等等

逻辑学家 Jeremy Avigad 前天在陶哲轩博客上写:

一年前还算体面、能正经发表的那类结果,现在借助 AI 就能轻松生成。这让我们开始担心,往后做数学意味着什么,又该怎么培养下一代数学家

OpenAI 发布当天,顾问组也发了声明

OpenAI 数学论文

IAS 顾问组,10 月 6 日

对于这些研究来说,成果公开只是第一步,人类还需要理解这些工作、并把它们收进数学知识

科学研究是真踏入了奇点了...

Github:https://github.com/openai/math

声明:本站原创文章文字版权归本站所有,转载务必注明作者和出处;本站转载文章仅仅代表原作者观点,不代表本站立场,图文版权归原作者所有。如有侵权,请联系我们删除。
未经允许不得转载:OpenAI 公开 722 篇数学论文:宣称证明准黎曼假设,形式化验证零错误
#OpenAI #数学 #黎曼假设 #Lean #形式化验证 
收藏 1
answer-me-with-html:开源 Agent Skill,让 AI 回答变成可视化 HTML 页面
Anthropic送福利:Claude Max每月白送200美元API额度,免绑卡教程
推荐阅读
  • Anthropic 投入 1 亿美元成立 Claude 前沿学院,2027 年底前培训 1 万名 FDE 工程师
  • Claude Opus 4.7 发布:长任务处理能力与自我验证升级,企业测试数据详解
  • 支付宝上线「AI收」功能,AI Agent商业化新突破
  • 火山方舟满血版DeepSeek R1 API免费体验,可薅145元代金券!不封顶(附API接入教程)
  • Qwen3.7-Plus正式发布:多模态冲进Vision Arena全球前五
评论 (0)
请登录后发表评论
分类精选
Cursor 限制国内使用 Claude 等模型解决方案!
34372 1年前
学生/非学生:如何申请Cursor Pro免费会员,如何通过SheerID验证快速激活全攻略
30968 1年前
即梦AI图片2.1:一句话快速生成带中文的海报图,免费AI文生图、视频工具、AIGC创作工具
23622 1年前
注意!Cursor单设备登录新规:一个账户最多可以3台设备登录,且限制单点登录
23122 1年前
腾讯ima知识库skills上线:教你如何把腾讯 IMA 知识库接入 OpenClaw 一步打通
21524 6月前
国产大模型横向对比:Kimi K2.6、GLM-5.1、Qwen3、MiniMax M2 四大模型选型指南
19162 5月前
字节推出Trae CLI :Claude Code 和 Gemini CLI的国产平替 ?手把手教你如何安装Trae Agent
18776 1年前
Trae国内版,搭载 doubao-1.5-pro、DeepSeek R1/V3模型,对比 Trae 国际版有什么不同
18529 1年前
DeepSeek宣布:降价,最高降价75%!别错过这个优惠时段,赶紧充值
18301 1年前
刚刚!Cursor风控又加强了,可能是因为这个原因!
16716 1年前

文章目录

关于苏米客
分类排行
1 2026诺贝尔化学奖揭晓:日本法国两位科学家攻克不对称合成世纪难题
2 ChatGPT全面上线GPT-6:免费用户可用,Intelligent UI让回答长出交互界面
3 Anthropic送福利:Claude Max每月白送200美元API额度,免绑卡教程
4 OpenAI 公开 722 篇数学论文:宣称证明准黎曼假设,形式化验证零错误
5 Reflection Beam:英伟达投资的开源新模型,对标智谱 GLM-5.2
6 SemiAnalysis 实测:同样 200 美元订阅,Claude 算力是 OpenAI 的 5 倍
7 Mistral Large 4 发布:1T 参数 49B 激活,aka「大胖猫」欧洲最强开源模型
8 Claude vs ChatGPT 订阅额度实测:同样 200 美元,Claude 给 5 倍额度
9 a16z 最新 AI 应用报告:美国 AI 付费用户仅 4.5%,头部 1% 贡献 20% 消费额
10 Anthropic 推出网络安全验证计划:三档权限开放 Claude 完整攻防能力
苏米客
登录 注册
显示
没有账号? · 立即注册
显示
已有账号? · 直接登录
登录代表你已同意 用户协议 和 隐私政策
©2015-2024 苏米客XMSUMI 版权所有 · WWW.XMSUMI.COM 闽ICP备14005900号-6 网站地图 百度地图
微信文章助手 程序库 免费影视APP 免费字体下载 产品经理导航 爱克硕儿 产品经理AI资讯 Axure元件库下载 申请友联