Ma's Tech Blog
数学 × AI 周报 第 07 期封面(AI 生成)

数学 × AI 周报 · 第 07 期:黎曼零点密度被顶到 67.2%,一份「生证明」要陶哲轩亲自消化八天

第 07 期:Anthropic 未发布的研究版 Claude 用两轮 Claude Code、共 3100 万 token,把黎曼ζ函数零点密度的已证下界从 41.6% 顶到 67.2%,官方同时说清楚这不等于证明黎曼猜想;数学爱好者 Lech Mazur 借 GPT-5.6 Pro 拿下悬置近 70 年的森多夫猜想,陶哲轩花八天把这份九万多行的「生证明」消化、重新形式化,压到一万五千行;OpenAI 十项数学突破被数学家指控引用不实,卷入"研究不端"争议。

数学 × AI 周报 第 06 期封面

数学 × AI 周报 · 第 06 期:一条推翻 87 年猜想的推文,一场追平人类满分的官方判卷

第 06 期:Anthropic 数论学家 Levent Alpöge 用 Claude Fable 5 找到反例,推翻了悬置 87 年的雅可比猜想(n≥3 情形),当晚就被 Lean 形式化核验,OpenAI 内部模型据称也独立找到了同一个反例;IMO 2026 官方判卷结果揭晓,华为"Celia"与小红书 "dots-note-3.0"双双拿到 42/42 满分,是 AI 首次在官方评分流程下追平人类最高分;国际数学家大会(ICM 2026)在费城开幕,陶哲轩发表公开演讲 「AI 时代的数学」,呼吁把声望分配给核验与消化结果的人,而不只是生成结果的人。

数学 × AI 周报 第 05 期封面

数学 × AI 周报 · 第 05 期:一周两个「证明」头条,一个签字画押,一个悬而未决

第 05 期:OpenAI 称 GPT-5.6 Sol Ultra 用 64 个子智能体一小时内"证明"了悬而未决 50 年的循环双覆盖猜想,十天过去仍无人正式核验;宾大统计学者 Edgar Dobriban 用 GPT-5.6 Sol Pro 90 分钟推翻 Benjamini-Hochberg 方法 30 年来的一个假设,并亲自核验、给出机器可验证证书;IMO 2026 上海笔试结束,AI 阵营的官方表态仍是悬念;中国科学院数学与系统科学研究院发布数学研究智能体 MMAT,攻克 8 个长期公开问题。