Ma's Tech Blog
数学 × AI 周报 第 06 期封面

数学 × AI 周报 · 第 06 期:一条推翻 87 年猜想的推文,一场追平人类满分的官方判卷

第 06 期:Anthropic 数论学家 Levent Alpöge 用 Claude Fable 5 找到反例,推翻了悬置 87 年的雅可比猜想(n≥3 情形),当晚就被 Lean 形式化核验,OpenAI 内部模型据称也独立找到了同一个反例;IMO 2026 官方判卷结果揭晓,华为"Celia"与小红书 "dots-note-3.0"双双拿到 42/42 满分,是 AI 首次在官方评分流程下追平人类最高分;国际数学家大会(ICM 2026)在费城开幕,陶哲轩发表公开演讲 「AI 时代的数学」,呼吁把声望分配给核验与消化结果的人,而不只是生成结果的人。

数学 × AI 周报 第 05 期封面

数学 × AI 周报 · 第 05 期:一周两个「证明」头条,一个签字画押,一个悬而未决

第 05 期:OpenAI 称 GPT-5.6 Sol Ultra 用 64 个子智能体一小时内"证明"了悬而未决 50 年的循环双覆盖猜想,十天过去仍无人正式核验;宾大统计学者 Edgar Dobriban 用 GPT-5.6 Sol Pro 90 分钟推翻 Benjamini-Hochberg 方法 30 年来的一个假设,并亲自核验、给出机器可验证证书;IMO 2026 上海笔试结束,AI 阵营的官方表态仍是悬念;中国科学院数学与系统科学研究院发布数学研究智能体 MMAT,攻克 8 个长期公开问题。