AI周报 | 2026-W37

2026-09-13 · AI周报

weeklyai
A 串讲 · ~2 min

AI周报 | 2026-W37

导语:本周(9月7日至13日)从 OpenAI 声称解决千禧年难题 Navier-Stokes 到开源模型发布的纪录周,覆盖本周定义的 AI 时刻。


本周 Top5

热点池暂无 curated,待恢复。本节将在评分数据恢复后恢复。


AI大事件

  • OpenAI 分享 Navier-Stokes 千禧年难题的解法,称由其下一代模型(强于 GPT-6 Astra)的智能体完成证明。该动态在 X 上获约 10.3 万互动,成为本周最热 AI 事件;OpenAI 后续澄清其证明与两位数学家的独立工作不同,且未使用对方数据。
  • Anthropic 宣布 Claude 完成费马大定理的首个形式化证明,被描述为迄今最大的 Lean 证明,是 AI 辅助形式化数学验证的里程碑。
  • Anthropic 经济学团队发布 2030 年 AI 经济影响模型,模拟对增长、就业与工资在多场景下的潜在影响。
  • Asahi Linux 正式支持 Apple M3 系列 Mac,扩展其对 Apple Silicon 的 Linux 支持(存在已知限制)。
  • Anthropic 将 Claude 限制为仅 18 岁以上可用,更新全产品服务条款;该变更在教育场景的未成年人 AI 使用上引发开发者讨论。

新发布追踪

Inference.net 发布 Schematron V2 Turbo(2026-09-12) Inference.net 推出 Schematron V2 Turbo 模型,为 Schematron 系列最新版本。

Inference.net 发布 Schematron V2 Small(2026-09-12) 与 Turbo 版同日发布,Schematron V2 Small 定位轻量级推理场景。

Sakana 发布 Fugu Ultra v2(2026-09-11) Sakana 推出 Fugu Ultra v2,为 Fugu 系列旗舰级更新。

Sakana 发布 Fugu Max(2026-09-11) Fugu Max 与 Fugu Ultra v2 同日发布,构成 Sakana 本周的双模型矩阵。

inclusionAI 发布 Ling 3.0 Flash VL(2026-09-10) inclusionAI 推出 Ling 3.0 Flash VL,为 Ling 系列视觉语言模型新版本。


调用榜变化

腾讯 Hy4 preview 跃升至榜首 Hy4 preview 本周排名第 1,较上周上升 14 位(上周第 15),成为本周调用榜最大赢家。

Z.ai GLM 5.3 Flash 与 DeepSeek V4 Flash 0731 大幅攀升 GLM 5.3 Flash 排名第 3,较上周上升 17 位;DeepSeek V4 Flash 0731 排名第 4,较上周上升 45 位,两者均展现强劲增长势头。

小米 MiMo-V2.5 与 DeepSeek V4 Flash 0423 排名飙升 MiMo-V2.5 排名第 5,较上周上升 147 位;DeepSeek V4 Flash 0423 排名第 6,较上周上升 143 位,两款模型本周实现跨越式增长。

下降趋势 本周输入未提供排名下降的具体模型信息,暂无法列出下降详情。


本周总结:本周呈现两条并行主线:一是前沿实验室在 AI 辅助形式化数学上的突破(OpenAI 的 Navier-Stokes 声称、Anthropic 的费马大定理证明),二是 ModelScope 上开源模型密集发布(Qwen3.8-27B、Kimi-K3、GLM-5.3)与中国模型在调用榜上的强势攀升。