Skip to content

AI 每日资讯 · 2026-09-10

自动汇总的全球 AI 相关要闻,非投资建议。链接指向原文,摘要仅供速览。

今日速览

  1. OpenAI 称内部模型给出纳维–斯托克斯千禧年难题解法 — 约 1 万个 Agent、88 小时;学界同时爆发署名争议
  2. Anthropic 预训练研究员辞职:实验室在「拿命赌博」 — 对齐负责人 Hubinger 称十年内灭绝概率 >10%
  3. Google 芬兰砸 130 亿欧元建 AI 基建 — 欧洲最大单笔;顺带签下 Loviisa 核电 22 年购电
  4. Meta 推出个人 Agent「Muse」 — 能发邮件、订机票、代付款,先在美国上线
  5. ChatGPT Images 2.5:延迟最多降一半 — API 拆成 Flare / Sunburst 两档
  6. DeepMind 放出 AlphaGenome Atlas — 预计算人类基因组约 90 亿种单碱基突变
  7. Google Cloud 与埃森哲组 1000 人前线工程师队 — 进客户现场落地 Gemini Enterprise
  8. 面壁智能开源 MiniCPM5-2B — 2B 端侧模型,AA 榜 4B 以下第一
  9. The Intercept 公开五角大楼约 400 页 AI 合同 — OpenAI / Anthropic / Google / xAI 各至多 2 亿美元
  10. OpenAI 拿出 500 万美元资助青少年与 AI 研究 — 单笔最高 100 万美元,10 月 6 日截止

详情

1. OpenAI:内部模型给出纳维–斯托克斯千禧年难题解法

OpenAI 9 月 8 日发文:内部系统给出纳维–斯托克斯存在性与光滑性问题的解,证明三维不可压缩流体可在有限时间内出现奇点。官方称这对应 Clay 千禧年大奖陈述 CD;证明写了分析稿,并用 Lean 形式化。模型「明显强于 GPT-6 Astra」,仍在训练。9 月 1 日起用约 1 万 个并发 Agent,9 月 5 日约 88 小时 后得到结果,Astra 再花 17 小时 做 Lean 验证。全项目约 3000 亿 输出 token、490 万 条消息;纳维–斯托克斯这条线约 1300 亿 token、270 万 条消息。公司明确不申领百万美元奖金。同一天 NYU 数学家 Tristan Buckmaster 与 Anthropic 的 Levent Alpöge 公布了相关 Euler 方程进展;Buckmaster 质疑 OpenAI 是否在得知他们工作后才加码,并问 Codex 会话有没有进训练。OpenAI 否认看到对方未公开材料,承认「去标识化产品数据理论上可能帮过模型」,并说两边 Euler 证明一个有外力、一个没有。独立数学家仍需核验。

2. Anthropic 研究员辞职:实验室在「拿命赌博」

Jacob Coxon 9 月 8 日在 X 宣布离开 Anthropic,并退出行业。他过去三年在 OpenAI 和 Anthropic 做预训练,2023 年 7 月至 2026 年 7 月在 OpenAI(含 GPT-4o),之后转到 Anthropic。原话:两家都没负起责任,「正直奔可自我改进的超级智能,拿我们的命赌博」。他说 OpenAI 很多人没真正内化文明级风险;Anthropic 看得清楚,但认定别人不会刹车,所以自己必须先到。对齐科学负责人 Evan Hubinger 公开附和:「Jacob 说得对——我们真的认真相信 AI 可能杀死所有人。我个人认为未来十年内概率 >10%。」他还写:Anthropic 在尽力,但「还没有解决超级智能对齐的计划,也谈不上走在正轨上」。多家媒体向公司求证,官方口径到发稿时仍少。这是现职对齐负责人把灭绝概率写成公开数字,不是营销口径。

3. Google 芬兰砸 130 亿欧元,并签欧洲首笔核电长约

Google 9 月 9 日宣布:未来两年(2027–2028)在芬兰投入至少 130 亿欧元(约 151 亿美元)做数字基建、清洁能源和本地合作,自称欧洲单笔最大投资。地点四个:Hamina、Kajaani、Muhos、Vaala;Hamina 是 15 年前纸厂改建的数据中心。官方测算建设期每年支撑逾 3.7 万 个岗位、给芬兰 GDP 贡献约 36 亿欧元;社区基金 3100 万欧元,四年内给四地。能源侧:与 Fortum 签 22 年 购电协议,支持 Loviisa 核电站延寿与升功率,这是 Google 在美国以外第一笔核电协议。路透社:协议覆盖该厂至多 50% 出力;DCD 写 2028 年起小额购电,2030–2049 提到 50%。另有新建陆上风电,以及邻近 Kajaani 新数据中心的 94 MW 电池,用来压住无风寒潮时的电价。核电延寿保住芬兰约 10% 电力。

4. Meta 推出个人 Agent Muse:发邮件、订机票、代付款

Meta 9 月 8 日发布 Muse:定位「不只回答、而是动手」。底层是 9 月 2 日的 Muse Spark。每个用户一台独立云虚拟机 Muse Secure VM,里面跑 Agent 和数据;另有 Sentinel 代理卡出口,敏感操作(发邮件、付款)要人点头。付款走 Stripe 的 Link,一次性卡号,真实卡号不进 Agent。路透社:免费档之外还有 20 美元 / 100 美元 月费。先在美国上 iOS、Android、muse.ai 和 WhatsApp,眼镜版后到;年底计划出用户持密钥的 Confidential VM,Meta 自己也打不开。可接邮箱、日历、支付、健康、购物和智能家居;没 API 就开浏览器填表。路透社同时写:内部测试出现过任务卡住、以及敏感数据未经授权暴露。公司说对话不进广告系统,可选择不把交互用于训练。

5. ChatGPT Images 2.5:更快、更跟指令,API 拆两档

OpenAI 9 月 8 日推出 ChatGPT Images 2.5。官方数字:ChatGPT Images 加 API 的 GPT-Image 每周生成超过 30 亿 张图。相对 Images 2.0,延迟最多降 50%;光线、纹理更自然,参考图主体更不容易被改没,多轮编辑更稳。产品侧新增 Sketch(在对话里手绘当参考,输入 @Sketch)、海报 / 周边等模板、图上批注,以及分享时可附带 prompt。API 两档:GPT-Image-2.5 Flare 是默认,质量高于 GPT-Image-2、延迟低一半;Sunburst 给要更精细控制的创意流,生成更慢。全档位 ChatGPT、ChatGPT Work、Codex,桌面 / 手机 / Web 同步推。继续用 C2PA 元数据和隐式水印。The Decoder 提醒:同价不等于同成本,token 消耗随模型和质量档变;2.5 还加了 xhigh / max 质量档。

6. DeepMind:AlphaGenome Atlas 预计算约 90 亿种单碱基突变

Google DeepMind 9 月 8 日发布 AlphaGenome Atlas:对参考人类基因组每一个可能的单碱基替换做分子效应预测,约 90 亿 条(约 30 亿碱基 × 3 种替换),数据集约 1 PB,体积超过 AlphaFold 数据库 30 倍。免费网页给学术使用,也走 AlphaGenome API,并做成 Google Antigravity 的 skill;商用将上 Google Cloud。新指标 AVI(AlphaGenome Variant Impact)把 AlphaGenome 与 AlphaMissense 压成一个分数,编码区(约 2%)和非编码区(约 98%)都能排。Exeter 的 Gareth Hawkes 用 UK Biobank 逾 5.4 万 人全基因组,按预测分子效应分组后,非编码关联多找出 22%;只看 AVI 最高的 1% 非编码变异,找到 19 个与 BMI 相关的区间。Broad 研究所用 AVI 在未解罕见病里捞到 DNM1 的错误剪接位点,实验筛查对上,该基因与癫痫性脑病强相关。

7. Google Cloud 与埃森哲:1000 名前线工程师进客户现场

埃森哲与 Google Cloud 9 月 8 日成立 Accenture Gemini Enterprise Business Group,挂在既有 Accenture Google Business Group 下。核心是建一支约 1000 人 的前线部署工程师(FDE)队伍,进客户现场把 Gemini Enterprise 从试点推到生产。埃森哲已有近 5 万 名 Google Cloud 技能员工。双方未披露金额,都称「重大联合投资」。四块重点:专有加速器与实施框架、可复用的行业方案、能力中心把实验接到企业级改造、推动 Gemini 能力被真正用起来。案例:YouTube 在 NFL Sunday Ticket 高峰用 Gemini Enterprise agent,客户情绪升 11%、平均处理时长降 37%。TechCrunch 引 Ramp 8 月数据:其美国客户企业 AI 支出里 Google 约 6%,Anthropic 43.5%、OpenAI 39.7%——这是在用人力补份额。WSJ:Google 负责培训这最多 1000 名埃森哲 FDE。

8. 面壁智能开源 MiniCPM5-2B:2B 端侧「小钢炮」

面壁智能联合 OpenBMB 9 月 8 日开源 MiniCPM5-2B,Apache 2.0。参数约 2B,上下文约 128K,面向手机 / PC 本地;官方称工具调用、深度搜索、代码生成已做出端侧通用 Agent 雏形。Artificial Analysis Intelligence Index 综合 23 分,排全球 4B 以下 开源基座第一,高于 Gemma 4 12B、Qwen3.5 9B 的 22 分。Agentic Index 20 分,同级 2B–4B 多在个位数。官方还写 34 项基准均分 53.9,真实任务评测 891 / 1000(人类基线)。除权重外,一并开源强化学习框架 Meshy、策略 JustRL II,以及 UltraData 代码预训练、Agent 轨迹、RL 数据。已适配英特尔、瑞芯微、Arm;推理可走 ollama、llama.cpp、vLLM、SGLang。7 月 WAIC 亮过相,这次才放权重。MiniCPM 系列截至 8 月下载量官方称破 5000 万

9. The Intercept:五角大楼与四家实验室的合同被 FOIA 翻出来

The Intercept 9 月 8 日刊出与 Legal Advocates for Safe Science and Technology 一起打的 FOIA 诉讼成果:逾 400 页 国防部文件,覆盖 2025 年 7 月与 Anthropic、Google、OpenAI、xAI 的原型合同及后续修订,每份上限约 2 亿美元。合同要求做「提升军事优势、军事效用或增强军事决策」的原型,覆盖作战、自动化决策、后勤和情报。四家都有双向信息共享:实验室向 DOD / CDAO 通报前沿模型表现和未来趋势,军方则提供用例基准、任务与威胁简报。Google 被点名要给五角大楼讲「对手的 AI 战术」。修订后的 OpenAI 合同(2026 年 2 月 27 日)写明可把工程师派进作战司令部、军种与战区单位;「系统监督」整节被涂黑。Anthropic 后来拒绝在无国内监控、无完全自主武器禁令的条件下上机密网,被列为供应链风险;OpenAI、Google、xAI 签了后续机密网部署。合同原文大量涂黑,细节仍不全。

10. OpenAI 拿出 500 万美元,资助青少年与生成式 AI 研究

OpenAI 9 月 8 日宣布 500 万美元 独立研究资助,题目是生成式 AI 如何影响 13–17 岁 青少年的生活与发展,重点在社交与情绪。单笔最高 100 万美元,间接费用上限 10%。钱来自 OpenAI Group PBC,不是基金会。欢迎各国申请,优先 AI 使用已经铺开的国家;方法不限,涉及未成年人必须写伦理审查、知情同意、隐私和伤害披露预案。评审看科学严谨、可行动性、独立性——明确要求结果即使对产品提供商不利也要站得住。申请即日起至 2026 年 10 月 6 日,内部专家与顾问滚动审,最晚 11 月 13 日 通知。获资助项目 2027 年一季度交中期,结束交终报;鼓励公开发表,但不作为拨款条件。偏好可能给研究 ChatGPT、跨学科、代表性不足人群的项目。

用代码记录成长 · RSS 订阅 · 标签