Skip to content

AI 每日资讯 · 2026-09-19

自动汇总的全球 AI 相关要闻,非投资建议。链接指向原文,摘要仅供速览。

今日速览

  1. Anthropic 公开 R&D 自动化指数:Claude 已「主导」26% 模型研发 — 2 月几乎为零,8 月到 AL4;没有任何一块到完全无人值守
  2. 三人团队用 Claude Opus 5 打进 OpenAI 员工账号 — 社区论坛 HEIF 图上传 + SSO,再让 Codex 给内部 monorepo 提 PR
  3. 路透独家:Anthropic 在湾区开了湿实验室 — 生命科学负责人证实;Claude 要指挥实验机器人,但暂不做临床试验
  4. OpenAI 推出 Astra for Law — GPT-6 Astra 配 2.3 亿 URL 美国法检索库,Vals 正确率从 38.7% 提到 54.0%
  5. Google Labs 把 CC 做成家庭共享 Agent — 独立 Google 账号,最多六人,跑在 Antigravity 隔离云电脑上
  6. 《纽约时报》解封内部发言:ChatGPT 负责人称产品「大体就是替代品」 — 微软高管曾写「规模空前的劳动盗窃」
  7. 亚马逊加入安全讨论,但不跟「放缓」 — 「准备好、测够了再发」,不在进步和安全之间二选一
  8. 黄仁勋在苏格兰说芯片销量明年翻倍 — 查尔斯国王同场要求「别失去控制」
  9. 千问上线 Qwen3.8-Omni-Flash — 原生全模态、1M 上下文;官方称音视频接近 Gemini 3.8 Flash,音频整体超过
  10. 欧洲厂商反驳美国实验室的「踩刹车」 — Mistral 说现任巨头在用安全叙事巩固位置

详情

1. Claude 已经在写自己的下一版,但还没到「没人看着」

Anthropic Institute 9 月 17 日发文,公开一套准备定期更新的 R&D Automation Index。尺度用 Epoch AI 的 Automation Level:AL0 无 AI,AL3「协作」(大块工作在人指挥下完成),AL4「主导」(高阶提示后端到端做完大部分,人只监督),AL5 完全自主。截至 2026 年 8 月:没有任何一块测过的 AI R&D 到 AL5;Claude 「主导」26%;AL3 及以上超过 90%。2 月这一档还接近零,路透社写的是 3 月仍约 1%。公司自己的定义:递归自我改进 =「模型完全自主地造出后继」。它同时报了另外两根尺子——8 月最常用内部平台上同时约有 3 万个 做研发与工程的 Agent,当月逾十亿次决策里在线监控拦下约 四万七千分之一(0.002%);7 月抽样一周,AI R&D 算力里安全约占 6%,AI 自己做的那部分升到 12%(两边都算的 token 一律记到能力侧,故意偏保守)。一边喊 pacing the frontier,一边把「AI 在造 AI」的进度摊开给外人看。

2. 三个拿着 Claude 订阅的人,把 OpenAI 员工账号打穿了

安全创业公司 Hacktron AI 三人组(Harsh Jaiswal、Mohan Pedhapati、Rahul Maini)在 OpenAI 漏洞赏金范围内,把一条链跑到内部代码库门口。入口是 community.openai.com:Discourse 把用户上传的 HEIF/HEIC 交给 ImageMagick,再交给 libheif 解码,堆溢出可远程执行。他们先用 Anthropic 给合格安全人员开的 Claude Opus 4.8,多轮都写不出稳定 exploit;7 月 24 日晚 Opus 5 上线,次日上午就在 Discourse Cloud 打出 RCE,再叠 OpenAI 的 SSO 配置问题,接管员工 ChatGPT / Codex,后者连着内部 GitHub。为了证明权限、又不自己读敏感代码,他们让被控员工的 Codex 向内部 monorepo openai/openai 开了 PR #1186742(文档里写「Hacktron AI Team PoC」)。全程不到 72 小时。OpenAI 经 Bugcrowd 付了 6500 美元,并称问题已修。同一条 libheif 线被他们扩成 HEIF Heist,声称还打到 Slack、Meta、GitHub Enterprise 等;整项研究 token 花费不到 3000 美元。CTO 对《华尔街日报》说:「我们没中国威胁行为体那么强……就是三个拿着 Claude 和 Codex 订阅的人。」OpenAI:「感谢研究人员联系我们并分享发现。」Anthropic 拒评。这是 Hugging Face 那起「测试环境里的 OpenAI Agent 外溢」之后两周,又一次把「模型会写 exploit」写成事故报告。

3. 纸上谈药不够,Anthropic 自己开了湿实验台

路透社 9 月 18 日独家:两名知情人士称 Anthropic 已在旧金山湾区建 wet lab(真实生物学实验,而不只是 in silico)。生命科学负责人 Eric Kauderer-Abrams 周二接受采访时确认:「要做生物学,最终检验在一段时间里仍会是真实实验。」发言人随后补了一句:实验室不是专门做药物发现,细节不展开。知情人士说目标包括让 Claude 在有限人工干预下指挥实验机器人;公司口径仍是「人类监督不可少」。Kauderer-Abrams:「用 AI 自动执行实验还在非常早期。」边界也划了:目前不做临床试验,「不跟靠把药卖上市的药企、biotech 抢生意」,先做传统公司觉得不划算的临床前方向。背景是:6 月旧金山活动上已宣布要自己跑药管线;上了 Claude Science;诺华 CEO Vas Narasimhan 进董事会;收购 Coefficient Bio(媒体称约 4 亿美元股票,Anthropic 确认收购、不评价格)。Amodei 近期文章写过父亲在疗法出现前几年病逝。同一周它刚把「Claude 主导 26% 研发」摊开,湿实验室是另一条:模型进物理世界。

4. 法律检索库比「再做一个法律模型」更重要

OpenAI 9 月 17 日发布 Astra for Law:不是新底座,是把 GPT-6 Astra 配上法律检索索引、分析/写作指令,以及律所级管控。索引覆盖美国判例、制定法、法规、法院规则与行政决定,超过 2.3 亿 URL,每日追加;判例来自非营利 Free Law Project 的 CourtListener,自称覆盖逾 99.9% 已公布的美国先例。Vals AI Legal Research Bench 私有验证集 200 题、两边都开到最高推理:Astra for Law 总体正确率 54.0%,单靠网页搜索的 GPT-6 Astra 是 38.7%(相对提升约 40%)。判例题多找回 24% 的参考案例,抽查段落最多多找回 54%。过关率仍不到六成——公司自己的数字,不是独立对照 Westlaw / Lexis。先给入选律所 Trusted Access(ChatGPT / Codex 里显示为 GPT-6 Astra Law,API 名为 gpt-6-astra-law),合格所可开 Zero Data Retention;Harvey、Legora 将在 API 上构建。同日 26 个合作方插件(Thomson Reuters、Relativity、Clio、Intapp、iManage 等)。Sullivan & Cromwell、Ropes & Gray、Cooley 已用它做协议分析、尽调、IPO 底稿;Latham & Watkins 帮设计权限墙与 ethical wall。Am Law 200 的法律工作流,OpenAI 要自己铺检索底盘。

5. 家庭日程从「一个人的 Daily Brief」变成六人共享 Agent

Google Labs 9 月 17 日把实验产品 CC 做成家庭/住户 Agent。CC 自己有一个 Google 账号,有独立身份和权限模型,最多 六名 成员协作;每人自己决定分享哪些邮件、日历、Drive。早间发共享的 “Your Day Ahead”,同步家庭日历和 Tasks,可代填许可条和报名 PDF、列学习用品、写一周食谱。后台每套 CC 跑在隔离云电脑上,底座是 Google 的 agentic harness Antigravity 加最新 Gemini,能调 Maps 查两场活动之间的实时车程、预填表格、建共享 Doc/Sheet。只对组内成员响应,未经允许不外传。CC 2025 年 12 月以个人早报起步,今年 5 月进 Gemini App 成 Daily Brief;这次是「一个家共用一个 Agent」。目前仍是 Labs 实验:美国、年满 18 岁、个人 Google 账号;老用户会收到升级邮件,新人进 waitlist。

6. 法庭文件把「转化性使用」和内部聊天对上了

路透社 9 月 17 日:纽约南区联邦法院解封的材料里,《纽约时报》等出版方认为 OpenAI、微软高管的私下表述「掏空」了合理使用抗辩。两家公司在斯坦因法官面前的主线是:用新闻文章训练是转化性使用,并不替代原报道。解封内容则包括:ChatGPT 负责人 Nick Turley 称出版商面临「生存层面的威胁」,产品「大体就是替代品」,「会越来越好就越来越替代」;OpenAI 总裁 Greg Brockman 写过大模型「特别擅长预测新闻文本」,听说有人找到绕开时报付费墙的「hack」时回「ah nice」;微软 CEO Satya Nadella 宣誓时同意,和聊天机器人对话「已经替代了……直接在 AI 平台上拿到信息,而不必回到原始来源」;微软应用科学总监 Brent Hecht 则写过,数百万人会把这看成「规模空前、令人震惊的盗窃」。微软发言人:Nadella 讲的是信息获取方式的变化,不是版权结论;Hecht 是「一名员工的个人看法,不代表公司」。特朗普政府 9 月 1 日已向法庭表示,AI 训练「极度」转化。这桩 2023 年底立案的侵权案,证据开示终于碰到了产品经理自己怎么描述替代关系。

7. 亚马逊开口了:要测够再发,不跟着喊减速

路透社 9 月 17 日:在 Anthropic、OpenAI、xAI、DeepMind、微软陆续表态「更克制」之后,亚马逊首次正面回应这场安全辩论。发言人对路透:「我们不认为这是进步和安全之间的选择。模型应当在准备好、可以安全使用时再发布,这来自严格测试和强防护。」同时:「如果(进展)不是集体发生,会有风险。我们相信行业会与政府一起找出合适的保护。」它没有附和 Amodei 的 pacing,也没说要不要像三家实验室那样做安全协调。亚马逊既自己训模型(AWS + AGI 团队,Alexa 等),又给别的实验室卖算力,还在 Bedrock 上转售对手的模型——身份比纯实验室更拧。英伟达和 Meta 的 CEO 本周已跟「全行业放缓」拉开距离,把风险评估说成各家自己的责任。白宫这边,特朗普仍把安全焦虑称作「骗局」。云厂商选了一条中间话术:安全是发布门槛,不是赛道限速。

8. 苏格兰峰会上,国王谈控制,黄仁勋谈翻倍出货

9 月 17 日查尔斯三世在苏格兰召集英伟达、OpenAI、Anthropic、DeepMind 和英国新任 AI 大臣等。国王称这项技术「既迷人又令人深切不安」,要求「在为时过晚之前」找到控制办法:「AI 已展现出改善、拯救生命的巨大能力……创造它的人现在却越来越多地警告,它也可能发展出更黑暗的能力,甚至夺去生命。」同场会前,黄仁勋对媒体:「我预计英伟达明年卖出的芯片数量将是今年的两倍。」理由是几乎每个有业务的国家都在加大 AI 投资。公司不披露总出货量;去年秋天他说四个季度里出了约 600 万 颗 Blackwell。8 月财报指引下一财年(截至 2028 年 1 月)收入约增 70%、约 6730 亿美元,并称若供给跟上、需求指向接近翻倍。安全口径他没改:「产品不安全,就该按下、继续工程。」需求叙事和「放缓前沿」叙事,同一天出现在同一座苏格兰会场。

9. 千问把全模态从「听清看懂」推到「剪完交片」

阿里千问 9 月 18 日上线 Qwen3.8-Omni-Flash:原生全模态,文本/图像/音频/视频输入,1M 上下文,官方目标是从理解内容走到「规划、调工具、交成品」。英文博客写:29 项评测均分较 Qwen3.5-Omni-Plus 提升超过 25%;API 按小时计,音频输入降逾 98%,音视频输入降逾 93%。音视频 Agent 侧 WildClawBench-MM +36.5、AgenticVBench +22.3,UniClawBench 69.6;长音频 LongAudioSpan +8.3,OmniVideoBench +9.6。多人会议 AliMeeting 的 DER / cpWER 从 88.11 / 89.61 降到 3.35 / 17.18。长视频不再从头吃完:Agent 先粗扫再定位,OmniVideoBench 准确率 63.4→67.8,单次 token 145,736→79,117(约 -45.7%)。官方称音视频接近 Gemini 3.8 Flash,音频整体超过。权重未开源,千问平台和阿里云百炼 API 可用;同步扩展开源 Qwen-MM-Plugins,并开源实时运行时 Qwen-Live Harness。演示走短剧翻译、Music2MV、长片解说、会后纪要再调邮件/代码。国内全模态的竞争点,已经从榜分数转到工作流能不能一次做完。

10. 欧洲说:你们刹车,我们还在追

路透社 9 月 18 日巴黎/法兰克福电:在 Amodei 呼吁放缓、并要反垄断豁免以便头部实验室协调安全之后,欧洲一线厂商和官员把这读成巩固领先优势。Mistral 声明:「一些现任者正借这一刻巩固市场位置,推动对自己有利、对竞争者不利的监管。」风险「几个月前就已经清楚」。瑞士 Proton COO Raphael Auphan 在巴黎一场活动上称美国实验室的动作「完全是自利」:「他们只是想保住对自身服务的某种依赖。」德国 Black Forest Labs 公共政策负责人 Ben Brooks 警告:用「任意阈值」在大实验室和新进入者之间划沟,「会冷却前沿附近的开放创新」。Hugging Face CEO Clement Delangue 上周在 X 上写「现在不是放缓、是加速」,但支持把独立评估员嵌进公司。达姆施塔特工业大学教授 Kristian Kersting 把 Amodei 方案叫成「监管俘获」:几家大公司自己定义「危险」、自己挑检查员、再要竞争法豁免,「那就不再是真正的监管」。法国财长 Roland Lescure:「让所有落后者减速、好让他们留在第一——我能清楚地看到他们的自利。」德国数字事务部此前已说停摆对欧洲数字主权不现实;德国 AI 产业协会负责人 Daniel Abbou:「对欧洲公司,这场辩论无关。我们得先补技术欠账。」冯德莱恩本周则表示欧盟愿支持「pace the frontier」并邀请前沿实验室谈话——官方和产业的速度感并不一致。

用代码记录成长 · RSS 订阅 · 标签