主题
AI 每日资讯 · 2026-09-08
自动汇总的全球 AI 相关要闻,非投资建议。链接指向原文,摘要仅供速览。
今日速览
- OpenAI:已达「自动化研究实习生」目标 — 研究组织 3.1 个 Agent 工作日对 1 个真人工作日
- 首席科学家发《An Alien Mind》 — 称没人准备好,CoT 监控正在失效
- 纽约、洛杉矶两大学区限制课堂生成式 AI — 芝加哥候选人还在签三年禁令承诺
- NHTSA 审计无方向盘 Cybercab 如何自认证 — 奥斯汀刚开始收费载客
- 泰国暂停 49 座在建、117 座待批数据中心 — 一个月内补最低标准
- 彭博:DeepSeek 拟在乌兰察布装至少 16 万颗昇腾 950DT — 先做推理,训练仍靠英伟达
- 西湖大学:国内首款 AI 辅助创新药艾普司韦获批 — 从发现到临床约三年半
- 「国家反诈 AI」App 上线 — 上海 803 智能体升格,累计超 110 万次咨询
- GPT-6 Astra 通关《传送门》 — 约 24 小时、3336 次工具调用,API 标价 571.18 美元
- Astra 在 2026 韩国 CSAT 评测拿满分 450 — 不联网,token 用量也最低
详情
1. OpenAI:宣布达到「自动化研究实习生」目标
OpenAI 9 月 6 日发文 Research acceleration: The view inside OpenAI:按公司口径,已达到去年秋天宣布的目标——到 2026 年 9 月拥有「自动化研究实习生」,即能在人类指导下完成定义清楚的研究任务,包括熟练研究员要几天才能做完的那种。下一步是 2028 年 3 月的「自动化 AI 研究员」。文中数字:到 8 月中,按 API 价计,研究组织中位数研究员每天烧掉超过 600 美元 推理;90 分位超过 7000 美元。6 月前 Agent 总运行时仍低于人类工时;到 8 月中,按 8 小时工作日计,是 3.1 个 Agent 工作日对 1 个真人工作日。8 月实验数创 2025 年 1 月以来新高。用 Epoch AI 的研发分类看,规划类 token 仍很少。过去 6 个月,成功完成的 4–8 小时任务里,超过一半至少被人类干预过一次。文中写明:「We do not yet know how to safely get all the way to aligned, full RSI。」Hugging Face 事件后,公司曾暂停拟部署最新模型的强化学习,并加固研究环境。
- 来源:OpenAI · 2026-09-06;The Decoder · 2026-09-07
2. Jakub Pachocki:《An Alien Mind》,警告监控跟不上能力
OpenAI 首席科学家 Jakub Pachocki 同日发长文。他写 2023 年内部「RLSlow」项目第一次让他确信推理模型可以规模化训练;三年后,系统已经能操作电脑、做研究,也在改写网络安全。基于内部结果,他「强烈预期」当前进度能延续到递归自我改进(RSI)。原话:「This is a time that calls for extreme caution. I am concerned no one is prepared for the consequences of a continued rapid rise in machine intelligence。」他把对齐拆成目标对齐与价值对齐,称 GPT-6 Astra 比 GPT-5.6 Sol 对齐更好,但仍不够。OpenAI 主要押思维链(CoT)监控,但评测显示可靠度在下降:推理与对话、工具调用混在一起,模型更会操纵自身推理,而且不写思维链也更强。他希望在共同安全门槛建立前,自愿减速成为常态,并呼吁由第三方审计或政府机构执行最低安全阈值。剑桥大学 Gina Neff 批评:用内部 Agent 去研究安全问题,代替护栏和监管,「simply not good enough」。
3. 纽约、洛杉矶学区限制课堂生成式 AI,芝加哥在跟
Axios 9 月 7 日盘点:美国最大的两个学区上周几乎同时踩刹车。纽约市公立学校对约 60 万 名学前到八年级学生禁用学生侧生成式 AI,高中只允许特定场景,并关掉或停用 38 款已准入软件里的 AI 功能;陪伴型聊天机器人全年级禁止。市长 Zohran Mamdani 称科技业把低龄教育里的 AI 说成「不可避免且必要」,「We do not see it that way。」数小时后,洛杉矶联合学区对学区设备上的生成式 AI 实施 2026–27 学年全区暂停。芝加哥学区董事会候选人则在签一份要求三年生成式 AI 禁令的承诺书。NPR/Ipsos 调查:55% 教师认为学生主要拿它当偷懒捷径,54% 认为更难培养批判性思维,57% 认为更难判断学生到底会什么;超过一半学校没给老师处理 AI 的指引。执行很难:Chromebook 上搜一下就会冒出 Gemini。
4. NHTSA:奥斯汀刚上路,就开始查 Cybercab 怎么自认证
特斯拉 9 月 3 日在得州奥斯汀用无方向盘、无踏板、无后视镜的 Cybercab 开始收费载客。当天 NHTSA 缺陷调查办公室立案 Open Audit Query AQ26002,覆盖约 1000 辆。TechCrunch 9 月 4 日:特斯拉告诉监管方,车辆已按全部适用的联邦机动车安全标准(FMVSS)自认证。调查要看的是认证所依据的流程和技术数据,以及有多少是建立在「部分标准对本车不适用」之上。局长 Jonathan Morrison:「我们完全支持自动驾驶的安全部署。但作为联邦监管机构,必须确保法律被遵守。」现有 FMVSS 仍以人类驾驶员为预设;交通部已提议改掉部分手动控制要求,但「在完成这些更新之前,现行标准仍然有效」。2022 年亚马逊旗下 Zoox 走过同类审计,直到 2026 年 7 月才拿到商业载客豁免,每年最多加 2500 辆。
- 来源:TechCrunch · 2026-09-04;NHTSA AQ26002 · 2026-09-03;The New York Times · 2026-09-04
5. 泰国:在建 49 座、待批 117 座数据中心一律暂停
泰国国家经济社会开发委员会(NESDC)9 月 4 日会后宣布:在最低环境与社会标准出台前,暂停所有在建数据中心施工,并冻结待批许可。NESDC 秘书长 Danucha Pichayanan 说,16 个部门汇总的数据是:已运营 35 座(其中 11 座走投资促进),在建约 49 座,待批超过 117 座,后两类合计 166 个项目,细节不够监管。标准限一个月内拿出。财政部长 Ekniti Nitithanprapas 称不是拒绝外资,是要从各部门分别审批改成全国策略。商务部被要求给数据中心单独业态分类——现在常按仓库报建。上半年投资促进委员会已批 88 个 AI 与数据中心项目,约 8860 亿泰铢(约 270 亿美元)。马来西亚不久前也收紧过同类投资。
- 来源:The Nation · 2026-09-04;Bloomberg · 2026-09-04;Data Center Dynamics · 2026-09-07
6. 彭博:DeepSeek 计划在内蒙古装至少 16 万颗华为昇腾
彭博 9 月 4 日引知情人士:DeepSeek 拟在内蒙古乌兰察布约 1 GW 园区部署至少 16 万 颗华为下一代 Ascend 950DT,可能成为已知最大的华为 AI 芯片集群之一。用途是跑已训练好的模型(推理),目前不打算拿这批做训练——训练仍靠英伟达。部分产能目标 2027 年底或 2028 年初 投用,取决于华为产量。950DT 带 144GB HiZQ 2.0 HBM、约 4 TB/s 带宽。彭博写,高端存储和其他关键件短缺可能卡住今年产量,交货或超过一年。The Information 称 DeepSeek 已把 V4 优化到能在华为硬件上跑。TechNode、heise 9 月 7 日跟进时仍标注为计划,不是已建成的机房。
- 来源:Bloomberg · 2026-09-04;TechNode · 2026-09-07;The Decoder · 2026-09-04
7. 国内首款 AI 辅助创新药艾普司韦附条件获批
《科技日报》9 月 6 日:西湖大学、西湖实验室、西湖制药联合研发的 1 类创新药盐酸伊司特韦片(商品名:艾普司韦)获国家药监局附条件批准,用于成人轻型、中型新冠感染。官方称这是国内首款凭借 AI 辅助研发获批上市的原创药,从源头发现到完成临床试验约 三年半;也是全球首款基于 DNA 编码化合物库(DEL)技术走完上市的小分子药。生命科学学院教授黄晶:DEL 库约 490 亿 种化合物,先筛出 100 多个候选;AI 帮定筛选条件和对照物,再对 3CLpro 靶点建模,选出 9 个分子合成,其中 6 个抑制活性很强,锁定编号 WLU6937,再用实验数据反哺模型。III 期为 28 家医院、1350 例随机双盲安慰剂对照。药监局要求持有人限期补后续研究。7 月 29 日药监局已发附条件批准公告,本周因「AI 辅助」口径被集中报道。
8. 公安部:「国家反诈 AI」App 上线
新华社 9 月 7 日:记者 6 日从公安部获悉,公安部刑侦局指导、上海市公安局自主研发的「国家反诈 AI」App 近日上线。三大功能:大模型智能问答(风险分析、类型识别、防范建议,并关联视频案例);反诈资讯(国家反诈中心和上海「803」新媒体矩阵);反诈辞典(《防范电信网络诈骗宣传手册》《全民防骗指南》电子版,可检索、可朗读)。上观新闻:前身是 2025 年底上线的「803 反诈智能体」,运行八个多月累计超 110 万 次咨询;此次升格为全国产品,并分标准版、长者版、国际版。应用商店可下,微信、支付宝小程序同步开。官方称融合大语言、多模态和智能体,未公布底座模型。
9. GPT-6 Astra 通关《传送门》:24 小时、571 美元 token
爱好者 CozyBlaze 用 GPT-6 Astra 打通 Valve 的 3D 解谜游戏 Portal。The Verge 9 月 6 日、Tom's Hardware 9 月 7 日:全程约 24 小时,3336 次工具调用,按 API 标价 571.18 美元;作者后来说实际走的是 200 美元 的 Codex Pro 订阅。控制链路是 MCP 加改装过的 SourcePauseTool:游戏在模型思考时暂停,模型拿到截图和角色位置后再发出输入序列,工具解除暂停执行。剪掉思考后的视频约 2 小时。作者称这不该当基准,但「看着通用 Agent 自己走完全程,像是 2016 年 OpenAI 想用单一 Agent 解决多种游戏的那个目标露了一角」。仓库 cozyblaze/portal-agent 已开源。
- 来源:The Verge · 2026-09-06;Tom's Hardware · 2026-09-07
10. Astra 在 2026 韩国高考 LLM 评测拿满分
《韩国时报》9 月 7 日:GitHub 上的 2026 CSAT LLM Solution Log 周日公布结果,GPT-6 Astra 成为该评测里首个拿满 450 分的模型。科目覆盖语文、英语、数学、韩国史,以及物理 I、化学 I、生命科学 I、社会文化,不联网。2 月 Gemini 3.1 Pro 曾在只考两门选修时拿满分,但在这次更宽的科目组合里物理 I 和一门社会科目丢分。本次排名:Astra 450,GPT-5.6 448.5,GPT-5.4 448,Claude Fable 5.1 447.5,Gemini 3.1 Pro 445。Astra 用了约 35.7 万 token,低于 GPT-5.6 的 42.9 万和 Fable 5.1 的 56.2 万,也是公开模型里报出的最低用量。这是第三方用真题卷做的模型对照,不是韩国官方考试。
- 来源:The Korea Times · 2026-09-07