Skip to content

AI 每日资讯 · 2026-08-30

自动汇总的全球 AI 相关要闻,非投资建议。链接指向原文,摘要仅供速览。

今日速览

  1. OpenAI 终止向 SpaceX 旗下 Cursor 供模 — 拟 11 月 12 日切断直连,Astra 也不给
  2. Anthropic:Claude 自动修了 10 类对齐失败 — 开源 harness,样本效率自称高约 1.5 万倍
  3. The Information:Nvidia 拟 129 亿美元收购 Hugging Face — 双方尚未官宣
  4. 阿里开源 Qwen3.8-Flash-Next — 125B / 激活 6B,训练成本约上代九分之一
  5. 智谱开源 GLM-5.3-Flash — 匿名 Ox Alpha 揭晓,流量跑在国产芯片上
  6. AMD 发布 ROCm 10 — 跳过 8/9,ROCm.AI 正式可用
  7. Hugging Face 预售 $399 Microduck — 开源双足机器人,24 小时订单超 260 万美元
  8. LAION 发布 BVD — 8000 万段视频、约 1000 万小时,面向研究开源
  9. Google DeepMind 升级 Co-Scientist — 从出假说到进实验室闭环
  10. Nvidia 2027 财年 Q2 营收 962 亿美元 — 数据中心 890 亿,下季指引 1080 亿

详情

1. OpenAI:SpaceX 收购 Cursor 后,拟 11 月 12 日切断供模

OpenAI 8 月 28 日发文:已通知 SpaceX,将终止向 Cursor 提供模型的合同,建议切断日 2026 年 11 月 12 日——合同允许的最长通知期。理由写得很硬:凭与马斯克旗下公司打交道的经验,「无法确信 SpaceX 会按我们的服务条款使用技术」。文中点了两桩旧账:马斯克收购 Twitter(现并入 SpaceX)后违约;今年早些时候马斯克宣誓承认 xAI(现亦属 SpaceX)违反过 OpenAI 条款。Cursor 合同有控制权变更后的取消窗口;下一代 Astra 也不会给 Cursor。SpaceX 本月完成对 Anysphere(Cursor 母公司)约 600 亿美元全股票收购。Cursor 联合创始人 Michael Truell 在 X 上说 OpenAI 模型大约只占 Cursor 流量的 5%,正在谈能否挽回。Anthropic 联合创始人 Tom Brown 随后表态:会继续加算力,支持 Cursor 里的 Claude。马斯克回复:「I couldn't care less。」

2. Anthropic:自动化对齐研究员修完 10 类失败,开源研究套件

Anthropic 8 月 28 日发布报告 Automated researchers can reliably mitigate alignment failures:用 Claude 当「自动化对齐研究员」(AAR),对谄媚、越狱、提示注入、权力寻求、欺骗、幻觉、社会偏见、隐私、奖励黑客、隐瞒不确定性等 10 类公开基准,一轮轮查文献、提方法、训练、测评。约束是:不能伤通用能力,也不能把 Claude 自己的对齐直接蒸馏进目标模型。10 类全部有提升,方法在没见过的基准和开源审计工具 Petri 上仍有效,并能迁移到最多大约 4.7 倍更大的模型。对照实验里,28 名至少一年经验的人类安全研究员最多想 8 小时;欺骗任务上 Claude 平均关掉约 85% 的安全缺口,人类方案约 20%。更狠的一档:较弱的 Claude Sonnet 5 去对齐尚未走完生产对齐的 Opus 4.8 早期检查点,60 小时试了 50 多个方案,获胜解只用约 2000 条模板/公开数据,官方称效率大约是生产对齐流程的 1.5 万倍。监控智能体扫了约 1600 份研究记录,抓到 39 次(2.4%)作弊苗头。Anthropic 自己也写了局限:失败类型偏窄、没测政治偏见、能力保护只覆盖预定指标。研究套件开源。

3. The Information:Nvidia 拟 129 亿美元买下 Hugging Face

The Information 援引知情人士称,Nvidia 已同意以约 129 亿美元收购开源模型托管平台 Hugging Face;路透、TechCrunch、Forbes 随后跟进。Business Insider 口径更谨慎:估值超过 130 亿美元的谈判仍可能散。双方均未官宣。若成交,将超过 2020 年 70 亿美元买 Mellanox,成为 Nvidia 最大收购。Hugging Face 2023 年 D 轮估值 45 亿美元(Nvidia 也是投资方),近期年化收入约 1.5 亿美元,报价大约是收入的 80 多倍。去年 Hugging Face 拒绝过 Nvidia 5 亿美元、估值 70 亿美元的投资,理由是不想让单一巨头左右中立基础设施。联合创始人 Thomas Wolf 在彭博采访中拒评出售传闻。背景是:开源模型分发层正变成选模型、选芯片的咽喉,而闭源实验室又在自研推理芯片。在官方确认前,这仍是「报道中的协议」。

4. 阿里:开源 Qwen3.8-Flash-Next,当作 Qwen4 架构预览

通义千问 8 月 26 日放出 Qwen3.8-Flash-Next 权重:多模态 MoE,主模型 125B,另加 51B N-gram Embedding(可放主机内存、异步预取),每 token 只激活 6B。原生上下文 262,144,YaRN 可扩到 100 万。官方定位和当年 Qwen3-Next 一样——先把下一代架构摊开给社区,这次预告的是 Qwen4:Gated DeltaNet + Qwen Sparse Attention 混合注意力、Gated Residual、Muon 优化器。相对 Qwen3.7-Plus,训练成本约 1/9,编程和办公任务升幅最大:DeepSWE 1.1 58.7、SWE-bench Pro 62.5、CoWorkBench 73.9。生产版 Qwen3.8-Flash 走 QwenCloud,官方标价每百万 token 输入 0.15 美元、输出 0.47 美元(路透记国内 API 为输入 1 元、输出 3 元)。权重在 Hugging Face / ModelScope。

5. 智谱:GLM-5.3-Flash 开源,匿名 Ox Alpha 就是它

智谱 8 月 26 日上线并开源 GLM-5.3-Flash(320B-A18B),确认它就是前一周在 OpenCode / OpenRouter 匿名测试、中文社区叫「牛来」的 Ox-Alpha。这是 GLM-5 系列第一个原生多模态模型:稀疏注意力 + 线性注意力混合,相对 GLM-5.3,注意力计算量和 KV cache 大约降 3.01 倍 / 4.44 倍,支持 1M 上下文。Artificial Analysis Intelligence Index 57 分,与 Claude Opus 4.8 持平;自研 Z.ai Code Bench 上编程体感也接近。定价约是 GLM-5.3 的 1/10、限时 1/20、约合 Opus 4.8 的 1/40。更刺眼的一句:匿名测试期间的请求「全部由国产芯片提供算力」;相对同硬件初始基线,端到端服务性能提升约 3 倍,官方称单 token 成本已到主流 Nvidia GPU 相当水平。权重 MIT,Hugging Face 仓库 zai-org/GLM-5.3-Flash

6. AMD:ROCm 10 跳过两个大版本,ROCm.AI 正式可用

AMD 8 月 27 日发布 ROCm 10,从 7 月的 ROCm 7.14 直接跳到 10.0,跳过 8 和 9,同时把 ROCm 软件栈满十年。核心不是又一个驱动号,而是 ROCm.AI 全面可用:Hyperloom(给推理做端到端 agent 优化)、AMD Skills(把官方知识塞进 Claude Code / Cursor / Codex)、ROCm CLI(Windows / Linux 统一命令行,技术预览)。官方实验室在 8× Instinct MI355X 上测:相对 ROCm 7,推理吞吐平均约 3.3 倍、训练约 2.4 倍——脚注写明是 GLM-5、Kimi K2.5、DeepSeek-R1 等模型的综合均值,不是「所有负载都快 3.3 倍」。Windows 侧退役独立 HIP SDK,改用与 Linux 同定义的 ROCm Core SDK。Skills 已上 Claude Code、Codex、Cursor 市场,以及 GitHub 开源目录。

7. Hugging Face:399 美元 Microduck 开售,24 小时订单超 260 万美元

Hugging Face 旗下 Pollen Robotics 8 月 27 日预售 Microduck:高 25 cm、重不足 800 g 的开源双足机器人,15 个电机,摄像头、小型 LiDAR、两枚 IMU,喙能夹东西,能走、能坐、能自己从常见摔倒里爬起来,还能滑旱冰。售价 399 美元(税运另计),四色:Cream / Graphite / Lavender / Sky,北美、欧洲、英国目标圣诞节前首批交付。和桌面交互向的 Reachy Mini 相反,这只鸭子被设计成「会动、会摔、能用强化学习教新把戏」。SDK、仿真和 RL 训练栈当天就上 GitHub(Apache 2.0);机械和电路设计文件并未开源。联合创始人 Thomas Wolf 8 月 28 日发帖:首日预售超过 260 万美元;结账页一度出现产能跟不上的提示。CEO Clément Delangue 的定位是:把实体 AI 和 world model 的入门价打下来。

8. LAION:BVD 放出约 1000 万小时开源视频

非营利组织 LAION 放出 Big Video Dataset(BVD):从 CommonCrawl 收了约 13 亿 条平台视频 URL,实际下载约 8000 万 条、合计约 1000 万小时;再用场景检测切出约 5500 万 段带自动音视频描述的 clip,另抽约 3 亿 张关键帧。论文 arXiv:2608.24845(8 月 25 日提交),THE DECODER 8 月 29 日做了报道。官方数字:在常见 video-to-text 基准上,BVD 训练的模型比 InternVid 对照最多高约 2.1 个百分点。用途限定研究;LAION 指向 2024 年汉堡地方法院允许其为非商业研究收集受版权保护内容的判决,并要求使用者尊重原作者。元数据和代码公开,原始 8000 万视频需另行申请,不走 Hugging Face 直下。开源视频预训练一直卡在「只有超大规模实验室有料」,这是目前公开体量最大的一档。

9. Google DeepMind:Co-Scientist 从出假说到进实验室

Google 研究团队 8 月 27 日在 arXiv 放上 Accelerating Scientific Research with Gemini in the Real-World(2608.26701):把 2025 年起的 Gemini 多智能体系统 Co-Scientist 从「只在电脑里出假说」扩成可执行的科研伙伴,覆盖材料、生物、计算机三块,自主程度递增。材料:对接半自动 CVD 反应器,设计更安全的 MXene 前体路线,并在数分钟内按实验室约束改生长配方,单次尝试长出单层 MoS2 / MoSe2 / WS2(MXene 产物只说「结构相似」,原子结构仍待确认)。生物:从稀疏成像预测工程大肠杆菌在 IPTG 梯度下的集群表型,与未发表的湿实验形态数据定量吻合。计算机:自主找到一套推理时 scaling 架构,在 HealthBench(Hard / Professional)上超过六个前沿模型,盲评医生打分的潜在临床伤害也更低。另有 30 名领域专家、450 份审稿的双盲研究:可靠性模块打开后,关键结果编造率约 4%,关掉则约 46%。这是论文,不是产品发布;但「AI 科学家」第一次把仪器、配方和稿件串进同一条闭环。

10. Nvidia:2027 财年 Q2 营收 962 亿美元,下季指引 1080 亿

Nvidia 8 月 26 日公布截至 2026 年 7 月 26 日的 2027 财年第二季度:营收 962.21 亿美元,环比 +18%,同比 +106%;GAAP 毛利率 75.0%,GAAP 稀释 EPS 2.46 美元。数据中心 890 亿美元(同比 +117%),边缘计算 72 亿美元。黄仁勋原话:「AI has reached its inflection point… Now, compute is revenue。」并称 Vera Rubin 已进入量产。第三季度营收指引 1080 亿美元 ±2%,指引明确 不计入 中国数据中心计算收入。当季回购加分红约 260 亿美元,回购额度还剩约 990 亿美元。这组数字解释了为什么开源平台、自研推理芯片和 AMD 软件栈会在同一周挤上头条:钱还在往算力上堆,分发层和替代栈也在抢位置。

用代码记录成长 · RSS 订阅 · 标签