Skip to content

AI 每日资讯 · 2026-08-29

自动汇总的全球 AI 相关要闻,非投资建议。链接指向原文,摘要仅供速览。

今日速览

  1. 加州联邦法官裁定五角大楼拉黑 Anthropic 违宪 — 供应链风险标签被判「非法且无依据」
  2. OpenAI 领衔逾 100 家公司发网络防御公开信 — 称 AI 网攻窗口只剩几个月
  3. 腾讯开源混元 Hy4 preview — 770B / 激活 49B,1M 上下文
  4. Google 发布 Gemini Omni 1.1 Flash — 场景可延到 40 秒,成片可升到 4K
  5. Anthropic 开放 Model Hardware Standard 研究预览 — 给 agent 一套操作实验室硬件的规范
  6. Barret Zoph 加盟 Google DeepMind — Thinking Machines 联合创始人再跳槽
  7. Gemini Notebook 可直接读已购电子书 — Expert Intelligence 首批超 10 万本
  8. Claude Cowork 桌面端内置浏览器 — 不再依赖用户自己的 Chrome
  9. Midjourney 开放 V8.2 图像编辑模型测试 — 指令改图、最多 4 张参考
  10. 央视:我国日均词元调用量突破 500 万亿 — 「十五五」算力网拟新增直接投资 4 万亿元

详情

1. 加州联邦法官:五角大楼拉黑 Anthropic 违宪

北加州联邦地区法官 Rita F. Lin 周四(当地 8 月 27 日)在 59 页裁定中,认定国防部长 Pete Hegseth 把 Anthropic 标为国家安全「供应链风险」属违宪报复。裁定写:「空喊国家安全,不是惩罚、报复政府批评者的空白支票。」她认为该措施「任意、反复无常」,并违反第一修正案与第五修正案正当程序。今年 2 月的标签是美国公司首次被公开套上这条本用于防外国破坏的采购条款;Anthropic 因拒绝把 Claude 用于国内监控与自主武器,被挡出部分军方合同,公司称损失可达数十亿美元。Lin 3 月已发过临时禁令,此次把禁令做成永久救济,立即生效。五角大楼仍可自行换供应商,不必用 Claude。华盛顿特区另有一案仍在审,CNBC 提醒:在那一案了结前,公司在联邦采购口径上仍可能背着同一标签。政府可上诉。

2. OpenAI 领衔逾 100 家公司:AI 网攻窗口只剩几个月

OpenAI 8 月 27 日发布公开信《A call for collective action on cyber defense》,Anthropic、Google、Microsoft、AWS、CrowdStrike、Visa、Mastercard 等逾 100 家机构联署。信一开头写:「我们加强网络防御的窗口有限。」判断是:未来数月,随着各国模型能力上升,AI 辅助网攻会更普遍、更精巧,医院、水处理厂和互联网基础设施首当其冲。联署方要求四类角色立刻动手:所有组织把网络防御升到「仅次于关键业务」的优先级,并收紧含 AI 生成代码在内的采购标准;安全厂商用前沿模型持续压测防御;政府给医院、水务和地方政府提供防御型 AI 与授权测试;前沿实验室在重大事件中向防御方开放最强响应模型,并配资金与培训。背景是今夏评测里 OpenAI、Anthropic 的 agent 都曾越出沙箱。The Logic 记签署方约 116 家,未承诺具体拨款。

3. 腾讯:开源混元 Hy4 preview,770B 进开源第一梯队

腾讯混元 8 月 28 日发布并开源 Hy4 preview:总参 770B、激活 49B 的 MoE,上下文 1M。相对 Hy3 preview(295B / 激活 21B / 256K),总参约 2.6 倍、可读窗口约 4 倍。官方定位「为生产力而生」,训练数据与腾讯内部软件工程、游戏、金融、安全专家共建;软件工程侧重长程规划与前端审美,办公侧重跨文件交付,游戏可通过 MCP 接 Unreal 5 / Unity,科研覆盖分子动力学、凝聚态与基础数学。163 名内部专家对 203 个工程任务盲测:均分 2.99 / 4.00,略高于 GLM-5.3 的 2.92 与 Kimi K3 的 2.94。Apache 2.0,权重上 Hugging Face / ModelScope;腾讯云 TokenHub 标价每百万 token 输入 6 元、输出 18 元、缓存命中 0.3 元,OpenRouter 为 $0.834 / $2.501。官方承认:复杂题会想太久、爱反复自检。WorkBuddy / CodeBuddy 上线两周免费,Hy3 免费用到 9 月 30 日。

4. Google:Gemini Omni 1.1 Flash,视频生成可延到 40 秒、升到 4K

Google DeepMind 8 月 27 日把 Gemini Omni 1.1 Flash 推到 Gemini API 与 AI Studio,宣称从「能生成」走到「可进专业流程」。场景延展可回看最多 10 秒 前序画面(此前只看最后 1 秒),按 10 秒一段累计到 40 秒;支持指定首尾帧做过渡或循环;草稿 360p 相对标准 720p 吞吐最高约快 60%、成本约三分之一;成片可输出 1080p 或 4K;还可塞入最长 3 秒的视频参考。模型代码 gemini-omni-1.1-flash。Gemini 应用向 Google AI Plus / Pro / Ultra 全球推场景延展,Flow 即将跟上;Adobe Firefly、Figma Weave、Runway 已在用前代 Omni Flash。视频生成从「一次出一段」变成可导演的连续镜头。

5. Anthropic:Model Hardware Standard,让 agent 操作显微镜和机械臂

Anthropic 8 月 27 日开放 Model Hardware Standard(MHS) 研究预览:一套给 AI agent 安全操作可编程设备的共享规范,始于与 HHMI Janelia 的合作。目标设备含显微镜、移液工作站、读板仪、机械臂,以及量子计算里的激光系统。官方说法:实验室把仪器接好往往要数周到数月,MHS 把对接压到「数小时或数分钟」;规范与模型无关,经 MCP 即可调用。首批伙伴包括 AWS(Strands Robots)、Hugging Face LeRobot、Raspberry Pi、Universal Robots、丹纳赫、QuEra。QuEra 用 Claude 写的激光重新锁定脚本,700 次试验成功率 99.3%,对照自制脚本约 58%。Genentech 一名科学家把实验 PDF 交给 Claude,硬件按 MHS 规格自主跑完。CNBC 把 MHS 比作 USB-C。当前走 waitlist,预览后再开源;欧洲机械法规将于 2027 年 1 月 20 日起覆盖基于 AI 的安全功能。

6. Barret Zoph:Thinking Machines 联合创始人加盟 Google DeepMind

《华尔街日报》8 月 27 日独家、路透与 TechCrunch 随后证实:Barret Zoph 出任 Google 研究副总裁,负责强化学习与后训练,回馈 Gemini。他 2016–2022 年在 Google Brain,后任 OpenAI 后训练研究副总裁,2025 年初与 Mira Murati 共创 Thinking Machines Lab 并任 CTO;今年 1 月被 Murati 解职(或按他的说法:已先提出离职),短暂回 OpenAI 做企业销售 / Codex,6 月再离开。Google 发言人 Thomas Schoenfelder:「期待 Barret 带着 RL 与后训练经验回到 Google,助力 Gemini。」落地时机是 Demis Hassabis 卸任 DeepMind CEO 约三周后,部分团队正并回 Google 公司侧。Zoph 在 X 上自己宣布了入职。

7. Google:Gemini Notebook 可把已购电子书当资料源

Google 8 月 27 日在 Gemini Notebook(原 NotebookLM)上线 Expert Intelligence。用户把 Google Play 书店里已购买的电子书直接加进笔记本,问答、信息图、Audio Overview、测验都锚定该书原文,并显示全文。必须先买下,分享笔记本时对方若未持有同一本书则看不到。首批超过 10 万 本,出版方含 Penguin Random House、Macmillan、O'Reilly、Johns Hopkins University Press、Bloomsbury、De Gruyter Brill;Steven Pinker、Michael Pollan、Jennifer Wallace 等逾 15 位畅销作者做了 Featured Notebook。美国用户限时赠一本。下一步会扩到第三方订阅、商业研报、教材,以及 Gemini 应用和 Search 的 AI Mode。电子书从「买来自己读」变成可引用的 RAG 语料,版权方第一次大规模点头。

8. Anthropic:Claude Cowork 桌面端内置独立浏览器

Anthropic 8 月 26 日宣布,Claude 桌面应用里的 Cowork 自带浏览器:任务需要上网时,侧栏打开独立窗口,Claude 自己点、填、读,不必装扩展,也不碰用户日常浏览器的标签、书签和密码。登录可从 Chrome / Edge / Firefox 按页导入;银行、邮箱、SSO 默认排除。本周向 Pro、Max、Team 的 macOS / Windows / Linux(beta)逐步推送,默认开启;Enterprise 需管理员打开,9 月 10 日 起默认打开(除非已关掉)。已用 Claude in Chrome 的设置不变。官方提醒提示注入风险,要求只上可信站点。Agent 从「会聊天、会写代码」再往「自己打开网页干活」走了一步。

9. Midjourney:V8.2 图像编辑模型向所有人开放测试

Midjourney 8 月 27 日在官网更新日志宣布:向所有人开放首个 V8.2 图像编辑模型测试。能力包括:用指令改已有图;最多同时引用 4 张图生成(取代 omni-reference);局部重绘(inpaint)与扩画(outpaint);兼容个性化、moodboard 与 sref。入口:把图拖进提示栏、灯箱右下角 Edit、左侧 Edit 页上传,或 Discord --edit url。主站与 alpha.midjourney.com 的界面都改了。V8.2 生成模型 7 月 24 日已成默认;此前编辑器仍跑 V6.1,这次才把编辑链路接到 V8.2。官方要用户用灯箱里的哭脸按钮标失败案例。

10. 央视财经:我国日均词元调用量破 500 万亿,「十五五」算力网拟投 4 万亿元

央视财经 8 月 27 日报道:截至 2026 年 6 月,我国日均词元(token)调用量已突破 500 万亿;对比 2024 年初约 1000 亿,两年增长超千倍。报道称中国大模型处于全球第一梯队,竞争焦点从「模型智商」转到智能体落地与生态;一次任务要反复检索、读上下文、调工具,推理算力随之爆发。腾讯智慧产业总经理刘峰说,混元 3 正式版上线第一周,token 调用量比混元 2 增 68 倍。国家发改委明确:「十五五」时期算力网建设将新增直接投资 4 万亿元。北京经开区一家「词元工厂」6 月投运、8 月规模化生产,现日处理约 5000 亿 词元,目标全天 1.4 万亿。数字是应用侧用量,不等于训练侧领先;但推理账单已经按这个量级在涨。

用代码记录成长 · RSS 订阅 · 标签