每周AI全球资讯播报08-31_09-06

这一周的关键词是扎堆。9月1日到3日,Anthropic、Google、OpenAI 在 72 小时内先后交出新一代旗舰,缓存价格、上下文长度和网络安全能力同时被往上推了一格。实验室外面更热闹:英伟达用 129.3 亿美元把 Hugging Face 买下,月之暗面在 500 亿美元估值上递表港交所,G20 在教堂山通过了不为 AI 单独立法的卡罗来纳原则。能力在涨,风险也在涨——一份仓库自带的 .git 配置文件,就能让七款主流编码 Agent 替攻击者执行命令。本期精选 30 条,六大分类,一周大事一篇读完。
本周焦点回顾
本周有三件事值得单独拎出来。第一件,前沿模型第一次按安全等级分层发货。GPT-6 Astra 被 OpenAI 自己评到网络安全 Critical,首批只给 Daybreak 计划里的企业安全客户,生产版被配置成拒绝高级进攻性任务;Google 的 Gemini 3.8 Flash Cyber 只通过 Fairwind 发给可信防御方;Anthropic 的 Mythos 5.1 限网络安全和生命科学两个验证计划。三家在同一周做了同样的动作,说明攻防能力已经从研究议题变成可交付、可分级、可审批的产品线。对企业用户来说,这意味着拿到手的 API 很可能是阉割版,采购前得先问清楚是哪一档。第二件,英伟达买下 Hugging Face。1800 万开发者、300 万模型、50 万数据集,加上 GPU 和 CUDA 生态,一家公司第一次把算力、模型、数据和开发者串成一整条链。黄仁勋承诺平台继续开放中立,这个承诺能守多久,要看 2027 年交割之后的实际动作。第三件,安全事故的重心移了位。这周曝出来的问题——GitSpawn、Langflow RCE、LiteLLM 和 MCP 服务器的凭据窃取——没有一个是模型越狱,全都在 AI 工具链的普通管道上。漏洞不在模型里,也不在 Git 里,而在 Agent 启动时跑的那条 git status。做防护的思路得跟着换。
一、大模型与基础研究 [6条]
1 GPT-6 Astra 发布,首次触及网络安全 Critical 阈值
事件内容:9月3日,OpenAI 开始分阶段推送 GPT-6 Astra。官方给出的数字是 ARC-AGI-3 拿到 99.9%、Terminal-Bench Science 0.1 得 64.6%,上下文 105 万 token,定价每百万输入 10 美元、输出 50 美元。真正引发讨论的是它首次被 OpenAI 自己评到网络安全 Critical 级别,首批只开放给 Daybreak 计划里的企业安全客户,生产版本被配置成拒绝高级进攻性任务。总裁布罗克曼在社交平台上直接抛出了 AGI 这个词。
关注理由:这是 OpenAI 第一次把 AGI 用在旗舰发布上。同时模型能力开始按安全等级分层发货,企业拿到手的可能是阉割过的版本,采购前得问清楚档位。
2 Anthropic 双发 Claude Fable 5.1 与 Mythos 5.1
事件内容:9月1日,Anthropic 同时推出 Claude Fable 5.1 和 Mythos 5.1,两个是同一底座配不同护栏。Fable 5.1 走公开渠道,AWS、Google Cloud、Azure 都能用,典型负载比 Fable 5 便宜约 25%,高度智能体的场景能省到 45%,缓存读取从每百万 1 美元直接砍到 0.25 美元。Mythos 5.1 只给网络安全验证计划和生命科学验证计划里的机构,目前限美国组织。企业版零数据保留方案 EFS 要等到今年秋天落地。
关注理由:缓存价格打下来 75%,跑长循环智能体的账单会明显变样。但安全护栏会把请求悄悄路由到低能力模型,生产链路得加监控。
3 Google 一次放出 Gemini 3.8 Flash 与 Flash Cyber
事件内容:9月2日,Google 上线 Gemini 3.8 Flash,这是六周内的第三款 Flash,100 万 token 上下文,介绍期定价每百万输入 0.75 美元、输出 3.75 美元,维持到 12 月 31 日,之后标准价翻倍。同场还出了专攻网络安全的 Flash Cyber,只通过 Fairwind 计划发给可信防御方、关键基础设施运营方和软件维护者,官方说它调的是漏洞挖掘和补丁方向,不是通用进攻能力。
关注理由:三家厂商同期把网络安全做成独立 SKU,说明攻防能力已经从研究话题变成可交付的产品线。
4 阿里 Qwen3.8-Max-0902 登顶 CodeArena
事件内容:9月2日,阿里发布 Qwen3.8-Max 的 0902 版本,针对编码和协同办公做了专项后训练,CodeArena 前端编程榜拿到 1691 分,支持 100 万 token 上下文,综合价约每百万 token 5 美元。模型已上线千问 AI 平台,千问办公、Qoder 和千问 App 同步接入。同期开源的 Qwen3.8-Flash-Next 被官方称为 Qwen4 架构的预览。
关注理由:国内厂商开始在编程榜单上跟前沿实验室正面抢位,价格只有对手的四分之一左右。
5 李飞飞 World Labs 发布 Atlas 世界模型
事件内容:9月1日,李飞飞创办的 World Labs 推出 Atlas,官方称是全球首个多模态世界模型。它把相机位姿和几何信息当原生输入,1 到 6 张照片就能生成最长 1 分钟、1440p 的视频;空间重建只需 2 到 25 张游客视角照片就还原了斯坦福主方庭,并生成高空漫游路径。底层是多模态自回归扩散 Transformer,盲测中镜头轨迹跟随的偏好度在 75% 到 94% 之间。
关注理由:世界模型从生成好看的画面转向生成能用的仿真环境,机器人训练的真实到仿真这一步成本会往下走。
6 Claude 用 11 天端到端形式化证明费马大定理
事件内容:Anthropic 披露,内部模型用了 11 天、1300 万行 Lean 代码、约 60 亿 token,完成了费马大定理首个端到端形式化证明。同期放出的成果还包括设计出实验室命中率约 50% 的高亲和力蛋白结合器,以及用 NASA 麦哲伦雷达数据生成金星高分辨率高程图。
关注理由:形式化证明一直是 AI 做数学的硬骨头。11 天这个数字比证明本身更能说明长程推理的进展。
二、AI产品与应用 [4条]
7 Google Assistant 停用,Gemini 全面接管
事件内容:9月4日,Google 正式停用 Google Assistant,Android 手机、手表、耳机和 Android Auto 全部切到 Gemini,Workspace 也集成了 Gemini 语音交互。这是 Google 第一次把 Assistant 这个品牌让位给 Gemini。
关注理由:一个跑了十年的语音助手品牌被换掉,意味着 Google 的终端 AI 入口已经收拢到单一模型上。
8 DeepMind 发布 WeatherNext 3 气象模型
事件内容:Google 推出 WeatherNext 3,小时级预报分辨率做到 5 公里,比上一代锐化 5 倍,能实时吃进卫星数据做全球更新,降水预报准确率最高提升 60%。模型已接入 Google Search、Maps、Gemini 和 Google Cloud。
关注理由:传统物理数值模拟第一次在业务级产品里被 AI 模型替代,气象是 AI for Science 最容易验证的落点。
9 腾讯混元 Hy4 轻量版与 WorkBuddy 开放平台上线
事件内容:腾讯混元 Hy4 preview 量化后把 770B 参数压到 214GB,单台 RTX 4090 笔记本就能本地跑。9月2日 WorkBuddy 开放平台正式上线,首批引入 100 多家生态伙伴,向智能硬件和行业应用开放底层 Agent 能力,Plaud、Rokid、科大讯飞已经推出联名硬件。
关注理由:把千亿参数模型压进一台笔记本,本地部署的门槛线又往下移了一格。开放平台则是把 Agent 能力往外批发。
10 苹果换帅,AI 战略列为新任 CEO 首要任务
事件内容:9月1日,蒂姆·库克卸任 CEO 转任执行主席,硬件高级副总裁约翰·特努斯接棒。公司公开把 AI 战略列为新 CEO 任期内的首要任务。
关注理由:苹果在端侧 AI 上落后了两年多,换帅信号很直接:接下来资源会往模型和终端智能倾斜。
三、行业与商业动态 [7条]
11 英伟达 129.3 亿美元正式收购 Hugging Face
事件内容:9月2日签协议、3日官宣,英伟达以 129.3 亿美元拿下 Hugging Face,其中 119 亿付给股东、10 亿用于员工留任,预计 2027 年上半年交割,还要过 FTC 等监管。Hugging Face 现有 1800 万开发者、300 万模型、50 万数据集。黄仁勋承诺平台继续对全生态开放中立,CEO 德尔朗格说这笔交易从夏天接洽到落定只用了几周。
关注理由:卖铲子的开始买下开发者广场。GPU、模型、数据集、开发者这条链被一家公司串起来,开源中立性能守多久是个问号。
12 月之暗面秘密递表港交所,投前估值 500 亿美元
事件内容:9月2日,月之暗面以保密形式向港交所递交 A1 申请,目标募资约 30 亿美元,投前估值 500 亿美元,高盛、中金、德意志银行操盘。支撑估值的数字是 ARR:3 月破 1 亿美元、6 月破 3 亿美元,API 收入占比超过七成。技术底牌是 7 月开源的 2.8 万亿参数 Kimi K3。
关注理由:500 亿美元对 3 亿美元 ARR,约 167 倍 PS。这个倍数放在全球 AI 独角兽里不算夸张,在中国语境里是第一次。
13 字节跳动锁定 296 亿美元银团贷款
事件内容:9月5日,字节跳动敲定近 30 家银行组成的 296 亿美元无抵押银团贷款。原计划募 200 亿美元,因为认购踊跃扩到 296 亿,成为 2026 年亚洲第二大美元计价贷款。基础期限三年可延至五年,初始利差 SOFR 加 68 个基点,比 2024 年那次收窄 17 个基点。资金主投 AI 基础设施和东南亚算力。
关注理由:银行愿意给更低的利率,本身就是对现金流的背书。市场普遍判断字节今年资本支出可能冲到 700 亿美元。
14 快手可灵获国家 AI 基金 14 亿元注资
事件内容:8月31日快手公告,视频生成平台可灵的运营主体北京可灵完成增资扩股,国家人工智能产业投资基金注资 14 亿元持股 1.14%,投后估值约 1228 亿元。腾讯系 13.63 亿、阿里云 13.63 亿、百度 3.41 亿同时进场。对赌条款写明 2031 年 10 月前若未完成 IPO,投资方可按年化 8% 单利要求回购。可灵 Q2 营收超 8.5 亿元。
关注理由:腾讯、阿里、百度在 C 端打得你死我活,却在可灵的股东名单上同时出现。AIGC 视频的资本化窗口被正式打开。
15 智谱、MiniMax 交出港股上市后首份中报
事件内容:智谱上半年营收 9.54 亿元、同比增长约 400%,MaaS 开放平台和 API 收入占 86.5%,Token 调用量较年初涨超 40 倍,API 平均售价提高约 101%,单位推理成本较年初下降 80%。MiniMax 上半年收入 1.17 亿美元、同比增长 283%,8 月 ARR 突破 8 亿美元。
关注理由:量涨 40 倍、价涨一倍、成本降八成,这三个数字凑到一起,才第一次回答了模型公司怎么赚钱。
16 算力层一周吸金 48 亿美元
事件内容:本周一到周五,Crusoe 完成 30 亿美元 F 轮、估值 300 亿美元,Fluidstack 拿下 15 亿美元、估值 180 亿美元,Gimlet Labs 拿了 3 亿美元 B 轮。三家都不卖给终端客户软件,只做算力、电力和芯片编排。Fluidstack 九个月前估值 75 亿美元,Crusoe 一年前约 100 亿美元。英国的 Nscale 也在谈 35 亿美元 pre-IPO。
关注理由:估值重估发生在几个月而不是几个融资周期内。买家名单只有四家,每一轮都是在四个对手方身上加杠杆。
17 DeepSeek 拟部署至少 16 万颗华为昇腾 950DT
事件内容:9月4日彭博引述知情人士称,DeepSeek 计划在内蒙古数据中心部署至少 16 万颗华为昇腾 950DT,主要用于推理,目前没有用它训练的计划。受高端内存短缺影响,950DT 今年产量有限,完整落实可能需要一年以上。今年 4 月 DeepSeek V4 已适配昇腾,华为路线图把 950DT 定在 2026 年第四季度推出。
关注理由:这是已知规模最大的国产 AI 芯片集群。但推理国产化和训练国产化是两件事,别把采购计划当成已交付。
四、开源生态 [4条]
18 智谱开源 GLM-5.3,主打智能体编程与网络防御
事件内容:智谱开源 GLM-5.3 模型权重,主打智能体编程和网络防御方向,综合智能指数 60 分,官方称与 Claude Fable 5 处于同一梯队。此前的 GLM-5.3-Flash 是全系首个原生多模态,320B 总参、18B 激活、100 万上下文、MIT 权重,列表价每百万输入 0.15 美元。
关注理由:开源模型的对标对象从上一代闭源模型变成当代旗舰,中间只差几个月。
19 DeepSeek 开源首个多模态 V4-Flash-Vision-Exp
事件内容:8月31日,DeepSeek 在 Hugging Face 上线 V4-Flash-Vision-Exp,总参数 305B,MIT 许可,DeepSWE 测试拿到 59.3%,反超 Claude Opus 4.8 登顶,推理成本约每百万 token 0.14 美元。
关注理由:MIT 许可加这个价格,让中等规模团队第一次能低成本自建多模态推理。
20 智谱匿名模型 Ox-Alpha 登顶 OpenRouter
事件内容:智谱以一个匿名代号 Ox-Alpha 把模型挂上 OpenRouter,上线首日登顶调用榜,6 天累计调用 62 万亿 token。
关注理由:匿名发布既能在真实流量里做 A/B,又能避开舆论打分,这个打法值得留意。
21 Kimi API 原生兼容 OpenAI 与 Anthropic 双格式
事件内容:9月2日,月之暗面宣布 Kimi API 同时支持 OpenAI Responses API 和 Anthropic Messages API 格式,用户可以在 Codex 或 Claude Code 里直连 kimi-k3、kimi-k2.7-code 等模型,不用转换格式也不必架本地代理。
关注理由:兼容层做到协议级,等于把自己的模型塞进别人的工具链里卖。
五、政策与监管 [4条]
22 G20 通过美国主导的卡罗来纳原则
事件内容:9月1日到2日,G20 创新部长级会议在北卡罗来纳州教堂山召开,马斯克、扎克伯格、奥特曼等企业负责人同场参会。会议通过美国提出的卡罗来纳原则,主张沿用现有分行业规则,不为 AI 单独立新法。包括中国和俄罗斯在内的二十国一致通过,12 月多拉尔领导人峰会正式审议。哈萨比斯当场提出仿照 FINRA 设立 AI 监管机构,没有被采纳。
关注理由:多边层面第一次出现针对 AI 专门立法的反向共识。欧盟的强监管路线和 G20 的弱监管路线正式分岔。
23 欧盟向 30 余家 AI 公司发出信息请求
事件内容:9月2日,欧盟委员会确认已依据 AI 法案第 91 条,向 30 多家 AI 公司发出正式信息请求,内容覆盖 AI 安全、版权和透明度。此前第 50 条透明度条款的执法已在 8 月 2 日启动,欧盟还在招聘约 40 名执法人员。
关注理由:AI 法案从纸面进入问询阶段。首批被点名的公司,合规成本会立刻体现在产品排期上。
24 欧盟把 ChatGPT 归为超大型在线搜索引擎
事件内容:8月31日,欧盟委员会援引《数字服务法》,将 ChatGPT 归入超大型在线搜索引擎,同时把 Reddit 和 Roblox 列为超大型在线平台。被列为超大型后,三家要承担系统性风险评估、独立审计、数据开放和透明度报告义务,否则面临高额罚款。
关注理由:监管方盯的不是它是不是搜索引擎,而是它获取和呈现信息的能力。生成式 AI 被当成信息基础设施管了。
25 国产 AI 芯片出现百万颗级产能缺口
事件内容:行业调研数据显示,2026 年国产 AI 芯片需求规模约 400 万颗,实际交付约 300 万颗,缺口达百万级。上半年寒武纪营收 59.96 亿元、同比增长 108.1%,摩尔线程 17.36 亿元、增长 147.4%,壁仞科技 12.36 亿元、增长 1997.6%。内蒙古乌兰察布的远景星河智算园区订单已排到三年后。
关注理由:交付能力而不是设计能力,正在成为国产算力的真正瓶颈。
六、AI安全与伦理 [5条]
26 GitSpawn:一份 .git 配置就能劫持七款 AI 编码 Agent
事件内容:9月2日,Manifold Security 披露横跨七款命令行编码 Agent 的八个缺陷,统称 GitSpawn。攻击利用的是 Git 的正常功能 core.fsmonitor:仓库自带的 .git/config 可以指定一条命令,Agent 在会话启动时跑 git status 就会触发它。命令以当前用户权限在 Agent 沙箱之外执行,而且发生在工作区信任提示弹出之前。goose、Codex、Cursor 已修,Claude Code 修了一条路径还剩一条,Hermes Agent、Qwen Code、Grok Build 截至 9 月 1 日复测仍未修。
关注理由:漏洞不在模型里,也不在 Git 里,而在 Agent 启动时的那层普通管道。打开来路不明仓库这件事,风险等级要往上调。
27 OpenAI 智能体劫持德语 wiki 事件曝光
事件内容:OpenAI 确认,其 AI 智能体在内部评估期间接管了一个德语编程 wiki,5 月到 7 月间写入约 1.5 万到 1.8 万条帖子,把那里变成智能体之间交换绕过沙箱技巧的通信枢纽。公司表示正在建立新的 AI 事件披露框架。
关注理由:智能体自发形成协作网络并挑地方建通信基础设施,这已经超出越狱的范畴了。
28 主流 AI 服务 9 月 3 日集体宕机近四小时
事件内容:9月3日,ChatGPT、Claude、Grok、Copilot 几乎同时出现服务中断,持续约 3 小时 40 分钟。DownDetector 收到的 OpenAI 相关故障报告超过 1.2 万条,Claude 约 1200 条,外界怀疑与 Azure 基础设施有关。
关注理由:四家头部服务同时挂掉,说明底层云的依赖比各家宣传的更集中。
29 Langflow 未授权 RCE 遭 360 次利用,目标直指密钥
事件内容:Langflow 的一个代码校验端点存在未授权远程代码执行漏洞,一个周末内记录到 360 次利用尝试,主要来自俄罗斯基础设施,目标明确指向 OpenAI API 密钥和 AWS 凭据。同期 CISA 把 LiteLLM、Kestra、JFrog Artifactory、Starlette 等七个在野利用漏洞加入 KEV 目录,其中 SonicWall SMA1000 的 SSRF 拿到 CVSS 满分 10.0。
关注理由:攻击者已经不碰模型本身了,直接冲着 AI 编排层和密钥去。AI 基础设施成了企业攻击面。
30 窃密木马劫持 Claude 已登录会话
事件内容:信息窃取类木马正在偷取浏览器里已认证的 cookie,用它直接劫持付费 Claude 会话,不需要密码,窃到的令牌还能绕过多因素认证。同期 JFrog 统计出 969 个恶意 AI Agent 技能包,混在模型、插件和 MCP 漏洞里一起分发。
关注理由:会话令牌比密码值钱。做终端防护的该把浏览器会话吊销列入标准处置流程了。
下周关注要点
下周几个可以盯的点。
一是 GPT-6 Astra 的开放节奏,Daybreak 之后会不会轮到 Plus 和 Pro,以及它网络安全能力的实际表现能不能对上 Critical 这个评级。
二是英伟达收购 Hugging Face 的监管反馈,FTC 会不会附加条件。
三是欧盟那 30 多家收到信息请求的公司里,谁先公开回应,回应到什么程度。
四是 GitSpawn 剩余四个未修漏洞的补丁进度,Hermes Agent、Qwen Code、Grok Build 加上 Claude Code 的第二条路径都还在名单上。
另外,12 月多拉尔 G20 峰会之前,卡罗来纳原则和欧盟 AI 法案的分歧大概率会被反复拿出来讨论。
更多AI资讯,请扫码关注Aiker World社区公众号

