英伟达以 129 亿美元、约 80 倍年化收入溢价买下 Hugging Face,把开源生态的分发入口收进自己手里;同一周它暂停 AI 云收益分成计划,回避反垄断审视。财报上 Q2 营收 962 亿美元继续翻倍,但应收账款半年涨到 630 亿、付款周期拉长到 60 天,算力金融化的链条在变脆。OpenAI(Jalapeño)、Meta(MTIA 300)、Apple(M6/M5 Ultra)三路自研芯片同步推进,英伟达的客户正在系统性地变成对手。中国这边,DeepSeek 以 5000 亿估值启动科创板 IPO,阿里 800 亿港元配售押注全栈 AI——开源模型的商业价值与战略价值同时被重新定价。
从过去 7 天的日报中抽取真正的行业转折信号,剔除噪声。星级 = 对产业格局的影响强度。
8 月 24 日市场还在传「130 亿美元探索出售」,26 日 The Information 已确认英伟达同意以 129 亿美元收购,估值超 130 亿。Hugging Face 年化收入约 1.5 亿美元(两个月内从 1 亿涨到 1.5 亿),收购价约为其年化收入的 80 倍——上一轮融资是 2023 年 D 轮 2.35 亿美元、估值 45 亿(Salesforce 领投),三年估值涨近三倍。平台托管超 300 万个模型、近 100 万个数据集、服务 1300 万开发者;微软也曾接触但未继续。
为什么重要:这笔账不是财务逻辑,是对冲。OpenAI(Jalapeño)、Anthropic(自研芯片)都在降低对英伟达的依赖,英伟达的判断是「开源模型越繁荣,GPU 需求越难被单一闭源势力切断」。买下 Hugging Face 等于掌控开源生态的分发渠道与技术情报,叠加英伟达自研的 Nemotron 开源模型,形成「模型 + 分发」的闭环。这是本周最重的一步棋。
英伟达 2027 财年 Q2(截至 7/26)营收 962.21 亿美元、同比 +106%,数据中心 890 亿、+117%(占总营收 92%),净利润 596.88 亿、+126%,毛利率 75%,非 GAAP 每股收益 2.22 美元。Q3 指引 1080 亿,并首度提前一年给出 2028 财年 +70% 的营收指引。订单积压飙至 2790 亿美元。但应收账款从半年前的 385 亿涨到 630 亿,付款周期由 45 天拉长到 60 天。
为什么重要:营收神话未破,但两个暗点浮出:应收账款半年增 245 亿、付款周期拉长,说明下游算力买家的现金流压力正在传导回英伟达;而订单积压 2790 亿的「含金量」,取决于 Anthropic(450 亿 Nscale 长约)、DeepSeek(500 亿融资)这些买家未来的偿债能力。需求端「主权 AI」从大厂向更广市场扩散,但付款节奏在变慢——这不是崩盘信号,是链条变脆的信号。
南华早报报道,DeepSeek 第二轮融资计划募资约 500 亿元,投前估值约 5000 亿人民币(约 740 亿美元),预计 8 月底前交割;老股东(Monolith、宁德时代)之外,新投资者包括 CPE 源峰、君联资本、Stony Creek Capital(关联兆易创新),以及合肥国资背景基金。DeepSeek 已启动科创板 IPO 筹备,可能在 2026 年底提交申请、2027 年挂牌。财务上,2026 年前 7 个月营收约 4.75 亿(约为 2025 全年 10 倍)、净亏损 7.15 亿、整体毛利率 44.6%、API 推理业务毛利率高达 82.9%。
为什么重要:首轮 500 亿(6 月交割)+ 二轮 500 亿 = 两轮累计募资超 1000 亿,创中国大模型纪录。更关键的是 82.9% 的 API 毛利——它第一次用硬数字证明「开源模型的推理变现效率」远高于外界预期。但 4.75 亿营收对 5000 亿估值,市销率依然极高,这更像一次对「开源 + 中国算力自主」叙事的提前定价。
Hot Chips 上,OpenAI 首度公布自研推理芯片 Jalapeño 的实测数据:每瓦吞吐为英伟达 GB200/GB300 的 1.5–1.9 倍。同一周,GPT-5.6 Sol 输出价再降 20% 至 20 美元/百万 token(上周已从 30 降到 20,两周累计 -33%)。上周 OpenAI 还收编了「AI 版 Firebase」Instant,为 Agent 补记忆层;本周又联合 100+ 机构发公开信呼吁集体网络防御。
为什么重要:自研芯片与降价互为表里——芯片把推理成本压下去,降价才有物理空间。这是「算力自主」第一次给出可量化的性能对标,也直接解释了英伟达本周为何急着买 Hugging Face 锁开源生态:闭源巨头正在用自研芯片切走推理侧的需求,而推理侧恰恰是英伟达订单里增长最快、也最脆弱的一块。
Anthropic 签下 6 年 450 亿美元算力长约,租用 Nscale 460 兆瓦、部署英伟达 Vera Rubin。同日发布经济指数「observed exposure」:程序员 75% 的工作被 AI 触及(其中 25%–50% 的工作内容被模型覆盖)。此外还发布 MHS 模型硬件标准,让 Agent 直接操作显微镜与机械臂。
为什么重要:IPO 前夜的 Anthropic 一边锁定 6 年算力(呼应 OpenAI 的 8GW 俄亥俄协议),一边用经济指数给「AI 渗透率」提供量化叙事——这是在给二级市场准备一套可核算的「落地故事」。450 亿长约叠加上周的「博通为其囤 1000 亿债务」,Anthropic 的算力重注在 IPO 前持续加码。
阿里开源 Qwen3.8-Flash-Next,125B 总参仅 6B 激活,训练成本降至前代的 1/9;智谱揭榜「Ox Alpha」即 GLM-5.3-Flash,320B 参数、MIT 许可开源、在国产芯片上训练(此前匿名霸榜)。Unsloth 同期放出 Qwen3.8-27B 的 1-bit 量化版,6.2GB 保留 77% 精度、8GB 内存即可跑。
为什么重要:开源密集 MoE 的参数规模在涨(125B、320B),但激活参数与训练成本在降——「大而便宜」成为新常态。这延续上周 DeepSeek V4-Flash-Vision 的方向,开源模型的对位能力在持续逼近闭源旗舰。MIT 许可 + 国产芯片训练的组合,也让「可商用、可自主」的边界进一步外扩。
Meta 首发自研训练芯片 MTIA 300(内置 NIC 与通信卸载引擎),并开源百万 GPU 级协议 MetaRoCE。Apple 突袭发布 M6 与 M5 Ultra:首款 2nm 芯片 + 首款四晶粒架构,主打 AI 计算。Perplexity 也联合英伟达推出「Portable Computer」,主打本地 Agent、零 token 成本。
为什么重要:自研芯片从 OpenAI/Anthropic 扩展到 Meta(训练侧)与 Apple(消费端 2nm)。「英伟达的客户变成竞争对手」不再是个别实验室的探索,而是一线厂商的系统性动作。尤其 Meta 把训练芯片也纳入自研,意味着最上游的训练算力供给也在被稀释。
Claude 记忆打通聊天与 Cowork,跨入口统一上下文、敏感话题默认不记;社区项目 claude-mem 冲到 92K★,claude-plugins-official(35K★)与 claude-plugins-community 双双上线,Anthropic 首次推出官方插件目录。OpenAI 收编 Instant 补记忆层;字节发布「豆包工作」Agent 深度打通飞书;bytedance/deer-flow(80K★)主打长时程 SuperAgent;agentgateway 的 MCP/LLM/A2A 三合一网关被 Linux 基金会托管。
为什么重要:Agent 竞争的重心从「模型能力」滑向「记忆 + 工具 + 插件生态」。跨会话记忆成了新的护城河,插件目录成了新的分发渠道。OpenAI、Anthropic、字节三家在同一周押注记忆层,说明「谁能记住上下文、谁能接入更多工具」正在取代「谁跑分更高」成为 Agent 落地的主战场。
| 厂商 | 模型 | 产品 | 融资 / 估值 | 关键动作 |
|---|---|---|---|---|
| OpenAI | GPT-5.6 Sol(输出价降至 $20,两周 -33%);Jalapeño 推理芯片(每瓦 1.5–1.9× GB200) | 收编 Instant 补 Agent 记忆层;联合 100+ 机构发 AI 网络攻击公开信 | 估值 8520 亿;上周签俄亥俄 8GW 算力协议 | 自研芯片首秀 + 旗舰连续降价 + 记忆层补位 |
| Anthropic | Claude 记忆统一(聊天 + Cowork);MHS 模型硬件标准 | 经济指数「observed exposure」(程序员 75%);Claude 官方插件目录上线 | 450 亿 Nscale 算力长约(6 年 460 兆瓦 Vera Rubin);IPO 2 万亿待定 | IPO 前锁 6 年算力 + 统一记忆层 + 铺插件生态 |
| Google DeepMind | Gemini 3.5 Transcribe(非流式 WER 2.6%、85+ 语言);Gemini Omni 1.1 Flash | 语音转写 + 视频生成(关键帧插值、4K 上采样) | —(母公司 Alphabet) | 语音与视频多模态双线工程化下沉 |
| Meta / xAI | MTIA 300 自研训练芯片;MetaRoCE 开源协议 | 消费级 Agent「Hatch」(高端订阅或 $199.99/月) | —(背靠 Meta 资产负债表) | 自研训练芯片 + 开源网络协议 + 消费级 Agent 定价试水 |
| DeepSeek / 阿里 / 字节 / 智谱 | Qwen3.8-Flash-Next(125B/6B、训练成本 1/9);GLM-5.3-Flash(320B MIT);阿里 Wan3.0 视频 | 阿里 Qoder 智能体工作台;字节「豆包工作」+ deer-flow;汤森路透 Thomson 用 Qwen 底座 | DeepSeek 5000 亿估值 + 500 亿二轮 + 科创板 IPO;阿里 800 亿港元配售;小鹏机器人 9 亿美元 | 融资 + 开源 + Agent + 视频生成四线并行 |
* 数据均来自本周日报原始信源(The Information / 南华早报 / Bloomberg / 官方博客等),并经外部搜索交叉验证,截至 8/30。
基于本周信号,下周值得跟踪的具体事件——每条都带一个可验证的判断标准。
对照第 35 周(08-17 ~ 08-23)周报的 5 条观察清单逐条核验。
核验口径:兑现 = 出现明确事实;部分兑现 = 相关但方向偏移或仅部分落地;未兑现 = 无公开信息。本周兑现 0 / 部分兑现 2 / 未兑现 3,窗口仅 1 周,多数观察项尚在发酵期,判断偏保守。