VOL · 79

把今天的 AI
一杯咖啡读完

每日精选 · 一手源优先 · 看见 AI 浪潮的真实方向

2026 / 09 / 03 · 周四

大 模 型
Meta Muse Spark 1.3
Meta 官方 · 9/2

Meta 发布 Muse Spark 1.3:编码超 GPT-5.6 Sol,工具调用砍 20%

9/2 Meta 发布迄今最强模型 Muse Spark 1.3,首席 AI 官 Alexandr Wang 称编码能力超越 OpenAI GPT-5.6 Sol、与 Anthropic Claude Fable 5.1 持平。相比 1.2,完成相同任务工具调用减少约 20%、token 消耗减少约 25%;长上下文 256K–512K 测试 98.5 分,领先 GPT-5.6 Sol 的 91.5 分,512K–1M 仍以 98.1 分领先第二名的 73.8 分。Artificial Analysis 实测 Intelligence Index 61 分(xhigh),与 GPT-5.6 Sol、Grok 4.6 同档。定价不变:输入 $1.25 / 缓存 $0.15 / 输出 $4.25 每百万 token,已上线 Muse Code 与 Meta Model API,后续接入 Instagram/Facebook/Meta AI。扎克伯格称其为"编程与 Agent 工作最大一次跃升",并预告开源权重版本与更大的 Watermelon 模型。

这周三巨头同一动作:Anthropic 降缓存价 75%、Google 推促销价 Flash、Meta 砍工具调用和 token——拼的不再是 benchmark 单点,而是「Agent 循环的单位成本」。Wang 那句"我真不想这么说,但 Gemini 是谁"是嘴炮,数据却实在:Meta 用"少调用、少浪费"回应了 Agent 时代最硬的问题——长任务里,效率就是钱。
Gemini 3.8 Flash
Google 官方 · 9/2

Google 六周三更 Flash:Gemini 3.8 逼近 Opus 5,价格仅 15%

9/2 Google 发布 Gemini 3.8 Flash 与网安专用版 3.8 Flash Cyber,是继三周前 3.7 Flash 后六周内第三次 Flash 更新。官方称 3.8 Flash 是"迄今推理与编程最强的 Flash 模型",面向长周期软件工程与自主 Agent,性能逼近 Claude Opus 5 而价格仅其约 15%。Cyber 版专攻漏洞挖掘与自动修复,Chrome 安全团队实测其生成正确补丁的数量是更大商业模型的 2.6 倍,并已内部全面部署;通过 Fairwind 计划向 650 多家政府与关键基础设施机构开放网安优先通道。

"逼近 Opus 5、价格 15%"是这轮 Flash 更新的真正杀招——把 Agent 能力打到白菜价,等于对 Anthropic 的定价体系直接开刀。而 Cyber 版把"安全模型"从辅助工具变成直接下场攻防的角色,Chrome 团队那句"2.6 倍补丁"说明安全大模型的 ROI 已经能落到生产线,不再是演示。
Qwen3.8-Max
千问官方 · 9/2

阿里 Qwen3.8-Max 更新:2.4 万亿参数 MoE,前端编程登顶

9/2 阿里千问发布旗舰 Qwen3.8-Max 0902 版,2.4 万亿参数 MoE 架构、100 万 token 上下文,围绕 Coding 与专业办公(Cowork)场景专项后训练,面向企业复杂任务与长周期自主开发。在 CodeArena 前端编程总榜提升 22 分至 1691 分夺冠;新版已上线千问 AI 平台 API,并接入千问办公、Qoder 与千问 App。

前端编程登顶的意义不在"又一个第一",而在它专挑 Coding 与 Cowork 这两个最吃 token、最贴近企业落地的地方后训练。2.4 万亿 MoE + 100 万上下文,是阿里把"通用大"收敛成"企业能用"的务实信号——榜单之外的真正战场,是 API 调用量与 Qoder 装机率。
World Labs Atlas
World Labs 官方 · 9/1

李飞飞 World Labs 发布 Atlas:全球首个多模态「世界模型」

9/1 李飞飞创办的 World Labs 发布 Atlas,定义为全球首个多模态世界模型,从零预训练于文本、图像、视频与 3D 数据,架构为多模态自回归扩散 Transformer。单张图即可生成最长 1 分钟、1440p 的相机可控视频,稀疏视角 3D 重建效果超过专用开源模型;可同时建模空间与时间,为机器人生成逼真 RGB 与深度数据,打通 Real-to-Sim 路径。目前向部分伙伴开放早期访问,并将驱动其 Marble 产品。

Atlas 把"世界模型"从口号做成了可量化的产品:1440p、1 分钟、稀疏重建超越专用模型。更关键的是它瞄准机器人预训练——逼真的 RGB+深度合成数据,是破解"真实数据贵、合成数据假"的钥匙。李飞飞押的始终是"空间智能",这条路线正从学术概念走向机器人的真实燃料。
推 理 优 化
The Information / 腾讯研究院 · 9/2

OpenAI Astra 被曝「循环深度」架构:35 亿参数撬动 500 亿算力

据 The Information 报道,OpenAI 即将发布的旗舰模型 Astra 采用循环深度(recurrent depth)技术:输出下一个 token 前,让文本在同一网络层反复处理,以计算换参数——公开论文显示 35 亿参数模型可等效调用约 500 亿参数的算力(约 14 倍),显著降低内存与带宽成本。代价是推理过程不可读,OpenAI 已人为限制其使用比例以保留人类可读的思维链,并配额外监控手段。此前 OpenAI 已确认 Astra 最快本月发布。

"循环深度"本质是给推理上杠杆:参数不够、算力来凑,用时间换空间。14 倍参数等效是个漂亮数字,但"推理不可读"是硬伤——对齐靠的就是读思维链,把链藏进循环里,等于监管和审计的眼睛被蒙了一半。OpenAI 自己都要"人为限制比例",说明它比谁都清楚这条路的代价。
融 资
财联社 / 界面新闻 · 9/2

英伟达收购 Hugging Face 谈至约 140 亿美元,或本周敲定

9/2 据财联社报道,英伟达正就收购开源模型社区平台 Hugging Face 深入谈判,总额约 140 亿美元,有望本周达成,或成年内 AI 领域金额最高收购案。若落地,英伟达将掌控开发者展示与共享 AI 模型的关键入口,强化开源生态与 GPU 需求飞轮。Reddit r/LocalLLaMA 当日热帖齐声担忧"英伟达买 HF 对开源不是好事",并有帖称英伟达同时接洽 llama.cpp 团队。双方均未官宣。

从 8 月末的 129 亿到现在的 140 亿,价格在涨、时间表在逼近,说明这不是捕风捉影。真正让开源社区炸锅的是底层逻辑:芯片厂收购模型分发平台,等于"卖铲子的人把矿场也买了"。HF 若易主,开源模型的中立分发层就没了——这才是比 140 亿更值得警惕的事。
商 业
华尔街见闻 / 财联社 · 9/2

博通 Q3 净利暴增 216%,AI 业务指引上调至 580 亿美元

9/2 博通发布 2026 财年第三财季财报:营收 295.91 亿美元、同比增长 86%,归母净利润 130.88 亿美元、同比暴增 216%,主因 AI 芯片(定制 ASIC + 网络)需求强劲。电话会上,公司将 AI 业务全年收入指引从 560 亿美元上调至 580 亿美元。财报公布后股价盘后一度大涨逾 20%。

英伟达收购 HF、博通净利翻三倍——同一天的两条线,讲的是同一件事:AI 算力还在"黄金抢购期",芯片厂从上游到分发层通吃。博通把指引上调 20 亿,等于给"AI 需求见顶论"又泼一盆冷水;但 216% 的净利增速也埋着下一问——如此高集中度的增长,能撑多久。
前 沿 技 术

Frontier · GitHub Trending 周边

pacifio/atlas
GitHub · 2,944★

pacifio/atlas:给多个编码 Agent 做「版本控制」的统一台账

2,944★(Rust),本日 +888 星登上 GitHub Trending。定位"Agent 的源代码管理":同时驱动多个编码 Agent,跟踪它们的改动并在同一处查询,解决多 Agent 并行开发时变更互相覆盖、无法溯源的问题。项目 2026 年 5 月创建,本周首次冲榜,单日星数增速在所有上榜仓库中居前。

多 Agent 协作从"能跑"进入"能管"的标志。当几个 Agent 同时改代码,最大的坑不是能力,而是冲突与溯源——atlas 把 Git 的思想搬进 Agent 编排层,是"subagent 工程实践"里最实的一类。888 星的单日爆发,说明这正是开发者此刻的刚需。
chrome-devtools-mcp
GitHub · 50,683★

chrome-devtools-mcp 破 5 万星:浏览器调试成 Agent 标配工具

50,683★(TypeScript),本日 +148 星。Chrome DevTools 官方推出的 MCP 服务器,把 Chrome DevTools 协议暴露给编码 Agent,让 Claude Code、Codex 等直接操控浏览器完成性能分析、DOM 检查、网络抓包等调试动作,是"浏览器自动化 + Agent"方向最主流的 MCP 连接器之一,现已跨越 5 万星里程碑。

破 5 万星,说明"Agent 会操作浏览器"已从炫技变成基础设施。MCP 生态里,官方背书的浏览器连接器天然最稳——它把几十年的调试能力直接喂给 Agent,是 Computer Use 落地最顺的一条路,也印证 MCP 正从"概念"走向"默认连接层"。
timesfm
GitHub · 29,952★

Google TimesFM-3:330M 参数时序基础模型登顶三项基准

29,952★(Python),本日 +343 星登上 Trending。Google Research 的时间序列基础模型,TimesFM-3 以 330M 参数一次前向预测多条联动序列,在 GIFT-Eval、FEV-Bench、TIME 三个预训练时序模型基准上排名第一。主打"小参数、强时序预测",用于金融、供应链、运维等真实预测场景。

大模型卷到万亿参数时,TimesFM 用 330M 证明时序预测是"专用基础模型"的活——小参数、可本地跑、预测精度还第一。这是"基础模型 + 垂类"路线的一次漂亮回击:不是所有问题都需要最大的模型,很多只需要最对的那个。