每日精选 · 一手源优先 · 看见 AI 浪潮的真实方向
2026 / 09 / 02 · 周三
9/1 Anthropic 发布 Claude Fable 5.1 与 Claude Mythos 5.1,同一底座、不同安全护栏(Fable 5.1 全量开放,Mythos 5.1 仅经可信访问计划供给网安/生命科学机构)。性能全面超越前代 Fable 5 与 OpenAI GPT-5.6 Sol:Agent 科研基准 Terminal-Bench-Science 0.1 拿下 52.6%(Fable 5 仅 24.7%、Opus 5 29.0%、GPT-5.6 Sol 22.4%);Agent 编程 Terminal-Bench 4.0 达 55.8%(Mythos 5.1 放宽护栏后 60.9%);知识工作 GDPval-AA v2 1853 分。价格层面,缓存读取资费下调 75%($1.00→$0.25/百万 token),典型负载成本降约 25%,高度 Agent 化任务最高省 45%;基础定价不变(输入 $10 / 输出 $50 每百万 token)。同步推出企业级前沿防护 EFS,把数据存进客户自控云基础设施,等效零数据留存,今秋分批开放。
8/31 Runway 发布 Solaris,定义为首个 Interface World Model(界面世界模型)。它基于 Gen-4.5 视频模型改造,去掉「代码」这层中间表示:用户点击、拖拽、输入都被当作下一帧的生成条件,界面逐帧自回归实时渲染(720p、约 37ms/帧),没有预定义页面与模板。架构上 LLM 负责「推理下一步」、世界模型负责「实时渲染」,实现推理与渲染解耦。真人偏好测试(250 人、近 7500 次两两比较)中,Solaris 在「指令遵循」获 61% 偏好(代码方案 24%)、「行为自然度」71%(代码方案 21%)。目前仅向关键伙伴开放早期申请。
9/1 OpenAI 发布《Path to Astra》,确认下一代模型 Astra 达到 Preparedness Framework 定义的「Critical」网络安全能力阈值——可在无人逐步指导下,自主发现并利用未知漏洞攻击强防护真实系统,为公司史上首个获此评级模型。评测中 Astra 在 ExploitBench 拿下 100% 满分,随后自建 20 个高严重性 V8 漏洞内部集测试,过程中自主发现并利用 2 个零日漏洞(正与维护者负责任披露);在强防护浏览器/OS 专家测试中跑通「沙箱逃逸→主机命令执行」与「本地提权到 root」的完整攻击链。安全面 Astra 越狱拒绝率达 91.5%(GPT-5.6 Sol 仅 59%)。发布采取双轨:通用能力照常上线,进攻性网安能力仅经 Daybreak Blue 提供给受审防御方。
9/1 SEMICON Taiwan 2026 上,三星存储产品规划副总裁 Jangseok Choi 披露下一代 HBM 路线图。HBM5 目标性能达 HBM4E 的 2 倍、每瓦性能提升 20%、热阻下降 20%,基础裸片(Base Die)从 4nm 升级到三星自研 2nm 节点,规划 12/16/20 层三种 DRAM 堆叠,预计 2028 年前后量产。更激进的是 zHBM 新架构:把存储芯片直接垂直堆叠在处理器上方,目标性能达 HBM4E 的 8 倍、每瓦提升 3 倍、热阻降 75%–90%,预计 2029 年后推出。同时提出 CUBE 战略(容量 / 利用率 / 带宽 / 效率四维)。
9/2 VAST(三启万物)宣布完成 B 轮与 B+ 轮合计约 30 亿元融资,由经纬创投领投,完美世界、三七互娱、蓝色光标、中科创达等产业资本与鼎晖 VGC、中金资本等财投参投;不到半年累计融资约 50 亿元,刷新 3D 原生智能赛道融资纪录。同步发布旗舰 3D 原生基座模型 Tripo P2.0——全球首个支持原生四边面拓扑网格的 3D 基座模型,单面数上限从 2 万提升至 5 万三角面,首次同时满足「引擎可用、动画可绑、编辑可及」三条工业级门槛。
据 WSJ / 路透社报道,Anthropic 与英伟达支持的云服务商 Lambda 达成约 350 亿美元(六年期)云计算协议,为 Claude 扩充算力。相关数据中心位于得州 Nueces County,由 Hut 8 建设、容量约 350MW,英伟达持有该设施承租权——Lambda 从英伟达取得机房使用权并部署英伟达芯片,再向 Anthropic 供算力。叠加此前与 Nscale 的 450 亿美元协议,Anthropic 近期云算力承诺合计约 800 亿美元。双方均未公开确认。
Frontier · GitHub Trending 周边
57,189★,本日登上 GitHub Trending。项目提供「2 小时从零训练一个 64M 参数 LLM」的完整代码与教程,把 GPT 结构的小模型训练全过程拆解为可复现的最小闭环,让学习者理解 LLM 的预训练、微调与推理底层机制,而非只停留在调用 API。
29,640★,本日登上 GitHub Trending。清华大学 MAIC 实验室开源的多智能体交互课堂,用户一键即可获得沉浸式多 Agent 学习体验——多个 AI 角色协同讲解、对话、演示,把「单一模型问答」升级为「多智能体协作教学」。
15,552★,本日登上 GitHub Trending。NVIDIA 开源的 AI Agent skills 安全扫描器,在安装 Claude Code、Codex、MCP skills 之前,检测其中的漏洞、恶意模式、安全风险、提示注入、数据外泄与供应链风险。