VOL · 47

把今天的 AI
一杯咖啡读完

每日精选 · 一手源优先 · 看见 AI 浪潮的真实方向

2026 / 07 / 23 · 周四

A G E N T
OpenAI 官方博客 · 今日

OpenAI Presence 发布:企业级 Agent 平台正式上线,自营客服已替代 75% 人工

7/22 OpenAI 发布 Presence 企业 Agent 平台 / 支持实时语音+聊天 Agent / 自营电话客服(1-888-GPT-0090)已解决 75% 入站工单无需人工 / Codex 驱动的改进循环 10 天内人工转接率降 15 个百分点 / BBVA、SoftBank、IAG 为首批设计合作伙伴 / 由 Forward Deployed Engineers 驻场部署,暂不开放自助

OpenAI 从模型供应商向企业软件商的转型,Presence 是最明确的一步。与 Anthropic Ode 咨询业务正面交锋,但 OpenAI 选择卖可部署产品而非纯咨询——前者规模化更快,后者单客户利润更高。75% 自主解决率是一个不回避责任的数字:自己先用、自己先扛。
NVIDIA GR00T LeRobot
NVIDIA 官方博客 · 今日

NVIDIA 联姻 Hugging Face:GR00T 1.7 机器人基础模型全面开放,1500 万下载量

NVIDIA Isaac GR00T 1.7 首个开源商用机器人 VLA 模型接入 Hugging Face LeRobot / Isaac Teleop 开源遥操作数据采集框架 / Cosmos 3 世界模型即将入驻 / 最大开源物理 AI 数��集 1500 万+ 下载,含 35 万轨迹 + 5700 万抓取 / 连接 NVIDIA 300 万机器人开发者 + HF 1600 万 AI 构建者

NVIDIA 把 GR00T 放进 Hugging Face 不是在送温暖——是在抢占机器人开发的入口标准。谁控制了从数据采集到仿真到部署的全链路工具链,谁就控制了物理 AI 时代的基础设施。Thomas Wolf 说得直白:「开源是让前沿研究变成可学习、可适配、可建造之物。」
大 模 型
Wccftech / NVIDIA · ��日

NVIDIA Vera Rubin 正式出货:首个 3nm AI 芯片平台,单机架造价 1.8 亿美元

7/22 首批 Vera Rubin 出货至微软 / Google / Amazon / Meta / Oracle / TSMC 3nm 工艺制造 / HBM4 显存 + 256GB SOCAMM2 LPDDR5X / 单 AI 服务器机架估价 1.8 亿美元 / 七芯片互联 + 全新软件栈 / 2026 下半年 Foxconn / Quanta / Wistron 全面量产

Vera Rubin 出货��味着下一代训练和推理算力进入倒计时。1.8 亿美元一个机架——这个定价已经把 NVIDIA 的 AI 芯片可寻址市场推向万亿美元量级。但首批只出货北美五大云厂商,「缺芯」的焦虑至少还要持续到 Q3。同期微软-Mistral 的欧洲大单点名要用 Vera Rubin,需求侧完全不愁。
Poolside Laguna S 2.1
The Agent Times / Poolside · 今日

Poolside Laguna S 2.1:118B MoE 编程模型,单台 DGX 可跑,9 周 4096 H200 训出

7/22 Poolside 发布 Laguna S 2.1 / 118B MoE 开源权重,8B 激活每 Token / Terminal-Bench 2.1 得分 70.2% / NVFP4 量化版单 DGX Spark 或 Mac Studio 可跑 / 仅 4096 张 H200 训练不到 9 周 / NVIDIA 投资,估值 120 亿美元 / 采用自研「Model Factory」自动化架构搜索+RL 平台

4096 块 H200、9 周训练就做出对标前沿的编程模型——Poolside 用「少即是多」挑战了参数军备竞赛的叙事。NVFP4 量化单 DGX 可跑是更大的信号:编程 Agent 正在从云端走向桌面。Nathan Benaich 的评价精准:「美国开源权重选手也在追赶前沿了。」
融 资
Microsoft Mistral
Microsoft 官方 · 今日

微软与 Mistral 签数十亿美元欧洲 AI 基建大单,数千颗 Vera Rubin 押注主权 AI

7/21 微软与 Mistral 达成数十亿美元战略合作 / 扩大欧洲 GPU 基础设施,使用数千颗 Vera Rubin GPU / Mistral Medium 3.5 + OCR 4 入驻 Microsoft Foundry 和 Copilot Studio / 支持 Azure Local 断网部署(金融 / 医疗 / 制造) / Mistral 目标 2030 年达 1GW 算力 / NVIDIA Ian Buck 背书

欧洲「主权 AI」叙事正在兑现为数十亿美元的合同。美国商务部暂停 Anthropic 模型出口后,Mistral 成为唯一能同时满足监管合规和前沿能力的欧洲选手——微软这步棋既卡了地缘政治的位,又绑定了下一代算力基础设施。Mistral 1GW 的目标野心不小:目前欧洲最大数据中心无非几百 MW。
开 源
Meituan LongCat-2.0
美团技术团队 · 今日

美团开源 LongCat-2.0:1.6 万亿参数,首个全流程国产算力训练的万亿大模型

7/23 美团正式开源 LongCat-2.0 / 1.6T 总参数(MoE),约 48B 激活参数 / 首个在 5 万张国产算力卡集群上完成全流程训推的万亿参数模型 / 原生 100 万 Token 长上下文 / LongCat Sparse Attention + N-gram Embedding 两项架构创新 / 针对 Agentic Coding 任务优化 / 提供国产硬件推理代码

5 万张国产卡跑出 1.6T 参数的模型——这不是又一个「类 GPT」,而是国产算力生态的里程碑式验证。Sparse Attention + N-gram Embedding 的长上下文方案值得关注,但真正的考验是开源后的开发者采纳:有没有人愿意在国产卡上跑它做 Agentic Coding?
安 全
WeRide WITT
南方都市报 · 今日

文远知行发布 WITT 物理 AI 大模型:事实错误率仅通用模型 1/3,节省 98% Token

文远知行发布自研 WeRide WITT 物理 AI 认知基础模型 / 引入「最小物理事实单元」概念拆解真实场景 / 事实错误率约为通用大模型的 1/3 / 节省 98% Token 成本 / 单卡日处理 1 万分钟车载视频 / 专治自动驾驶感知幻觉

「最小物理事实单元」这个提法值得认真对待——自动驾驶需要的不是更聪明的通用模型,而是不会产生幻觉的物理世界理解。WITT 把事实准确率做到通用模型 3 倍、Token 效率提升 50 倍,证明专用化可能是比 Scaling 更靠谱的安全路径。
前 沿 技 术

Frontier · GitHub & arXiv 周边

SkillOpt
GitHub · 本周

微软 SkillOpt:像训练神经网络一样训练 Agent 技能,52 项基准全最优,14.5K Star

微软开源 SkillOpt / 将 Agent 技能��档视为可训练状态,轨迹驱动编辑 + 验证门控迭代优化 / 部署时零额外模型调用 / 在 6 基准 × 7 模型 × 3 执行方式共 52 单元全部最优或并列最优 / GPT-5.5 Direct Chat +23.5 分,Codex Loop +24.8 分 / 14,496 ⭐ / MIT 许可

SkillOpt 的核心洞察力:Agent 技能不是 prompt engineering,而是一个可优化的参数空间。零推理开销意味着技能训练和部署完全解耦——工程上极其实用。微软用 52/52 全刷榜比论文本身更有说服力,自带的 SkillOpt-Sleep 夜间自进化引擎进一步降低了持续优化的运维成本。
AstrBot
GitHub · 本周

AstrBot:37.8K Star 全能 Agent 平台,集成 15+ IM + MCP + 沙箱执行

AstrBot v4.26.7 / 开源全能 Agent 聊天机器人平台 / 5,017 Commits, 255 Tags, 176 Branches / 支持 QQ、企微、飞书、钉钉、Telegram、Discord、LINE 等 15+ IM 平台 / 原生 MCP 协议 + Skills 技能系统 + Agent 沙箱(会话级资源复用) / 1000+ 插件可一键安装 / 37,793 ⭐

AstrBot 是目前 IM-Agent 集成最完整的开源方案——不是又一个 Agent 框架,而是在「把 Agent 连接一切即时通讯」这件事上做到了工程上限。255 个 Tag 说明维护节奏健康,15+ IM 覆盖意味着它是真正的「基础设施」而非 Demo。MCP 原生 + 沙箱执行是安全部署的关键差异化。
CW Field LLM
GitHub · 本周

连续波场 LLM 引导:0MB 显存、无 Autograd 推理,用流体力学替代反向传播

开源 Continuous_Wave_Field_LLM_Brain / 0MB VRAM 零拷贝混合引导层,基于 CUDA 裸机 + JAX / PyTorch 桥接 / 无 Autograd,使用粘性 Burgers 方程 + 交叉轴涡量反演替代反向传播 / 0ns 指针互锁的零拷贝数据传输 / 质心积分逆解码器替代 Softmax / Apache 2.0 许可 / 防御性现有技术注册

用流体力学方程替代反向传播——这是近来最大胆的推理优化提案之一。0MB 显存、0ns 互锁的数字听起来悬乎,但 CUDA 裸机互锁 + JAX XLA HLO 内联融合的技术栈是认真的。「防御性现有技术注册」意味着作者不打算商业化,而是开放给社区验证。真正的考验:在 Llama 级模型上的实际基准。