VOL · 54

把今天的 AI
一杯咖啡读完

每日精选 · 一手源优先 · 看见 AI 浪潮的真实方向

2026 / 08 / 03 · 周一

常 规 要 闻
Astra
OpenAI 官方 · 今日

OpenAI 下一代模型 Astra 攻克 10 项菲尔兹奖级数学难题,249 页论文

涵盖高维几何、群论、编码理论等方向 / 推翻 Connes 刚性猜想、解决 3 个 Erdős 问题、构造首个非 sofic 群 / 全部证明经 Lean 4 形式化验证 / 总 API 调用成本约 $2,000 / Astra 目前处于内部安全评估阶段,暂未公开

这不是刷榜,是制造新知识。Astra 在没有人类提示介入的情况下自主推导,10 个开放超过十年的难题在 API 上跑了一周、花了 2000 美元就给出了——这个成本数字比结果本身更让人清醒:前沿推理已经被 token 化了。
DeepSeek 官方 · 今日

DeepSeek V4-Flash 正式版 API 公测:后训练优化让 Agent 能力��涨 6 倍

MoE 架构 284B 总参 / 13B 激活参数 / DeepSWE 从预览版 7.3 跃升至 54.4(+647%)/ TerminalBench 82.7 超越 V4-Pro 预览版 / 架构未变,纯后训练优化 / 缓存命中价格仅 0.2 元/百万 tokens

同一个骨架,同一套参数,只重新做了后训练——Agent 能力从"勉强能用"进化到"开发者默认模型"。这说明两件事:后训练优化空间被严重低估;便宜模型不再是"够用就行",而是正在逼近旗舰的工程可靠性。
央视财经 · OpenRouter · 今日

中国大模型包揽 OpenRouter 全球调用榜前五,总份额 63.5%

小米 MiMo-V2.5 以 10.5 万亿 Token/周登顶 / DeepSeek V4-Flash、腾讯混元 3、智谱 GLM-5.2、DeepSeek V4-Pro 分列 2-5 位 / 中国模型合计占全球调用量 63.5% / MoE 低成本推理 + 开源策略为核心驱动

不是技术指标领先,是开发者用脚投票。中国模型在全球多模型聚合平台的前五席被全包——便宜、够快、够用,这三张牌组合在一起正在成为全球开发者的事实默认选项。这个榜单比任何 Benchmark 都更有说服力。
华尔街日报 · 财联社 · 今日

英伟达拟为 OpenAI 提供 2500 亿美元融资担保,共建 10GW 超算中心

约 $2,500 亿融资担保谈判中 / 目标在俄亥俄州建设 10 吉瓦巨型数据中心 / 若落地将成为全球最大单体 AI 算力基建项目 / 此前英伟达已向 SSI 投约 $50 亿 / NVIDIA 正从芯片商转型为 AI 基础设施的"银行"

2,500 亿是什么概念?超过全球多数国家的 IT 年度预算。黄仁勋不是在赌 OpenAI,是在赌整个 AI 算力赛道的下一个十年——从卖铲子到开矿场,NVIDIA 正在把算力变成它自己的金融产品。问题是:谁来为这 10GW 的电费买单?
Sol
OpenAI · 今日

OpenAI Sol 模型自主重写 GPU 内核,运营成本降 20%,开启"模型优化模型"时代

Sol 自主设计数百个优化实验重写生产内核 / Token 生成效率 +15%,端到端成本 -20% / 模型监控训练流程并直接介入调度优化 / 配合 GPT-5.6 Luna 降价 80%,Sol Fast 模式速度 2.5× / 价格下降形成自我驱动飞轮

真正的故事不是降价本身,而是"模型在优化自己"。Sol 重写 GPU kernel、设计实验、监控生产——过去工程师一年挤出十几个点的效率提升,现在模型 7×24 不间断在做。成本下降开始拥有了自我驱动能力,这个飞轮一旦转起来,竞争对手追的不再是技术差距,是时间差。
雷峰网 · 今日

求之科技 1 亿美元天使+轮落地,距首轮不到 1 月跻身具身智能独角兽

首轮超 $1 亿天使轮落地不足 1 月再获 $1 亿 / IDG、武岳峰、达晨、九阳、华映等参投 / 构建 ORION 分层具身基础模型 + LOOP 虚实混合数据闭环 + DISCOVERSE 高保真仿真器全栈 / 老股东悉数追加

具身智能赛道还在撒钱——一个月内两轮各 1 亿美元,说明"模型-数据-仿真"全栈路线正在被资本用真金白银投票。但具身智能的工程化鸿沟远大于语言模型:仿真到现实的迁移、硬件供应链、量产成本,每一关都比融资难。
MiniMax 官方 · 富瑞 · 今日

MiniMax H3 全模态生成模型发布:统一音视频理解与生成,将开源权重

文本/图像/视频/声音统一理解 + 原生双声道音视频输出 / 最高 15s 2K 分辨率视频 / 768p 价格约为同业一半,2K 仅同业 1/3 / 未来几天将开放模型权重 / MiniMax-W 股价涨超 6%

全模态理解+生成不再是闭源巨头的专利。MiniMax 的策略很清晰:先用性价比抢视频生成的市场份额,再用开源权重锁定开发者生态。但开源后的社区活跃度和模型迭代速度才是真正的考验——权重放出来只是开始,不是结束。
前 沿 技 术

Frontier · GitHub & arXiv 周边

Agent-Reach
GitHub · 今日 +659★

Agent-Reach 64.7K★:零 API 费用让 AI Agent 读取全网信息

Python CLI 工具 / 单命令读取搜索 Twitter、Reddit、YouTube、GitHub、B站、小红书六大平台 / 零 API 费用 / 64,755 Stars,今日 +659 / 为 Claude Code、Codex 等 Agent 提供免费的网络信息获取能力

Agent 的"眼睛"进入零成本时代。过去给 Agent 配上��搜索能力要么付 API 费、要么自己搭爬虫——Agent-Reach 用一个 CLI 统一了入口,而且免费。这本质上是在降低 Agent 部署的总拥有成本(TCO):模型价格在降、工具层也在降,Agent 的生产级部署门槛正在系统性坍塌。
TencentDB
GitHub · 腾讯云 · 今日 +604★

TencentDB-Agent-Memory 11.1K★:团队级 Agent 记忆中枢,四类资产跨框架共享

将对话/文档/代码转化为 Chat Memory、Skill、LLM-Wiki、Code-Graph 四类可复用资产 / 团队级治理,跨 Agent 框架共享 / 11,111 Stars,今日 +604 / TypeScript 编写,腾讯云官方开源 / 支持 Claude Code、Codex、Cursor 等主流 Agent

Agent 记忆从"单兵工具"走向"团队基础设施"。Chat Memory 管对话、Skill 管能力、LLM-Wiki 管知识、Code-Graph 管代码——四维记忆架构把 Agent 从一个无状态的函数调用升级为有组织记忆的团队成员。腾讯云选择在这个时间点开源,是在押"Agent 记忆中间层"会成为下一个必争之地��
ds4
GitHub · antirez · 今日 +139★

antirez/ds4 20K★:Redis 之父打造 DeepSeek V4 原生推理引擎

Redis 作者 antirez 项目 / DeepSeek V4 Flash & PRO 本地推理引擎 / 支持 Metal (Apple Silicon)、CUDA、ROCm 三平台 / 20,015 Stars,今日 +139 / 纯 C 编写,极致性能 / 联合贡献者含 mitsuhiko(Flask/Rye 作者)

不是框架,是引擎——antirez 的代码哲学在这里体现得很彻底:用 C 在三个平台手写推理内核,拒绝抽象层。一位传奇程序员为 DeepSeek V4 专门写了个原生推理引擎,这件事本身就是在说:V4 系列值得被"原生"对待,而不是通过 Hugging Face transformers 多一层包装。