VOL · 44

把今天的 AI
一杯咖啡读完

从 Qwen 2.4T 旗舰开源到 Kimi 算力告急,国产大模型进入「产能竞赛」新阶段

Monday · July 20, 2026

今 日 要 闻

News

阿里 Qwen3.8-Max 预览版上线:2.4T 参数,宣称仅次于 Fable 5

7 月 19 日,阿里官宣 Qwen3.8 即将发布并全量开源,参数量 2.4T。预览版已登陆 Token Plan、Qoder 及 QoderWork,内部实测全栈开发 / 数据分析 / Office 多 Agent 长程任务匹敌前沿模型。限时白天 credit 1 折,Token Plan 月费低至 35 元。

Kimi K3 开源刚把热度拉满,Qwen 不到 48 小时就掏出 2.4T 参数回应——国产大模型不是「追赶」,是在互卷中完成了连续能力供给的工业化。

大模型 IT 之家

Kimi K3 暂停新增付费用户:GPU 供给跟不上需求爆发

因 Kimi K3 上线后推理需求逼近现有 GPU 容量上限,月之暗面 7 月 19 日起暂停新增订阅,优先保障存量会员。后续会员将拆分为通用版与 KimiCode(编程工作流)版,以更精确分配算力。K3 开源后 48 小时内海内外开发者涌入测试,需求远超预期。

AI 行业第一次如此赤裸地展示了「模型好 ≠ 能服务好」。大模型竞赛的下半场不是参数多少,是推理产能、调度能力和定价体系的三重博弈。

大模型 / 商业 雪球 / CCTV

MiniMax 完成 160 亿港元再融资,M3 Pro 2.5-3T 参数即将开源

7 月 10 日,港股 AI 公司 MiniMax 完成约 160 亿港元(约 138 亿人民币)再融资,百余家机构 7 倍认购覆盖。据 The Information 报道,新一代大语言模型 M3 Pro 参数规模达 2.5-3 万亿,计划开源。创始人闫俊杰宣布实现 AGI 前不再领取薪酬,个人持股 5% 用于员工激励及开源社区支持。

百亿融资 + 3T 级开源计划,MiniMax 的野心已经很清楚了:不是做中国的 OpenAI,是做一个有开源底座的商业化 AI 基础设施公司。

融资 / 开源 新浪财经 / The Information

面壁智能 MiniCPM5-2B:全球 4B 以下模型第一,17 分登顶 AA 榜单

7 月 19 日 WAIC 上,面壁智能联合 OpenBMB 推出 MiniCPM5-2B 端侧模型,在 Artificial Analysis 综合评测中拿下 17 分,登顶全球 4B 以下模型榜首。原生支持 512K 超长上下文、混合思考切换、工具调用和深度搜索。已适配 AMD / 英特尔 / 联发科 / 高通,并完成华为昇腾等 9 款国产芯片 Day0 适配。

2B 参数塞进 512K 上下文 + 端侧 Agent 能力,这不是「小模型也不错」,是端侧 AI 的临界点:手机 / 座舱 / PC 本地跑一个真正能用的 AI 助手,今天开始不需要等。

大模型 / 端侧 网易 / WAIC

商汤 SenseNova U1 Pro:原生多模态 Agent 基座,长程任务「一次交付」

7 月 18 日 WAIC,商汤发布 SenseNova U1 Pro,基于 NEO-unify 内核架构实现语言和视觉统一表征,定位「交付级原生多模态智能体基座」。解决多模态产品「反复抽卡」困境,从单点内容生成升级为闭环完成复杂长程任务。预览版已开启邀请测试,正式版预计 8 月上线并推出 API。

「交付」而非「生成」——商汤这一刀切在了多模态 Agent 的最大痛点:用户要的不是一堆候选,是一个可以拿出来用的结果。

Agent 界面新闻 / WAIC

Anthropic 推翻下线计划:Claude Fable 5 永久对外,Kimi K3 催生「竞争性开放」

7 月 19 日,Anthropic 推翻原定 7 月 25 日下线 Fable 5 的计划,宣布 Fable 5 永久对外开放。此前 Fable 5 推广期至 7 月 19 日截止,但 Kimi K3 发布次日 Anthropic 紧急调整决策。同时 Anthropic 推出 Claude for Teachers,向全美 K-12 教师免费开放高级能力。

Kimi K3 开源 48 小时内,Anthropic 从「限量供应」变成了「永久开放」——这不是巧合,是开源竞争力对闭源定价权的直接冲击。好模型不怕竞争,怕的是用户货比三家。

大模型 / 产业格局 Anthropic 官方

蚂蚁数科 Agentar 2.0:200 个岗位级数字专家模板,Agent 工业化落地

7 月 19 日 WAIC,蚂蚁数科发布商业智能体超级工厂平台 Agentar 2.0,首批预置 200 个岗位级数字专家模板,提供数百个可订阅的 Skills 级开箱可用智能体工具。同期阿里云百炼上线 HappyOyster 1.0 开放式世界模型,输入一句话或一张图即可生成可交互 AI 数字世界。

200 个「岗位级」模板意味着蚂蚁不是在做一个 Agent 平台,是在做一套岗位替代方案。Agent 从开发者玩具变成 HR 采购清单上的条目,这一步跨得很大。

Agent / 产品 界面新闻 / WAIC

前 沿 技 术

Frontier · GitHub & arXiv 周边

wigolo:面向 AI Agent 的本地优先 MCP 搜索引擎,首日 595★

基于 MCP 协议的本地优先搜索 / 抓取 / 爬取工具,面向 AI 编程 Agent 设计。零 API 密钥、零云服务、$0 / 次查询,公开 Beta 版本。TypeScript 编写,首日 GitHub Trending 获得 595 星,累计 1,855 星。

「无需 API 密钥的 MCP 搜索」击中了一个真实痛点:Agent 要访问大量外部信息源,但每个源都要申请 key 的管理成本太高。wigolo 用本地化路线绕过了这个瓶颈。

前沿技术 / MCP 生态 GitHub Trending · 今日

code-review-graph:MCP + 本地代码知识图谱,首日 663★

面向 AI 编程工具的本地优先代码智能图谱,支持 MCP 和 CLI 接口。为 AI 编程 Agent 构建持久化代码库地图,在代码审查和大仓库工作流中实现经基准测试验证的上下文缩减。Python 编写,首日 GitHub Trending 获得 663 星,累计 21,278 星。

21K 星说明这个需求是真实的:AI 编程 Agent 最大的瓶颈不是模型能力,而是对代码库「全局理解」的缺失。知识图谱作为 Agent 的长期记忆层,这条路正在被验证。

前沿技术 / Agent 基础设施 GitHub Trending · 今日

Multi-Head Latent Control:从隐状态直接决策路由,大模型调用量减 90%

arXiv:2607.14277(7 月 15 日)。研究提出一种轻量级控制层,从冻结 LLM/VLM 的隐状态轨迹中直接预测部署时控制信号——能力头判断是否应 defer 到更强模型,解析头选择工具调用 / 澄清 / 拒绝 / 直接回答。在 AndroidWorld 上将大模型调用量减少 90.7%,工具调用决策提升 158%。

这可能是当下最务实的 Agent 成本优化路线:不改模型、不训 RL,只在推理时加一层轻量 probe,让系统自己学会「什么时候该用大模型、什么时候不该用」。90% 的节省是实实在在的 token 账单。

前沿技术 / 推理优化 arXiv · 2026-07-15