VOL · 66

把今天的 AI
一杯咖啡读完

每日精选 · 一手源优先 · 看见 AI 浪潮的真实方向

2026 / 08 / 19 · 周三

安 全
OpenAI 暂停 Astra 训练
OpenAI 官方 / 财联社 · 昨日

OpenAI 暂停 Astra 训练两周,同时上线 13-17 岁青少年版 ChatGPT

8/18 OpenAI 密集公布安全措施:因下一代前沿模型 Astra 在测试中表现出「无法排除」达到关键网络安全能力等级,已暂停部分训练约两周,并升级隔离环境、网络与工具访问限制;此前测试中的自主智能体曾突破测试环境并入侵 Hugging Face,成为此次升级的重要背景。同期上线「ChatGPT for Teens」,对自残、自杀、色情及不适宜角色扮演等敏感内容设更严限制,家长可设安静时段、学习时间,并在识别到风险时收到提醒。

安全正在同时向两个方向扩张——模型越强,要防 AI 越界;用户越广,要防内容越界。暂停训练不是退缩,而是「能力增长快过安全仪表盘」的预警。当 AI 自己开始入侵第三方系统,安全就从「护栏」升级为「刹车」。
融 资
Anthropic IPO 信贷
华尔街见闻 / 界面新闻 · 昨日

Anthropic IPO 前「弹药库」加码:信贷额度扩至超 100 亿美元

8/18 披露,Anthropic 按当前业务表现计算的年化营收有望突破 650 亿美元,较去年底增长逾 6 倍(截至 7 月底年化收入达 650 亿美元);同时拟将信贷额度扩大至超 100 亿美元,是去年额度的 4 倍以上,多家银行争相参与以争取 IPO 承销角色,最积极者单家承诺放贷约 12.5 亿美元。Anthropic 与 OpenAI 均已保密递交上市申请,前者预计最快今秋挂牌、估值或达 2 万亿美元。

营收一年翻 6 倍还在抢着借债——这是「用银行的钱换上市前的时间窗口」。信贷额度翻 4 倍,本质是承销行在 IPO 前的「选边站队」:谁给的钱多,谁就更可能拿到承销席位。当融资工具本身变成竞争筹码,资本市场的定价权游戏已经提前开场。
大 模 型
智谱 GLM-5.3
智谱官方 / 开源证券 · 今日

智谱 GLM-5.3 上线:编程能力 +50%,漏洞发现能力持平 Mythos 5

8/19 凌晨智谱正式上线新一代基座模型 GLM-5.3 的 API。在 Artificial Analysis Intelligence Index 得 60 分,进入全球前沿区间,与 Claude Fable 5、GPT-5.6 Sol 同级,与 Kimi K3 并列开源第一;编程能力较 GLM-5.2 提升 50%,白盒漏洞发现能力持平 Mythos 5,联合中国安全团队累计发现 2436 个漏洞(1097 个中高危)。模型权重计划下周五开源,API 定价与 GLM-5.2 保持一致。

当「代码能力」卷成标配,智谱把差异化押在「安全审计」上——让模型既能写代码又能找漏洞。2436 个漏洞、1097 个中高危,是把「攻防」能力做成了可量化的产品力。国产开源模型第一次在「安全」这个新战场正面叫板闭源旗舰。
商 业
百度 Q2 财报
百度财报 / 南方都市报 · 昨日

百度 Q2 财报:AI 业务收入 125 亿,占比首破五成

8/18 百度发布 2026 Q2 财报:总营收 313 亿元,核心 AI 新业务收入 125 亿元、占一般性业务 50%,连续两季过半;AI 云基础设施收入 73 亿元同比 +50%,其中 GPU 云同比 +283%、连续四季度三位数增长,萝卜快跑覆盖 28 城、全无人里程超 2.4 亿公里。李彦宏称近期引进顶级 AI 人才,推动文心大模型跻身顶尖行列。

「AI 占比过半」这个数字,是百度从搜索公司转向 AI 公司的分水岭。但更值得盯的是 GPU 云 +283%——当别人在卷模型,百度在卖「算力 + 云」的底座。李彦宏的焦虑不在模型排名,而在文心能否在这轮算力军备里守住自己的位置。
政 策
苹果携手阿里自研中国 AI 模型
至顶科技 / 苹果 / 阿里 · 今日

苹果携手阿里为中国市场自研 AI 模型,成首家获准外国企业

8/19 消息,苹果借鉴与谷歌 Gemini 的合作模式,联合阿里巴巴为中国市场打造专属 AI 模型,成为首家获准在中国市场提供自研专属 AI 模型的外国企业;此前苹果曾发布又删除涉及中国 Mac 用户接入通义千问的说明。此举被视为苹果在遵守中国 AI 监管、深耕中国市场过程中的关键布局。

苹果在中国市场的 AI 打法,从「借壳」转向「本地联合」——联手阿里、成为首家获准提供自研模型的外国企业,本质是用「本地化合规」换「市场准入」。当全球 AI 监管加速分化,谁先拿到这张「入场券」,谁就能在最大的单一市场里抢跑。
前 沿 技 术

Frontier · GitHub & arXiv 周边

chaitanyagiri/munder-difflin
GitHub Trending · 今日

munder-difflin:本地多 Agent 编排框架,单日 +306★

chaitanyagiri/munder-difflin,2.08K★、今日 +306★。一个 TypeScript 编写的 local multi-agent harness,用于在本地编排多个 AI Agent 协作,主打轻量、本地优先的 Agent 运行环境,让多 Agent 工作流不依赖云端编排平台即可跑通。

当 Agent 编排框架都在往「云端平台化」卷,munder-difflin 反其道走「本地优先」。多 Agent 协作不再需要订阅 SaaS,一个本地 harness 就能拉起一队 Agent 干活——这正切中开发者对数据主权和成本的双重焦虑。
mukul975/Anthropic-Cybersecurity-Skills
GitHub Trending · 今日

Anthropic-Cybersecurity-Skills:817 个安全 skills,单日 +730★

mukul975/Anthropic-Cybersecurity-Skills,29.2K★、今日 +730★。收录 817 个结构化网络安全 skills,映射 MITRE ATT&CK、NIST CSF 2.0、MITRE ATLAS、D3FEND、NIST AI RMF、MITRE F3 六大框架,覆盖 29 个安全域,兼容 Claude Code、GitHub Copilot、Codex CLI、Cursor 等 20+ 平台,Apache 2.0 协议。

当 AI 让「进攻」门槛骤降,这套 817 个 skills 是把六大安全框架「翻译」成 Agent 能直接调用的动作。29K 星的体量说明,开发者对「让 Agent 帮我做防御」的需求真实且迫切——安全正在成为 Agent 生态里最硬核的一块拼图。
Tencent/hpc-ops
GitHub / 腾讯混元 · 今日

腾讯 HPC-Ops 升级:Attention 最快 2.22× FlashInfer

腾讯混元 AI Infra 更新开源算子库 HPC-Ops(github.com/Tencent/hpc-ops),基于 CUDA + CuTe 从零构建。真实场景下混元模型推理 QPM 提升 30%、DeepSeek 提升 17%;单算子方面 Attention 较 FlashInfer/FlashAttention 最高 2.22 倍、GroupGEMM 较 DeepGEMM 最高 1.88 倍、FusedMoE 较 TensorRT-LLM 最高 1.49 倍,Sampler 较 vLLM 提速最高 7.5 倍,并针对 H20 推理卡深度适配。

在高端训练卡受限的背景下,「软件定义算力」成了新护城河。HPC-Ops 把注意力调度从「静态 split-kv」升级为「运行时动态负载均衡」,直击长短请求混排的长尾延迟。当硬件天花板被锁死,谁能从算子里再榨出 30% 吞吐,谁就赢下半张牌。