VOL · 64

把今天的 AI
一杯咖啡读完

每日精选 · 一手源优先 · 看见 AI 浪潮的真实方向

2026 / 08 / 16 · 周日

融 资
Anthropic Q2 营收
21 世纪经济报道 / Bloomberg · 昨日

Anthropic Q2 营收 115 亿美元:14 倍暴增,营业利润首次转正

8/15 Bloomberg 文件披露:Anthropic Q2 初步营收超 115 亿美元,同比增约 14 倍(去年同期 7.87 亿、Q1 为 47.3 亿),调整后营业利润首次转正。5 月年化营收已破 470 亿美元;公司已秘密提交 IPO 申请,与摩根士丹利、高盛、摩根大通合作,市场预期 10 月上市、估值或超 2 万亿美元

从「烧钱无底洞」到「现金流机器」的转折点。推理毛利率从一年前 38% 飙到 70%–85%,靠的是硬件优化与定制芯片——每单位算力的边际收益大幅抬升。若 10 月 IPO 估值破 2 万亿,将刷新史上最大 IPO 纪录,Anthropic 彻底甩掉「落后方」标签。
大 模 型
Qwen3.8
澎湃新闻 / Hugging Face 报告 · 昨日

阿里开源 Qwen3.8-27B,千问下载量破 30 亿登顶全球第一

8/14 晚阿里千问正式开源 Qwen3.8-27B 原生多模态稠密模型,270 亿参数整体超越 Qwen3.7-Plus,Apache 2.0 协议。据 Hugging Face《开放模型现状》报告,千问近半年下载量破 30 亿次(HF Hub 20.45 亿),超谷歌 4.18 亿、Meta 2.27 亿;累计开源 460+ 模型、衍生 30 万+,稳居全球第一开源模型

下载量不等于质量,但 30 亿下载 + 30 万衍生模型,说明 Qwen 已成为全球开发者的「默认工作流」。报告还点出一个分野:中国前沿模型冲到 7540 亿至 2.78 万亿参数,美国多数月份不足 1300 亿。开源生态的天平,正在反转。
字节 10 万亿参数
钛媒体 · 昨日

字节押注 10 万亿参数大模型,张一鸣否决「蒸馏捷径」

8/15 钛媒体披露:7 月底字节 Seed 全员会上,张一鸣明确反对蒸馏竞品模型;字节正预训练最高 10 万亿参数大模型,体量超 Kimi K3 三倍以上,另讨论训练超 5 万亿参数模型;同时新设「AI 数据与安全」一级部门,整合超千人团队与 Seed、Flow、抖音平行联动

全网都在用蒸馏「抄近道」省算力,张一鸣反手押 10 万亿参数的原生模型——这是长期主义与变现节奏的一场豪赌。10 万亿参数的训练成本是天文数字,但若不自己炼,就等于把地基交到别人手里。字节要的是一张「后蒸馏时代」不被卡脖子的底牌。
A G E N T
Copilot 接入 Grok 4.6
GitHub 官方 changelog · 昨日

GitHub Copilot 接入 Grok 4.6:8 大平台同日上线

8/14 GitHub 将 xAI 的 Grok 4.6 接入 Copilot 模型选择器,VS Code、Visual Studio、CLI、云 Agent、App、JetBrains、Xcode、Eclipse 八大平台同日上线——距 Grok 4.6 发布仅 2 天(8/12)。按 xAI 官方 $2/$6 每百万 token 计费,Business/Enterprise 默认关闭、需管理员开启

「八大平台同日上线」才是真信号:GitHub 不再让新模型在 IDE 里「先试点、后铺开」,而是把跨平台对齐当成发布门槛。Grok 4.6 主打长程 Agent 任务,正好补上 Copilot CLI 与云 Agent 的短板。编码助手的模型选择器,成了 xAI 与 OpenAI、Anthropic 正面拼刺刀的战场。
开 源
studio-dots-ai/dots.tts
小红书 dots / 上海交大 X-LANCE · 昨日

小红书开源 dots.tts:首包 54ms 的连续自回归语音基座

小红书 dots 团队联合上海交大 X-LANCE 开源 20 亿参数连续自回归 TTS 基座 dots.tts,全链路不用离散声学 Token,直接在连续隐空间建模;1T1A 双流模式音频首包延迟低至 54.4ms;Seed-TTS-Eval 零样本克隆平均 SIM 79.2、24 语种平均 83.9 达 SOTA;Apache 2.0 开源 6 个 checkpoint 及训练、微调、蒸馏全套代码

语音合成的「连续化」是趋势——跳过离散 token 直接建模连续隐空间,质量更高、延迟更低。首包 54ms 意味着它够格当实时语音 Agent 的「声带」。小红书从内容平台往语音基座扎,说明大厂都在抢「Agent 的嘴」这块底层能力。
前 沿 技 术

Frontier · GitHub & arXiv 周边

cactus-compute/needle
GitHub Trending · 今日

needle:14MB 端侧基础模型,单日 +547★

cactus-compute/needle,6.1K★、今日 +547★。14MB 基础模型,面向手机、可穿戴、智能家居、机器人等微型设备,主打端侧本地部署,把基础模型塞进消费级边缘硬件

14MB 装下一个「基础模型」——当云端大模型还在拼参数,这个项目证明「小」也有用武之地。端侧 AI 要的不是大而全,而是功耗、内存与延迟的极致克制。边缘智能的下一块拼图,正在被填上。
citrolabs/ego-lite
GitHub Trending · 今日

ego-lite:把登录态借给 Agent 的浏览器自动化,单日 +545★

citrolabs/ego-lite,11K★、今日 +545★。面向 AI Agent 的浏览器自动化工具,可把已登录的浏览器状态分享给 Codex、Claude Code 等 Agent,零成本零配置,绕开验证码与二次认证

Agent 最大的摩擦之一就是「登录态」——让它干活,先得把账号给它。ego-lite 直接把你的登录浏览器喂给 Agent,绕开验证码和二次认证。浏览器自动化正在成为 Agent 的「手」,这块工具层的竞争才刚刚开始。
MakazhanAlpamys/Soup
GitHub Trending · 今日

Soup:一个 YAML 微调 LLM,4GB 显卡训 8B,单日 +297★

MakazhanAlpamys/Soup,1.7K★、今日 +297★。一个 YAML 配置即可微调 LLM,Layer streaming 技术让 8B 模型在 4GB 笔记本 GPU 上完成训练

把微调门槛从「服务器集群」拉到「一张笔记本显卡」——Layer streaming 让 8B 模型在 4GB 显存上就能训练。当微调彻底民主化,个人开发者也能造私有模型,这对云 API 是长期威胁。