AI周报 | 8月10日–8月16日:本周AI大事盘点
这周 AI 圈最扎眼的两条线,一条是中国开源模型的集体冲刺,另一条是 Anthropic 的上市倒计时。DeepSeek 把旗舰 V4 Pro 转成正式版、顺手开源了 Harness 框架,阿里放出 2.4 万亿参数的 Qwen3.8 权重、通义千问下载量顺势登顶全球第一,智谱 GLM-5.3 又在编程榜单上夺了开源冠军。另一头,Anthropic 二季度营收同比暴涨 1361%,正朝着史上最大 IPO 狂奔;谷歌则被 Gemini 的困局逼得把创始人布林请回一线。夹在中间的,还有英伟达拉上六大华尔街巨头搭起的 5000 亿美元算力融资平台。
1. DeepSeek V4 Pro 正式版上线,Harness 开源框架同步放出
8 月 13 日晚,DeepSeek 旗舰模型 V4 Pro 转正式版,同时预告 API 价格将大幅上调(8 月 17 日起生效);约两小时后,主打「一切皆插件」的 Agent 框架 Harness 开发者预览版以 MIT 协议开源,发布半小时 GitHub 星数破万。正式版、涨价、开源框架三连击,标志 DeepSeek 从「低价换规模」转向「利润换算力」,Harness 则摆明了要抢 Agent 开发框架的生态位。来源
2. Anthropic 二季度营收暴增 1361%,10 月 IPO 冲击史上最大
Anthropic 二季度营收超 115 亿美元,同比涨约 14 倍,调整后营业利润首次由负转正,市场预期其 10 月启动 IPO、估值或冲上 2 万亿美元,有望超越 SpaceX 成为史上最大上市;同期还传出拟以约 60 亿美元收购 Decart AI。前沿模型公司第一次要在公开市场被定价,1361% 的增速把「AI 商业化」从叙事变成了实打实的财报。来源
3. 英伟达联姻六大华尔街巨头,组建 5000 亿美元算力融资平台
英伟达与 Apollo、贝莱德、黑石、Brookfield、高盛、KKR 六家机构签下备忘录,共建「算力融资平台」,目标撬动 5000 亿美元以上第三方资本,覆盖芯片、电力、数据中心全链条。这相当于给 AI 基建装上一台金融级的资本引擎,规模是谷歌此前融资网络的 2.5 倍,算力军备赛从企业财报一路升级到金融系统层面的动员。来源
4. OpenAI 发布 GPT-5.6-Cyber,顺手挖出两个 Chrome 零日漏洞
OpenAI 的「Daybreak Red」计划放出攻击性安全模型 GPT-5.6-Cyber,内部基准 95% 的敏感安全提问应答率远超上代的 57.3%;实战中它分析 Chrome V8 引擎找出两个此前未知的零日漏洞,Google 已修复。把「最强模型能不能挖洞」从争议变成官方产品,攻防一体正成为前沿实验室的新标配。来源
5. 谷歌布林紧急接管 Gemini,3.5 Pro 被曝取消
SemiAnalysis 判断 Gemini 3.5 Pro 已被悄悄取消、Gemini 4 进入预训练,联合创始人布林重回 Gemini 一线直接坐镇。谷歌旗舰被按下暂停键、创始人亲自下场,说明 Gemini 在代码和企业赛道的落后已经到了需要最顶层出手的程度。来源
6. 阿里开源 Qwen3.8-2.4T-A95B,通义千问下载量登顶全球
8 月 13 日阿里开放 Qwen-Max 级旗舰 Qwen3.8-2.4T-A95B 权重(总参数 2.4 万亿、激活 95B);隔天 Hugging Face 报告显示千问家族半年下载超 20 亿次,成为全球第一的开源模型。2.4 万亿参数的旗舰第一次「裸奔」开源,叠加 20 亿下载量的生态体量,开源阵营的话语权正式从美国厂商手里交到中国这边。来源 / 来源
7. 智谱 GLM-5.3 编程开源登顶,两周后开放权重
智谱发布 7430 亿参数的 GLM-5.3,Terminal-Bench 3.0 从 4.6 分跃升至 28.3 分夺开源第一,DeepSWE 从 46.2 提到 66.9,编程能力内部评测提升 50%,还涌现出超 GPT-5.6 Sol 的网络安全能力,承诺两周后开源权重。国产基座模型首次在编程这条最硬核的赛道上开源登顶,中国大模型的卷法从追参数转向追硬指标。来源
8. SpaceXAI 发布 Grok 4.6,综合智能打平 GPT-5.6 Sol
SpaceXAI(xAI 与 Cursor 合并后的实体)发布 Grok 4.6,Artificial Analysis 智能指数 61 分与 GPT-5.6 Sol Max 持平、GDPVal-AA 1753 分反超,价格却只要同级约一半,已上线 Cursor、Grok Build 等渠道。Grok 首次在综合榜单和 OpenAI 旗舰站上同一台阶,还用半价开打,前沿模型的价格锚被继续往下压。来源
9. 月之暗面 Kimi G 轮开闸,估值三个月翻近三倍至 500 亿美元
Kimi 启动 G 轮(Pre-IPO)融资,估值 500 亿美元、机构需 8 月 15 日前打款,较 4 月的 180 亿美元翻了近三倍,驱动因素是 7 月底 K3 完整权重开源(全球首个 3 万亿参数开源模型)。开源一个 3 万亿参数的模型,换来三个月估值翻近三倍,开源换估值的商业闭环走通了。来源
10. Claude 未公开研究模型刷新黎曼猜想纪录
Anthropic 官宣,一个未公开的 Claude 研究模型把满足黎曼猜想的零点比例下界从 41.6% 推到 67.2%,靠的是 Claude Code 里拉起约 60 个子智能体、一天半跑 2400 条 Shell 命令、输出 3100 万 token 的协作流水线。前沿数学纪录第一次主要由 AI 智能体军团推进、人类在旁边喊「继续,相信你自己」,AI for Science 从工具变成了主力。来源
本周趋势
这周最清晰的方向,是中国开源模型完成了从跟随到定义价格与榜单的跃迁:DeepSeek 转正涨价、阿里放 2.4T 权重、智谱编程登顶、通义千问 20 亿下载,中国大模型调用量还连续 15 周超过美国,开源加低价的规模效应正在全球兑现。开源和自研两条路都在提速,Meta 放出 30B 智能体模型 Muse Glimmer,Ilya 的 SSI 首款 TTT 推理引擎也被曝光。资本侧在重构:Anthropic 冲击史上最大 IPO、英伟达拉来 5000 亿美元融资平台、Kimi 估值三个月翻近三倍,Terafab 动工、微软 Maia 300 逼近量产,算力与芯片自研成了巨头账本上最贵的词。具身智能同样升温,宇树 IPO 进入读秒、智元出货量登顶全球、自变量用 30% 硬件成本跑出分拣新纪录,机器人正从技术故事变成有销量的生意。另一条暗线是安全与透明,GPT-5.6-Cyber 挖出 Chrome 零日、模型「思维链」被曝可提取、Claude 全球打水印,越强越要可解释可溯源;下周值得盯的:DeepSeek 新价格 17 日生效、Qwen3.8 与 GLM-5.3 权重落地、宇树上市表现,以及 8 月 22 日开幕的世界人形机器人运动会。