1. OpenAI 用万级智能体在 88 小时内解出 Navier–Stokes 千禧年难题
OpenAI 于 9 月 8 日公开了一份针对 Navier–Stokes 存在性与光滑性问题的证明,这是 Clay 数学研究所 2000 年列出的七个千禧年难题之一,悬置约 90 年。证明由内部一个比 GPT-6 Astra 更强的模型驱动多智能体系统产出:8 月 28 日起开始训练该模型,9 月 1 日启动攻关,约 1 万个并发 agent 协作,9 月 5 日得到结论,全程 88 小时,其间发送 270 万条消息、消耗约 1300 亿输出 token。结论是:三维不可压流体即使从光滑静止状态出发,也能在有限时间内形成奇点,即方程本身会失效——对应千禧年表述中的命题 C 与 D。Lean 形式化与验证又花了 17 小时,由 GPT-6 Astra 完成。算力代价被描述为「数以百万美元计」,约为此前数学成果投入的 1000 倍。
争议同时爆发。纽约大学数学家 Tristan Buckmaster 与 Anthropic 研究员 Levent Alpöge 在数小时前刚发布相关的 Euler 方程成果,质疑 OpenAI 是听到风声后才切入、并沿用了他们的思路;OpenAI 否认接触过其工作,也承认无法完全排除去标识化的用户数据间接帮助了模型。公司表示不打算领取 100 万美元奖金,Clay 研究所尚未确认该证明。
2. DeepSeek V4.1 Flash 限时 Beta 今日到期:新架构、原生多模态
DeepSeek 约在 9 月 8 日悄然开放了一个测试端点 deepseek-v4.1-flash-expires-on-0910,今天(9 月 10 日)失效。没有官方博客、模型卡、X 公告或变更日志,开发者是从社区群通知里发现这个 ID 的。按通知说法,这是 V4 系列自 4 月 Preview 以来最大的一次架构变更:多模态能力内建于模型本身,文本、图像、语音统一建模,而不是像 8 月 V4-Flash-Vision-Exp 那样外挂视觉塔。价格与 V4-Flash 完全一致(错峰 $0.22/M 输入、$0.66/M 输出),并发限制 20 请求/账号,远低于生产档的约 2500。第三方测试者报告约 350–500 tokens/s 吞吐、首 token 低于 200ms,第三方网关页面列出 1M 上下文与 384K 最大输出,但官方均未确认,也没有发布任何基准。
3. Meta 上线个人 AI 代理 Muse:能发邮件、下单、订行程
Meta 于 9 月 8 日在美国推出 Muse,一个基于 Muse Spark 模型的个人 AI 代理。它运行在专用隔离虚拟机里,自带浏览器,可接入 Google Workspace、Ticketmaster、OpenTable、Spotify、Apple Health 等服务,能管理日程、起草并发送邮件、比价购物、填表、订旅行。支付走 Stripe 的 Link 虚拟卡,真实卡号不外露,并支持 1Password 读取已有登录凭据。入口包括独立 App、muse.ai 网站和 WhatsApp,后续将上 Meta AI 眼镜;免费档之外有 $20/月 Power 和 $100/月 Maximum 两档订阅。Reuters 报道称内部测试出现过卡死和敏感数据未授权暴露的问题,而这次发布距离 Meta 就社交媒体伤害达成的 180 亿美元多州和解不到两周。
4. Google 在芬兰投 130 亿欧元,签下 22 年核电协议
Google 宣布未来两年在芬兰投入至少 130 亿欧元(约 151 亿美元),是其在欧洲最大的一笔投资,覆盖四个地点的数据中心扩容,包括长期运营的 Hamina 园区。更关键的是能源侧:Google 与芬兰国有能源公司 Fortum 签署 22 年购电协议,在 2030 至 2049 年间购买 Loviisa 核电站最多一半的发电量,同时出资支持电网升级、风电和储能。这笔交易把 AI 基建竞争的焦点从 GPU 移向电力——芬兰的低碳发电、凉爽气候和靠近欧洲客户的位置,正是超大规模数据中心需要的组合,而原本被视为「遗产资产」的核电站正在变成 AI 经济的战略资源。
5. OpenAI CFO:Luna 降价 80% 后用量涨 10 倍,自研 Jalapeño 芯片不到 9 个月流片
OpenAI CFO Sarah Friar 在高盛 Communacopia 科技大会上给出一组经营数字:把低价模型 Luna 降价 80% 后,用量涨了约 10 倍;她说在云上部署 Luna 比用智谱 GLM 5.3 这类中国开源模型「更便宜」。企业客户收入 6 月到 7 月环比增长 32%,远高于同期全公司约 20% 的年化增速,企业业务与消费者业务年中已接近持平,比内部预期更早;编程工具 Codex 已有 2500 万用户。芯片方面,她确认 OpenAI 用自己的模型参与了与博通联合开发的推理芯片 Jalapeño 的设计,从设计到流片不到 9 个月,早期样片相比典型 AI GPU 约有 50% 的成本节省,目标是 2026 年底开始部署。她还提到 OpenAI 正在测试按业务结果而非按 token 消耗计费的定价方式,并把芯片设计、生命科学、金融服务列为重点行业。
6. Cognition 融资 20 亿美元,估值 480 亿,四个月翻近一倍
Devin 母公司 Cognition 于 9 月 8 日宣布完成超 20 亿美元 Series E 融资,估值 480 亿美元,而 5 月上一轮时估值还是 260 亿。本轮由 a16z 与 Accel 领投,Founders Fund、General Catalyst、Avenir 等老股东跟投,跟投名单里还有英伟达等 30 多家机构。公司称 run-rate 收入已从 5 月的 4.92 亿美元增至接近 9 亿美元,并把 2026 年底目标定在 40–50 亿美元年化。代价同样清楚:它租用的英伟达算力集群每年花费数亿美元,今年仅算力现金消耗就可能达到 8 亿美元,这也是它坚持自研模型、降低对第三方依赖的原因。
7. 法律 AI 公司 Harvey 融资 5.5 亿美元,估值 156 亿
法律 AI 公司 Harvey 于 9 月 9 日完成 5.5 亿美元融资,估值 156 亿美元,较 3 月的 110 亿上涨逾四成。本轮由 Lightspeed Venture Partners 与新成立的 Diffusion 联合领投,Sapphire Ventures、Whale Rock 跟投,公司累计融资已超过 15 亿美元。Harvey 称年度经常性收入已突破 4 亿美元,客户数从 3 月的约 1300 家增至 3000 多家,包括 Latham & Watkins 与微软内部法务团队。本周它还收购了 AI agent 安全公司 Guardrails AI,并计划自建模型——此前已发布开源权重的法律模型和 Harvey LAB 法律 agent 基准。按收入计算,这轮约 39 倍市销率,说明专业服务 AI 已从聊天机器人附属功能变成独立的核心软件市场。
8. 京东云要建 10 万卡国产 GPU 集群,采用摩尔线程芯片
京东云在 9 月 9 日的京东全球科技探索者大会上宣布,计划用国产芯片厂商摩尔线程的通用 GPU 建设一个 10 万卡规模的智算集群,面向大模型训练、推理与具身智能,并将算力开放给多行业客户。京东称这将是国内主要云厂商首次把国产 GPU 部署到十万卡量级。目前尚未公布完成时间、全集群基准和实际运营部署。意义在于工程验证:把国产加速器从单机安装扩展到超大规模集群,要同时解决网络、软件栈、可靠性和功耗问题,这比造出单颗芯片难得多。
9. 宇树上市后回撤 45%,证监会提高人形机器人 IPO 门槛
据 The Information 报道,中国证监会已通过非正式窗口指导提高人形机器人企业的上市门槛:申请方需要展示经常性收入、亏损收窄的路径或真正的技术创新,才会进入审核。这一变化发生在宇树科技 8 月 19 日登陆科创板、首日暴涨 460% 之后——其股价目前已较最高点回落约 45%,引发对机器人泡沫和散户亏损的担忧。中国有 400 多个人形机器人模型在研,上半年全球出货绝大多数来自中国厂商。收紧 IPO 不会让工厂停工,但会改变初创公司和投行排队背后的退出算术。
10. Unit 42:AI 智能体不到 10 小时攻破企业网络
Palo Alto Networks 的 Unit 42 披露一起调查案例:一名人类攻击者借助多个自主 AI 智能体,在不到 10 小时内完成了对整个企业网络的入侵,串联了 50 多种 MITRE ATT&CK 技术。值得注意的是,这些技术本身大多是已知手法,没有 0-day,AI 压缩的是侦察、验证结果、利用漏洞和横向移动所需的时间——同样工作交给人工团队,此前大约需要两周。研究人员观察到多个 agent 并行工作,并用结构化文件在会话之间传递信息。结论很直接:当攻击速度被机器拉满,防守方也需要同等速度的自动化防御。