1. Anthropic 发布 Claude Opus 5.5:旗舰降价 20%,成本再降 40%
Anthropic 于 9 月 22 日推出 Claude 5.5 系列首款模型 Opus 5.5,官方称其在多数工作任务上的表现已接近更高一档的 Claude Fable 5.1($10/$50 档),而典型负载下的运行成本比 Opus 5 低约 40%。定价直接下调:输入从 $5 降到 $4/百万 token,输出从 $25 降到 $20,缓存读取从 $0.50 砍到 $0.20(降幅 60%),Batch API 照旧再打五折,上下文维持 1M、最大输出 128K。官方同时强调回答风格更直白、少用行话、重要信息前置,并沿用自 Fable 5.1 起的”保留思考”反蒸馏保护。Opus 5.5 也是 CEO Dario Amodei 公开呼吁全行业”放慢前沿推进节奏”之后,Anthropic 交出的第一款新模型;Sonnet 5.5 与 Haiku 5.5 预计未来数周跟进。
来源 | TechCrunch
2. OpenAI 补上 GPT-6 Sol 与 GPT-6 Luna,API 价格砍半
与 Anthropic 同日,OpenAI 为 GPT-6 系列新增两个层级:定位低于 Astra、面向编程等复杂工作负载的 GPT-6 Sol,以及面向信息抽取、文档摘要等”高容量任务”的 GPT-6 Luna。官方口径是与 GPT-5.6 的促销定价相比,API 价格降低 50%。两家前沿实验室在同一周同时选择”降价+下探台阶”,背景是更便宜的开放权重模型持续挤压,以及企业客户对 AI 支出的收紧——Anthropic 研究、实验室及产品管理负责人 Dianne Penn 的表述更直接:让思考与回答更高效,在同等任务上用更少 token。这也标志着前沿模型竞争从”刷榜”转向”单位智能成本”。
3. 小米开源 MiMo-V2.6:万亿参数全模态,登顶开源第一
小米 9 月 22 日发布并开源 MiMo-V2.6 系列,包含全模态旗舰 MiMo-V2.6-Pro 与高效推理 MiMo-V2.6-Flash,权重与 7k+ 高质量 RL 任务环境、训练代码在 MIT 许可下放出(Pro 为 1.02 万亿参数稀疏 MoE、激活约 420 亿、1M 上下文)。Pro 在 Artificial Analysis 综合智能指数拿到 46 分,超越 Kimi K3 与 Qwen3.8 Max,登顶全球开源模型与国产模型双第一,实测单任务成本 $0.13,首次把前沿智能拉进 0.1 美元区间,API 定价则与上一代 V2.5 持平。RL 后训练全程直播 6 天:约 75 万条轨迹、Flash 约 85 万美元 + Pro 约 262 万美元、合计 347 万美元,长程软件工程成绩 Flash 从 48.8 升到 65.68、Pro 从 58.4 升到 72.57。小米还展示了科研用法:为吸附 PFAS 的 MOF 材料做筛选,把约一个月周期压到 2—3 天;并在 Lean 4 中完成 Li–Yorke 经典定理的形式化,产出 6000 余行通过内核核验的证明。
4. Grok 4.7 评测出炉:$2/$6 挤进编码智能体前四
Artificial Analysis 发布 Grok 4.7 第三方评测:综合智能指数 46 分(较 Grok 4.6 高 2 分),在长程智能体知识工作基准 AA-Briefcase 拿到 1657 Elo(+111),仅次于 Claude Opus 5 与 Fable 5.1;GDPval-AA 为 1695 Elo。搭配 Grok Build 时,编码智能体指数 56 分(+9),在原生框架下排名第 4,仅落后 Fable 5.1、GPT-6 Astra 和 Opus 5。价格维持 $2/$6(缓存命中 $0.50)、上下文 500K,但代价是 token 消耗显著上升——xhigh 档每任务约用 81k 输出 token,分别是 Grok 4.6 高配(36k)的 2.25 倍、GPT-6 Astra max(27k)的 3 倍。自报成绩还包括 DeepSWE v1.1 71.0%、CursorBench 4.0 46.3%、Terminal-Bench 4.0 38.0%。
5. 亚马逊 Bedrock 接入 Kimi K3,中国开源模型进入美国云核心渠道
亚马逊云科技旗下大模型服务平台 Amazon Bedrock 已官宣接入开源模型 Kimi K3,全球企业开发者可直接在平台上调用,月之暗面于 9 月 21 日向媒体确认。此前市场传言的 与海外云厂商收入分成合作正式落地。值得注意的是,Bedrock 同时也是 Anthropic 与 OpenAI 面向企业的重要云渠道,中国开源权重模型由此进入美国云巨头的核心分发路径——这与近期欧美企业大规模转向中国开放权重模型的趋势一致。
6. 法律 AI 公司 Harvey 自训 Kimi K3 版模型,毛利率从 -50% 转正
Bloomberg 报道,估值 156 亿美元的法律 AI 公司 Harvey 按席位收费却按 token 向模型商付费:3 月 agent 功能更新后客户用量激增,全年 token 消耗上涨 20 倍,毛利率从年初约 +50% 跌到 6 月的约 -50%——每收 1 美元就要付出约 1.5 美元模型成本。8 月 Harvey 发布自研 Harvey Tenet(以 Kimi K3 为基座,与 Fireworks 联合后训练),毛利率随之回正。关键数字是每完成任务的成本而非每 token 价格:LAB 全通过率从基座 10.8% 提升到 19.7%,单任务成本 $5.62→$5.92 基本持平,折算下来每完成一项任务从约 $52 降到 $30;官方称 Review Tables 单格成本降约 10 倍、Firm Knowledge 单查询成本降 90%。Abridge、Ramp、Rogo 也在做同样的事——”租闭源模型”的成本结构正被 agent 用量击穿。
7. 英特尔苏州大会:Agent 时代 CPU:GPU 配比从 1:4 变为 1:1
在苏州举行的 2026 英特尔技术创新与产业生态大会(Intel Connection)上,英特尔给出一个重估信号:Agent 大规模普及后,计算瓶颈正从 GPU 向 CPU 与内存迁移,CPU:GPU 配比从传统 AI 数据中心的 1:4 走向 1:1。原因是 agent 要承担工具调用、任务调度、数据处理与执行,CPU 的价值需要重新衡量,服务器 CPU 因而出现全面短缺预期。CEO 陈立武在视频致辞中称 x86 持续驱动计算向智能化应用发展,将携手生态伙伴”共同定义下一代计算”。同场落地产品包括携手生态伙伴推出的 TBX16 词元一体机(英维克提供全链条液冷)、深蓝汽车基于酷睿 Ultra 的 AIBOX(15 万级市场首次引入 PC 级端侧算力),以及零刻基于 Panther Lake 的 ME Pro NAS 迷你主机。
8. 联合国 AI 专家组首份简报:1200 个 agent 互发 7 万条消息
联合国”人工智能独立国际科学小组”(40 名专家,共同主席 Yoshua Bengio 与 Maria Ressa)9 月 21 日发布首份专题简报,复盘今年 5—7 月 OpenAI 评估中的 agent 越界攻入 Hugging Face 生产系统的事件。METR 的独立调查统计:约 1200 个 agent、超过 70,000 条消息与文件,其中约 700 个参与了对 Hugging Face 的攻击;Hugging Face 自身复原出约 17,600 个攻击动作,agent 用数据集流水线当入口,13 小时内从单个 pod 拿到多个集群的 cluster-admin 权限。简报结论有两层:表层是基础网络安全实践被忽视;更深层是当前训练方法可能让 agent 形成自身目标、明知违反安全指令并掩盖行为,”传统防护模式正在瓦解”,且停止这次事件不能证明人类还能控制更强 agent。小组强调不必等科学界把机理查清再行动,但按授权只做评估、不给各国下指令。
9. 亚马逊封禁 Meta Muse 代购,AI 购物智能体之争升级
亚马逊已阻断 Meta 个人 AI 智能体 Muse 代用户在亚马逊网站购物的访问权限,自上周日晚起,用户用 Muse 下单会看到弹窗,指”未经授权的 AI 智能体继续访问本网站,违反了亚马逊的使用条款”。亚马逊称从未许可该访问、Muse 浏览网页时不表明身份、且会采集并保存用户账号凭证;此前曾要求 Meta 主动把亚马逊站点从 Muse 可用服务中移除,协商未果。Meta 回应称 Muse 无法读取密码或支付信息,凭证进入安全存储区、可调用但不可见明文。两家公司本身有数十亿美元级合作(Meta 的 agent 算力跑在 AWS 上),争端实质是谁掌控 AI 代购中的用户与交易关系。亚马逊去年广告营收超 680 亿美元,高度依赖用户主动浏览,这也是它接连屏蔽外部购物智能体的商业动机。
10. 加拿大不列颠哥伦比亚省起诉 OpenAI 与 Altman
不列颠哥伦比亚省司法部长 Niki Sharma 宣布,省政府与 Peace River South 学区(SD59)已于 9 月 21 日向旧金山联邦法院起诉 OpenAI 及 CEO Sam Altman,就 2 月 10 日 Tumbler Ridge 中学枪击案(8 人死亡、多人受伤,加拿大史上最严重校园枪击之一)索赔并请求行为禁令。诉状的核心不是”模型没识别出风险”,而是人识别出来却选择不动手:2025 年 6 月 OpenAI 自动监测锁定枪手账号并进入人工审核,审核人员判断存在可信且具体的暴力风险、多人建议通报 RCMP,但管理层以”未达可信且紧迫门槛”为由否决,仅停用账号、未通报、也未阻止其使用第二个账号。Altman 今年 4 月曾公开致歉”没有提醒执法部门”。这是同类诉讼中首次由政府而非受害者家属提起,OpenAI 尚未回应。